面壁智能“小钢炮”模型开源:号称端侧全面对标 GPT-4V
创始人
2024-08-07 10:38:53
0

IT之家 8 月 7 日消息,面壁智能昨日开源了 MiniCPM-V 2.6 模型,官方表示将端侧 AI 多模态能力拉升至全面对标GPT-4V 水平

官方称MiniCPM-V 2.6 模型仅 8B 参数,取得 20B 以下单图、多图、视频理解3 SOTA 成绩,有以下特点:

  • “三合一最强”端侧多模态:首次在端侧实现单图、多图、视频理解等多模态核心能力全面超越 GPT-4V,单图理解越级比肩多模态王者Gemini 1.5 Pro和新晋顶流GPT-4o mini
  • 多项功能首次上端:实时视频理解、多图联合理解、多图 ICL视觉类比学习、多图 OCR等功能
  • 最高多模态像素密度:类比知识密度,小钢炮 2.6 取得了两倍于 GPT-4o 的单 token 编码像素密度(token density)
  • 端侧友好:量化后端侧 6G 内存可用;端侧推理速度达18 tokens / s,相比上代模型快 33%。发布即支持llama.cpp、ollama、vllm推理;且支持多种语言
  • 统一高清框架:小钢炮的传统优势OCR 能力延续了其SOTA性能水平,并进一步覆盖单图、多图、视频理解

IT之家附开源地址:

  • GitHub: https://github.com/OpenBMB/MiniCPM-V
  • HuggingFace:https://huggingface.co/openbmb/MiniCPM-V-2_6

相关内容

创意信息新注册《AI能力感...
证券之星消息,近日创意信息(300366)新注册了4个项目的软件著...
2025-03-15 06:41:37
AI语音助手Maya,完全...
2025-03-14 18:41:15
新点软件:基于华为等多家开...
金融界3月14日消息,有投资者在互动平台向新点软件提问:你好!请问...
2025-03-14 17:12:09
原创 ...
风向彻底变了——AI应用的时代正式到来! 2024年,网络推广做的...
2025-03-14 14:42:42
清华率先开源AI制药智能体...
LG 衡宇 发自 凹非寺 量子位 | 公众号 QbitAI AI智...
2025-03-14 08:40:41
AI产业热潮不减
【深圳商报讯】(首席记者 谢惠茜)虽然算力以及人工智能板块迎来回调...
2025-03-14 08:13:13

热门资讯

原创 华... 想在竞争残酷的市场中发力,必须要带来一些激进的卖点,但是随着功能特性的提升,硬件也必须要进行给力才可...
支持 AI 扩图,华为 Pur... 2024-07-28 09:05:02作者:姚立伟 华为Pura 70 Pro手机今日推出鸿蒙Ha...
苹果macOS 15.1:允许... 苹果公司在其最新的macOS 15.1版本中,推出了一项引人注目的新功能——允许用户将Mac App...
吞噬星空维妮娜美图/高清壁纸/... 国漫女神|《吞噬星空》维妮娜美图/高清壁纸/AI手机壁纸/无水印 国漫女神|《吞噬星空》维妮娜美图...
原创 苹... 前言 IQUNIX在做好看的桌面产品上,一直都给我留下非常深刻的印象。而且早期和苹果产品的设计风格...
原创 商... 最近,各家的AI 9笔记本开始陆续登场,其实大家并不一定非选AI 9 HX 370,主要是这颗CPU...
AI智能+高效清洁!萤石RS2... 目前扫拖机器人市场的竞争非常激烈,在上下水扫拖一体机市场也出现了很多所谓的创新产品。但是对于这些产品...
2024年度中国银行业发展报告... 21世纪经济报道 记者李愿 北京报道 10月19日,中国银行业协会在2024金融街论坛年会·金融街之...