更多精彩 >

MMMU权威评测榜更新,云知声山海UniGPT-mMed荣登榜首

2024-10-08 20:16:48   来源:天极网  作者: 

摘要:近日,多模态人工智能模型基准评测集MMMU更新榜单,云知声山海多模态大模型UniGPT-mMed以通用能力、医疗专业能力双双排名第一的优异成绩登顶榜首,力压GPT-4V,充分彰显其硬核实力。

近日,多模态人工智能模型基准评测集MMMU更新榜单,云知声山海多模态大模型UniGPT-mMed以通用能力、医疗专业能力双双排名第一的优异成绩登顶榜首,力压GPT-4V,充分彰显其硬核实力。

 

image.png

 

作为国内权威多模态基准评测,MMMU由IN.AI Research等多家机构联合构建,专注于考量人工智能在解决大学层次多学科问题时的多模态理解与推理能力。

该评测集涉及艺术与设计、商科、科学、健康与医学、人文与社会科学、技术与工程等六个常见学科,包含 1.15 万个精心选取的多模态问题,涵盖 30 个不同的科目和183 个子领域。同时,MMMU 中许多问题都需要专家级的推理能力,例如,使用傅立叶变换或均衡理论来推导问题的解,这在满足评测内容广泛性的同时,也确保了其深度。

此外,MMMU还提出了两个独特的挑战:一是其涵盖多种图像格式,从照片和绘画等视觉场景到图表和表格,可用于测试 LMM 的感知能力;二是MMMU的输入形式是文本和图像的混合,要求AI模型能够将图像和文本信息结合起来进行深入理解,并在此基础上执行复杂推理。这不仅考验了模型的学科知识储备,也对其综合分析和应用能力提出了更高要求。

评测结果显示,云知声山海多模态大模型UniGPT-mMed以总分57的优异成绩登顶榜首,并在健康与医学细分赛道超越GPT-4V,力压一众大模型拔得头筹,充分展现出其在拥有业内一流的通用能力之外,更具备打造世界领先的行业大模型的能力。

 

image.png

 

UniGPT-mMed是云知声基于山海大模型底座构建的多模态大模型。其通过分析和整合海量论文、书籍及网站数据,利用精细化数据处理技术,自动识别并提取图片及其相关文本描述,并通过多模态分析技术评估图片的质量和图文之间的匹配度,筛选出最优数据。与此同时,系统能够参考图片和上下文信息对图片进行重新描述,使得图文数据更加对齐。

通过预设问答场景,UniGPT-mMed能够将图文对齐数据转化为高质量的场景问答数据集,并采用思维链和自我反思技术,进一步优化生成数据,最终构建起一个包含数亿条高质量图文问答的数据集,进而为用户提供更加丰富、准确和可靠的信息检索和问答服务。

此次评测,是云知声在多模态大模型赛道持续深耕、不断技术创新的成果体现。

作为中国AGI技术产业化的先行者,云知声于2016年开始打造Atlas人工智能基础设施,并以此为基础,构建云知大脑(UniBrain)技术中台——以山海(UniGPT)通用认知大模型为核心,结合多模态感知与生成、知识图谱、物联平台等智能组件,为云知声智慧物联、智慧医疗、智慧座舱、智慧交通等业务提供高效的产品化支撑,持续推动“U(云知大脑)+X(应用场景)”战略布局,致力推动千行百业的智慧化升级。

作为云知大脑的核心,山海大模型具备语言生成、语言理解、知识问答、逻辑推理、代码能力、数学能力、安全合规能力七项通用能力及插件扩展、领域增强、企业定制三项行业落地能力,能够满足更多场景的应用需求。今年8月,云知声推出山海多模态大模型,通过整合跨模态信息,山海多模态大模型能够接收文本、音频、图像等多种形式作为输入,并实时生成文本、音频和图像的任意组合输出,带来实时多模态拟人交互体验,开启AGI新范式。

目前,山海大模型已相继在OpenCompass大模型评测、SuperCLUE中文大模型基准测评、MedBench评测、Flageval大模型评测、SuperBench等多个权威评测中屡创佳绩,稳居国内大模型第一梯队;在医疗专业能力上,其基于山海大模型孵化的医疗大模型在CCKS 2023 PromptCBLUE医疗大模型评测中夺得通用赛道一等奖,并在MedBench评测中位列全球第一,各项指标全面超越GPT-4。

登顶MMMU评测榜,充分印证了云知声山海多模态大模型在通用能力、专业能力层面的突出实力,也将鞭策云知声持续迭代多模态大模型技术底座,实现大模型技术在多领域场景下的渗透和应用,以技术创新为各行各业带来更多智能化变革。


猜你喜欢

小雨智造与北航共建实验室,创始人乔忠良:工业落地比人形奇观更具正义性

智能+小雨智造

2026年4月26日,由北京小雨智造科技有限公司与北京航空航天大学共同成立的“工业具身智能联合实验室...

10小时前

「Hi, I'm KAI」——超维动力发布全球最高自由度人形机器人

智能+超维动力

4月26日,具身智能公司超维动力Kinetix AI(KAI)举办「降临GIFTED」发布会,正式发...

19小时前

中关村科金得助大模型平台及全栈产品接入DeepSeek-V4系列模型

智能+中关村科金

2026年4月24日,DeepSeek全新系列模型DeepSeek-V4预览版正式上线并开源。

3天前

中关村科金发布得助智能投放产品,AI原生广告投放进入"自动驾驶"时代

智能+中关村科金

当AIGC让创意产能过剩,投放端却仍困在“工具拼接”的体力劳动中。

3天前

SentiCat公测上线:国产Agent走向“任务执行 + 情感陪伴”新阶段

智能+SentiCat

大模型能力的跃升与“龙虾”等标杆产品的全球爆火,将 AI Agent 赛道推向了风口浪尖。

3天前

智驱新程 博赢未来 | 远大智能工业集团博林特电梯2026年度经销商大会圆满举行

上市公司远大智能

2026年1月10日,在深入贯彻国家“制造强国”与“高质量发展”战略部署的时代背景下,“智驱新程 博...

2026-01-14

吉谷鲜加壹电蒸锅 TVC :李乃文上演“蒸鱼指挥家” ,笑到打鸣 !

大消费吉谷鲜

当厨电广告还在循规蹈矩展示功能时 ,吉谷鲜加壹电蒸锅的 TVC 已然凭借脑洞大开的剧情成为社交平台热...

2026-01-14

香港贵金属交易平台最新排名:专业、可靠、口碑俱佳!

金融科技贵金属交易平台

在全球贵金属投资浪潮中,香港凭借其成熟的金融市场体系、严格的监管机制以及与国际接轨的交易环境,始终占...

2026-01-14

炒黄金哪个平台最正规可靠?国内十大正规炒黄金交易平台排名

金融科技黄金交易平台

在黄金交易市场鱼龙混杂的环境中,投资者李先生在一家“高收益”平台投入大量资金后,最终遭遇平台无法提现...

2026-01-14

浩鲸科技2025年度盘点:AI 突破应用壁垒 逆势领跑行业增长

智能+浩鲸科技

2025 年浩鲸科技重磅发布企业 AI 操作系统 “鲸智百应”,将大模型能力深度融入企业全生命周期运...

2026-01-14

阿赛小面:以“一同生长”破局餐饮寒冬,践行普惠使命的百店征途

大消费阿赛小面

2026年初,餐饮行业仍处于“需求疲软、成本高企”的调整期,据《2025年中国餐饮产业生态白皮书》显...

2026-01-14

生态赋能科技创新,联想控股与所投企业共创AI生态

上市公司联想控股智谱

1月8日,北京智谱华章科技股份有限公司(以下简称“智谱”)成功登陆港交所,成为“大模型第一股”,这不...

2026-01-14

江苏步道科技完成1000万天使轮融资,领航中小企业数据化与通证化转型

创新创业江苏步道科技

在数字经济浪潮澎湃、产业升级方兴未艾的时代背景下,一家专注于赋能实体经济的企业孵化平台迎来了发展的关...

2026-01-14

TCL科技2025年归母净利润预计达42.1-45.5亿元,大尺寸面板新一轮涨价态势将强化盈利增长逻辑!

上市公司TCL

1月13日晚间,TCL科技(000100.SZ)披露2025年度业绩预告,预计2025年归属于上市公...

2026-01-14

钱大妈港交所递表,社区生鲜GMV五连冠 营收盈利同步增长

钱大妈

1月12日晚间,中国社区生鲜连锁龙头钱大妈国际控股有限公司(以下简称“钱大妈”)正式向港交所递交招股...

2026-01-14

投资家网(www.investorscn.com)是国内领先的资本与产业创新综合服务平台。为活跃于中国市场的VC/PE、上市公司、创业企业、地方政府等提供专业的第三方信息服务,包括行业媒体、智库服务、会议服务及生态服务。长按右侧二维码添加"投资哥"可与小编深入交流,并可加入微信群参与官方活动,赶快行动吧。

第20届中国投资年会圆满闭幕!K型曲线下,寻找穿越分化的确定性

第20届中国投资年会圆满闭幕!K型曲线下,寻找穿越分化的确定性

2026年4月22日至24日,第20届中国投资年会·年度峰会于北京海淀盛大召开

第四届中国研究生金融科技创新大赛在南京收官

第四届中国研究生金融科技创新大赛在南京收官

12月28日,第四届中国研究生金融科技创新大赛在南京落幕。

京杭对话:杭州,凭什么吸引北京创新企业?

京杭对话:杭州,凭什么吸引北京创新企业?

从一张精准的产业蓝图,到一个敏捷的创新操作系统,再到一片丰沃的赋能土壤,杭州的生产性服务业正在这条路...

第19届中国投资年会·有限合伙人峰会在沪成功举办

第19届中国投资年会·有限合伙人峰会在沪成功举办

11月27日,由投中信息和投中网主办的第19届中国投资年会·有限合伙人峰会在上海举办。

“京杭聚势,共启新篇”:招商新路径,奏响区域协同发展强音

“京杭聚势,共启新篇”:招商新路径,奏响区域协同发展强音

在区域经济协同发展的大背景下,京杭两地的经济协作正以一种全新的姿态加速推进。