|
昆仑万维近日正式发布其最新开源多模态大模型Skywork-R1V3.0,在跨模态推理能力方面取得突破性进展。官方称,该模型已达到“接近人类初级专家”的推理水平,在国际权威多模态测试集MMMU中取得76.0 分的领先成绩,超越闭源强者如 Claude 3.7 Sonnet(75.0)和 GPT-4.5(74.4)。
🧠 小样本 + 强泛化:Skywork-R1V3.0 如何做到?Skywork-R1V3.0 延续了上一代模型 R1V2.0 的架构,通过“冷启动”训练策略和大量高质量蒸馏数据,结合拒绝采样机制,构建了一个多模态推理能力极强的训练体系。 训练数据量控制精巧,仅使用: 在数据规模远小于主流闭源大模型的前提下,Skywork-R1V3.0 通过强化学习策略优化复杂推理路径,实现了“小数据,强能力”的范式突破。
🧩 多模态推理能力:图文理解不输 GPT-4.5Skywork-R1V3.0 实现了对文本与图像的深度联合建模,其跨模态能力在多个评测任务中领先: 📌 MMMU 综合测试(图文跨模态综合):Skywork-R1V3.0:76.0 Claude 3.7 Sonnet:75.0 GPT-4.5:74.4
📌 物理推理(MMMU-Physics):📌 逻辑推理能力(MMMU-Logic):
🧮 数学能力评测同样亮眼:Skywork-R1V3.0 在多项数学推理测试中展现卓越能力,领先于当前所有开源模型: MathVista:77.1 MathVerse:59.6 MathVision:52.6
这一成绩表明,Skywork-R1V3.0 不仅能够处理静态知识类问题,还能准确处理公式理解、图形推理等动态复杂任务。
🔍 Skywork-R1V3.0 是开源阵营的里程碑在 GPT-4.5、Claude 3 系列、Gemini 等闭源大模型主导的背景下,Skywork-R1V3.0 的开源发布为全球开发者社区注入了强心剂。它不仅仅是一项技术成果,更是对多模态AI开源生态的有力支撑: 显示了中国 AI 企业在基础模型上的系统化能力; 强化了开源阵营在多模态领域的技术话语权; 为科研机构和产业应用提供了高性能可调的模型基础。
|