昆仑万维发布 Skywork-R1V3.0：开源模型挑战多模态推理极限，逼近人类专家水平

显示全部楼层

昆仑万维近日正式发布其最新开源多模态大模型Skywork-R1V3.0，在跨模态推理能力方面取得突破性进展。官方称，该模型已达到“接近人类初级专家”的推理水平，在国际权威多模态测试集MMMU中取得76.0 分的领先成绩，超越闭源强者如 Claude 3.7 Sonnet（75.0）和 GPT-4.5（74.4）。

🧠 小样本 + 强泛化：Skywork-R1V3.0 如何做到？

Skywork-R1V3.0 延续了上一代模型 R1V2.0 的架构，通过“冷启动”训练策略和大量高质量蒸馏数据，结合拒绝采样机制，构建了一个多模态推理能力极强的训练体系。

训练数据量控制精巧，仅使用：

1.2 万条监督微调数据
1.3 万条强化学习样本

在数据规模远小于主流闭源大模型的前提下，Skywork-R1V3.0 通过强化学习策略优化复杂推理路径，实现了“小数据，强能力”的范式突破。

🧩 多模态推理能力：图文理解不输 GPT-4.5

Skywork-R1V3.0 实现了对文本与图像的深度联合建模，其跨模态能力在多个评测任务中领先：

📌 MMMU 综合测试（图文跨模态综合）：

Skywork-R1V3.0：76.0
Claude 3.7 Sonnet：75.0
GPT-4.5：74.4

📌 物理推理（MMMU-Physics）：

开放式题：52.8
闭集题：31.5

📌 逻辑推理能力（MMMU-Logic）：

总分：59.7

🧮 数学能力评测同样亮眼：

Skywork-R1V3.0 在多项数学推理测试中展现卓越能力，领先于当前所有开源模型：

MathVista：77.1
MathVerse：59.6
MathVision：52.6

这一成绩表明，Skywork-R1V3.0 不仅能够处理静态知识类问题，还能准确处理公式理解、图形推理等动态复杂任务。

🔍 Skywork-R1V3.0 是开源阵营的里程碑

在 GPT-4.5、Claude 3 系列、Gemini 等闭源大模型主导的背景下，Skywork-R1V3.0 的开源发布为全球开发者社区注入了强心剂。它不仅仅是一项技术成果，更是对多模态AI开源生态的有力支撑：

显示了中国 AI 企业在基础模型上的系统化能力；
强化了开源阵营在多模态领域的技术话语权；
为科研机构和产业应用提供了高性能可调的模型基础。