返回顶部
热门问答 更多热门问答
技术文章 更多技术文章

昆仑万维发布 Skywork-R1V3.0:开源模型挑战多模态推理极限,逼近人类专家水平

[复制链接]
链载Ai 显示全部楼层 发表于 昨天 13:55 |阅读模式 打印 上一主题 下一主题

昆仑万维近日正式发布其最新开源多模态大模型Skywork-R1V3.0,在跨模态推理能力方面取得突破性进展。官方称,该模型已达到“接近人类初级专家”的推理水平,在国际权威多模态测试集MMMU中取得76.0 分的领先成绩,超越闭源强者如 Claude 3.7 Sonnet(75.0)和 GPT-4.5(74.4)。



🧠 小样本 + 强泛化:Skywork-R1V3.0 如何做到?

Skywork-R1V3.0 延续了上一代模型 R1V2.0 的架构,通过“冷启动”训练策略和大量高质量蒸馏数据,结合拒绝采样机制,构建了一个多模态推理能力极强的训练体系。

训练数据量控制精巧,仅使用:

  • 1.2 万条监督微调数据

  • 1.3 万条强化学习样本

在数据规模远小于主流闭源大模型的前提下,Skywork-R1V3.0 通过强化学习策略优化复杂推理路径,实现了“小数据,强能力”的范式突破。



🧩 多模态推理能力:图文理解不输 GPT-4.5

Skywork-R1V3.0 实现了对文本与图像的深度联合建模,其跨模态能力在多个评测任务中领先:

📌 MMMU 综合测试(图文跨模态综合):

  • Skywork-R1V3.0:76.0

  • Claude 3.7 Sonnet:75.0

  • GPT-4.5:74.4

📌 物理推理(MMMU-Physics):

  • 开放式题:52.8

  • 闭集题:31.5

📌 逻辑推理能力(MMMU-Logic):

  • 总分:59.7



🧮 数学能力评测同样亮眼:

Skywork-R1V3.0 在多项数学推理测试中展现卓越能力,领先于当前所有开源模型:

  • MathVista:77.1

  • MathVerse:59.6

  • MathVision:52.6

这一成绩表明,Skywork-R1V3.0 不仅能够处理静态知识类问题,还能准确处理公式理解、图形推理等动态复杂任务。



🔍 Skywork-R1V3.0 是开源阵营的里程碑

在 GPT-4.5、Claude 3 系列、Gemini 等闭源大模型主导的背景下,Skywork-R1V3.0 的开源发布为全球开发者社区注入了强心剂。它不仅仅是一项技术成果,更是对多模态AI开源生态的有力支撑

  • 显示了中国 AI 企业在基础模型上的系统化能力;

  • 强化了开源阵营在多模态领域的技术话语权;

  • 为科研机构和产业应用提供了高性能可调的模型基础。

回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

链载AI是专业的生成式人工智能教程平台。提供Stable Diffusion、Midjourney AI绘画教程,Suno AI音乐生成指南,以及Runway、Pika等AI视频制作与动画生成实战案例。从提示词编写到参数调整,手把手助您从入门到精通。
  • 官方手机版

  • 微信公众号

  • 商务合作

  • Powered by Discuz! X3.5 | Copyright © 2025-2025. | 链载Ai
  • 桂ICP备2024021734号 | 营业执照 | |广西笔趣文化传媒有限公司|| QQ