DeepSeek多模态模型来了 创新推理框架引领变革-世界奇异-【鼎古号】

DeepSeek多模态模型来了 创新推理框架引领变革

   2026-05-01 00:43:30 每日经济新闻鼎古号10
核心提示:4月30日,DeepSeek在Github上正式发布了多模态模型,并公布了背后的技术报告。技术报告中提到,尽管多模态大语言模型取得了显著进展,但主流的思维链范式仍主要局限于语言学领域

4月30日,DeepSeek在Github上正式发布了多模态模型,并公布了背后的技术报告。技术报告中提到,尽管多模态大语言模型取得了显著进展,但主流的思维链范式仍主要局限于语言学领域。近期研究虽然通过高分辨率裁剪技术来弥合感知鸿沟,却忽视了一个更根本的问题:参照鸿沟。自然语言的模糊性往往无法为复杂的空间布局提供精确、明确的指引,导致需要严谨参照的任务出现逻辑崩溃。

DeepSeek的多模态技术报告提出基于视觉原语的思考——这一创新推理框架将点、边界框等空间标记提升为“思维的基本单元”。通过将这些视觉原语直接融入思考过程,模型在“推理”时能够“指代”,从而将其认知轨迹有效锚定在图像的物理坐标中。

技术报告还指出,该框架基于高度优化的架构,具备极高的视觉标记效率。尽管模型规模紧凑且图像标记预算较低,DeepSeek的多模态模型在具有挑战性的计数和空间推理基准测试上,能够与GPT-5.4、Claude-Sonnet-4.6和Gemini-3-Flash等前沿模型匹配。这为开发更高效、更具可扩展性的System-2类多模态智能提供了新的方向。

 
免责声明:以上所展示的信息由网友自行发布,内容的真实性、准确性和合法性由发布者负责。 鼎古号对此不承担任何保证责任, 鼎古号仅提供信息存储空间服务。任何单位或个人如对以上内容有权利主张(包括但不限于侵犯著作权、商业信誉等),请与我们联系并出示相关证据,我们将按国家相关法规即时移除。

本文地址:http://mip.wlchinahz.com/news/x103657.html

收藏 0打赏 0
 
更多>同类资讯
推荐图文
推荐资讯
点击排行

免责声明:本站所有信息均来自互联网搜集,产品相关信息的真实性准确性均由发布单位及个人负责,请大家仔细辨认!并不代表本站观点,鼎古号对此不承担任何相关法律责任!如有信息侵犯了您的权益,请告知,本站将立刻删除。
友情提示:买产品需谨慎
网站处理与建议:wfmyw@qq.com