专栏名称: 量子位
վ'ᴗ' ի 追踪AI行业和技术动态,这里更快一步!关注我们,回复“今天”,更多大新闻等你来发现
TodayRss-海外RSS稳定源
目录
今天看啥  ›  专栏  ›  量子位

Qwen紧追OpenAI开源4B端侧大模型,AIME25得分超越Claude 4 Opus

量子位  · 公众号  · AI  · 2025-08-07 08:56
    

主要观点总结

Qwen团队发布了两个新的模型:Qwen3-4B-Instruct-2507和Qwen3-4B-Thinking-2507。这两个模型在通用能力、推理能力等方面有了显著的提升,并且支持256k上下文。Qwen3-4B-Instruct-2507是一个非推理模型,注重指令遵循、逻辑推理、文本理解等方面;而Qwen3-4B-Thinking-2507是一个推理模型,专为专家级任务设计。这两个模型对端侧非常友好,甚至可以在树莓派上运行。官方提供了部署建议,并分享了模型代码。同时,市场对此次更新反响热烈,有网友呼吁开源更多模型。

关键观点总结

关键观点1: Qwen团队发布两个新模型:Qwen3-4B-Instruct-2507和Qwen3-4B-Thinking-2507。

这两个模型在通用能力和推理能力上有了显著提升,支持256k上下文。

关键观点2: Qwen3-4B-Instruct-2507是非推理模型,注重指令遵循、逻辑推理、文本理解等能力。

它在多语言长尾知识覆盖、与用户偏好匹配以及长上下文理解能力方面都有明显改进。

关键观点3: Qwen3-4B-Thinking-2507是推理模型,专为专家级任务设计。

它在逻辑推理、数学、科学、编程以及需要人类专业知识的任务上表现优异。

关键观点4: 这两个模型对端侧非常友好,可在树莓派上运行。

官方提供了部署建议,并分享了模型代码。

关键观点5: 市场对此次更新反响热烈,有网友呼吁开源更多模型。

同时,讨论了其他AI团队的竞争情况,以及AI Coding将如何重构开发。


免责声明:本文内容摘要由平台算法生成,仅为信息导航参考,不代表原文立场或观点。 原文内容版权归原作者所有,如您为原作者并希望删除该摘要或链接,请通过 【版权申诉通道】联系我们处理。

原文地址: 访问原文地址
总结与预览地址:访问文章预览/总结
文章地址: 访问文章快照