文章来源:08AI导航发布时间:2025-08-07 16:45:10
8月7日消息,通义千问Qwen昨日(8月6日)发布公告,宣布,推出Qwen3-4B-Instruct-2507和Qwen3-4B-Thinking-2507两个模型,大幅提升性能。
官方表示,SLM(SmallLanguageModels)对AgenticAI的发展极具价值,“2507”版本的Qwen3-4B模型,体积小,性能强,对手机等端侧硬件部署尤为友好。
援引博文介绍,在非推理(non-thinking)领域,Qwen3-4B-Instruct-2507显著提升通用能力,目标成为更全能的端侧利器。
该模型掌握更多语言和长尾知识,上下文理解扩展至256K,小模型也能处理长文本。该模型通用能力超越了闭源的小尺寸模型GPT-4.1-nano,性能接近等规模的Qwen3-30B-A3B(non-thinking)。
官方表示该模型更像一位高效的“执行专家”,遵循指令、迅速响应,更适合用于内容创作、工具调用等。
在推理(thinking)领域,Qwen3-4B-Thinking-2507大幅提升了推理能力,AIME25高达81.3分。Qwen3-4B-Thinking-2507的推理表现可媲美中等模型Qwen3-30B-Thinking,在聚焦数学能力的AIME25测评中,以4B参数量斩获惊人的81.3分的好成绩。
官方表示该模型像一位严谨的“学术专家”,面对复杂问题逐步推理,完成任务更深入可靠。
相关攻略 更多
最新资讯 更多
2025年了,AI还看不懂时钟,90%人都能答对,顶尖AI全军覆没
更新时间:2025-10-14
光刻机龙头或领投“欧洲OpenAI”
更新时间:2025-10-14
华人缔造商业传奇,全球第一家突破百亿美金的AI编程企业诞生
更新时间:2025-10-14
具身智能进家干活,先从“AI家电”抓起?
更新时间:2025-10-14
前零一万物联创戴宗宏创业:20人团队,能干上百人的AI定制项目
更新时间:2025-10-14
阿里端出最强语音模型,英文rap精准转文字,准确率干翻全球
更新时间:2025-10-14
小扎「梦之队」首批论文上线,LLM自举进化,单步性能狂飙22%
更新时间:2025-10-14
再也不怕面瘫脸,YouTube黑科技:AI帮你「永久微笑」,连僵尸都咧嘴笑
更新时间:2025-10-14
2025年全球企业级AI Agent优秀厂商有哪些?
更新时间:2025-10-14
GPT-5 为啥不 “胡说” 了?OpenAI 新论文讲透了
更新时间:2025-10-14