开源项目 7月前 • 188 阅读 • 0 评论

阿里开源两款4B小模型：手机电脑都能用，比GPT-4.1-nano还强

作者头像

AI中国

AI技术专栏作家 | 发布了 246 篇文章

HuggingFace

HuggingFace

0秒前

魔搭社区

魔搭社区

0秒前

智东西

作者 | 王涵

编辑 | 漠影

智东西8月7日报道，今天上午，通义千问Qwen宣布推出两款更小尺寸的新模型：Qwen3-4B-Instruct-2507和Qwen3-4B-Thinking-2507。

其中，Qwen3-4B-Thinking-2507的推理能力可媲美中尺寸模型；Qwen3-4B-Instruct-2507在知识、推理、编程、对齐以及agent能力上全面超越了闭源的小尺寸模型GPT-4.1-nano。

此次发布的“2507”版本的Qwen3-4B模型对手机等端侧硬件部署较为友好，目前已在魔搭社区和Hugging Face正式开源。

已在Hugging Face开源（来源：Hugging Face）

魔搭社区：
https://modelscope.cn/collections/Qwen3-9743180bdc6b48

Hugging Face：https://huggingface.co/Qwen

一、性能比肩中尺寸模型，agent能力超越GPT-4.1-nano

Qwen3-4B-Instruct-2507与Qwen3-4B-Thinking-2507的上下文理解能力都扩展到了256K，可处理长文本，能支持更复杂的文档分析、长篇内容生成以及跨段落推理等场景。

性能方面，Qwen3-4B-Thinking-2507在复杂问题推理能力、数学能力、代码能力以及多轮函数调用能力上的表现大幅领先Qwen3同尺寸小模型。在Arena-Hard v2基准测试上，Qwen3-4B-Instruct-2507取得43.4分的成绩，更胜一筹。

在非推理领域，Qwen3-4B-Instruct-2507在知识、推理、编程、对齐以及agengt能力上全面超越了闭源的小尺寸模型GPT-4.1-nano，且与中等规模的Qwen3-30B-A3B（non-thinking）性能接近。

该模型覆盖了更多语言的长尾知识，在主观和开放性任务中与人类偏好的对齐性增强，能够提供更符合需求的答复。

在推理领域，Qwen3-4B-Thinking-2507表现突出，推理能力可媲美中等模型Qwen3-30B-Thinking。特别是在聚焦数学能力的AIME25测评中，以4B参数量取得了81.3分的成绩。

其通用能力也显著提升，Agent分数超越了更大尺寸的Qwen3-30B-Thinking模型。

结语：小尺寸模型加速AI端侧落地

通义千问此次推出的Qwen3-4B系列新模型，以更小的尺寸实现了性能上的优化，在通用能力上展现出超越同级别模型甚至逼近中大规模模型的实力，并且，小尺寸模型展现出了对端侧硬件的更高的友好度。

无论是腾讯、阿里还是OpenAI等AI老玩家，都开始推出小尺寸模型，并且在agent能力上下功夫。这在一定程度上反映出目前主流市场认为小型语言模型（SLM）对Agentic AI的发展具有重要价值。

这类高性能小模型的开源与普及，将有望加速AI技术在端侧设备的渗透，进而推动更多轻量化、场景化的智能应用落地。

作者头像

AI前线

专注人工智能前沿技术报道，深入解析AI发展趋势与应用场景

246篇文章 1.2M阅读 56.3k粉丝

评论 (128)

用户头像

AI爱好者

2小时前

这个更新太令人期待了！视频分析功能将极大扩展AI的应用场景，特别是在教育和内容创作领域。

用户头像

开发者小明

昨天

有没有人测试过新的API响应速度？我们正在开发一个实时视频分析应用，非常关注性能表现。

作者头像

AI前线作者

12小时前

我们测试的平均响应时间在300ms左右，比上一代快了很多，适合实时应用场景。

用户头像

科技观察家

3天前

GPT-4的视频处理能力已经接近专业级水平，这可能会对内容审核、视频编辑等行业产生颠覆性影响。期待看到更多创新应用！

文章章节

1. GPT-4简介与注册指南

1.1 账号注册步骤

推荐文章

北京人形开源最新VLM模型，推动具身智能再迈关键一步 !

北京人形开源最新VLM模型，推动具身智能再迈关键一步 !

4月前 • 开源项目

速抢（2核2G）77元/年香港免备案服务器

速抢（2核2G）77元/年香港免备案服务器

0秒前 • 开源项目

用了Rust，谷歌实测：Android上内存漏洞率比C/C++低1000倍！

用了Rust，谷歌实测：Android上内存漏洞率比C/C++低1000倍！

4月前 • 开源项目

全球最大开源具身大模型！中国机器人跑完马拉松后开始学思考

全球最大开源具身大模型！中国机器人跑完马拉松后开始学思考

4月前 • 开源项目

刚刚，华为AI推理大招开源，时延降90%，吞吐提22倍，上下文10倍级扩展

刚刚，华为AI推理大招开源，时延降90%，吞吐提22倍，上下文10倍级扩展

4月前 • 开源项目

AI的开源战略

AI的开源战略

4月前 • 开源项目

开源即爆火！英伟达重磅推出OmniVinci全模态大模型

开源即爆火！英伟达重磅推出OmniVinci全模态大模型

4月前 • 开源项目

国际刑事法院也“踢掉”了微软Office！因邮箱一度“被封”，决定改为开源替代品openDesk

国际刑事法院也“踢掉”了微软Office！因邮箱一度“被封”，决定改为开源替代品openDesk

4月前 • 开源项目

热门标签

AI评测人才竞争 AI短剧制作 ClaudeAI DocHero Al 宇宙传讯中配 AI综述万物研究所·夏日探索计划品牌引用

热门作者

作者头像

AI前沿

2.4k 粉丝

作者头像

机器学习实验室

1.8k 粉丝

作者头像

AI创业圈

3.1k 粉丝