Qwen3.8-Max:当大模型开始像工程师一样工作
你让一个人从零写一个能自进化的Agent框架,他得翻文档、搭环境、踩坑、debug,折腾两周算快的。
阿里今天发布的Qwen3.8-Max,接到同样的任务后,自己运行了16天,265次代码提交,最后交出了一个真实可用的oh-my-cli项目。全程没人告诉它下一步该干什么。
这就是今天Qwen3.8-Max发布会上最让我注意的点——不是2.4万亿参数有多吓人,而是它开始像一个真正的工程师那样工作了。
参数之外,更值得关注的是“自主决策能力”
Qwen3.8-Max这次把总参数量推到了2.4T,激活95B,基于MoE架构做优化。在三方Arena榜单上,整体表现仅次于Anthropic的Claude系列,编程能力排到全球第四。
但参数和排名这些数字看腻了,真正有意思的是阿里放出来的几个实测案例:
-
16天独立写完一个oh-my-cli项目,265次代码提交
-
在芯片设计沙箱里跑了约500轮交互,把硬件门数从8298门压缩到678门
-
在365天的电商经营模拟中,以4.16倍回报拿了第一
-
在一场有458支人类队伍参加的算法竞赛里,24小时就干到了榜首
这些任务有一个共同点:周期长、步骤多、需要自主决策,而不是“你问我答”式的单次对话。现在的顶尖大模型,比拼的早已不是谁更会聊天,而是谁能真正端到端地把事情做完。
定价与开源:两个值得关注的信息
定价方面,国内输入12元/百万tokens、输出36元,隐式缓存命中只要1.5元。国际价格分别是Opus5的40%和24%。
更重磅的是,阿里宣布下周就开源Qwen3.8-Max的完整权重——这是Qwen家族里Max级别模型第一次开源。同时还会开源一个27B的小尺寸版本,给本地部署和端侧场景用。
对开发者的意义
从Kimi K3到阿里Qwen3.8-Max,国产大模型正在把"开源"从营销口号变成真刀真枪的工程交付。对开发者来说,这意味着以后用顶级模型的门槛会越来越低。如果你正在找稳定又划算的API接入方案,EasyAPI值得看看。

网硕互联帮助中心




评论前必须登录!
注册