塔斯娱乐资讯网

阿里发布Qwen3.8Flash 阿里昨晚扔了个炸弹,Qwen3.8-Flash

阿里发布Qwen3.8Flash 阿里昨晚扔了个炸弹,Qwen3.8-Flash,直接把大模型价格打到了地板价。

但这不是单纯降价,是底层架构的革命。1250亿参数的MoE模型,每次只激活60亿,靠Qwen4的下一代架构硬生生把训练成本砍了90%。每百万token输入0.8块钱、输出2.7块钱,是Claude Opus4.6的不到3%,DeepSeek-V4-Flash的三分之一。

性能呢?完爆Opus4.6,接近Opus4.8。编程评测领先9分,手机操作任务高出22分,视觉数学超25分。注意,这是用九分之一的钱训出来的。

特别值得一提的是,在真实任务中,Agent工作需长输入(Input),缓存命中价格对综合成本影响大,Qwen3.8-Flash缓存命中价格低至每百万Tokens 0.1元、国际站0.016美元,特别适合大量、频繁的日常智能体任务,开发者可以极致性价比获取前沿性能。

阿里走了一条新路,不卷参数规模了,卷单位算力能承载多少智能。以前是堆GPU堆数据硬刚,现在是从Attention到Embedding全部重做,让每一分算力都转化成有效智能。

Qwen3.8-Flash-Next已经开源了,这是Qwen4架构的预览版,智能不一定要那么贵,效率才是下一站。