塔斯娱乐资讯网

千问办公上线Qwen3.8-Flash,专治Agent“Token焦虑”,量大管

千问办公上线Qwen3.8-Flash,专治Agent“Token焦虑”,量大管饱
Agent圈现在最头疼的,不是模型不聪明,是Token烧不起。IDC预测,2026年我国企业级Token消耗量将同比增长约20倍。重度玩家一天干掉10亿Token,耗费数千美元。而且,同一个任务,Agent工作流的Token消耗是聊天机器人的5到30倍。用AI用出了理财的感觉,打开任务还要先算成本,大伤脑筋。
昨晚阿里放出Qwen3.8-Flash,千问办公第一时间接入,同步上线标准模式,模型的Token生成速度提升100%,Token消耗减少75%。
先说一下这模型:千亿总参数,仅激活60亿,官方口径性能超越Claude Opus4.6;每百万Tokens输入0.8元,输出2.7元,不到Claude Opus4.6的1/40,比DeepSeek-V4-Flash忙时价格的1/3还低。