凌晨 2 点多刷到 @Claude 官号,以为眼花:一次发了俩模型,Fable 5.1 和 Mythos 5.1。
先说让我一下子清醒的:这俩其实是同一个模型,只是安全限制不同。Fable 5.1 全面开放,Mythos 5.1 只给经过验证的网络安全、生命科学机构用,暂限美国机构。官方原话:identical。
性能上,Fable 5.1 明显是冲着「长时间跑任务」去的。Terminal-Bench-Science 从 24.7% 跳到 52.6%,直接翻倍;Terminal-Bench 4.0 从 42% 涨到 55.8%;AutomationBench 从 17.1% 涨到 31.4%。但传统基准涨得不多,HLE 只从 57.8% 到 60.9%。意思很明确:普通问答没啥惊喜,挂机干活的场景才是主场。
价格倒是真的友好了一截。基础价没动,输入 10 美元、输出 50 美元每百万 token,但缓存读取从 1 美元砍到 0.25 美元,降了 75%。官方算过账:典型负载总成本降约 25%,复杂 coding 和高度 agentic 的任务最多省 45%。对天天跑长任务的开发者,这比涨分实在。
还憋了个大招:Enterprise Frontier Safeguards(EFS),企业数据存客户自己的云,等于零数据保留,秋季开始分阶段推。官方说网络安全误报少了 60%,生物医疗误报少了 85%。
科研案例也很离谱:设计蛋白 binder,12 个靶点命中率近 50%(行业常见只有 10-15%);用 NASA 30 年前的雷达数据重建了 1/3 金星的高分辨率地图;写 GPU kernel 把 7 个开源模型提速最高 2.5 倍。
有开发者在评论区指出,这可能是 IPO 前最后一次重量级发布,9 月 7 日劳动节后 Anthropic 就要公开招股书了。选在凌晨发,多少有点「赶在路演前秀肌肉」的意思。#Anthropic #人工智能 #大模型 #效率工具 #程序员 #科技资讯 #Agent #AI工具 #Claude #AI资讯
