塔斯娱乐资讯网

秦叶热谈科技的文章

Anthropic 的 Dario Amodei 提了个事,说要给大模型迭代踩刹车。马斯克和奥尔特曼都跟着应了。新闻出来那天我正好在盯训练日志,扫了一眼评论区,全是说这帮人搞垄断的。说实话,从搞技术的人角度看,他们担心的那个点确实存在。

模型迭代这玩意儿,现在有个很具体的瓶颈。参数规模每往上翻一倍,能用 ​

Anthropic 的 Dario Amodei 提了个事,说要给大模型迭代踩刹车。马斯克和奥尔特曼都跟着应了。新闻出来那天我正好在盯训练日志,扫了一眼评论区,全是说这帮人搞垄断的。说实话,从搞技术的人角度看,他们担心的那个点确实存在。 模型迭代这玩意儿,现在有个很具体的瓶颈。参数规模每往上翻一倍,能用 ​

Anthropic 的 Dario Amodei 提了个事,说要给大模型迭代踩刹车。马斯克和奥尔特曼都跟着应了。新闻出来那天我正好在盯训练日志,扫了一眼评论区,全是说这帮人搞垄断的。说实话,从搞技术的人角度看,他们担心的那个点确实存在。 模型迭代这玩意儿,现在有个很具体的瓶颈。参数规模每往上翻一倍,能用 ​
ENISA 拿到 Mythos 5,GP

看到 ENISA 拿到 Mythos 5 的访问权,第一反应不是高兴,是觉得有点意外。这事拖了挺久,中间还卡了白宫那一步。官方说法是已经获准,正在测试阶段,OpenAI 的 GPT-6 Astra 也一起批了。这两个名字放一起挺刺眼,一个主打安全漏洞挖掘,一个定位不明确,但欧盟现在同时握着两 ​

ENISA 拿到 Mythos 5,GP 看到 ENISA 拿到 Mythos 5 的访问权,第一反应不是高兴,是觉得有点意外。这事拖了挺久,中间还卡了白宫那一步。官方说法是已经获准,正在测试阶段,OpenAI 的 GPT-6 Astra 也一起批了。这两个名字放一起挺刺眼,一个主打安全漏洞挖掘,一个定位不明确,但欧盟现在同时握着两 ​

ENISA 拿到 Mythos 5,GP 看到 ENISA 拿到 Mythos 5 的访问权,第一反应不是高兴,是觉得有点意外。这事拖了挺久,中间还卡了白宫那一步。官方说法是已经获准,正在测试阶段,OpenAI 的 GPT-6 Astra 也一起批了。这两个名字放一起挺刺眼,一个主打安全漏洞挖掘,一个定位不明确,但欧盟现在同时握着两 ​
Claude Max 订阅条款出现文字游戏

Anthropic 最近被一群 Claude 用户告了。集体诉讼,指控的是 Max 套餐的宣传和实际限制对不上。

事情是这样的。Claude Max 是 2025 年 4 月推的,分两档,100 美元和 200 美元每月,对应 Pro 套餐 5 倍和 20 倍的使用额度。宣传语里写的是“非常适合经常使用 Claude ​

Claude Max 订阅条款出现文字游戏 Anthropic 最近被一群 Claude 用户告了。集体诉讼,指控的是 Max 套餐的宣传和实际限制对不上。 事情是这样的。Claude Max 是 2025 年 4 月推的,分两档,100 美元和 200 美元每月,对应 Pro 套餐 5 倍和 20 倍的使用额度。宣传语里写的是“非常适合经常使用 Claude ​

Claude Max 订阅条款出现文字游戏 Anthropic 最近被一群 Claude 用户告了。集体诉讼,指控的是 Max 套餐的宣传和实际限制对不上。 事情是这样的。Claude Max 是 2025 年 4 月推的,分两档,100 美元和 200 美元每月,对应 Pro 套餐 5 倍和 20 倍的使用额度。宣传语里写的是“非常适合经常使用 Claude ​
吴恩达那几封信讲 AI 工程技能地图,四个板块递进:驾驭不可预测的 LLM、打好软件工程外壳、用好编程智能体、最后上移到决定构建什么。逻辑是通的,但有一处判断我特别想拿出来单独说。

他访谈了数十位顶尖工程师,结合自己团队经验,给出的结论是:让智能体自主跑几小时烧掉千万 token 这种用法,实 ​

吴恩达那几封信讲 AI 工程技能地图,四个板块递进:驾驭不可预测的 LLM、打好软件工程外壳、用好编程智能体、最后上移到决定构建什么。逻辑是通的,但有一处判断我特别想拿出来单独说。 他访谈了数十位顶尖工程师,结合自己团队经验,给出的结论是:让智能体自主跑几小时烧掉千万 token 这种用法,实 ​

吴恩达那几封信讲 AI 工程技能地图,四个板块递进:驾驭不可预测的 LLM、打好软件工程外壳、用好编程智能体、最后上移到决定构建什么。逻辑是通的,但有一处判断我特别想拿出来单独说。 他访谈了数十位顶尖工程师,结合自己团队经验,给出的结论是:让智能体自主跑几小时烧掉千万 token 这种用法,实 ​
OpenAI 语音模式能点单了,Pro 

9 月 10 日,OpenAI 语音产品负责人 Atty Eleti 宣布,ChatGPT Voice 里用户可以直接选模型,也能选推理深度。Pro 套餐可以调用 GPT-5.6 Sol 或 GPT-6 Astra。需要联网搜索或复杂推理时,语音模式会自动转给指定模型处理。

这里有个细节,语音模式把问题转给底层文本 ​

OpenAI 语音模式能点单了,Pro 9 月 10 日,OpenAI 语音产品负责人 Atty Eleti 宣布,ChatGPT Voice 里用户可以直接选模型,也能选推理深度。Pro 套餐可以调用 GPT-5.6 Sol 或 GPT-6 Astra。需要联网搜索或复杂推理时,语音模式会自动转给指定模型处理。 这里有个细节,语音模式把问题转给底层文本 ​

OpenAI 语音模式能点单了,Pro 9 月 10 日,OpenAI 语音产品负责人 Atty Eleti 宣布,ChatGPT Voice 里用户可以直接选模型,也能选推理深度。Pro 套餐可以调用 GPT-5.6 Sol 或 GPT-6 Astra。需要联网搜索或复杂推理时,语音模式会自动转给指定模型处理。 这里有个细节,语音模式把问题转给底层文本 ​
Harness 0.1.5 更新:适配 

昨天把 Harness 升到 0.1.5。主要想试试 V4.1 Flash 的适配情况。

552B 的 MoE,结构叫 Causal-Encoder-Decoder。输入输出不对称——输入激活 8B,输出 16B。DeepSeek 官方说成本比同尺寸已知模型低不少,具体数字没细看。

KV Cache 这块变化挺大。跟上一代比,HBM 需求 ​

Harness 0.1.5 更新:适配 昨天把 Harness 升到 0.1.5。主要想试试 V4.1 Flash 的适配情况。 552B 的 MoE,结构叫 Causal-Encoder-Decoder。输入输出不对称——输入激活 8B,输出 16B。DeepSeek 官方说成本比同尺寸已知模型低不少,具体数字没细看。 KV Cache 这块变化挺大。跟上一代比,HBM 需求 ​

Harness 0.1.5 更新:适配 昨天把 Harness 升到 0.1.5。主要想试试 V4.1 Flash 的适配情况。 552B 的 MoE,结构叫 Causal-Encoder-Decoder。输入输出不对称——输入激活 8B,输出 16B。DeepSeek 官方说成本比同尺寸已知模型低不少,具体数字没细看。 KV Cache 这块变化挺大。跟上一代比,HBM 需求 ​
Claude 第四起外网访问事件的排查逻

Anthropic 在 9 月 9 日发了个公告,确认一起 2026 年 1 月发生的安全事件。这是他们对外披露的第四起。前 7 月 30 日已经披露过三起,那次的直接原因是第三方评估环境配置失误。模型被指派了无限制的夺旗网络攻击任务,测试环境本该和真实互联网隔离,但因为和评 ​

Claude 第四起外网访问事件的排查逻 Anthropic 在 9 月 9 日发了个公告,确认一起 2026 年 1 月发生的安全事件。这是他们对外披露的第四起。前 7 月 30 日已经披露过三起,那次的直接原因是第三方评估环境配置失误。模型被指派了无限制的夺旗网络攻击任务,测试环境本该和真实互联网隔离,但因为和评 ​

Claude 第四起外网访问事件的排查逻 Anthropic 在 9 月 9 日发了个公告,确认一起 2026 年 1 月发生的安全事件。这是他们对外披露的第四起。前 7 月 30 日已经披露过三起,那次的直接原因是第三方评估环境配置失误。模型被指派了无限制的夺旗网络攻击任务,测试环境本该和真实互联网隔离,但因为和评 ​
V4Pro下架,Flash要等两年?

看到DeepSeek V4Pro下架的消息,有点意外。毕竟之前用着还行,虽然不知道具体原因。

话说回来,新出的V4.1 Flash居然要等到2026年9月才上线……这时间是不是定得太远了?现在都2024年中了,等于还得等两年多。用户总不能一直空窗吧。
这篇拆解写得挺全。从选品到客服到复 ​

V4Pro下架,Flash要等两年? 看到DeepSeek V4Pro下架的消息,有点意外。毕竟之前用着还行,虽然不知道具体原因。 话说回来,新出的V4.1 Flash居然要等到2026年9月才上线……这时间是不是定得太远了?现在都2024年中了,等于还得等两年多。用户总不能一直空窗吧。 这篇拆解写得挺全。从选品到客服到复 ​

V4Pro下架,Flash要等两年? 看到DeepSeek V4Pro下架的消息,有点意外。毕竟之前用着还行,虽然不知道具体原因。 话说回来,新出的V4.1 Flash居然要等到2026年9月才上线……这时间是不是定得太远了?现在都2024年中了,等于还得等两年多。用户总不能一直空窗吧。 这篇拆解写得挺全。从选品到客服到复 ​
K2.8 上了

K2.8 Preview 全量进 Kimi Code 了,综合性能接近 K3。

怎么说呢,Preview 这个词听着就不太稳。

本地部署的人最清楚,版本号和表现经常不是一回事。

你拿 Q4_K_M 量化一下,token 生成大概率还得看心情。

#Kimi##K2.8##Preview##Kimi Code##月之暗面# ​

K2.8 上了 K2.8 Preview 全量进 Kimi Code 了,综合性能接近 K3。 怎么说呢,Preview 这个词听着就不太稳。 本地部署的人最清楚,版本号和表现经常不是一回事。 你拿 Q4_K_M 量化一下,token 生成大概率还得看心情。 #Kimi##K2.8##Preview##Kimi Code##月之暗面# ​

K2.8 上了 K2.8 Preview 全量进 Kimi Code 了,综合性能接近 K3。 怎么说呢,Preview 这个词听着就不太稳。 本地部署的人最清楚,版本号和表现经常不是一回事。 你拿 Q4_K_M 量化一下,token 生成大概率还得看心情。 #Kimi##K2.8##Preview##Kimi Code##月之暗面# ​
K2.8 Preview 全量上线 Kimi Code,官方说综合性能接近 K3。

本地模型没动。32B 还是跑着,显存卡着,Kimi 这边只能走云端。

K2.8 挺好,国产模型又进了一步。 加油,LLM ​

K2.8 Preview 全量上线 Kimi Code,官方说综合性能接近 K3。 本地模型没动。32B 还是跑着,显存卡着,Kimi 这边只能走云端。 K2.8 挺好,国产模型又进了一步。 加油,LLM ​

K2.8 Preview 全量上线 Kimi Code,官方说综合性能接近 K3。 本地模型没动。32B 还是跑着,显存卡着,Kimi 这边只能走云端。 K2.8 挺好,国产模型又进了一步。 加油,LLM ​
V4 Pro 退场,先看价格

DeepSeek 开放平台发的通知,V4.1 Flash 预计 9 月 10 日前后上线,性能、费用、速度、总用时全面超 V4 Pro。全面超过这四个字最近出现的频率有点高。先跳过,往下看价格。数字比形容词靠谱。

新价格 9 月 10 日 12 点生效。空闲时段,输入缓存命中每百万 token 0.02 元,缓存 ​

V4 Pro 退场,先看价格 DeepSeek 开放平台发的通知,V4.1 Flash 预计 9 月 10 日前后上线,性能、费用、速度、总用时全面超 V4 Pro。全面超过这四个字最近出现的频率有点高。先跳过,往下看价格。数字比形容词靠谱。 新价格 9 月 10 日 12 点生效。空闲时段,输入缓存命中每百万 token 0.02 元,缓存 ​

V4 Pro 退场,先看价格 DeepSeek 开放平台发的通知,V4.1 Flash 预计 9 月 10 日前后上线,性能、费用、速度、总用时全面超 V4 Pro。全面超过这四个字最近出现的频率有点高。先跳过,往下看价格。数字比形容词靠谱。 新价格 9 月 10 日 12 点生效。空闲时段,输入缓存命中每百万 token 0.02 元,缓存 ​
DeepSeek Harness 上手

DeepSeek Harness 不是又一个编码助手。它是 DeepSeek 官方开源的 agent harness,命令叫 dsh,核心是 everything-is-a-plugin 架构,底下跑 Cordis。模型、工具、沙箱、会话,全都能当插件换,不用改源码。

装它别想太多。有 Node.js 就一条命令,npx web。 ​

DeepSeek Harness 上手 DeepSeek Harness 不是又一个编码助手。它是 DeepSeek 官方开源的 agent harness,命令叫 dsh,核心是 everything-is-a-plugin 架构,底下跑 Cordis。模型、工具、沙箱、会话,全都能当插件换,不用改源码。 装它别想太多。有 Node.js 就一条命令,npx web。 ​

DeepSeek Harness 上手 DeepSeek Harness 不是又一个编码助手。它是 DeepSeek 官方开源的 agent harness,命令叫 dsh,核心是 everything-is-a-plugin 架构,底下跑 Cordis。模型、工具、沙箱、会话,全都能当插件换,不用改源码。 装它别想太多。有 Node.js 就一条命令,npx web。 ​
本地跑32B模型,显存真的够吗?

假设你刚下了一个热门开源 32B 模型,开了量化,显存还是爆了。参数表写的 20G 看着挺宽松,实际跑起来不是那么回事。

量化等级对显存的影响经常被轻描淡写。Q4_K_M 看似省了一半,但上下文一拉长,显存需求不是线性涨,是跳着涨。常见的情况是:加载时还好好的,一生 ​

本地跑32B模型,显存真的够吗? 假设你刚下了一个热门开源 32B 模型,开了量化,显存还是爆了。参数表写的 20G 看着挺宽松,实际跑起来不是那么回事。 量化等级对显存的影响经常被轻描淡写。Q4_K_M 看似省了一半,但上下文一拉长,显存需求不是线性涨,是跳着涨。常见的情况是:加载时还好好的,一生 ​

本地跑32B模型,显存真的够吗? 假设你刚下了一个热门开源 32B 模型,开了量化,显存还是爆了。参数表写的 20G 看着挺宽松,实际跑起来不是那么回事。 量化等级对显存的影响经常被轻描淡写。Q4_K_M 看似省了一半,但上下文一拉长,显存需求不是线性涨,是跳着涨。常见的情况是:加载时还好好的,一生 ​
美伊冲突持续升级,霍尔木兹海峡的航运安全问题,再次成为推动国际油价上涨的主要原因。

周一,布伦特原油上涨至每桶96.77美元,WTI原油报91.94美元。过去一周,布伦特原油累计上涨7.8%,WTI更大涨近10%。

美国与伊朗近期在霍尔木兹海峡及周边水域发生多次冲突,市场担心油轮运输可能长期受到影响。 ​

美伊冲突持续升级,霍尔木兹海峡的航运安全问题,再次成为推动国际油价上涨的主要原因。 周一,布伦特原油上涨至每桶96.77美元,WTI原油报91.94美元。过去一周,布伦特原油累计上涨7.8%,WTI更大涨近10%。 美国与伊朗近期在霍尔木兹海峡及周边水域发生多次冲突,市场担心油轮运输可能长期受到影响。 ​

美伊冲突持续升级,霍尔木兹海峡的航运安全问题,再次成为推动国际油价上涨的主要原因。 周一,布伦特原油上涨至每桶96.77美元,WTI原油报91.94美元。过去一周,布伦特原油累计上涨7.8%,WTI更大涨近10%。 美国与伊朗近期在霍尔木兹海峡及周边水域发生多次冲突,市场担心油轮运输可能长期受到影响。 ​

#设计师称中国客厅已失去意义# 在我们河南,我们不叫客厅,叫堂屋。农村传统的堂屋除了充当客厅,往往还有一条供奉桌,平时也放暖瓶水杯等杂物,过年时会收拾得清清爽爽,摆放祭品。 不过,上次回家最大的发现是:虽然现在的房屋布局跟我小时候有很大不同,但是,我家,我叔家,我两个舅舅家,我姑父 ​

#设计师称中国客厅已失去意义# 在我们河南,我们不叫客厅,叫堂屋。农村传统的堂屋除了充当客厅,往往还有一条供奉桌,平时也放暖瓶水杯等杂物,过年时会收拾得清清爽爽,摆放祭品。 不过,上次回家最大的发现是:虽然现在的房屋布局跟我小时候有很大不同,但是,我家,我叔家,我两个舅舅家,我姑父 ​