数博会现场,蹲完海光今天的发布会加展台,一个感受特别深——以前做推理,大家思路特简单:DCU够猛就行,CPU凑合搭一个,差不多得了。但今年展台上聊得最多的就是“智能体”,这套新物种上来以后,原来的路子彻底走不通了。
海光这次首发的Agent to Token开放计算架构,把这事儿掰扯得挺明白。智能体跑起来,任务编排、工具调用、沙箱隔离、记忆检索,七七八八的调度活儿,九成以上全压在CPU身上。DCU只干一件事——词元解码生成。算力配比直接从过去的1:8、1:4,收敛到了1:1。
旁边哥们打了个比方我觉得特形象:以前是GPU唱独角戏,现在CPU和DCU得演对手戏。
海光C86这次就是冲着这个来的,强单核、硬件虚拟化、大缓存、低访存延迟,把智能体高并发、多分支、强隔离的需求卡得死死的。说白了,不再单纯拼谁算力猛,而是看CPU和DCU能不能打好配合。
这套全链路方案,确实戳中了政企做智能体落地的刚需。算力这事儿,真得换个脑子看了。
海光信息 AI智能体算力
