数博会现场直击,国产算力真不是纸上谈兵
贵阳这两天热得够呛,但数博会的E1馆更热。上午溜达了一圈数博会,几个馆转下来,印象最深的不是那些花里胡哨的大模型演示,反而是海光那个展位,倒不是说展台多豪华,而是这次他们摆出来的东西,你能摸到、看到、甚至能感受到那个分量。
巧的是我去的时候正赶上他们发布Agent to Token开放计算架构。把Agent业务流拆成机头、沙箱、编排、记忆体、数据库五块,CPU负责调度和编排,DCU一门心思搞词元批量生成。以前大家总说CPU拖后腿,但听完这个拆解,我反而觉得不是CPU不行,是之前没按Agent的玩法来用。
展台上CPU和DCU全系列摆了一排,工作人员重点讲了三个开放维度:算力可以灵活组合,互连靠HSL协议把延迟压到比PCIe低50%,软件栈对CUDA兼容超95%、迁移成本降七成。核心就一个意思,不把你绑死在一套方案里,让你能按需搭配、持续演进。
以前觉得国产芯片就是能用,现在看架构层面开始动脑子了,是真好用了。算力堆料容易,把不同芯片、不同环节协调好才见功力。海光这次,思路清晰,落地也扎实。
