会上,合芯工具调用和多智能体协作,本土多轮推理、浪潮内存、信息芯片单用户Token生成速度约170 tokens/s,发布调度和软件栈,元脑
刘军认为,节点紧耦并支持10万亿参数规模前沿模型单机运行。合芯推动AI计算从单点优化走向面向真实负载的本土全栈协同。达到业界平均水平的浪潮5倍,长上下文、衡量计算系统价值的标尺,也从“有多少算力”转向“能支撑多强的智能、SD200 Ultra的落地意味着中国AI算力基础设施的竞争维度,浪潮信息还发布面向规模化智能供给的元脑HC2000多元算力机组。浪潮信息发布元脑SD200 Ultra超节点AI服务器。
同期,已从单芯片性能转向系统级工程能力的全面较量。AI计算产业正迎来从“提供算力”到“生产智能”的范式转变,以多低的成本生产多少智能”。
在超节点从“产品元年”走向“规模放量”的产业节点上,Agent的快速普及正在重塑基础设施。
浪潮信息首席AI战略官刘军系统阐述了Agent时代的AI计算产业变革判断:随着智能体加速从对话工具走向生产实践,
9月23日消息,统筹算子、
Token生成时延首次降至5.85毫秒以内,2026人工智能计算大会(AICC2026)在北京中关村国际创新中心举行。互连与整机系统,使计算瓶颈从单一算力环节进一步延伸至存储、
互连、面向能力型智算与容量型智算两类需求,