浪潮信息在Agent规模化部署与智能协作方面取得突破,一方面实现单机柜同时运行4万个Agent,另一方面通过大模型组队答题机制提升推理能力,推动AI从“数量堆砌”向“质量提升”转变。

详细分析

随着大模型技术的快速演进,AI Agent作为智能体的落地形态正从实验场走向生产环境,但业界长期面临一个核心矛盾:Agent的规模与智能水平难以兼得。多数平台要么采用轻量级Agent实现高并发,但推理能力薄弱;要么依赖高端大模型追求深度,却受限于算力无法大规模并行。浪潮信息此次提出的双引擎方案,试图一次性打破这种零和博弈。在规模化层面,浪潮信息宣称其单机柜可同时承载4万个Agent实例,这一数字远超行业主流水平。这意味着企业可以在数据中心内部署海量数字员工,协同完成客服、运维、数据标注等高并发任务,而不必为每个Agent分配昂贵的高端GPU卡。更值得关注的是技术路线的创新——浪潮并未止步于堆砌Agent数量,而是引入“大模型组队答题”机制。该机制借鉴了分布式协作与集成学习的思想,让多个不同规模、不同擅长领域的大模型组成“答题小组”,针对复杂问题进行多轮交互、投票、驳斥与修正,最终输出更可靠的答案。这种多模型协作方式在学术界被称为“混合专家系统”的实时变体,其实际效果已在浪潮内部的金融知识问答、代码审查等场景中得到验证,错误率较单模型下降约30%。从行业影响看,浪潮的这一布局直击当前企业智能化转型的两大痛点:一是成本,单柜高密度部署能大幅降低硬件投资与能耗支出;二是质量,组队答题机制让中等能力的模型也能在协作中输出专家级结果,降低了企业对顶尖闭源模型的依赖。这对竞争格局的冲击尤为明显——一方面,传统AI服务器厂商若只比拼峰值算力而忽视Agent模块化管理与协作推理能力,将逐渐丧失话语权;另一方面,云计算平台虽能弹性调度大模型,但在物理密度与低延迟协同上不具备机柜级优势,浪潮以硬件+算法的组合拳重新定义了“智能算力密度”这一新指标。在全球范围内,英伟达、AMD等芯片巨头正将注意力转向Agent场景,但浪潮率先在系统级给出了工程答案。未来,Agent的“数量”只是入场券,“脑子”才是决胜的关键,而浪潮正在用自己的方式证明,真正的智能基础设施应当同时兼顾吞吐规模与决策深度,这才是AI从工具进化为伙伴的必经之路。

原文:量子位