虽然大模型用起来非常的方便,智能体也非常火热,但落地的时候,算力成本成为无底洞,数据隐私也成为高压线,这或许,就是当下AI行业最真实的尴尬。
对此,AMD董事会主席及首席执行官苏姿丰博士(Dr. Lisa Su)在今年的AMD AI开发者大会上给出了AMD的解法。她表示,AI应该无处不在,为每一个人、每一种工作负载、每一种形态的设备服务。她强调,AMD的使命不仅是提供高性能计算,更是通过开放的软件与硬件生态,赋能开发者应对智能时代的算力挑战。
算力拐点已至:从“堆GPU”到“系统工程”
当前,AI正处于从训练主导转向推理普及的关键拐点。智能体AI的崛起,使得计算需求从一次询问演变为“多步、多调用、多智能体”的复杂协作。这一转变对算力提出了全新要求:不仅需要强大的GPU,更需要系统级的协同、高带宽大容量的统一内存,以及从端到云的完整计算谱系。
AMD高级副总裁、计算与图形总经理Jack Huynh在演讲中用数据揭示了挑战的严峻性。他表示,到2030年,全球将有50亿人使用AI。Token需求呈指数级增长,仅OpenRouter一个平台,从2025年2月到2026年初,处理的Token数就从2万亿飙升至42万亿。中国每天消耗140万亿Token,两年内增长超过100倍。
Jack Huynh进一步指出,算力已不再是唯一约束。计算对预填充很重要,但内存在当前扮演着比过去重要得多的角色。内存大小决定了你能在上下文中运行多大的模型,内存带宽则决定了解码速度。这一洞察,正是AMD推出锐龙AI Max+系列处理器的核心逻辑。
AMD高级副总裁、大中华区总裁潘晓明在大会欢迎辞中深刻指出,中国正走在全球AI发展的最前沿。AMD通过覆盖云、边、端的计算产品组合和开源的ROCm软件平台,为开发者提供开放的全栈式AI算力支持;不断优化开发环境与工具链,助力创意孵化与落地;同时通过开发者社区与校园计划,积极推动人才培养和生态共建。
锐龙AI Max+系列:重新定义智能体主机
为应对本地化、低延迟、高隐私的AI推理需求,AMD率先提出“智能体主机”新概念,并推出锐龙AI Max+系列处理器。该系列最高支持


闽公网安备 35020602001684号