展开菜单
首页 精品内容 本月促销 装机必备 Windows macOS软件 IOS软件 Android AI PDF教程 专题
全部分类

当前位置:

首页 > 硬件相关 > AMD再下重注 苏姿丰在Agent时代再出狠招

AMD再下重注 苏姿丰在Agent时代再出狠招

AMD在上海举办AI开发者日,首次落地北美以外。CEO苏姿丰指出AI正从训练转向推理,数据中心CPU与GPU比例将从1:4变为1:1,CPU在智能体协调中作用提升。AMD推出“智能体主机”新硬件品类,支持本地高效运行大模型以降低推理成本。ROCm开源生态持续扩大,已支持超300万个模型,并通过与中国开发者社区合作降低迁移门槛。

5月19日,AMD在上海举办了其AI开发者日(AI DevDay 2026),这也是该活动首次在北美以外地区落地。现场吸引了超过2000名开发者,AMD董事会主席及CEO苏姿丰、高级副总裁Jack Huynh先后发表主旨演讲,零一万物CEO李开复、阶跃星辰CTO朱亦博、清华大学教授汪玉等业界与学界代表也登台分享了见解。大会主题“开放-构建-创新-连接”之下,一条与行业巨头NVIDIA迥异的算力发展路线,被系统性地勾勒出来。


CPU:GPU从1:4到1:1,推理正在重写算力配比

苏姿丰在演讲中抛出了一个关键数据:传统数据中心里,CPU与GPU的比例通常是1:4,而到2026年,这个比例预计将变为1:1。

这背后的逻辑源于AI应用从训练到推理的范式转变。在训练阶段,GPU承担了几乎所有的密集计算,CPU主要负责调度和数据搬运,1:4的配比合情合理。然而,到了推理阶段,尤其是智能体(Agent)运行时,计算结构发生了根本变化。一个智能体要完成任务,涉及目标解析、工具调用、多步骤决策、状态管理和数据流转——这些复杂逻辑的编排,恰恰是CPU的强项。GPU继续负责其擅长的大模型推理和并行计算,而CPU则升级为协调调度与逻辑控制的核心,两者角色趋于对等。

苏姿丰在现场清晰地展示了这一逻辑链:从“大模型为中心”转向“智能体编排”,Agent的每一步运行都重度依赖CPU。GPU的工作并未减少,但CPU的工作量在推理场景下大幅增加,从辅助角色转变为对等伙伴。

这一判断对产业的影响是具体而深远的。服务器的采购逻辑将随之改变,CPU的调度能力将成为新的关键评估指标。芯片公司也需要重新平衡其在CPU和GPU产品线上的资源投入。目前,行业资源高度集中在训练侧,推理侧的算力需求增速尚未充分反映到基础设施投资中。AMD凭借在CPU领域的EPYC产品线和GPU领域的Instinct系列,成为少数两家都能提供、且有动力推动这一趋势的厂商。

200B模型本地跑近100 tokens/s,Token成本趋近于零

AMD在此次大会上明确提出了“智能体主机”这一新硬件品类。其定义清晰:具备96GB GPU专属显存、128GB统一内存,能本地运行200B参数模型,支持7×24小时持续工作,且断网可用。

目前,基于Ryzen AI Max+系列处理器的系统设计已有35款落地,来自惠普、华硕、联想、宏碁及多家本土品牌,覆盖笔记本、一体机和Mini AI工作站等多种形态。


AMD高级副总裁Jack Huynh描绘了一条清晰的AI部署路径:开发阶段,使用Ryzen AI Max在本地运行200B模型;规模测试阶段,采用Radeon AI Pro R9700配合Threadripper Pro 9000工作站(提供128条PCIe 5.0通道,支持多GPU协同);最终部署阶段,则上马MI350系列数据中心GPU。关键在于,同一套ROCm软件栈贯穿始终,实现了从笔记本到数据中心的代码一次编写、全路径运行。

这条路径能否成立,核心在于本地推理的性能与经济性。阶跃星辰CTO朱亦博在现场提供了一组有力数据:其Step 3.5模型约1960亿参数,经过4位量化后,在AI Max 395平台上的解码速度接近每秒100个token,甚至比许多云端模型API还要快。阶跃星辰即将发布的新模型也将继续在AMD平台上保持流畅运行。

这组性能数据背后,是一道清晰的经济账。智能体运行的特点是持续调用、高频推理,如果采用云API按Token计费的模式,企业的长期成本将非常高昂。而本地部署则将Token成本压至趋近于零,仅消耗电费。有技术分享提到,中国头部开发者一年在API调用上的花费可达数百万元。当200B参数的模型能以近100 tokens/s的速度在本地运行时,许多AI应用的商业模式才真正算得过来账。

零一万物与AMD联合推出的Cube01企业智能体一体机,正是基于此理念,它能在本地同时运行数百个Agent。李开复在与苏姿丰的对谈中提出了“DRI”(直接责任人)的概念,他认为智能体时代,开发者的角色将从编写代码转向编排智能体并对最终结果负责。他更直言,企业CEO应主导AI转型,因为IT部门天然倾向于安全部署而非业务重构,导致许多企业的AI应用停留在会议纪要、内部搜索等低价值场景,未能触及真正影响损益表的核心业务流程。


李开复对2024至2026年AI行业核心问题的演变做了梳理:2024年是“AI能不能完成一项任务”,2025年是“AI能不能完成一条完整工作流”,2026年则将演进为“AI能不能运营一个企业职能部门”。顺着这个逻辑,智能体主机所要承载的,是能够持续运行、自主决策并对业务结果负责的AI系统,而不仅仅是运行模型的终端设备。

300万模型Day 0适配,ROCm在拆CUDA的墙

ROCm是AMD在软件层面与NVIDIA竞争的核心武器。本次大会披露了其最新进展:新增支持锐龙AI 400系列处理器,相关组件可在ComfyUI中直接下载;从ROCm 7.2版本开始同时支持Windows和Linux系统;通过Hugging Face和魔搭社区,其支持模型数量已超过300万个;DeepSeek、通义千问、MiniMax、Kimi、阶跃星辰、小米MiMo等国内主流开源模型均已实现Day 0适配。

此外,AMD推出了面向中国AI开发者的免费公共开发者云,底层搭载Radeon GPU;与魔搭和阿里云的合作,使得开发者无需自备硬件,即可直接在魔搭创空间中使用AMD GPU。

一个值得注意的内部实践是,AMD部署了数千个Agent持续监控开源社区,自动识别AMD支持中的缺口,生成完整的Pull Request并完成自动测试,将工程师的产出效率从每周几个PR提升至每天几个。AMD还在利用Agent辅助进行GPU内核的性能优化——针对不同模型推理负载的内核特征,Agent能自动生成内核排列组合,进行性能分析和迭代,速度远超人工。

开源,对AMD而言是唯一可行的竞争策略。CUDA的壁垒在于开发者生态的惯性:代码已经在NVIDIA平台上跑通,迁移到另一个平台需要时间和试错成本。AMD要打破这种惯性,必须将迁移成本压到最低。ROCm的思路是做抽象层:开发者无需关心底层GPU的具体型号,编写一次代码即可在从笔记本到数据中心的任何AMD硬件上运行。同时,通过支持OpenAI Triton、Gluon、TileLang等工具,进一步降低了GPU编程的门槛。

李开复在对谈中对开源模式给出了一个精辟的比喻:硅谷闭源模型公司的模式类似于iOS,追求高利润和封闭控制;而全球开源社区的模式则类似于Android,覆盖面广,强调开放协作。他指出,中国AI企业由于算力资源相对有限,无法像美国巨头那样“暴力”堆砌算力,因此工程效率和开源协作能力是被迫进化出的核心优势。他将中国AI生态比作一个“去中心化的学习小组”——企业在商业上竞争,却在开源层面共享成果。AMD在中国市场集中投入开源生态,正是契合了这一市场结构:这里拥有全球最活跃的开源社区和最愿意尝试新硬件的开发者群体。

数据不上云、延迟不等人,中国市场验证端侧推理

AMD AI开发者日此前仅在旧金山举办,上海成为北美之外的首站,超过2000人的现场规模也印证了其重要性。苏姿丰在演讲中多次强调中国市场的重要性:AMD在华已超过30年,大中华区主要研发中心拥有超过4000名工程师,并在四地设立了AI卓越中心;今年恰逢上海研发中心成立二十周年。

AMD在中国所阐述的内容具有明确的指向性:端侧推理、开放生态、本地部署。这三个方向,在中国市场有着坚实的现实约束作为支撑。

现场演示了一个医疗场景:基于Ryzen AI Max的问诊系统,包含病例采集、知识图谱、患者简报三个Agent,所有数据均在本地处理,演示过程中甚至切断了WiFi。Jack Huynh指出,中国的医疗法规要求患者数据不能上云,本地推理在此场景下成为了合规的前提。

朱亦博也表达了类似判断:本地AI无需持续联网,响应更快,且不向云端发送数据。他相信未来将是端云协同的模式——本地模型处理高频、低延迟、隐私敏感的任务,复杂任务再调用云端大模型,从而大幅降低Token成本。

清华大学电子工程系教授、无问芯穹发起人汪玉则提出了“物理AI”的方向。他指出,机器人、无人机等设备的感知-决策-控制延迟要求达到毫秒级,算力必须在设备本地。无问芯穹与AMD合作开发的物理AI推理框架RLinf,在四个月内于GitHub上获得了超过3300个Star,并被超过20家公司采用。汪玉提出了一个公式:AI生产力 = 智能规模 × Token生产效率 × Token价值转化。其中,Token生产效率(每秒生成的Token数)直接与硬件和软件的协同优化相关,这也是AMD芯片在无问芯穹平台上被重点优化的方向。

苏姿丰预测,到2030年全球将有50亿人每日使用AI。Jack Huynh补充了一个对比:PC普及花了45年,互联网花了27年,智能手机花了15年,而AI的普及速度将远超此前任何技术。他透露,推理Token需求在2026年上半年比2025年同期增长了20倍,推理成本正在从一个技术问题演变为战略资源问题。

AMD在上海这场大会上释放的信号可以归结为:AI产业的下一个增长点正在向推理侧和端侧转移,算力将从集中的训练集群,散落到每一台设备、每一个工厂、每一个机器人中。在这个新阶段,单纯堆叠GPU数量不再是唯一答案,CPU的调度能力、软件栈的开放性、端侧部署的经济性,都成为了同等重要的竞争维度。AMD选择的路线——聚焦端侧推理、拥抱开放生态、推动本地部署——每一项都指向了当前市场领导者布局中的相对薄弱环节。两条技术路线都拥有各自的市场空间,但推理侧和端侧的增长速度,将最终决定这条差异化路线能走多远。

本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
硬件相关
相关文章 更多
精品专题 更多
装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

IOS软件

正软商城iOS软件专区,精选适用于iPhone和iPad的办公、学习、影音、设计、效率及AI应用,提供功能介绍、适用设备、系统要求和正版获取方式等信息。

AI

正软商城AI软件专区,汇集AI写作、AI绘画、AI视频、AI办公、AI编程、AI翻译、智能客服和数据分析等人工智能工具,提供功能介绍、适用平台、收费方式及正版购买信息。

PDF教程

PDF教程适合刚接触PDF文件的用户,本文整理PDF打开、编辑、转换、合并、压缩等常见基础操作。通过这些教程可以快速了解PDF文件怎么处理,解决办公、学习和资料科整理中的常见问题。使用极轻PDF可在线完成多种PDF操作,适合新手快速上手。

Mac软件 更多
灵活计算器
灵活计算器

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

图几
图几

图几是一款适用于 macOS 的截图、标注与美化工具,支持离线操作保障隐私。界面整理和高频系统操作被放到一起考虑,桌面或窗口内容一多时,管理起来会更省心。

密码键盘
密码键盘

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

思源笔记
思源笔记

思源笔记是一款本地笔记软件,提供所见即所得的编辑方式,为长文写作带来顺滑的体验。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

Office 365 简体中文
Office 365 简体中文

一款文字处理软件,一种订阅式的跨平台办公软件,基于云平台提供多种服务,通过将 Excel 和 Outlook 等应用与 OneDrive 和 Microsoft Teams 等强大的云服务相结合,Office 365 可让任何人使用任何设备随时随地创建和共享内容。

WALTR PRO
WALTR PRO

WALTR是一款电脑至iOS文件传输转换工具,操作简单,快速实现文件识别与传送。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

CodeExpander
CodeExpander

CodeExpander 是一款快捷短语输入增强工具,通过键入缩写自动展开为自定义文段,提升工作效率。任务管理和过程控制会更完整,持续下载、批量同步或需要稳定传输流程的场景会更适合它。

Mountain Duck
Mountain Duck

Mountain Duck 是一款能将多个网盘挂载到本地的工具,像本地磁盘一样使用网盘。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

Menuist
Menuist

Menuist 是一款面向 macOS 的 Finder 右键菜单增强工具,主要用来补充新建文件、快捷导航等常用操作,让日常文件管理和访问路径时更高效、更顺手。

Mole
Mole

Mole 是一款专为 Mac 设计的深度清理优化工具,涵盖缓存清理、应用管理及实时状态监控等功能。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

WINDOWS 更多
Windows 10
Windows 10

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

思源笔记
思源笔记

思源笔记是一款本地笔记软件,提供所见即所得的编辑方式,为长文写作带来顺滑的体验。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

傲梅轻松备份
傲梅轻松备份

傲梅轻松备份是一款专业易用的数据备份软件,为重要数据提供安全保障。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

Office 365 简体中文
Office 365 简体中文

一款文字处理软件,一种订阅式的跨平台办公软件,基于云平台提供多种服务,通过将 Excel 和 Outlook 等应用与 OneDrive 和 Microsoft Teams 等强大的云服务相结合,Office 365 可让任何人使用任何设备随时随地创建和共享内容。

Wise Folder Hider Pro
Wise Folder Hider Pro

Wise Folder Hider Pro 是一款专业级文件和文件夹隐藏加密软件,为私密数据添加多重保护。高频操作更强调就近处理,浏览、整理和跨目录移动文件时,来回切换和重复点击都会少很多。

WALTR PRO
WALTR PRO

WALTR是一款电脑至iOS文件传输转换工具,操作简单,快速实现文件识别与传送。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

CodeExpander
CodeExpander

CodeExpander 是一款快捷短语输入增强工具,通过键入缩写自动展开为自定义文段,提升工作效率。任务管理和过程控制会更完整,持续下载、批量同步或需要稳定传输流程的场景会更适合它。

PinStack
PinStack

PinStack是一款轻量级的Windows平台剪贴板管理工具,优化您的剪贴板使用体验。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

Mountain Duck
Mountain Duck

Mountain Duck 是一款能将多个网盘挂载到本地的工具,像本地磁盘一样使用网盘。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

Seer
Seer

Seer是一款在Win平台下的空格键功能增强效率工具,只需轻敲空格键,就能预览几乎任何格式的文件。它更适合把零散的小功能集中起来使用,处理高频琐碎任务时会更省事。