问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
AMD近期正式发布锐龙Pro 9000系列工作站级处理器,全系搭载最新Zen5架构与3D V-Cache堆叠缓存技术,相较上一代产品单线程性能提升16%,多线程性能提升28%,面向本地AI工作站、专业内容创作等场景优化,本地7B参数大语言模型推理速度最高提升40%,预计将率先登陆戴尔、惠普等品牌的商用工作站产品线。
据IDC发布的2024年上半年商用终端报告,国内AI工作站出货量同比上涨127%,其中82%的企业采购方明确表示,工作站需要支持本地运行7B及以上参数的大语言模型,且核心数据不能上传公有云。这一需求也倒逼上游芯片厂商加速升级桌面级处理器的AI算力表现,AMD此次推出的锐龙Pro 9000系列正是瞄准这一市场缺口。
过去几年,企业端的AI应用大多依赖云端算力支持,但对于工业设计、医药研发、涉密内容创作等场景而言,数据上传云端存在极高的安全风险,而传统工作站CPU受限于缓存容量、指令集架构,跑AI推理时需要频繁调取内存数据,延迟往往是云端的3-5倍,根本无法满足实时交互的需求。
此前行业的普遍解决方案是在工作站中搭载高端独立显卡来完成AI计算,但单张AI专业卡的采购成本动辄数万元,远超出中小团队的预算范围,性价比极低。
此次AMD推出的锐龙Pro 9000系列,最大的升级点就是将消费端已经验证成熟的3D V-Cache技术下放到商用工作站产品线,全系最高配备128MB堆叠缓存,相比上一代同级别产品缓存容量翻倍,大模型推理时需要调用的权重数据可以直接存储在缓存中,不需要反复调取内存,延迟降低60%以上。
同时Zen5架构新增了对AVX-512 AI专用加速指令集的支持,不需要独立显卡,仅靠CPU就能实现7B参数大语言模型每秒8token以上的推理速度,运行14B参数的轻量模型也能达到每秒3-4token,完全可以满足日常AI代码生成、AI内容润色、AI设计出图的需求。
根据官方测试数据,锐龙Pro 9000系列在专业内容创作场景的性能比上一代提升32%,AI辅助视频渲染的速度提升41%,整体功耗反而降低了12%,适合长时间高负载运行的工作站使用场景。
此前AI算力的升级主要集中在云端数据中心,但随着终端芯片的AI性能不断提升,算力下沉已经成为明确的行业趋势。AMD相关负责人表示,未来会把更多AI加速技术下放到商用甚至消费级产品线,让更多中小团队、个人开发者不需要采购昂贵的专业硬件,就能在本地完成AI模型的微调、推理工作。
有行业分析师预测,到2025年底,支持本地运行7B以上参数大模型的商用PC、工作站渗透率将超过40%,AI应用的落地门槛会进一步降低。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。