AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

英伟达发布RTX Spark技术 消费级PC端侧AI可脱离云端运行

近日英伟达正式推出RTX Spark技术框架,可让搭载RTX系列显卡的消费级PC脱离云端算力支持,本地运行定制微调的大语言模型与AI智能体。目前全球已有超1亿台搭载RTX显卡的终端符合端侧AI运行要求,该技术在延迟、隐私性上的优势,有望重构消费级AI应用的落地逻辑。

配图

过去两年消费级AI应用几乎都绑定云端算力:用户调用ChatGPT生成内容、用AI修图工具处理素材时,所有数据都要上传至厂商云端服务器处理,不仅受网络波动影响经常出现延迟卡顿,敏感工作数据、个人隐私信息上传泄露的风险也始终存在,用户对本地运行AI的需求正在快速攀升。

随着生成式AI应用向个人场景渗透,云端部署的短板越来越突出:一方面公共网络环境不稳定时,AI工具的响应速度会大幅下降,户外、差旅等无网场景下更是完全无法使用;另一方面,用户如果将包含商业机密的工作文档、个人健康信息等敏感数据上传至第三方云端,很容易出现数据泄露风险。

此前受限于消费级终端的算力天花板,端侧AI只能运行参数极低的轻量化模型,生成效果远达不到可用标准,市场始终没有出现规模化的落地方案。

本次英伟达推出的RTX Spark技术框架,核心就是解决大语言模型在消费级显卡上的运行效率问题。据官方披露的测试数据,搭载RTX 40系列显卡的笔记本电脑,运行7B参数的开源大语言模型时,推理速度可达30token/秒,基本等同于常规云端调用的响应速度,已经能满足日常文案生成、信息检索、智能助理交互的需求。

更重要的是,该技术支持用户本地微调专属模型:用户可以将自己的工作文档、学习资料、日程记录导入模型完成微调,所有数据全程保存在本地终端,完全不会上传至外部服务器,从根源上解决了隐私泄露的隐患。目前全球已有超1亿台搭载RTX系列显卡的消费级PC符合该技术的运行要求,用户无需更换硬件即可体验端侧AI能力,落地门槛大幅降低。

业内人士指出,RTX Spark的推出并不意味着云端算力会被取代,而是推动AI应用形成“端云协同”的成熟架构:日常高频、隐私性高的轻量化需求由端侧算力承接,需要大算力支持的多模态生成、复杂推理任务则调用云端算力,两者结合既保证了用户体验,也能降低厂商的云端算力成本。

对于英伟达而言,该技术也进一步巩固了其在AI算力领域的生态优势:此前英伟达的核心优势集中在云端训练算力市场,现在通过RTX Spark打开消费级端侧AI的入口,有望打通从训练到推理、从云端到终端的全链条AI生态,重塑整个消费级AI市场的竞争格局。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。