AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

英伟达推出开源AI框架Polar 可使Codex性能提升近600%

英伟达研究团队于2026年5月28日发布开源AI框架Polar,支持现有代码智能体框架Codex、Claude Code、Qwen Code等无缝接入广义相对策略优化(GRPO)强化学习技术,无需改动原有工具调用、上下文组织逻辑,实测可使Codex性能提升近600%,大幅降低代码智能体的强化学习训练落地门槛。

配图

---

当前代码智能体已经成为AI赛道的核心布局方向,OpenAI Codex、Anthropic Claude Code、通义Qwen Code等产品已广泛落地代码补全、缺陷修复等场景,但性能优化长期面临瓶颈:监督学习只能拟合已有样本,难以适配多步决策的复杂开发任务;强化学习虽能通过奖励信号迭代策略,却要求重构智能体的工具调用、上下文管理等核心模块,改造成本极高,中小研发团队普遍无力承担。

英伟达此次推出的Polar框架,核心价值就是解决了强化学习的兼容难题。框架采用外挂式调度层设计,不需要改动原有智能体的工具调用、上下文组织、补丁提交流程,就能直接接入广义相对策略优化(GRPO)训练方案。

GRPO是英伟达团队研发的专属强化学习优化技术,专门针对长流程多步决策任务优化,通过动态调整的奖励信号校准模型策略,大幅降低了传统强化学习训练容易出现的奖励偏移、收敛不稳定问题。实测数据显示,接入Polar框架后,Codex在代码调试、多轮协作开发等复杂任务中的性能提升近600%,整体训练成本仅为传统改造方案的1/10。

据了解,Polar框架目前已完全开源,所有开发者均可免费获取使用。英伟达团队透露,后续还将逐步扩展Polar的适配范围,覆盖办公智能体、机器人决策智能体等更多品类的AI智能体产品。

业内分析人士指出,Polar相当于为现有所有智能体产品提供了一个“即插即用”的性能强化插件,不需要重构核心代码就能实现性能跃升,有望推动整个AI智能体行业的迭代速度提升3-5倍,未来复杂场景下的智能体落地周期将从原先的半年以上缩短至1个月左右。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。