资讯

英伟达推出开源 AI 框架 Polar，Codex 性能提升近 600%

2026年05月28日 11:20

本文共计877个字，预计阅读时长3分钟。

来源/aibase 责编/huazi56 爱力方

英伟达研究团队近日发布了一个全新的开源 AI 框架 ——Polar。该框架旨在帮助现有的智能体框架（如 Codex、Claude Code、Qwen Code）接入一种名为广义相对策略优化（GRPO）的训练方法，而不影响其原有的工具调用、上下文组织和补丁提交方式。这一创新将大大提升代码智能体的表现。

GRPO 是一种针对强化学习的优化技术，它通过奖励信号来调整模型策略，帮助模型在多步决策任务中学习到更优的行为。在这项研究中，GRPO 主要用于代码智能体的训练，旨在让模型在实际的工具调用和补丁提交流程中不断改进表现。

研究表明，智能体的强化学习正在逐步从单步任务转向更复杂的长流程任务，例如代码仓库的、浏览器操作以及操作系统的交互。这类任务往往依赖于现有的执行框架，涉及多轮调用、工具使用以及上下文管理等，因此直接将这些框架改写为传统的强化学习环境接口非常困难，可能导致关键训练信号的丢失。

英伟达的 Polar 框架并不试图重写智能体框架，而是通过在模型 API 的边界处放置智能体，保持原有运行逻辑不变。Polar 在执行框架与推理服务器之间了模型智能体，兼容多种请求风格，能够记录关键数据并将其转化为可用于训练的信息。

从系统架构来看，Polar 包括了任务提交、会话调度和状态持久化等功能，通过优化初始化、运行和后处理的流程，显著提升了训练效率。根据实验结果，使用 Polar 与 GRPO 训练的智能体在 SWE-Bench Verified 测试中的性能大幅提升，Codex 的 pass@1 分数从 3.8% 提升至 26.4%，增长幅度达 594.74%。

此外，该框架在提高效率方面也表现出色，训练时间减少了约 5.39 倍，GPU 的平均利用率也显著提升，为未来的智能体训练提供了更强大的支持。

划重点：

英伟达发布了开源 AI 框架 Polar，助力 Codex 等智能体框架接入新训练方法。

Codex 的性能在最新测试中大幅提升，pass@1 分数增长 594.74%。

Polar 优化训练效率，显著减少了训练时间与资源消耗。

来源：英伟达推出开源 AI 框架 Polar，Codex 性能提升近 600% | AIbase

声明：本文来自aibase，版权归作者所有。文章内容仅代表作者独立观点，不代表爱力方立场，转载目的在于传递更多信息。如有侵权，请联系 copyright#agent.ren。

TAGS: 英伟达 Polar AI框架 Codex 性能提升

热门资讯

微软开源项目遭黑客入侵，多款AI开发工具被植入密码窃取软件

匿名

2026-06-09

·

846 浏览
LabVLA：浙大与上海AI Lab联合探索科学具身智能，推动AI进入实验室

匿名

2026-06-26

·

790 浏览
通义实验室联合开源首个统一科学大模型LOGOS，1B参数性能超越NatureLM

匿名

2026-06-18

·

788 浏览
富士通推出PHOTON新架构，性能提升475倍以应对AI算力瓶颈

匿名

2026-06-26

·

612 浏览
世界模型到底在建模什么

匿名

2026-06-29

·

560 浏览
余承东发声，鸿蒙智能将迈向Agent时代

匿名

2026-06-12

·

543 浏览

通知

尊敬的用户

user

资讯

英伟达推出开源 AI 框架 Polar，Codex 性能提升近 600%

英伟达推出开源 AI 框架 Polar，Codex 性能提升近 600%

相关图文

黄仁勋穿过的黑色皮夹克将拍卖：有亲笔签名，预计成交价4万-6万美元（约27万-40万元人民币）

利好来袭！突然集体飙涨！英伟达、特斯拉传出大动作

英伟达发布Nemotron-Labs-TwoTower扩散语言模型性能提升超两倍

AI芯片独角兽Etched融资成功，估值升至50亿美元。

Anthropic发布Claude Sonnet 5，性能逼近Opus 4.8、价格降低60%；英伟达老款GPU RTX 3060重新在美上市

“大空头”伯里再次向AI宣战：不仅做空英伟达，还做空卡特彼勒

热门资讯

微软开源项目遭黑客入侵，多款AI开发工具被植入密码窃取软件

LabVLA：浙大与上海AI Lab联合探索科学具身智能，推动AI进入实验室

通义实验室联合开源首个统一科学大模型LOGOS，1B参数性能超越NatureLM

富士通推出PHOTON新架构，性能提升475倍以应对AI算力瓶颈

世界模型到底在建模什么

余承东发声，鸿蒙智能将迈向Agent时代

快讯

周末要闻汇总：国常会部署加快新一代通信网、算力网建设长江存储IPO有最新进展

新产品配套英伟达产业链液冷概念股3天2板本周机构密集调研相关上市公司

2026世界人工智能大会期间，上海部分道路和区域将实施交通管制

上海发布两项通告加强2026世界人工智能大会安全管理

人民锐评：AI智能荐股？投资没有一键致富！

手机成为大模型竞争新赛场 AI超级载体利好哪些硬件环节

周末要闻 | 国常会要求加快新一代通信网和算力网建设

白林松：当世界聚焦“规模化创新”，创意科技正把AI带入物理世界

中国第二届“绿色光疗·孝爱同行”健康发展大会暨康企集团七周年AI健康公益盛典圆满落幕

30万内智驾SUV横评：四款车功能体验落差谁最小？

推荐专栏

爱力方

机器人大讲堂

下一篇

user

资讯

英伟达推出开源 AI 框架 Polar，Codex 性能提升近 600%

英伟达推出开源 AI 框架 Polar，Codex 性能提升近 600%

相关图文

黄仁勋穿过的黑色皮夹克将拍卖：有亲笔签名，预计成交价4万-6万美元（约27万-40万元人民币）

利好来袭！突然集体飙涨！英伟达、特斯拉传出大动作

英伟达发布Nemotron-Labs-TwoTower扩散语言模型 性能提升超两倍

AI芯片独角兽Etched融资成功，估值升至50亿美元。

Anthropic发布Claude Sonnet 5，性能逼近Opus 4.8、价格降低60%；英伟达老款GPU RTX 3060重新在美上市

“大空头”伯里再次向AI宣战：不仅做空英伟达，还做空卡特彼勒

热门资讯

微软开源项目遭黑客入侵，多款AI开发工具被植入密码窃取软件

LabVLA：浙大与上海AI Lab联合探索科学具身智能，推动AI进入实验室

通义实验室联合开源首个统一科学大模型LOGOS，1B参数性能超越NatureLM

富士通推出PHOTON新架构，性能提升475倍以应对AI算力瓶颈

世界模型到底在建模什么

余承东发声，鸿蒙智能将迈向Agent时代

快讯

周末要闻汇总：国常会部署加快新一代通信网、算力网建设 长江存储IPO有最新进展

新产品配套英伟达产业链 液冷概念股3天2板 本周机构密集调研相关上市公司

2026世界人工智能大会期间，上海部分道路和区域将实施交通管制

上海发布两项通告 加强2026世界人工智能大会安全管理

人民锐评：AI智能荐股？投资没有一键致富！

手机成为大模型竞争新赛场 AI超级载体利好哪些硬件环节

周末要闻 | 国常会要求加快新一代通信网和算力网建设

白林松：当世界聚焦“规模化创新”，创意科技正把AI带入物理世界

中国第二届“绿色光疗·孝爱同行”健康发展大会暨康企集团七周年AI健康公益盛典圆满落幕

30万内智驾SUV横评：四款车功能体验落差谁最小？

推荐专栏

爱力方

机器人大讲堂

下一篇

英伟达发布Nemotron-Labs-TwoTower扩散语言模型性能提升超两倍

周末要闻汇总：国常会部署加快新一代通信网、算力网建设长江存储IPO有最新进展

新产品配套英伟达产业链液冷概念股3天2板本周机构密集调研相关上市公司

上海发布两项通告加强2026世界人工智能大会安全管理