近日,OpenAI工程师Ryan Lopopolo公开了一项特殊AI编程实验,实验全程遵循“零人工手写代码”规则,完全依赖OpenAI的Codex大模型完成开发任务。实验初期模型处理复杂逻辑能力不足,开发效率仅为人工开发的十分之一,最终团队仍产出规模达百万行的代码工具库Symphony,摸索出AI智能体参与软件工程的全新协作模式。
Ryan Lopopolo在长文《Harness engineering》中,公开了这场内部实验的完整过程。实验核心规则非常苛刻:人类工程师绝对不手写任何一行代码,所有开发工作都交给由Codex驱动的AI智能体完成,人工只负责提出需求、校准方向。
实验初期的推进远低于预期,由于大模型本身对长链路复杂逻辑的处理能力有限,智能体每完成一轮需求迭代都需要反复修正,整体开发速度仅为人工开发的十分之一,项目推进一度陷入停滞。
为了让AI智能体能够独立完成全流程开发,OpenAI团队被迫打磨出一套精细的Harness开发台体系,其中最核心的设计要求是将智能体的单次构建反馈时间死守在一分钟以内。
极致的反馈速度给了智能体快速试错的空间,开发效率随着模型迭代开始呈现指数级增长。随着GPT系列推理模型能力升级,这套基于AI智能体的开发体系,最终产出效率远超单一工程师团队,成功完成了规模达百万行的代码工具库Symphony的开发。由于全程没有人工手写核心代码,这个工具库也被团队称为“幽灵库”。
当前行业内AI编程的主流定位还是辅助工具:帮助开发者补全代码片段、修复小型bug、生成注释,核心开发工作依然由人类完成。而这场零人工写码实验,探索出了一种完全不同的协作模式:人类工程师将开发经验蒸馏给AI智能体,让智能体承担全流程编码工作,成为对等的开发队友,而非辅助工具。
这种新的工作模式,也为大型软件工程的AI转型提供了新的思路,随着大模型推理能力的持续提升,未来人类负责架构决策、AI负责全流程编码的分工,或许会成为更多研发团队的选择。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。