OpenAI最新研究表明 当前AI模型仍无法媲美人类程序员

星夢妙者
发布: 2025-02-25 12:02:19
原创
967人浏览过

openai 最新研究表明:ai 编程能力仍逊于人类程序员,即使是最先进的模型也无法胜任大多数编程任务。

OpenAI CEO 萨姆·奥尔特曼曾预测,AI 模型将在年底超越“低级别”软件工程师。然而,OpenAI 研究人员近期发表的论文却挑战了这一说法。研究人员使用名为 SWE-Lancer 的新基准测试工具(基于 Upwork 上 1400 多个软件工程任务)对 o1、GPT-4o 和 Claude 3.5 Sonnet 三款大型语言模型 (LLMs) 进行了评估。

OpenAI最新研究表明 当前AI模型仍无法媲美人类程序员

SWE-Lancer 基准测试涵盖两类任务:独立任务(修复漏洞)和管理任务(高层次决策)。测试中,模型无法访问互联网,避免直接抄袭现有答案。

结果显示,虽然这些 LLM 完成任务的速度远超人类,但它们只能解决一些表面问题,无法深入理解漏洞的根本原因,提供的解决方案往往“错误或不完整”。这些“半成品”解决方案,对于熟悉 AI 协作的人来说并不陌生——AI 擅长生成看似合理的答案,但经不起仔细推敲。

OpenAI最新研究表明 当前AI模型仍无法媲美人类程序员

Claude 3.5 Sonnet 的表现优于 o1 和 GPT-4o,但在多数情况下答案仍然是错误的。研究人员强调,实际应用中,AI 模型需要具备更高的可靠性。

总而言之,这项研究表明,尽管先进的 LLM 能够快速处理一些细节任务,但其编程能力远不及人类工程师。虽然 LLM 技术不断进步,但目前仍不足以取代人类程序员。然而,令人担忧的是,一些 CEO 已经开始解雇人类程序员,转而使用这些尚不成熟的 AI 模型。

以上就是OpenAI最新研究表明 当前AI模型仍无法媲美人类程序员的详细内容,更多请关注php中文网其它相关文章!

豆包AI编程
豆包AI编程

智能代码生成与优化,高效提升开发速度与质量!

下载
相关标签:
来源:php中文网
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn
最新问题
开源免费商场系统广告
热门教程
更多>
最新下载
更多>
网站特效
网站源码
网站素材
前端模板
关于我们 免责申明 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送
PHP中文网APP
随时随地碎片化学习
PHP中文网抖音号
发现有趣的

Copyright 2014-2025 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号