细数AI程序员 Devin、SWE-agent、通义灵码、Devika...，“码农”要失业了吗？

本文主要是介绍细数AI程序员 Devin、SWE-agent、通义灵码、Devika...，“码农”要失业了吗？，希望对大家解决编程问题提供一定的参考价值，需要的开发者们随着小编来一起学习吧！

细数AI程序员 Devin、SWE-agent、通义灵码、Devika…，“码农”要失业了吗？

3月12日，美国AI初创公司Cognition AI在X平台发布一条视频，宣布了首位完全自主的AI程序员 Devin 的诞生。
在这里插入图片描述

第一位接近人类的 AI 程序员，究竟强在哪里？

不同于我们在前两年看到的 GitHub Copilot 等 AI 编程助手，Devin 并非单纯辅助的角色，而是能够完全独立、端到端地完成整个开发项目，包括从编写代码、修复 Bug 到最终执行的完整编程生命周期。

Devin 不仅能自主学习新技术，自己改Bug，甚至还能训练和微调自己的AI模型，表现已然远超GPT-4等“顶流选手”。

Cognition AI 对于 Devin 的定义是：世界上第一位完全自主的 AI 软件工程师。利用大模型能力已经掌握了全栈技能，仅需要人类给出自然语言指令，就可以自动完成复杂的代码任务。

在这里插入图片描述

目前用过 Devin 的少数用户，给出的实测感受基本都是赞赏有加：

Devin 从头开始构建一个网站，只要 5-10 分钟。
Devin 重复创建基于 Web 的经典乒乓球游戏，只要 5-10 分钟。
Devin 可构建一个小型 SMS 网站摘要器，并通过 Twilio 部署。
Devin 擅长项目原型设计、修复错误以及以图形形式显示复杂数据。
Devin 已经通过了一家行业领先 AI 公司的工程面试。
Devin 可以在自由职业平台 Upwork 接单：编写和调试代码来运行计算机视觉模型。Devin 有条不紊地设置代码仓库，解决版本冲突，从互联网下载图片供模型使用，采样结果数据，还编写了一份漂亮的报告，完美达到雇主需求。

Cognition AI 让 Devin 进行了一次编码基准测试 SWE-Bench，解决开源项目里真实存在的 GitHub 难题。

Devin 完全自力更生，端到端正确解决了其中的 13.86%，比起之前模型在辅助下的最好成绩 4.8%，这已经是非常大的进步了，甚至远远超过了 GPT-4、Claude2 等一众前辈。

在这里插入图片描述

随后的这两个月里，无数的 Devin 模仿者横空出世。

OpenDevin：3月13日（Devin 发布第二天）首次出现了 Devin 克隆版本 OpenDevin：
https://github.com/OpenDevin/OpenDevin
AutoDev：3 月 13 日，微软提交了一篇关于全自动软件开发框架的论文AutoDev，还介绍了多智能体协同（Multi-Agent）的概念。
https://arxiv.org/pdf/2403.08299.pdf
AutoCoder：AutoCoder是国人祝威廉团队在 3 月 18 日首次发布的命令行版 Devin。
https://github.com/allwefantasy/auto-coder
Devika：3月21日，Devin 开源竞品 Devik问世。
Devika 是一个富有主动性的AI软件工程师，依托于Claude 3能够理解人类的高级指令，把这些指令分解成具体步骤，搜集所需的信息，并据此编写代码来完成既定目标。

https://github.com/stitionai/devika
在这里插入图片描述

通义灵码：4月2日，国内首个AI程序员“通义灵码”入职阿里云：专属工号AI001。
SWE-agent：4月3日，普林斯顿大学的NLP团队开发了一个开源AI程序员SWE-agent，它利用GPT-4模型在GitHub存储库中自动解决问题。SWE-agent在SWE-bench测试集上的表现与Devin相似，平均耗时93秒，解决了12.29%的问题。SWE-agent通过与专用终端交互，可以打开、搜索文件内容，使用自动语法检查、编辑特定行，以及编写和执行测试。
https://github.com/princeton-nlp/SWE-agent
Replit Teams：初创公司 Replit 将在 4 月 9 日发布的 Devin 竞品。