细数AI程序员 Devin、SWE-agent、通义灵码、Devika...,“码农”要失业了吗?

2024-04-17 12:12

本文主要是介绍细数AI程序员 Devin、SWE-agent、通义灵码、Devika...,“码农”要失业了吗?,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

细数AI程序员 Devin、SWE-agent、通义灵码、Devika…,“码农”要失业了吗?

1. 全球首位AI工程师:Devin

3月12日,美国AI初创公司Cognition AI在X平台发布一条视频,宣布了首位完全自主的AI程序员 Devin 的诞生。
在这里插入图片描述

第一位接近人类的 AI 程序员,究竟强在哪里?

不同于我们在前两年看到的 GitHub Copilot 等 AI 编程助手,Devin 并非单纯辅助的角色,而是能够完全独立、端到端地完成整个开发项目,包括从编写代码、修复 Bug 到最终执行的完整编程生命周期。

Devin 不仅能自主学习新技术,自己改Bug,甚至还能训练和微调自己的AI模型,表现已然远超GPT-4等“顶流选手”。

Cognition AI 对于 Devin 的定义是:世界上第一位完全自主的 AI 软件工程师。利用大模型能力已经掌握了全栈技能,仅需要人类给出自然语言指令,就可以自动完成复杂的代码任务。

在这里插入图片描述

目前用过 Devin 的少数用户,给出的实测感受基本都是赞赏有加:

  • Devin 从头开始构建一个网站,只要 5-10 分钟。
  • Devin 重复创建基于 Web 的经典乒乓球游戏,只要 5-10 分钟。
  • Devin 可构建一个小型 SMS 网站摘要器,并通过 Twilio 部署。
  • Devin 擅长项目原型设计、修复错误以及以图形形式显示复杂数据。
  • Devin 已经通过了一家行业领先 AI 公司的工程面试。
  • Devin 可以在自由职业平台 Upwork 接单:编写和调试代码来运行计算机视觉模型。Devin 有条不紊地设置代码仓库,解决版本冲突,从互联网下载图片供模型使用,采样结果数据,还编写了一份漂亮的报告,完美达到雇主需求。

Cognition AI 让 Devin 进行了一次编码基准测试 SWE-Bench,解决开源项目里真实存在的 GitHub 难题。

Devin 完全自力更生,端到端正确解决了其中的 13.86%,比起之前模型在辅助下的最好成绩 4.8%,这已经是非常大的进步了,甚至远远超过了 GPT-4、Claude2 等一众前辈。

在这里插入图片描述

随后的这两个月里,无数的 Devin 模仿者横空出世。

  1. OpenDevin:3月13日(Devin 发布第二天)首次出现了 Devin 克隆版本 OpenDevin:
    https://github.com/OpenDevin/OpenDevin
    在这里插入图片描述

  2. AutoDev:3 月 13 日,微软提交了一篇关于全自动软件开发框架的论文AutoDev,还介绍了多智能体协同(Multi-Agent)的概念。
    https://arxiv.org/pdf/2403.08299.pdf
    在这里插入图片描述

  3. AutoCoder:AutoCoder是国人祝威廉团队在 3 月 18 日首次发布的命令行版 Devin。
    https://github.com/allwefantasy/auto-coder
    在这里插入图片描述

  4. Devika:3月21日,Devin 开源竞品 Devik问世。
    Devika 是一个富有主动性的AI软件工程师,依托于Claude 3能够理解人类的高级指令,把这些指令分解成具体步骤,搜集所需的信息,并据此编写代码来完成既定目标。

https://github.com/stitionai/devika
在这里插入图片描述

  1. 通义灵码:4月2日,国内首个AI程序员“通义灵码”入职阿里云:专属工号AI001。

  2. SWE-agent:4月3日,普林斯顿大学的NLP团队开发了一个开源AI程序员SWE-agent,它利用GPT-4模型在GitHub存储库中自动解决问题。SWE-agent在SWE-bench测试集上的表现与Devin相似,平均耗时93秒,解决了12.29%的问题。SWE-agent通过与专用终端交互,可以打开、搜索文件内容,使用自动语法检查、编辑特定行,以及编写和执行测试。
    https://github.com/princeton-nlp/SWE-agent
    在这里插入图片描述

  3. Replit Teams:初创公司 Replit 将在 4 月 9 日发布的 Devin 竞品。

2. 普林斯顿首个开源AI程序员:SWE-agent

程序员请 AI 代劳自己的工作,不只是 Cognition AI 一家的想法。

4月3日,来自普林斯顿大学 NLP 组的研究人员放出了一个开源版 AI 程序员——SWE-agent,不到一天就获得了上千的 GitHub Star 量。

SWE-agent 是一款用于自主解决 GitHub 存储库中问题的新系统。

在这里插入图片描述

项目网站:https://swe-agent.com/
GitHub:https://github.com/princeton-nlp/SWE-agent

在SWE-agent上,团队主要设计了这些功能:

  • 创建文件查看和编辑器,可以打开、滚动和编辑文件。结果发现每轮只显示100行时效果最佳。
  • 通过自动语法检查编辑特定行。如果代码语法不正确,就不让编辑命令通过。当命令输出为空时会返回一条信息:”您的命令运行成功,但未产生任何输出”。
  • 编写和执行测试。目前使用SWE-agent主要有两个步骤:
  1. 第一步:推理。SWE-agent接收一个输入的GitHub问题,并返回一个试图修复该问题的拉取请求。
  2. 第二步:评估拉取请求,以验证它是否确实修复了问题。(目前仅适用于 SWE-bench 基准中的问题)。

在这里插入图片描述

图注:SWE-agent示例

在SWE-bench测试集上,SWE-agent 成功解决了 12.29% 的问题,平均耗时只有93秒,准确率堪比Devin(13.84%)。

在这里插入图片描述

研究人员专门为大语言模型设计了简洁的指令和反馈格式——智能体-计算机接口(ACI),从而让模型能够更轻松地浏览代码仓库、查看、编辑和运行代码文件。

通过智能体计算机接口(ACI),SWE-agent 让LLM有了与专属的Docker容器互动,实现浏览、搜索、编辑和执行代码的功能,从而极大地拓宽了LLM在软件开发领域的应用范围。

在这里插入图片描述

研究团队表示,他们将在4月10号发布论文。

3. 国内首个AI程序员:通义灵码

4月2日,国内首个AI程序员“通义灵码”入职阿里云:专属工号AI001。
在这里插入图片描述

「通义灵码」由阿里云和通义实验室联合开发,目前下载量超过 200 万,每天都有数百万行代码被人类程序员采纳。

在这里插入图片描述

AI程序员「通义灵码」在阿里云担任「代码助理」,具备扎实的编程基础,深入学习过万亿量级的代码数据,目前能熟练使用 200 多种编程语言,精通其中 16 种语言,包括 Java、Python、Go、JavaScript、TypeScript、C/C++、C# 等主流语言。

「通义灵码」可优化代码、生成测试框架和用例,提高工作效率。

「通义灵码」还有一点优势:支持企业级代码库专项训练,能够更好理解企业的代码和文档数据,并支持国产化适配。

未来 20% 阿里云代码将由其编写,但程序员仍为核心。

在这里插入图片描述

图注:通义灵码可以迅速写出单元测试

在这里插入图片描述

图注:通义灵码具备研发智能问答、异常报错排查等能力

阿里云宣布,通义灵码在通义千问 APP 上线, 免费向全民开放,所有人可以随时随地在手机上写代码、读代码、学习编程技能。

在这里插入图片描述

随着像Devin、Devika和OpenDevin这样的AI软件工程师的兴起,我们已经见证了AI在编程方面的巨大潜力。

这些AI不仅能够规划和执行复杂的工程任务,还能找出并修复漏洞,甚至负责整个项目的开发流程。然而,当面对复杂的现有代码库并追求编写安全代码时,情况变得更加复杂。

虽然我们尚未达到AI能够完全取代软件工程师的阶段,但AI无疑正在改变技术领域的面貌和未来的走向。

AI与程序员相互促进,共同学习。

参考:
https://finance.sina.cn/2024-04-05/detail-inaqurrr9584546.d.html

欢迎各位关注我的个人微信公众号:HsuDan,我将分享更多自己的学习心得、避坑总结、面试经验、AI最新技术资讯。

这篇关于细数AI程序员 Devin、SWE-agent、通义灵码、Devika...,“码农”要失业了吗?的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/911771

相关文章

Ilya-AI分享的他在OpenAI学习到的15个提示工程技巧

Ilya(不是本人,claude AI)在社交媒体上分享了他在OpenAI学习到的15个Prompt撰写技巧。 以下是详细的内容: 提示精确化:在编写提示时,力求表达清晰准确。清楚地阐述任务需求和概念定义至关重要。例:不用"分析文本",而用"判断这段话的情感倾向:积极、消极还是中性"。 快速迭代:善于快速连续调整提示。熟练的提示工程师能够灵活地进行多轮优化。例:从"总结文章"到"用

AI绘图怎么变现?想做点副业的小白必看!

在科技飞速发展的今天,AI绘图作为一种新兴技术,不仅改变了艺术创作的方式,也为创作者提供了多种变现途径。本文将详细探讨几种常见的AI绘图变现方式,帮助创作者更好地利用这一技术实现经济收益。 更多实操教程和AI绘画工具,可以扫描下方,免费获取 定制服务:个性化的创意商机 个性化定制 AI绘图技术能够根据用户需求生成个性化的头像、壁纸、插画等作品。例如,姓氏头像在电商平台上非常受欢迎,

从去中心化到智能化:Web3如何与AI共同塑造数字生态

在数字时代的演进中,Web3和人工智能(AI)正成为塑造未来互联网的两大核心力量。Web3的去中心化理念与AI的智能化技术,正相互交织,共同推动数字生态的变革。本文将探讨Web3与AI的融合如何改变数字世界,并展望这一新兴组合如何重塑我们的在线体验。 Web3的去中心化愿景 Web3代表了互联网的第三代发展,它基于去中心化的区块链技术,旨在创建一个开放、透明且用户主导的数字生态。不同于传统

AI一键生成 PPT

AI一键生成 PPT 操作步骤 作为一名打工人,是不是经常需要制作各种PPT来分享我的生活和想法。但是,你们知道,有时候灵感来了,时间却不够用了!😩直到我发现了Kimi AI——一个能够自动生成PPT的神奇助手!🌟 什么是Kimi? 一款月之暗面科技有限公司开发的AI办公工具,帮助用户快速生成高质量的演示文稿。 无论你是职场人士、学生还是教师,Kimi都能够为你的办公文

Andrej Karpathy最新采访:认知核心模型10亿参数就够了,AI会打破教育不公的僵局

夕小瑶科技说 原创  作者 | 海野 AI圈子的红人,AI大神Andrej Karpathy,曾是OpenAI联合创始人之一,特斯拉AI总监。上一次的动态是官宣创办一家名为 Eureka Labs 的人工智能+教育公司 ,宣布将长期致力于AI原生教育。 近日,Andrej Karpathy接受了No Priors(投资博客)的采访,与硅谷知名投资人 Sara Guo 和 Elad G

AI hospital 论文Idea

一、Benchmarking Large Language Models on Communicative Medical Coaching: A Dataset and a Novel System论文地址含代码 大多数现有模型和工具主要迎合以患者为中心的服务。这项工作深入探讨了LLMs在提高医疗专业人员的沟通能力。目标是构建一个模拟实践环境,人类医生(即医学学习者)可以在其中与患者代理进行医学

AI行业应用(不定期更新)

ChatPDF 可以让你上传一个 PDF 文件,然后针对这个 PDF 进行小结和提问。你可以把各种各样你要研究的分析报告交给它,快速获取到想要知道的信息。https://www.chatpdf.com/

【北交大信息所AI-Max2】使用方法

BJTU信息所集群AI_MAX2使用方法 使用的前提是预约到相应的算力卡,拥有登录权限的账号密码,一般为导师组共用一个。 有浏览器、ssh工具就可以。 1.新建集群Terminal 浏览器登陆10.126.62.75 (如果是1集群把75改成66) 交互式开发 执行器选Terminal 密码随便设一个(需记住) 工作空间:私有数据、全部文件 加速器选GeForce_RTX_2080_Ti

AI Toolkit + H100 GPU,一小时内微调最新热门文生图模型 FLUX

上个月,FLUX 席卷了互联网,这并非没有原因。他们声称优于 DALLE 3、Ideogram 和 Stable Diffusion 3 等模型,而这一点已被证明是有依据的。随着越来越多的流行图像生成工具(如 Stable Diffusion Web UI Forge 和 ComyUI)开始支持这些模型,FLUX 在 Stable Diffusion 领域的扩展将会持续下去。 自 FLU

AI基础 L9 Local Search II 局部搜索

Local Beam search 对于当前的所有k个状态,生成它们的所有可能后继状态。 检查生成的后继状态中是否有任何状态是解决方案。 如果所有后继状态都不是解决方案,则从所有后继状态中选择k个最佳状态。 当达到预设的迭代次数或满足某个终止条件时,算法停止。 — Choose k successors randomly, biased towards good ones — Close