别再手敲重构了!Bun核心开发用一群Agent,11天把百万行代码从Zig改成Rust

别再手敲重构了!Bun核心开发用一群Agent,11天把百万行代码从Zig改成Rust 封面

别再手敲重构了!Bun核心开发用一群Agent,11天把百万行代码从Zig改成Rust

说实话,前两天我刷到一条消息,愣了三十秒。Bun 1.4 发布了,核心开发者 Jarred Sumner 干了一件事:用一群 AI Agent,把 Bun 底层超过 100 万行代码,从 Zig 语言整体重写成 Rust。耗时 11 天,6778 次提交,烧掉大约 16.5 万美元的 Token。

你没看错,是 100 万行,不是 100 行的演示。InfluxDB 创始人 Paul Dix 看完直接丢下一句:传统编程正在走向终结。

我第一反应是离谱。但冷静下来想,这件事真正吓人的地方,不是”AI 能写代码”,而是”AI 开始接管一整个工程师最怕的活:大规模重构和语言迁移”。今天这篇文章,我就把这套打法拆开,告诉你普通人怎么抄。

先搞清楚:Agent接管”重写”,底层到底变了什么

过去两年我们聊的”AI 写代码”,基本是两个形态。要么是补全几行,要么是让它按指令生成一个函数。说白了,它干的是”片段活”。

这次不一样。Bun 的做法是:先由人写一份迁移规格书,定义清楚 Zig 和 Rust 的映射规则、内存模型差异、哪些模块先动。然后放一群 Agent 并行上:每个 Agent 认领一个模块,照着规格书改,改完跑测试,不过就自己修,修不动再上报。

这已经不是”AI 辅助编程”,这是”AI 当包工头带着一队工人盖楼”。之前我们写过千问 Agent Teams 多 Agent 协同出片的实战(千问AgentTeams实测:你只当甲方),那套分工逻辑和今天 Bun 的包工头模式是同一个思路,只不过从”出片”换成了”改代码”。模型智能只是地基,真正值钱的是那套调度和验收机制。

实战工作流示意:Agent 分工改写代码库
实战工作流示意:Agent 分工改写代码库

实战场景:搭一套能跑通的自动重构工作流

你手头要是也有个老旧项目想迁语言、迁框架,别急着全量推倒。我给你一套照着能落地的流程,核心就四步。

痛点很明确:手动迁移 10 万行代码,三个月起步,还容易改出隐性 bug。人肉 Review 根本看不过来,改到后面自己都忘了前面改了啥。

第一步,写迁移规格书。把”从哪到哪、规则是什么”写死,这是 Agent 不跑偏的锚。

第二步,拆模块派活。按目录或功能切成小块,每块丢给一个 Agent,并行跑,别让它们挤一个上下文里互相干扰。

第三步,设验证门。每个模块改完必须过编译加单测,不过不让合并。这一步省了,后面全是雷。

第四步,人只做终审。你盯规格书和异常上报,不碰具体改码。调度和验收这套机制,跟 DeepSeek 开源的 Harness 把一切插件化的思路一致(DeepSeek Harness插件生态全梳理),本质都是把”怎么管 Agent”工程化,而不是指望模型一次写对。

这套流程跑下来,迁移效率大概是纯人肉的 6 到 10 倍,关键是不累人。你从”写代码的”变成了”验收代码的”。

三个能直接抄的指令模板

光说流程太空,给你三段真实能用的提示词。把下面的占位符换成你的项目就行。

模板一,迁移规格书:

你是要把项目从 {源语言} 迁移到 {目标语言} 的架构师。
先输出一份迁移规格书:列出模块清单、两种语言的关键差异、
内存与并发模型映射、禁止事项。不要改任何代码,只产出规则文档。

模板二,模块派活:

你是负责 {模块名} 的迁移 Agent。严格遵守规格书第 X 节。
改写该模块全部文件,保持对外接口签名不变。
每改完一个文件,运行 {测试命令},失败就自己修,
连续 3 次不过立刻上报,不要硬编。

模板三,验收门:

你是验收 Agent。对提交的 {模块名} 跑 {编译命令} 和 {单测命令},
输出通过/失败清单。失败时只报告,不要自动改。

记住一条铁律:接口签名写进规格书就锁死,Agent 改之前先读依赖清单,动接口必须走人工审批。

踩坑预警:接口跑偏与验收缺失
踩坑预警:接口跑偏与验收缺失

别踩这个坑:上下文一丢,Agent就瞎改

坑 1:现象是某个模块改完,接口签名悄悄变了,下游全崩。根因是 Agent 只看到自己那块,不知道别的模块依赖什么。长期跑任务的 Agent 自己纠错这件事,Fable 5.1 连干三天自己纠错的案例(Fable 5.1实测)已经验证过能行,但前提是你要给它清晰的验收标准,而不是让它自由发挥。

解法只有一条:规格书里把对外接口锁死,Agent 改之前先读依赖清单,改动接口必须走人工审批。谁跳过这步,谁的项目就准备半夜救火。

第二个坑:没有验证门,百万行等于百万个雷

坑 2:现象是 Agent 提交了一堆”能跑但不对”的代码,编译过了,逻辑错了。根因是只过了编译没过单测,或者压根没测试。我见过最惨的一次,Agent 把金额字段的类型从整数改成浮点,编译全过,上线三天才发现对账差了几毛钱,查了一周。

解法是验证门必须含单测加回归,宁可慢,不能放没有测试覆盖的提交进主干。宁可 Agent 跑得慢一点,也别让它蒙混过关。验收 Agent 不通过,这模块就不合并,就这么简单。

我的真心话:未来最值钱的不是写代码

回到开头那句话。Bun 这件事给我的震动,不是 AI 多能写,而是”验证和调度”成了新核心竞争力。一个开发者加一群 Agent,11 天重写百万行,省下的不是体力,是那些本来要熬到脱发的深夜。

如果你只记一句话,记这句:模型越来越便宜,会用 Agent 把脏活管起来的本事越来越贵。从你最怕的那个重构任务开始,照上面四步搭个小工作流,先跑通一个模块,再决定要不要 All in。

关注圈圈,持续带你玩转 AI 工具。

© 版权声明
THE END
喜欢就支持一下吧
点赞75 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容