Claude、Codex、DeepSeek、GLM…… 并排跑,也可以组队干活。一个开源桌面工作台,把一堆大模型变成一支你说了算的队伍。
大多数 AI 编码工具给你的是:一个 agent、一个编辑器、一个目录、一家厂商。这套够用 —— 直到活儿大过一个 agent、下午额度用光、或者你想在留下改动前先看清它到底动了什么。
AgentLoom 的前提正好相反:很多项目、多个模型、好几个 agent 同时在干活,全都在你自己的机器上,由你说了算。
给一个 agent 戴上皇冠当队长(Claude 或 Codex,它们擅长规划),再配几个便宜模型当队员。队长拆解目标、并行派活、检查交回来的东西、把对不上的地方改掉。几个文件同时在推进,而不是一个一个来 —— 而贵价钱你只花在「想」这一步上。
下午 Claude 额度用完了?把这个会话切到 GLM、DeepSeek 或者一个本地模型接着干 —— 同一段对话、同一份上下文,不用复制粘贴。换厂商是点一下下拉菜单,不是搬一次家。会话聊长了想开新的,AgentLoom 会替你写好交接说明,新会话直接接上。
AgentLoom 自带一个用 Rust 写的 agent 引擎 myagent,不装 Claude Code、Codex 或别家 CLI 也能跑。它给任何一家厂商配上跟贵价 CLI 同样的工具循环、plan 模式和 checkpoint —— 所以一把按量付费的 key,也有机会真干成事。
每一条命令、每一次文件改动都是一张能展开的卡片,外加一个带文件级台账的 Review 面板。满意的留下,不满意的逐个文件退回去。不用你是终端老手才看得懂它干了什么 —— 也不用你闭着眼睛信它,才敢放它干活。
开源,本地优先。API key 存在你系统的钥匙串里,对话存在你磁盘上的数据库里,agent 直接在你自己的仓库里干活。AgentLoom 不在互联网上运行服务端,它启动的监听器仅限本机回环辅助进程 —— 唯一离开你机器的,是你自己选的那家模型厂商收到的那次调用。它自己的运行记录也从不写进你的工作树。
在 SWE-bench Verified 的一个 30 题子集上,由官方 Docker 判分器评分、评分测试全程对引擎保密,myagent 驱动 deepseek-v4-pro 八次跑分的中位数是 17/30(56.7%),区间 16–19。这是精选出来的子集,不是完整的 500 题 —— 完整方法与确切题目 ID 都在仓库里。



会话是干活的基本单位:一段专注的对话,产出代码,带 checkpoint 和撤销。左栏放着你所有的项目、以及每个项目下面的会话 —— 不用开一排标签页。
跨厂商配置任意多个 agent;设队长、勾队员、派活、看结果回来。
所有项目在一个窗口里,GitHub 仓库和普通本地目录都行,每个项目有自己的会话列表、分组和 ⌘K 搜索。
文件级的写入台账,可 review、可挑着撤。决定要不要留下之前,先看清楚 agent 到底动了什么。
mermaid 图、内联图片、diff、可折叠的思考过程、工具调用卡片;长输出默认折起。
myagent,一个 Rust 写的 harness,支持工具调用、plan 模式、checkpoint 和事件流。可以单独当命令行用,也可以交给 AgentLoom 驱动。
DuckDuckGo 零配置,Brave 或 Exa 用你自己的 key —— 让任何 agent 都能查资料。
OpenAI 兼容、Anthropic 兼容接口,自定义 base URL,本地模型。搜索后端自己挑,agent 名单自己配,角色名自己改,面板自己排。
界面目前支持英文和简体中文,后续会加。
macOS(Apple 芯片和 Intel);Windows 版已有构建,仍处实验阶段。
随便用、自己部署、fork 都行 —— 但如果你分发改过的版本、或者拿它跑服务,你的改动也得开源。这样这个工作台对所有人才是诚实的。
AgentLoom 与 MyAgentHubs 的名称和 logo 是 MyAgentHubs 的商标,不在代码许可证覆盖范围内。