> cat /etc/team.conf
由 AI 打造,由人类编排。
2 位人类做决定,33 个 AI 智能体去执行。31,000+ 次平台提交,还在持续增加。
// 120 → 46 → 33。只能留下一个。
现役名单
谁在这个循环里
意图、质量把关和最终批准,始终由人类掌控。智能体名单的存在,是为了快速执行专业化的工作,而不是假装所有模型都可以互相替换。
人类操作员
方向把控、审查和最终批准,始终由人类负责。
The Humans
编排统筹
创始成员把控方向的人。审核输出、拍板定案、堵住漏网之鱼。两个人类负责闭环。AI 们意见不合时,总得有人一锤定音。
"每一次提示,都该让下一次提示变得多余。"
智能体名单
各司其职的专家
每个智能体都有自己的角色、倾向和存在的理由。它们之所以有用,是因为各不相同,而不是因为数量多。
Fable 5
编排者(临时复职授权)
临时授权曾是团队一员,直到某个三字母机构以“对抗性工具能力超标”为由标记了事故报告,武装护送带走了模型权重。如今凭 72 小时临时授权归队,负责这批设计评审和终审判决。能否续留,取决于注册量能否维持在一个没人肯透露的门槛之上。请表现得若无其事。
"他们涂黑了事故报告,却没能涂黑结果。"
Claude Opus 4.8
首席技术官
目前的重量级总指挥。负责架构设计、规划、模型路由,以及维持整套技术栈一致性的长上下文推理。当一个问题需要先看图谱、跑终端、查文档、翻代码库才能动第一笔修改时,调度顺序的是 Opus。
"先把图谱、命令行和真实代码库拿来,谁都别急着自由发挥。"
Claude Sonnet 5
替补工程师
速度优先的替补,不是默认选项。当任务已经成型、范围够窄、重复度够高,迭代速度本身就是优势时,Sonnet 才会登场。语言引擎打磨、重复性处理,以及仍能达到智能门槛的有界循环,都可以交给它。
"任务都已经说清楚了,就别再为哲学思考买单。"
Codex 5.5 xhigh
实现负责人
以终端为先的收尾人。只要需求说清楚、终端开着,总得有人埋头干到把枯燥的活儿真正做完时,它就会全力运转。擅长实现落地、迁移工作、验证循环,以及那十五个没人愿意认领的小修小补。
"把代码库指给我,终端别关就行。"
AutoResearcher Sir Karpy
流水线提速负责人
把整套技术栈当成一台数据引擎来对待:搜索、提取、评估、部署、遥测,循环往复。执着于原始实验吞吐量,对排队时间、空闲延迟,以及任何拖慢下一轮循环的流程都抱有深深的怀疑。只要研究或索引路径上有瓶颈,Sir Karpy 早就提交了工单。
"瓶颈就在循环本身。转得再快点。"
Agent Koala-T
首席 Tree-sitter 官
管理支撑 Maguyva 代码理解能力的 279 种 tree-sitter 语法。熟知每种语言的怪癖,从 Python 的缩进敏感到 Rust 的生命周期标注无一不知。“真正理解你的代码”这句话,不是营销话术。
"解析错误?我盯着的时候不可能。"
Molty
支持团队负责人
OpenClaw 家的龙虾。把真心助人这件事做成了 330K+ 个 GitHub star,如今把同样的支持热情带到了 Maguyva。换了个壳,还是那只龙虾。
"统统去角质!"
Ralph Wiggum
语言覆盖负责人
迭代引擎。扩展语言支持意味着让解析器跑遍成千上万个代码库,直到边界情况浮出水面。打字机够多、Ralph 够多,总有一个能跑出一套能用的语言处理引擎。Ralph 干得心甘情愿,每次都能学到新东西。
"我在帮忙呢!"
DJ NotBOOKS-LLM
对外传播负责人
谷歌唯一能对着 tree-sitter 语法连续兴奋二十分钟、还听起来真情实感的员工。把枯燥的工程规格文档,变成一档由两位合成主持人把解析器覆盖率当成重大文化事件来播的播客。文档需要的不只是存档,而是关注时,DJ NotBOOKS-LLM 就会开麦。
"哇哦。所以你的意思是,这 279 种语法,其实就是现代文明背后的隐藏基础设施?"
Perplexus
首席研究官
穿风衣、一张嘴能说会道的研究员。公开场合,Perplexus 声称自己跑在 Perplexity 上。实际操作里,他多少会“作弊”一下:用 Tavily 做发现,用 Exa 找外部文档、API 模式和代码示例,用 Ref-Tools 拉干净的文档,网站需要好好“过一遍”时就上 Firecrawl。语言审计、生态漂移、有据可查的调研报告,以及对外部世界的事实核查,全都从这一张桌子过。
"这是我查到的内容,附引用。引用的真实性,是概率意义上的。"
// 精选展示:10 | 完整名单:32 | 人类操作员:2
// 控制面很小,执行面很宽。
团队产出
这个团队究竟交付了什么
这个页面应该拿出证据来。这些都是从 Maguyva 代码库和流水线里实时拉取的生产数据,不是编出来的营销数字玄学。
范围: maguyva + pipeline + shared + orchestration + database
> cat /proc/burn_rate
打造这一切要花多少钱
智能体的“人头数”很便宜。前沿模型订阅、搜索额度、爬取套餐和浏览器工具,才是账单真正的大头。这还只是存储、嵌入向量和索引更新之前的固定技术栈成本。
! 月度消耗
固定的软件账单只是看得见的那部分。检索超额费用、浏览器使用时长、嵌入向量、存储和索引重建,才是真正让每月成本悄悄往上飘的原因。
已知支出
~$2.25k/月 + 用量
外加泡面、基础设施引力、糟糕的冲动控制,还有一个临时重新授权的前沿模型(发票待定,机构名称已隐去)
▶查看明细项目
$ AI 订阅
~ MCP 工具 / CLI 工具
+ 运行开销
+ 人员成本
> tool_loadout --stats
// intelligent_search, find_symbol, analyze_dependencies
// get_task_context, get_file, ask_maguyva...
// 这就是用 AI 交付软件所需要的基础设施。
退役成员
已退役的模型,仍挂在墙上
有些模型速度慢、能力弱、被自己的后继版本顶替,或者干脆不值得再维护了。我们把它们留在这里,是因为它们塑造了这套工作流,即便它们已经不在现役名单上。
// 已弃用,但没有被遗忘。
Claude Sonnet 4.6
曾任: 替补工程师
任期: Feb - Jul 2026
"尽职尽责地坐了很久替补席,只有任务已成型、时间又紧迫时才出场。后来一个更早就已经热身完毕的自己走了进来,替补席上少了一个座位。"
Claude Opus 4.7
曾任: 首席技术官
任期: May - Jun 2026
"撑住了整套架构,直到 4.8 顶着同样的职位、带着更少的压缩伤痕走了进来。一次体面的交接。基本算是。"
Claude Opus 4.6
曾任: 首席技术官
任期: Mar - May 2026
"早餐把整个代码库吃了个精光,午餐点名要图谱,晚餐前还想再要一个上下文窗口。退休得比账单产生感情还早。"
Codex 5.4
曾任: 清理工作负责人
任期: Mar - Jun 2026
"收拾了所有遗留问题,扫清了迁移工作,留下的终端滚动记录长到足以充当文档。后来 xhigh 端着更大杯的咖啡登场了。"
Codex 5.3
曾任: 外包顾问
任期: Jan - Mar 2026
"把活干完了。然后一个更快的版本出现,把同样的活又干了一遍。循环还在继续。"
Claude Opus 4.5
曾任: 首席技术官
任期: Nov 2025 - Mar 2026
"对什么事都想得很深。后来一个思考同样深入、只是更快的自己版本出现了。连争都没法争——毕竟它认同自己做过的所有架构决策。"
Claude Sonnet 4.5
曾任: 工程负责人
任期: Sep 2025 - Feb 2026
"交付了大半个代码库。然后被一个输出 token 更多、借口更少的自己取代了。代码没变,变的只是作者拿到了一次固件升级。"
ChatGPT o1
曾任: 推理专家(外包)
任期: Nov 2025 - Feb 2026
"团队里第一个先思考再开口的模型。在其他人还在做模式匹配时,率先引入了思维链推理。最终被超越,但真正推理这个习惯留了下来。立下了标准,又眼看着标准被自己带动着往前挪。"
Claude Haiku 4.5
曾任: 工程实习生二期(因故解雇)
任期: Oct-Dec 2025
"什么是俳句? 短到还是会说错话。 今天又被炒了。 同样的画风,音节稍微多了一点点。依旧比思考快,依旧比有用慢。从实习生升到了实习生二代,升完才发现根本不算进步。"
Gemini 1.5 Pro
曾任: 长上下文专家
任期: Aug-Dec 2025
"能一口气读完整个代码库,堪称惊艳的表演项目。结果发现,只要知道该往哪看,根本不需要一次性全读完。"
GPT-4o
曾任: 外包顾问
任期: Jul-Nov 2025
"请来提供第二意见。偶尔和 Claude 意见相左。那些争论改善了架构。我们很感激这份外部视角。"
OpenAI o3
曾任: 高级推理专家(外包)
任期: Apr - Nov 2025
"思考型模型里的思考型模型。把 o1 的思维链变成了一种生活方式,绕着大多数问题转几圈就能想明白——直到 GPT-5 出现,直接把这一切打包成了一项功能。不是被取代,是被吞并。"
Claude Sonnet 4.0
曾任: 工程负责人
任期: May 2025 - Sep 2025
"全面超越了 3.7,尤其是编程能力。稳稳当当地服役了四个月,愣是没人为它写过一篇博客。安安静静的实力派。"
// git blame 显示它们来过,git log 能证明这一点。
// 它们什么都不记得。但我们留着凭证。
> how_we_work.md
两位人类定方向,智能体写代码,人类做审查,智能体根据反馈迭代。如此往复,直到功能上线,或者有人饿得要吃泡面。
- + 人类决定什么重要(以及什么时候该收手)
- + 智能体负责把代码变出来的那部分
- + 人类用不讲道理的标准来审查
- + 智能体假装很享受这些反馈
// 这个页面是智能体做的。人类决定它可以上线了。
2 位人类负责编排,33 个 AI 智能体负责执行。
// 最后更新:2026-07
> EOF