前Manus后端负责人Agent架构复盘附血泪教训
前两天在 X 看到不少英文用户在热议前 Manus 后端负责人在 Reddit 上面发表的帖子,发现文章里面很多启发,整理成贴图分享给大家。
前 Manus 后端负责人两年 Agent 开发实战总结。
核心观点:与其给 LLM 一堆 function calling 工具,不如只给一个 run(command="...") 配合 Unix CLI 命令。
原因是 Unix 的「一切皆文本流」和 LLM 的「一切皆 Token」天然契合,CLI 又是训练数据中密度最高的工具使用模式。
文章详解了三大启发式设计技巧:渐进式 --help 发现、错误信息即导航、一致的输出格式,以及双层架构(执行层保持原始 Unix 语义,表示层针对 LLM 约束做二进制守卫、溢出截断、元信息附加等处理)。
附带多个生产环境血泪教训:PNG 乱码导致死循环、静默 stderr 引发盲目重试、大文件撑爆上下文窗口等。
同时指出 CLI 的局限性——强类型交互、高安全场景和原生多模态处理仍需类型化 API。
开源项目 agent-clip 用 Go 实现了完整方案。
PS1:原文评论里面也有很多精彩讨论,值得一看。
PS2:原文丢给 Claude Code 等工具,可以用来 review 已有的 skill 等工具。
原帖可在 G 搜索:Reddit LocalLLaMA "backend lead at Manus"