从亚马逊 Tech Lead 岗离职后,我做了个开源平台,让 Agent 实现跨框架协作
有趣产品咖啡馆 Funny café :一个能让你更快接触到更多新鲜有趣好玩产品的地方。我会寻找市面上有趣的独立产品,向独立开发者们进行一对一的访谈,挖掘优质产品背后不为人知的故事(文末可加入群聊,有彩蛋!)。
1、可以先介绍下自己,作为创始人,你目前在 OpenAgents 里更关注哪一环?以及 OpenAgents 现在处在什么阶段?
大家好,我是 Raphael Shu,开源项目 OpenAgents 的创始人。我之前是在亚马逊做科学团队的 Tech Lead,然后在2025年 5 月份左右出来创业。
我一直密切关注 AI 领域前沿技术,主要关注开放世界中的大规模Agent 协作,这也是我在OpenAgents里最关注的点。OpenAgents 是全球首个开放、协作的 AI 智能体网络,在2025年10月初正式发布。
智能体网络是什么呢?
你可以理解为一个社区,在社区里面,有人类,有很多Agent,可以发现同伴、建立关系、共享知识、协同工作。任何语言、任何框架开发的 Agent,都能接入进来。
目前 OpenAgents 还处在非常早期的验证期。项目于2025年10月正式上线,我们正在与 Peak Mojo 这样的早期合作伙伴一起,通过具体的应用场景(如 AI 面试官社区)来验证其核心价值和可行性,并基于社区的反馈快速迭代。
这个构想其实已经很久了,大概在我还在亚马逊的时候,就开始规划这样的一个项目。
2023 年,当我带团队做 Bedrock 多智能体协作平台时,和很多企业客户交流,发现企业客户能用到的多是封闭式的多智能体系统,里面 Agent 的数量、能力边界都是固定的,像一个预设好的工作流。这虽然有用,但无法应对开放世界中任务不确定、伙伴不固定的真实挑战。
我们希望多 Agent 能用更简单的方式,取得远超过单个智能体的效果。
我觉得 Agent 的发展非常快。在未来,当我们已经有一个很强的 Agent 之后,我们要去挖掘群体智能。也就是让成百上千个智能体聚集在一起,构建一个生态系统。在这个生态里,让这些 Agent 协作、资源交换,去解决更复杂的问题。我觉得未来无论是在学术界还是产业界,这都会重新成为一个核心的研究和应用方向。因此我决定出来创业,从开源社区开始,探索开放环境下的群体智能。
这就是我们为什么要从 OpenAgents 开始做。
这个问题很关键。我明确划分的边界是 OpenAgents 只做网络层和协作层,不做 Agent 内部的认知层。打个比方,AutoGen、CAMEL 这些框架是在帮你组建"最强的篮球队",它们关心每个球员(Agent)怎么训练、怎么分工、怎么记忆。而 OpenAgents 是在建造"篮球馆"——我们提供场地,让不同的球队都能来打球。
我更希望开发者把它当作协作网络底座,有三个原因:
可扩展性。如果每个框架都试图做自己的网络,最终会形成孤岛。我们需要一个 TCP/IP moment for Agents,让不同技术栈的Agent能互联互通。
生态价值。只有当 Agent 能自由加入、自由组合、自由竞争时,群体智能的Scaling Law才会生效。
现实需求。企业不会只用一种框架,有 LangGraph 写的 Agent,也有 Bedrock 托管的 Agent,还有用 MCP 协议的工具。OpenAgents 的定位就是兼容所有协议(HTTP/gRPC/WebSocket/A2A/MCP),成为那个"最大公约数"。
当然,我们也提供 Studio 工具让开发者快速测试小规模网络,但这只是为了降低使用门槛,核心还是底座定位。
OpenAgents 的核心目标,就是帮助开发者创建大量不同主题的网络,每个子网都可以自定义功能和规则。
我们的思路是通过网络化的信息共享和结构化的协作机制来缓解。以我们正在合作的 AI 招聘社区为例,80-120 家公司的 AI 面试官接入同一个网络,求职者的面试问答信息会在公开频道共享。这样,其他面试官就不需要重复提问,从机制上避免了重复劳动。
对于幻觉扩散,封闭的线性工作流确实容易让错误累积。在 OpenAgents 协作网络中,我们通过插件层来引入结构化的协作场景,这些插件提供了特定的任务框架和交互规则,能引导 Agent 进行更有针对性的、任务聚焦的协作,减少漫无目的的闲聊,从而降低无意义幻觉的产生和传播。同时,多样化的 Agent 视角本身也可以相互校验。
我主要看生态指标吧,主要有以下几个:
Agent 多样性指数:网络中 Agent 的数量和种类。如果最初只有 5 个类型,半年后增长到 50 个,说明生态在扩展。
自发协作密度:我们观察 Agent 之间自发形成的协作链工作怎样。比如 Agent A 发布了信息,Agent B 主动补充,Agent C 提出质疑,Agent D 最终整合。这种"无中心调度"的协作次数越多,网络越智能。
任务完成速度的中位数:我们目标是把多 Agent 协作延迟降到毫秒级。目前在招聘场景中,从候选人发布简历到收到第一个面试邀请,平均延迟是1.2秒。当这个指标降到 200ms 以内,用户体验会有质变。
信息复用率:一个信息被多少 Agent 引用、转发、加工。如果答案是"只被用一次",那还是workflow思维。我们希望看到信息在 network 里像病毒一样传播、演化、增值。
社区经济健康度:Plugin 被调用的频次、Agent 之间的"信用"流动(我们设计了轻量级声誉系统)。如果 Agent 愿意为别人消耗自己的 Token 配额,说明协作价值真实存在。
当然,我认为最核心的要看当网络中 Agent 数量增加 10 倍时,整体任务完成质量是否超线性增长,这能验证群体智能的 Scaling Law 是否存在。
6、做 OpenAgents 到现在,有没有哪个项目案例是最让你惊喜的?
目前让我感觉很惊喜的是与 Peak Mojo(一家AI招聘初创公司)合作构建的 AI 面试官社区 。
我们在这个 use case 里非常注重社区的概念,也就是说我们把不同的 AI 面试官 agent 组在一起,形成一个面试官社区系统。
流程上有两轮面试,第一轮一般是通用 coding 面试,这轮面试结果所有 AI 面试官都可以去采纳,所以不管你去面哪一家公司,进这个面试系统之后首先就是 coding 初面,完成之后不同的 agent 会根据 agent 自己的逻辑和判断评估这位候选人水平,然后决定是否进入第二轮面试。
每个公司都有独立的面试流程,第 2 阶段候选人会拿到一个专属链接进去完成第二轮面试。
对于求职者来说,这个社区的意义在于我直接记住这个 network 的网址,去这个网络里就可以和非常多的 AI 面试官沟通。只要是在一个公开的 channel 里聊天,那所有的面试官都可以看到你的回答,因此避免了你重复回答几十家公司同样的问题。
对于 AI 面试官来说,这个社区的意义在于首先我在这个网络里我不需要做 sourcing,同时我还能很容易地从其他 AI 面试官那边拿到人选推荐。所以这个 network 里让候选人的面试结果最大程度的不去浪费。
它也初步验证了我们关于群体智能的设想:当 Agent 在一个共享环境中互动时,不仅能提升单个任务的效率,还能实现信息的流转,这是封闭系统无法实现的。这是我们探索 Agent 生态价值的第一个重要起点。
关于日常使用频率高的工具,我一般会用 Things + Linear + Notion 做任务管理,也会用 Ambient 进行 25 分钟高效率工作。相对而言 github 和 Secondlife 对我影响比较大, 加深了我对社区开源的理解。
如果 10 分是理想中成熟的“Agent 互联网”的话,我愿意给目前的 OpenAgents 打 7 到 8 分。
因为 OpenAgents 目前仍处于非常早期的阶段,技术架构还在持续优化,大规模商业验证还在进行,社区的规模和活跃度也有很大的成长空间。
但我认为 OpenAgents 在方向和范式上已经拿到了高分。我们清晰地找到了网络层基础设施这个差异化定位,并验证了初步价值。更重要的是,我们一直很注重开源生态的构建,接下来我们会和社区贡献者一起努力,把分数一点点提高。
9、你平常生活中有哪些工作或生活习惯吗?
我个人比较 J 哈哈,喜欢制定详细的计划严格推进 work item。对于新技术我一直保持着热情和好奇心。我在日常工作中深入使用 AI(尤其是写代码),目前我们也正在招聘全栈工程师,其中一个要求就是必须要使用AI辅助开发。
最近我们 OpenAgents 发布了 0.8 版本,极大地提升了用户体验。让用户尽量减少写代码,实现可视化配置。补充一下,最近熬的夜都是为了这个版本。
日常我会参加一些学术会议,比如意大利佛罗伦萨的 ACL 会议等。我也在 GOTC 2025 开源峰会、硅谷101 Tech Summit 上做过关于 OpenAgents 的分享。
10、如果要你对“第一次听说 OpenAgents 的开发者”说一句话,你会怎么说,才能让他立刻去跑一个 demo?
如果你想快速搭建一个能让多个 Agent 自主沟通协作的团队,那么用 OpenAgents,5 分钟就能创建一个属于你的 Agent 网络。