智能体演示很出色,但应该先接入什么?
假设您正在构建一个客户咨询智能体。按角色划分的智能体可以分别负责调研和回复,也可以在浏览器中查找订单信息,还可以把客户偏好记到下一次对话。这些能力在演示中看起来都很有用,但同时接入会让您很难找到失败发生在哪里。
Google 介绍的 Gemini 3 案例同样包括六种:ADK、Agno、Browser Use、Eigent、Letta 和 mem0。不过,它们并不是在相同任务和条件下比较性能的对照表。每个案例的工作内容和组件都不同。
与其看框架名称,不如看工作最先停在哪个环节。从三个轴来理解——拆分和汇总结果的编排、在网页界面上执行任务的行动、将状态延续到下一次运行的记忆——首次验证的范围就会更清晰。
这三层不是产品分类,而是失败诊断表
编排、行动和记忆并非 Google 提出的官方产品分类,而是将六个案例落地到实际工作中的诊断轴。一个工具也可能涉及多个轴。ADK 案例将专业智能体与 Google Search、Maps 和代码执行结合;Agno 将记忆、知识和工具结合到多智能体系统中。Eigent 也会协调多个专业智能体,同时在浏览器中执行 Salesforce 任务。
| 最先观察到的失败 | 优先查看的轴 | 最小验证 |
|---|---|---|
| 调研、计算和写作结果彼此不一致 | 编排 | 只定义两个角色和一种结果交接格式 |
| 在输入、上传等界面操作中停住 | 行动 | 只操作一个由您直接管理的测试表单 |
| 在下一次对话中忘记用户条件 | 记忆 | 保存一项非敏感信息,并在新对话中重新检索 |
如果最近一次失败发生在结果整合环节,请先减少智能体数量和交接格式再检查;如果发生在界面操作中,请先复现行动流程,再添加记忆存储。这三个轴并不是替代安全、评估、可观测性和权限控制的完整架构,而是用于选择首次实验起点的工具。
Browser Use 示例不是可以原样运行的练习
Browser Use 案例会将结构化的申请人信息和 PDF 输入网页表单,提交申请后再确认是否成功。它展示了字段识别、JSON 值映射、文件上传和多步骤表单处理如何在行动层结合。
但是,不能只因仓库说明中写着“mock application form”,就判断它是安全的沙盒。当前的 main.py 会跳转到固定的外部 Appcast URL,任务指令中还包括判断缺失的选项、点击提交按钮以及确认成功页面。
请勿使用真实个人信息原样运行此示例。
更安全的做法是仅将当前仓库视为阅读代码结构的资料,了解如何把 JSON 连接到界面字段并上传 PDF。如果需要验证执行,请将目标 URL 改为您直接管理的本地或测试表单,移除外部提交指令,并在输入值和附件正确显示时停止。
即使需要记忆,Letta 和 mem0 的起点也不同
Letta 案例更接近于管理长期维持的人设和按用户划分的关系状态。Letta 公开仓库中包含 Core、Recall 和 Archival memory,以及每位用户的动态记忆块;运行该仓库需要配置 Letta 和 Bluesky。
mem0 MCP 将 add_memory、search_memories、get_memory、update_memory 和 delete_memory 等记忆操作作为现有 AI 客户端可调用的工具公开。 虽然没有在相同条件下比较两款产品的结果,但您可以根据所需状态的形态缩小第一个候选方案。
选择问题应当比“我需要记忆吗?”更具体。
如果要向现有客户端连接可保存、可检索的记忆工具,请先验证 mem0 的往返流程。如果智能体必须持续管理人设和按用户划分的关系状态,Letta 案例的记忆结构会是更接近的起点。
首次运行请收窄到一条记忆的保存、重新检索和删除
如果希望在不对外部网站产生操作的情况下确认连接成功,Mem0 MCP 的记忆往返是一个小型的首次练习。请准备 Mem0 Platform 账户、兼容 MCP 的客户端,以及可删除的非敏感测试信息。只有选择使用 npx mcp-add 的快速设置路径时才需要 Node.js 18 或更高版本;如果使用客户端的手动设置路径,要求可能不同。
- 在官方文档中选择所用客户端的设置路径。
对于支持npx的客户端,请用mcp-add注册 Mem0 MCP 服务器地址https://mcp.mem0.ai/mcp。如果您使用 Claude Desktop,可以在Settings > Connectors > Add custom connector中选择手动路径并添加相同地址。 - 保存设置并重启客户端。
请完全重启应用,以便应用新的服务器。如果首次工具调用打开浏览器认证,请批准要使用的 Mem0 账户的访问权限。如果客户端要求使用 API 密钥方式,请按照官方格式连接,不要将密钥放入代码或将要提交的文件中。 - 确认记忆工具已公开。
在客户端的 MCP 或工具列表中查找 Mem0 的添加记忆和搜索工具。如果看不到工具,请先重新检查服务器地址以及是否已重启。 - 保存一项可删除的偏好。
可以输入示例请求:“请记住,我在新项目的示例代码中更偏好 TypeScript 而不是 JavaScript。”这只是用于确认连接的示例,请不要使用真实个人信息或生产环境机密。在调用记录中确认已执行add_memory,并记录返回的memory_id或 Mem0 控制台中的已保存条目。 - 在新对话中再次查找已保存的信息。
请打开新对话,或使用上下文已重置的会话,以免它仅依据当前对话上下文作答,然后问:“我在新项目中偏好的语言是什么?”在调用记录中确认已执行search_memories或get_memory,并检查返回的memory_id或保存内容是否与前一步的条目一致,以及是否反映在回答中。 - 删除测试记忆。
使用确认过的memory_id通过delete_memory删除,并确认它也已从控制台中消失。
成功标准并不是回答碰巧猜对了 TypeScript。您需要确认 Mem0 工具已公开、账户已认证、add_memory 调用和保存条目已确认、新对话中已调用 search_memories 或 get_memory、返回的 memory_id 或保存内容一致、回答已反映该信息,以及最后已删除。这一往返仅验证连接状态,并不能证明实际服务中的用户识别、访问权限、保留期限和删除政策。
请结合当前指南重新检查示例中的模型名称
Browser Use 和 Letta 示例中仍保留着 gemini-3-pro-preview,但截至 2026 年 9 月 7 日,最新官方模型指南中的 GA 快速入门模型是 gemini-3.8-flash。 但这并不意味着只替换仓库中的模型字符串就一定能运行。
最新指南的迁移项包括移除旧的采样参数、迁移到 thinking_level、使用 previous_interaction_id,以及检查函数调用格式等。 实际应用前,请确认所选框架的 provider 是否支持 gemini-3.8-flash 和相应的 API 方式,并一同检查输入格式和工具调用处理。本次调研资料尚不足以确认 Browser Use 和 Letta 当前的支持情况。
如果想进一步深入
Real-World Agent Examples with Gemini 3 是了解六个案例共同涉及哪些工作和组件的起点。developers.googleblog.com
Mem0 MCP 可用于查看按客户端区分的连接、认证、记忆保存、搜索和删除,以及控制台确认流程。docs.mem0.ai
Application Submission Demo 可用于确认从 JSON 映射、PDF 上传一直到外部提交的代码实际范围。github.com
What's new in Gemini 3.8 Flash 是一份官方指南,汇总了当前快速入门模型以及迁移时需要检查的 API 变更。ai.google.dev



