美团CatPaw管起3万智能体

美团正式上线企业级智能体平台 CatPaw,已覆盖内部9万名员工、托管超过3万个Agent。它的真正价值不只是让AI回答问题,而是把执行、经验复用和企业治理装进同一套系统。
美团把内部使用的智能体平台推向台前
**美团在今天(2026年7月27日)正式上线全场景 AI Agent 平台 CatPaw,并公布了一组少见的企业级落地数据:覆盖9万名员工、搭建超过3万个Agent。**该平台同时提供面向普通员工的AI工作台,以及面向企业的Agent开发、运行和统一管理能力,目前已经在餐饮、美业、宠物医院等真实业务场景中完成验证。
**CatPaw 是一个连接移动端、PC端和云端执行环境的企业级智能体平台。**它不是单纯增加了联网搜索或文档问答能力的聊天机器人,而是允许Agent在授权范围内读取文件、控制浏览器、运行终端命令,并最终交付Excel、可视化报告、营销物料或代码等可直接使用的成果。
**9万名员工和3万个Agent,是CatPaw此次发布最有分量的信息。**按简单比例计算,美团内部平均每3名被覆盖员工对应1个已搭建Agent,这意味着它已经越过几十个试点项目的阶段,进入需要处理权限、并发、版本、凭证和资产复用的大规模运行阶段。

CatPaw不只回答问题,而是直接操作电脑
**AI Agent 是能够围绕目标自主规划步骤、调用工具并持续执行任务的人工智能系统。**传统聊天助手的工作通常停留在生成答案,Agent则需要把答案变成动作,例如打开经营数据、清洗表格、访问后台页面、生成分析图表,再将结果整理成一份报告。
**CatPaw最明显的产品特点,是把移动端发令、PC端操作和云端持续运行组合在了一起。**用户可以在手机上发起任务、查看进度和确认关键决策,PC客户端负责文件操作、浏览器控制和终端命令等本地深度执行;当任务耗时较长或需要定时运行时,则可以切换至云端模式。
| 运行形态 | 主要用途 | 可执行能力 | 适合场景 | |---|---|---|---| | 移动端App | 发起任务、查看进度、人工确认 | 任务管理、远程审批、结果查看 | 外出途中检查经营数据、确认营销方案 | | PC客户端 | 本地深度执行 | 文件操作、浏览器控制、终端命令 | 整理本地表格、操作业务后台、生成代码 | | 云端模式 | 长时间和定时运行 | 7×24小时持续执行,不依赖本地设备在线 | 定时日报、长程调研、批量数据处理 |
**云端模式解决的是Agent产品中经常被忽略的执行连续性问题。**如果一个数据分析任务需要运行两小时,普通桌面Agent会受到电脑休眠、网络变化和应用退出影响;CatPaw将长程任务放在云端后,即使本地设备关机或断网,任务仍能继续,用户之后通过手机或电脑查看结果即可。
**这种三端协同设计比单一网页聊天框更接近企业真实工作流。**员工并不总是坐在电脑前,但高风险操作又不能完全取消人工确认,因此手机承担审批入口、PC承担本地操作、云端承担持续运行,是一套相对合理的分工。
3万个Agent的关键不是数量,而是能不能复用
**企业级Agent托管是对智能体的创建、运行、权限、版本和生命周期进行集中管理的能力。**个人制作一个自动化助手并不困难,真正困难的是让数万个Agent稳定运行,并避免不同团队重复建设、权限失控或经验随人员流动而消失。
**CatPaw用“专家”和“技能”两层结构组织企业能力。**专家是面向特定业务目标、集成多项技能和子Agent的复合型智能体;技能则是可以被Agent反复调用的标准化操作能力,例如生成商品文案、诊断门店评价或执行一段固定的浏览器流程。
**专家广场承担的是企业内部Agent应用商店的角色。**员工可以一键安装现成专家,也可以通过对话描述自己的工作方式,将个人流程封装成专属专家,再共享给团队使用。这种机制的目标并非让每名员工都学习复杂编排,而是让熟悉业务的人能够把经验直接固化下来。
**浏览器操作录制则在缩短Agent技能的制作门槛。**CatPaw内嵌浏览器支持记录操作过程,并将日常高频流程生成可复用技能;它的逻辑有些像传统RPA的录制器,但加入大模型后,系统不再只依赖固定坐标和机械步骤,还能结合页面内容理解任务意图。
**这套机制的实际价值取决于技能面对页面变化时是否足够稳健。**如果按钮位置调整、字段名称变化或业务系统弹出异常提示,纯录制流程容易失败;Agent虽然具备语义判断能力,却可能执行错误操作。因此,失败重试、步骤回放、版本管理和人工接管,仍然会决定平台能否长期运行。
美团真正的优势是本地生活知识
**行业知识封装是CatPaw区别于通用办公助手的核心资产。**美团把门店经营、评价体系、营销转化和履约配送等经验,封装为可以直接安装的专家与技能,覆盖门店评价诊断、商品文案生成、营销物料设计评估、活动策划和经营数据分析等场景。
**本地生活业务对Agent的要求远高于生成一段文案。**以门店评价诊断为例,系统需要区分口味、价格、服务、环境和配送问题,识别近期评价趋势,再结合门店类型给出可执行建议;如果只做情绪分类和关键词统计,最后得到的往往是一份正确但无用的报告。
**美团的壁垒不一定在底层模型,而在业务语境和工作链路。**通用模型能够写促销文案,却未必理解什么样的套餐结构更适合餐饮门店、哪些评价问题会影响转化、活动引流和实际履约之间如何平衡。CatPaw如果能把这些隐性规则持续沉淀为技能,就比单纯接入一个更大的模型更难复制。
| 产品路线 | 主要交互方式 | 强项 | 常见短板 | |---|---|---|---| | CatPaw | 对话下达目标,跨端执行 | 本地生活知识、桌面操作、云端长程任务、统一治理 | 对外定价、模型配置和量化效果尚未公布 | | 通用企业助手 | 对话、搜索、文档问答 | 部署快,适合知识查询和内容生成 | 深度执行能力通常依赖额外集成 | | 传统RPA | 流程录制、规则编排 | 固定流程稳定,行为边界清晰 | 页面变化适应性弱,处理非结构化任务困难 | | 开发者型Agent | 终端、代码仓库、IDE | 编程和工程任务能力强 | 对运营、门店和营销人员不够友好 |
**CatPaw采用的是“通用执行底座加行业技能包”的路线。**这比只卖一个对话入口更有业务价值,也比完全定制化项目更容易复制,但前提是平台能够在标准化和业务差异之间找到平衡。
多Agent并发让复杂任务更快,也让治理更难
**多Agent协作是把复杂目标拆分给多个具备不同工具和上下文的智能体并行处理,再统一汇总结果的工作方式。**CatPaw面对跨领域任务时,会动态拆解任务,并将不同部分分配给多个Agent;各Agent运行在独立环境中,彼此不干扰,用户可以实时查看进度。
**多Agent适合边界相对清楚、能够并行推进的任务。**例如制作一次门店活动方案时,一个Agent可以分析历史经营数据,一个Agent研究近期评价,一个Agent生成活动文案,另一个Agent检查营销物料,最后再由汇总Agent整合输出。
**并发并不天然等于更高质量。**任务拆得过细会增加上下文传递和结果合并成本,不同Agent也可能基于不一致的数据得出相互冲突的结论;如果底层模型按使用量计费,多Agent还可能让推理成本成倍增长。CatPaw此次没有公布任务成功率、平均耗时、单任务成本或人工接管比例,因此外界暂时无法量化其多Agent架构的实际收益。
**3万个Agent也不能直接等同于3万个高频活跃应用。**这一数字可能同时包含个人实验、团队模板、长期运行任务和低频工具,后续更值得关注的指标包括月活跃Agent数量、任务完成率、平均节省工时、失败率以及被多个团队复用的技能比例。
长期记忆让Agent更顺手,也扩大了数据边界
**长期记忆是系统跨会话保存用户偏好、操作习惯和历史上下文,并在后续任务中继续调用这些信息的能力。**CatPaw支持跨设备、跨对话保持连续理解,用户不必每次重新解释常用文件格式、报告结构或业务偏好。
**长期记忆对高频办公场景很实用。**如果一名运营人员每周都需要按固定口径生成门店报告,Agent记住指标定义、图表风格和接收对象后,可以显著减少重复提示;团队共享专家后,新成员也能更快沿用成熟工作方法。
**长期记忆同时也是企业最敏感的数据治理环节之一。**系统需要明确记住了什么、保存多久、谁可以查看、用户能否删除,以及员工离职或岗位变化后如何处理历史记忆。记忆如果缺少清晰边界,就可能把原本只存在于单次会话中的敏感信息带到后续任务。
安全能力决定CatPaw能否走出美团
**凭证集中托管是由平台统一保存和调用账号凭据,使Agent执行任务时不直接接触敏感认证信息的机制。**美团表示,CatPaw采用隔离运行环境,租户之间数据互不可见,并让Agent在执行过程中对敏感凭证保持零接触。
**CatPaw还提供分级权限控制、团队账号体系、统一管理后台和私有化部署。**这些能力瞄准的都是企业采购中的硬门槛:管理员需要决定谁能创建Agent、谁能安装技能、哪些Agent可以访问文件或业务后台,以及高风险操作是否必须由人工确认。
**企业真正需要验证的不是安全功能列表,而是边界条件。**浏览器控制和终端命令意味着Agent具备较高权限,平台需要应对提示注入、恶意网页内容、越权读取、错误命令和敏感数据外发等风险。操作日志是否可追溯、权限能否细化到具体工具、危险动作能否强制审批,都会比一句“环境隔离”更重要。
**截至7月27日,美团尚未在公开信息中披露CatPaw的具体价格、底层模型组合、服务等级协议、数据保留周期及第三方安全认证。**对于准备采购的企业而言,这些信息会直接影响总成本和合规判断,也是CatPaw从内部平台走向外部市场后必须补齐的产品说明。
CatPaw与此前AI IDE是什么关系
**CatPaw这一名称此前更多以美团AI IDE的身份被外界认识。**2025年公开测试的相关产品主要面向编程场景,强调Agent与开发者协作;此次发布的CatPaw则把能力扩展到移动端、云端任务、本地生活专家和企业级托管,目标用户也从研发人员扩大至运营、营销和门店经营者。
**这次变化更像是从开发者工具升级为企业Agent操作系统。**代码、终端和文件能力仍然是底层执行基础,但产品重点已经转向如何让非技术员工创建、安装、共享和管理Agent。名称相同并不意味着产品只是在AI IDE上增加几个插件,而是美团正在尝试把原有Agent执行能力平台化。
判断:规模证明能用,商业化仍要看可量化结果
**CatPaw目前最大的说服力来自真实组织规模,而不是功能清单。**覆盖9万名员工、搭建超过3万个Agent,说明美团至少已经处理过大规模推广中的账号、权限、技能复用和运行环境问题,这比只展示几个演示案例更有价值。
**CatPaw最值得关注的方向是把个人经验变成企业数字资产。**当员工能够通过对话和操作录制沉淀专家与技能,企业获得的不只是一次自动化结果,而是一套可以复制、共享和持续迭代的工作方法。
**CatPaw能否成为有竞争力的外部产品,最终仍取决于成本、可靠性和业务收益。**企业客户不会只为“拥有3万个Agent”付费,而会追问每个Agent节省了多少工时、任务成功率是多少、出错后由谁负责,以及与现有业务系统集成需要多长时间。
**这次发布表明企业Agent的竞争已经从模型能力转向执行和治理。**模型负责理解目标只是第一步,真正困难的是让Agent安全地操作系统、在设备离线后继续工作、把经验沉淀为技能,并让管理员看得见、管得住。CatPaw已经给出了一套相对完整的产品框架,但它还需要用公开定价和量化案例证明,这套框架不仅适合美团,也适合更多组织。
参考来源
- IT之家:美团全场景AI Agent平台CatPaw发布,已在内部大规模落地 —— 汇总CatPaw于2026年7月27日发布的产品能力、内部覆盖规模、安全机制与行业场景。
- 知乎:美团发布AI IDE产品CatPaw公测版 —— 用于了解CatPaw品牌此前在AI IDE和开发者Agent方向的产品背景。



