AICOR/咨询报告/Agent 对比

主流 AI Agent
对比报告

覆盖近 1 年(2025.08—2026.08):三类玩家格局、主流产品与框架对比、MCP 生态演进、企业落地路径与「Demo→生产」判断。咨询部 · 编制

AICOR 咨询部 · 研究分析师出品

主流 AI Agent 对比报告

近一年窗口(2025 年 8 月 — 2026 年 8 月):全球与中国 AI Agent 市场全景、三类玩家(通用 Agent 助手 / 智能体开发平台 / 开发框架与编排层)的多维对比、MCP 与 A2A 协议标准化进展、近一年关键动态时间线,以及面向企业的落地路径建议

出品|AICOR(AI核)咨询部 · 研究分析师 主体|重庆科悦睿博网络科技有限公司 周期|2025 年 8 月 — 2026 年 8 月 完成|2026 年 8 月 19 日 编制人|研究分析师(AICOR) 版本|V1.0

核心摘要

过去 12 个月,AI Agent 完成了从「聊天机器人补充」到「企业数字劳动力」的品类确立:Gartner 预测 2026 年底全球 40% 的企业应用将内置任务型 Agent(2025 年不足 5%)〔23〕;IDC 口径下 2026 年全球 AI Agent 市场规模约 109 亿美元、2025→2030 复合增速 45.8%〔23〕;中国市场企业级 AI 智能体市场 2025 年 212 亿元、2026E 449 亿元〔23〕〔24〕。

「采用爆发 × 价值兑现缺口」并存:79% 的企业已启动 Agent 部署,却有约 40% 以上的 Agent 项目面临 2027 年前被取消的风险〔23〕;88% 的企业仍停留在「单 Agent Demo」阶段〔23〕。Agent 不缺能力,缺的是可靠性、集成深度、治理与 ROI 度量——这既是市场最大的裂缝,也是「Agent 生产化」服务商与咨询方的战略机会。

449 亿元
2026E 中国企业级 AI 智能体市场规模(+110%,赛迪口径)〔23〕〔24〕
109 亿美元
2026E 全球 AI Agent 市场规模(+43%,IDC/SaaSUltra 口径)〔23〕
40%
2026 年底企业应用内置任务型 Agent 比例(2025 年 <5%,Gartner)〔23〕
25 亿美元
Claude Code 年化收入运行率(2026.02 官方披露,发布约一年)〔6〕〔7〕
~1 万
MCP 官方注册公共服务器数量,月 SDK 下载量近亿次〔19〕〔21〕
报告范围与方法说明。本报告覆盖 2025 年 8 月—2026 年 8 月,聚焦「主流 AI Agent 产品、平台与框架」的横向对比。数据全部来源于 2026 年 8 月 19 日的多轮网络检索(共 8 组 10 余轮关键词组合,含 Manus、OpenAI Operator/Deep Research、Claude Code、Google Gemini Agent、智谱 AutoGLM、扣子 Coze、Dify、MCP 协议、Agent 框架对比、企业落地市场数据等),交叉验证自厂商官网、官方公告、Linux 基金会发布及第三方研究(IDC、Gartner、McKinsey、Anthropic 官方研究等)。所有关键数字均在正文标注来源序号(见附录);对口径存疑、单一来源转述或预测值的数据,一律以「估计值/待核实」明示,未作任何虚构填充。

市场全景

Market Landscape — 品类确立与三类玩家

1.1 总盘:全球百亿美元级赛道,中国智能体市场连续翻倍

2025—2026 年被行业普遍称为「智能体之年」:2025 是聊天机器人之年,2026 则是「你给它一个目标,它自己拆解、调工具、跨应用把活干完」的 Agent 之年〔8〕。机构口径趋同但数字各异,核心方向一致——Agent 是当前 AI 商业化变现最快的品类

图 1|中国企业级 AI 智能体市场规模(亿元)

2024—2026E 为赛迪顾问/IDC 口径;2029F 为预测值,图中截断显示;2027—2028 无公开拆分数(估计值/待核实)〔23〕〔24〕
0150300450600 86 212 +110% 449 CAGR≈107% ≈3320 202420252026E2029F
实际值 2026E 预测值 2029F 预测(截断,赛迪口径)
109 亿美元
2026E 全球 AI Agent 市场(+43%);2030E 约 503 亿美元,CAGR 45.8%〔23〕
79% 企业
Gartner 2026Q1 调研:已启动 Agent 部署的组织比例(一年前不足 20%)〔23〕
40% 企业应用
Gartner:2026 年底 40% 企业应用内置任务型 Agent(2025 年 <5%)〔23〕
22 亿
IDC:2030 年全球活跃 Agent 数,Agent 被定义为「新数字劳动力」〔24〕

1.2 三类玩家总览:谁在供给「Agent」

市场上的「Agent」不是一个产品,而是一整个品类〔8〕。为便于对比,本报告把供给方划分为三类——通用 Agent 助手(面向终端用户直接干活)、智能体开发平台(面向业务/开发者搭建 Agent)、Agent 开发框架与编排层(面向技术团队自建 Agent 系统的工程底座)。三者能力边界在快速互相渗透(平台开始内置框架、助手开始开放 API),但定位、客群与商业模式仍泾渭分明:

玩家类型 代表产品 / 厂商 核心供给形态 2026 关键词
通用 Agent 助手 海外:Manus、OpenAI Operator / Deep Research / Codex / Atlas、Anthropic Claude Code / Computer Use / Cowork、Google Gemini Agent / Deep Research Max;国内:智谱 AutoGLM、腾讯 WorkBuddy、字节豆包、Kimi、美团 CatPaw〔1〕〔4〕〔6〕〔8〕〔9〕〔10〕 「交付结果」的终端产品:写代码、做研究、操作浏览器/桌面、办公自动化;多为订阅制或按量计费 商业化爆发(Claude Code ARR 破 25 亿美元〔6〕〔7〕);从单任务走向工作流接管(Manus 连续更新 Skills / PlanMode / 云电脑〔1〕〔2〕〔3〕)
智能体开发平台 字节扣子 Coze(+火山 HiAgent)、百度文心智能体 / 千帆 AppBuilder、阿里云百炼、腾讯元器(+腾讯云 ADP)、讯飞星辰、华为盘古智能体、蚂蚁数科 Agentar;海外参照 Salesforce Agentforce、Microsoft Copilot Studio〔8〕〔13〕〔14〕〔25〕 低代码/零代码搭建 + 分发 + 治理:知识库、工作流、插件市场、多渠道发布、私有化/SSO/审计 平台大版本迭代(扣子 3.0〔13〕);企业版提价 + 治理能力升级;头部平台向「数字员工」演进〔8〕〔14〕
开发框架 / 编排层 LangGraph / LangChain、CrewAI、AutoGen / AG2、Microsoft Agent Framework、Google ADK、OpenAI Agents SDK、Claude Agent SDK、Dify、Coze Studio、AgentScope 等〔16〕〔17〕〔18〕 工程底座:状态编排、多 Agent 协作、记忆/工具管理、可观测性;Dify 等同时是平台型开源产品 框架 1.0 化(LangGraph/LangChain 1.0〔16〕、微软 MAF 1.0〔16〕〔18〕);厂商官方 SDK 齐发,终结 LangChain 垄断〔18〕

注:三类边界正在互相渗透——扣子开源 Coze Studio 切入框架层〔16〕,Anthropic/OpenAI 推出官方 Agent SDK〔18〕,Claude Code 亦被企业当作「开发工具」采购。本报告按「用户主要接触的界面」归类。

1.3 一年主旋律:三层结构性变化

  • ① 单 Agent → 多 Agent 协作:Anthropic 2026 年研究显示,多智能体编排可将 90.2% 的复杂任务完成度提升约 15 倍,但 88% 的企业仍卡在「单 Agent Demo」阶段〔23〕。从「一个 Agent 干一件事」到「一群 Agent 协作干一个流程」,是近一年最重要的能力叙事。
  • ② 从「聊天」到「任务执行」:ChatBot 卖答案,Coding Agent 卖结果〔7〕。代码 Agent 最先跑通「按结果付费」的商业模式,随后向数据分析、研究、运营、金融扩散——OpenAI Codex 周活用户已超 500 万且正在向非编程场景渗透〔7〕〔8〕。
  • ③ 从「各自为战」到「标准协议」:MCP(Agent↔工具)与 A2A(Agent↔Agent)双双落户 Linux 基金会,MCP 官方注册服务器约 9,600—10,000 个、月 SDK 下载量近亿次〔19〕〔20〕〔21〕。行业称其为「Agent 的 USB-C 时刻」与「Kubernetes 时刻」〔20〕〔21〕。
分析师判断:2025.08—2026.08 是 Agent 的「品类确立期」——市场共识已从「Agent 是不是伪需求」切换为「先上哪个场景、用什么平台、怎么治理」。2026 下半年的竞争将围绕「谁先跨过生产化门槛」展开:可靠性、可审计、可度量 ROI,而非演示效果。

对比维度

Evaluation Framework — 六维评估

本报告采用六个维度评估三类玩家。维度定义如下,后续各章均以该框架展开:

维度 评估内容 观察信号(近一年)
① 任务自动化能力 多步规划、工具调用、自主执行、跨应用闭环;能否独立完成「从目标到交付」 SWE-bench / Terminal-Bench / DeepSearchQA / HLE 等基准跃迁(如 GLM-5.3 Terminal-Bench 3.0 从 4.6→28.3〔12〕);Operator/Computer Use 的真实完成率仍仅约 19%(人类 80.8%)〔9〕
② 企业落地成熟度 生产可用性、私有化部署、SSO/权限/审计、SLA、团队版/席位模式 Claude Code 企业版「基础席位 + 按用量」〔6〕;扣子企业版新增 SSO/VPC/KMS〔13〕;Salesforce Agentforce 按动作计费 0.10 美元〔8〕
③ 成本 Token 消耗、平台订阅费、席位费、按动作/成果计费;「完成一次真实任务」的单位成本 大模型降价潮(2026 年 7—8 月,百万 Token 低至约 0.025 元人民币量级,估计值);GLM-5.3 称前沿旗舰中单任务成本最低〔12〕;企业开始按「修一个 Bug / 交付一个 PR」算账〔7〕
④ 生态与扩展 MCP/插件/工具链支持、开发者生态、模型兼容性、社区与可观测工具 MCP 成事实标准、官方注册服务器近万〔19〕〔21〕;Dify 插件市场国产模型安装量数十万至百万级〔15〕;LangGraph PyPI 月下载量千万级〔16〕
⑤ 中文与本地化支持 中文指令与输出质量、国产模型底座、国内生态(企微/飞书/微信)、信创适配 国内产品原生中文;OpenAI/Google 旗舰 Agent 多为英文优先且部分仅美国区(如 Gemini Agent、Operator 早期〔9〕〔11〕);国内企业倾向国产底座(混元/GLM/DeepSeek/Qwen)〔14〕〔30〕
⑥ 安全合规 中国《智能体规范应用与创新发展实施意见》〔26〕〔27〕备案与分级监管、权限分级(用户决策/授权决策/自主决策)、数据不出域、审计追溯 2026.05 三部门《实施意见》确立分类分级监管与统一登记备案平台〔26〕〔27〕〔28〕;《人工智能拟人化互动服务管理暂行办法》2026.07.15 施行〔29〕;OpenClaw 暴露「指令诱导发起网络攻击」等风险〔26〕
评估口径提醒:六维评分在本报告中以「高 / 中高 / 中 / 中低 / 低」五档呈现,属分析师基于公开信息的定性判断,不构成精确量化测评;读者应结合自身场景(行业、数据敏感度、预算、团队技术栈)权重化使用。

通用 Agent 助手产品对比

General-purpose Agent Products

3.1 核心对比表:主流 Agent 产品(2026.08)

下表选取近一年最具代表性、信息密度最高的 8 类通用 Agent 产品。定价、用户数与市场数据为 2026 年 8 月检索时点数据,部分为估计值(已标注)。

产品 / 厂商 类型与定位 核心能力与近一年关键进展 成本与商业模式 生态 / 中文 / 企业成熟度
Manus
通用任务 Agent
「给一个目标,几天后拿成品」的异步云端通用 Agent〔8〕 2025.03 首发「全球首款通用 AI Agent」;2025.12 被 Meta 以约 20 亿美元收购官宣→2026.04 被叫停→2026.08 恢复独立运营〔1〕〔2〕〔3〕。年化收入由约 1 亿美元升至 4—5 亿美元(估计值)〔2〕。2026 年连续迭代 Skills、My Computer、Cloud Computer、Branch、Auto-Publish、智能 PPT、PlanMode〔1〕〔2〕 订阅制(免费额度 + 付费档,估计值/以官网为准)〔1〕〔3〕 与阿里通义千问战略合作,接入 DeepSeek/硅基流动等国产模型〔1〕;中文团队原生中文;偏个人/团队生产力,尚未见企业级治理底座(估计值/待核实)〔3〕
OpenAI
Operator / Deep Research / Codex / Atlas
浏览器操作 + 研究 + 代码
生态最大的通用 Agent 家族:Operator 真开浏览器订餐填表;Deep Research 多源调研;Codex 云端编码;Atlas 为 Agent 内嵌的浏览器〔4〕〔8〕 Deep Research 基于 o3,HLE 得分 26.6%(此前顶级模型约 9%)〔5〕;2026.02 起可连接任意 MCP 或应用并限制可信站点〔4〕;以 API-first 进入 Azure AI Foundry,可链入企业知识库〔5〕;Codex 周活用户超 500 万并向分析/运营/金融扩散〔7〕 Pro 200 美元/月(Operator 早期仅美区)〔8〕;Deep Research:Pro 250 次/月、Plus 25 次/月〔4〕;企业版经 Azure 计费〔5〕 MCP 原生支持〔4〕;中文:企业版经 Azure 可达,产品本体英文优先〔5〕;企业成熟度:中高(3M+ 企业客户,平均每用户日省 40—60 分钟〔5〕,估计值)
Anthropic
Claude Code / Computer Use / Cowork / Dispatch
代码 Agent 标杆
终端里的软件工程 Agent:读代码库、改文件、跑命令、管 git;通过 MCP 连 300+ 外部工具〔8〕 2025.05 公开后 6 个月 ARR 破 10 亿美元,2026.02 官方披露超 25 亿美元〔6〕〔7〕;周活翻倍、企业客户贡献超一半收入〔6〕。SWE-bench 头部 70%+〔8〕;Computer Use(macOS)为 research preview,真实完成率约 19%(vs 人类 80.8%)〔9〕;Dispatch 支持手机远程指派任务〔9〕 企业版 20 美元/席/月 + 实际模型用量〔6〕;个人 Max 100—200 美元/月〔6〕;「卖工程师时间而非 Token」〔7〕 MCP 发明者,原生一等公民〔19〕〔21〕;CLI 中文可用但资料英文优先;企业成熟度:高(500+ 客户年消费超 100 万美元〔6〕)
Google
Gemini Agent / Deep Research Max / Chrome Auto Browse
工作区 + 浏览器 Agent
把 Agent 内嵌进 Workspace/Search/Chrome:邮件、日历、文档、浏览器自动操作〔9〕〔10〕 2026.05.04 关停独立 Mariner,技术并入 Gemini Agent(最多 10 个并行任务、持久云会话)〔9〕〔10〕;2026.01.29 推出 Chrome Auto Browse〔9〕;Deep Research Max 基于 Gemini 3.1 Pro:DeepSearchQA 93.3%(2025.12 为 66.1%)、HLE 54.6%〔9〕 AI Ultra 249.99 美元/月;Gemini Agent 仅美国区英语可用〔9〕〔11〕 MCP + Workspace 深度集成;中文:未开放中文区(估计值/待核实);企业成熟度:中(Mariner 时代缺团队席与审计导出,Gemini Agent 面向消费与 Workspace〔11〕)
智谱
AutoGLM / GLM-5.3
手机/浏览器操作 Agent
端侧与浏览器操作 Agent(AutoGLM 系),配合 GLM 系列基座〔8〕〔12〕 GLM-5.3(2026.08.19)AA 综合智能指数 60 分,与闭源旗舰同级、并列开源第一;Terminal-Bench 3.0 从 4.6→28.3,DeepSWE v1.1 达 66.9,CyberGym 网络安全 84.5%;以「前沿旗舰中最低单任务成本」主推〔12〕 API 定价与 GLM-5.2 持平,权重下周五开源〔12〕 接入 ZCode / GLM CodingPlan〔12〕;原生中文 + 信创适配;企业成熟度:中高(政务/金融/研报场景为主〔25〕,估计值)
腾讯 WorkBuddy
办公 Agent
「一句话让 AI 替你上班」的桌面办公智能体,感知→规划→执行→交付闭环〔8〕 2026.03.09 上线;2026.06 PC 端月访问量超 2000 万、居国内办公智能体第一(估计值)〔8〕;2026.06 发布企业版 Agent Suite〔8〕;接入企微/微信/腾讯文档/QQ/钉钉/飞书〔8〕 基础免费 + 企业按量(估计值)〔8〕 混元 Hy3 底座(自选模型用户 60%+ 选 Hy3)〔8〕;原生中文;企业成熟度:中高(国内办公场景领先,治理随企业版迭代〔8〕)
字节豆包 / 扣子(C 端)美团 CatPaw
C 端入口与全场景平台
豆包为国内最大 C 端 Agent 入口;CatPaw(2026.07.27 上线)为全场景 Agent 平台(个人工作台 + 企业托管)〔8〕 豆包 2026.04 月活 3.36 亿,国内第一(估计值)〔8〕;CatPaw 底层 LongCat 2.0(1.6 万亿参数 MoE),支持文件/浏览器/终端操作、多 Agent 协同;内部已覆盖 9 万员工、搭建 3 万+ Agent〔8〕 豆包免费+订阅;CatPaw 个人免费/企业托管按量(估计值/待核实)〔8〕 深度绑定字节生态(飞书/抖音);原生中文;企业成熟度:中(CatPaw 支持私有化部署〔8〕)
Salesforce Agentforce(企业级参照)
CRM 企业 Agent
CRM 原生企业 Agent,在工单/营销/客服流程内端到端执行〔8〕 上线半年签下 2.9 万单、ARR 约 8 亿美元;用 Data Cloud 降低幻觉,按动作计费约 0.10 美元〔8〕 按动作计费(约 0.10 美元/动作)〔8〕 中文:国内需结合本地 CRM 改造(估计值);企业成熟度:高(权限/审计/人工兜底底座成熟〔8〕)

3.2 成熟度矩阵:自主执行 × 企业生产可用性

图 2|主流 Agent 产品成熟度矩阵(2026.08)

定性判断:横轴=任务自动化与自主执行能力,纵轴=企业生产可用性;气泡大小示意产品线广度
任务自动化 / 自主执行能力 → 企业生产可用性 → 生产就绪区 自主但待生产化 企业级但偏人工编排 早期实验区 Agentforce Copilot Studio 盘古/Agentar Claude Code Codex / Cursor Deep Research Gemini Agent Manus AutoGLM WorkBuddy Operator Atlas Dify LangGraph 扣子 Coze Computer Use 豆包/Kimi 代码/研究类 通用任务/办公类 平台/框架类 企业级/垂直类
代码/研究类 通用任务/办公类 平台/框架类 企业级/垂直类

3.3 分维度解读

① 任务自动化:代码与研究最成熟,通用操作仍「能跑不能用」

近一年基准数据的跃迁集中在代码与深度研究两条线:头部代码 Agent 在 SWE-bench Verified 上稳定 70%+(2024 年还是个位数)〔8〕;Deep Research Max 在 HLE 上从 46.4% 升至 54.6%〔9〕。而浏览器/桌面操作类 Agent 仍是短板——牛津/MIT 等 2026 年研究显示最强 Computer Use 系统真实任务完成率仅约 19%,人类为 80.8%,且任务越复杂表现断崖式下滑〔8〕〔9〕。结论:「会写代码」「会读资料」已生产可用,「会替人操作任意软件」尚属早期

② 企业落地:代码 Agent 已证明「按结果付费」,通用 Agent 仍在补治理

Claude Code 是过去一年企业变现速度最快的样本:发布约一年 ARR 破 25 亿美元,企业客户贡献超半壁收入,定价从「席位」转向「席位费 + 按模型用量」〔6〕〔7〕。微软针对数万名工程师的研究显示,采用命令行 Coding Agent 的工程师合并 PR 数量平均提高约 24%〔6〕。反观通用任务 Agent(Manus、Operator 等),多为个人订阅、缺少团队席/审计/SLA,尚难作为企业系统采购(估计值/待核实)〔1〕〔9〕〔11〕。

③ 成本:从「按 Token」到「按任务」,降价潮加速生产化

2026 年 7—8 月全球模型集中降价(OpenAI GPT-5.6 Luna 降价 80%,国产模型百万 Token 低至约 0.025 元人民币量级,估计值)〔1〕〔12〕;GLM-5.3 以「前沿旗舰中最低单任务成本」定价〔12〕。更重要的是商业模式迁移:Agentforce 按动作计费(0.10 美元/动作)〔8〕、Claude Code 按席位+用量〔6〕、企业开始核算「修一个 Bug 多少钱」〔7〕——「完成一次真实交付的成本」正在取代「每百万 Token 价格」成为采购指标。

④ 生态:MCP 成「插座」,谁能插进企业系统谁赢

MCP 已成为 Agent 连接企业系统的默认插座〔19〕〔20〕〔21〕:Claude Code 原生支持、Deep Research 2026.02 起可连任意 MCP〔4〕、Dify 原生内置 MCP Client〔15〕。当前竞争焦点已从「谁的模型强」转向「谁的工具链能插进客户已有的系统」——这也是 MCP Tunnels(直连内网、无需公网端点)这类「面向受监管企业」的能力被行业视为关键信号的原因〔19〕。

⑤ 中文与本地化:国产产品全线领先,海外旗舰普遍英文优先

中文场景下,智谱 AutoGLM/GLM、腾讯 WorkBuddy、豆包、Kimi、美团 CatPaw 均为原生中文并深度绑定国内协作生态(企微/飞书/微信/钉钉)〔8〕〔12〕〔30〕;海外旗舰的 Agent 功能多数仅美国区英文可用(Gemini Agent、Operator 早期版本〔9〕〔11〕),中国企业直接采购海外通用 Agent 的可用性仍受限制(估计值/待核实)。

⑥ 安全合规:中国进入「智能体专项监管元年」

2026.05.08 国家网信办、发改委、工信部联合印发《智能体规范应用与创新发展实施意见》——国内首个国家级智能体专项政策:确立分类分级监管、建立统一登记备案平台、区分「用户决策 / 授权决策 / 自主决策」三种权限模式并保证用户知情权与最终决策权〔26〕〔27〕〔28〕;2026.07.15《人工智能拟人化互动服务管理暂行办法》施行,情感互动类 Agent 纳入专项监管〔29〕。对企业而言,Agent 采购已不只是技术选型,而是合规工程——私有化、数据不出域、行为围栏、审计追溯成为刚需(详见第七章)。

智能体开发平台对比

Agent Development Platforms

4.1 核心对比表:国内主流智能体开发平台(2026.08)

国内平台是「企业 Agent 落地」的主战场:零代码搭建、渠道分发、模型网关与私有化能力一体交付。下表覆盖 2026 年市场认知度最高的平台;定价为公开渠道口径,存在版本差异,请以官网为准

平台(厂商 / 底座) 核心能力 典型场景 定价与成本(估计值) 私有化与安全合规
扣子 Coze(字节 / 豆包、DeepSeek 等多模型)〔13〕〔30〕 国内生态最完善的低代码 Agent 平台:拖拽工作流、插件市场、知识库、多 Agent 协作;扣子 3.0 支持云端 Agent/职业模板、云手机/云电脑、本地 Agent 接入〔13〕 客服 Bot、内容创作、办公自动化、多渠道分发(飞书/抖音/微信/网页)〔13〕〔30〕 企业标准版 ¥980/月(2026.07.14 起,原 ¥498)、旗舰版 ¥8,980/月;席位 ¥29/个/月〔13〕 企业版支持 SSO、VPC 私网连接、KMS 密钥(旗舰版);个人/团队版不含〔13〕
百度千帆 / 文心智能体(百度 / 文心 ERNIE 4.5/X1)〔14〕〔25〕 Agent-first 重构千帆:聚合 150+ SOTA 模型;AppBuilder 低代码;跨智能体记忆共享;搜索 + 知识图谱增强〔14〕〔30〕 政务、法律、医疗等知识密集型场景;企业知识助手〔14〕〔30〕 AppBuilder 约 ¥0.05—0.09/千 Token、¥198/人/月(估计值);私有化约 ¥50 万/年起(估计值)〔25〕 面向央国企采购流程顺畅;支持私有化与多模态 RAG〔14〕〔25〕
阿里云百炼(阿里 / Qwen 系列)〔8〕〔14〕〔25〕 「AI 模型超市」:160+ 模型统一接入;预置 Agent 模板(电商导购/文档审核);多模型路由与效果评测;与钉钉/阿里云深度集成〔8〕〔30〕 电商导购、企业知识库、复杂任务编排、研发(Qoder 编码智能体)〔25〕〔30〕 百炼约 ¥0.06—0.10/千 Token、¥298/人/月(估计值);新用户约 7000 万 Token/90 天免费额度〔25〕〔30〕 支持私有化(Qoder 私有化约 ¥80 万/年起,估计值);阿里云合规体系〔25〕
腾讯元器(腾讯 / 混元 Hy3)〔8〕〔14〕〔25〕 微信生态原生 Agent 平台:零代码搭建,公众号/小程序/企业微信一键接入;腾讯云 ADP 覆盖构建到管控全环节〔14〕〔30〕 私域运营、社群自动化、客户全生命周期管理、微信客服〔14〕〔30〕 元器基础版约 ¥9,800/月、高级版约 ¥29,800/月,定制化约 ¥50 万起(估计值)〔25〕;ADP ¥88/188/4880 元〔30〕 深度绑定微信生态;B 端 ADP 含管控与审计能力〔14〕〔25〕
讯飞星辰(科大讯飞 / 星火 X1.5)〔14〕〔25〕〔30〕 语音能力见长:方言识别、多轮语音交互;面向教育/医疗/政务提供垂直模板;Astron Agent 已开源〔14〕〔25〕 课堂助教、医院导诊、政务语音助手〔14〕〔30〕 免费 + 增值订阅(估计值)〔30〕 全国产算力路线,信创友好〔14〕〔25〕
火山引擎 HiAgent(字节 / 豆包 Seed 系)〔14〕〔25〕 企业级智能体中台:「数字员工」+ 研发智能体 Trae;飞书/ERP 集成;权限审计、私有化部署〔14〕〔25〕 数字员工、研发提效、中大型企业流程自动化〔14〕〔25〕 公有云约 ¥0.08—0.12/千 Token;Trae 企业版约 ¥399/人/月;私有化百万级起步(均为估计值)〔25〕 私有化 + 权限审计能力完整〔14〕〔25〕
华为盘古智能体(华为 / 盘古 5.x)〔14〕〔25〕 工业/政企底座:智慧城市、产线优化、能源调度;ModelArts Studio 全链路;昇腾芯片亲和〔14〕〔25〕 制造、能源、政务、城市治理〔14〕〔25〕 公有云约 ¥0.05—0.08/千 Token(估计值)〔25〕 全链路昇腾自主可控 + Cloud Stack 私有化;信创首选〔14〕〔25〕
蚂蚁数科 Agentar(蚂蚁 / 多模型)〔14〕〔25〕 全栈高合规型:信通院最高 5 级认证、私有化部署、全链路审计〔14〕〔25〕 金融、政务、大型集团〔14〕〔25〕 估计值/待核实〔14〕〔25〕 信通院 5 级认证 + 全链路审计,合规标杆〔14〕〔25〕
Dify(开源 / 多模型)〔15〕〔16〕〔18〕 开源 Agent 中台:可视化工作流 + 生产级 RAG + 插件市场 + 模型网关;GitHub 约 15 万 Star、800+ 贡献者;2026.07 1.16.0 推出多人协作与 Agent App〔15〕〔16〕 央国企/金融私有化落地(东吴证券、广州金控等案例)、技术团队自建 AI 中台〔15〕〔16〕 社区版免费(Apache 2.0 + 附加条款);企业版付费(估计值/待核实)〔15〕 完全私有化部署、数据自主可控;但协议禁止基于源码运营多租户 SaaS〔15〕〔16〕

注:海外企业级平台参照——Salesforce Agentforce 按动作计费约 0.10 美元〔8〕;Microsoft Copilot Studio 已有 16 万组织、40 万+ 自定义 Agent 在跑〔8〕。国内平台定价与案例细节多为媒体/社区转述,标注估计值。

4.2 平台维度解读

1 亿+ 个 Agent
扣子官网展示「正在工作的 Agent」数量(2026.08,官方页面口径)〔13〕
3.36 亿 月活
豆包 MAU(2026.04,估计值)——国内最大 C 端 Agent 入口,平台分发通道成熟〔8〕
15 万 GitHub Star
Dify(2026 年中),开源 Agent 中台最活跃项目之一;LangChain 主仓约 14 万〔15〕〔16〕
50 人 项目协作
扣子 3.0 企业版单项目最大协作者数;本地 Agent 连接不限制〔13〕
  • 低代码是「上半场」,治理是「下半场」:2026 年平台竞争的叙事已从「谁最容易搭」转向「谁能安全地把 Agent 管起来」——扣子 3.0 的 SSO/VPC/KMS、HiAgent 的权限审计、Agentar 的信通院 5 级认证均是信号〔13〕〔14〕〔25〕。企业选平台应把「治理能力」当作第一筛选条件而非加分项。
  • 生态绑定决定分发效率:元器=微信、扣子=字节系、百炼=阿里/钉钉、讯飞=语音场景——平台竞争力与母体生态强相关〔14〕〔30〕。采购时应先问「我的用户在哪个生态」,而非「哪个平台最热门」。
  • 开源(Dify)成为私有化刚需的默认答案:对数据敏感、信创或央国企场景,Dify 类开源平台是事实上的默认起点;但要注意其「禁止多租户 SaaS 转售」的协议边界与超大并发下的性能短板〔15〕〔16〕。

开发框架与编排层对比

Agent Frameworks & Orchestration

5.1 核心对比表:主流 Agent 开发框架(2026.08)

2026 年框架层的标志性事件是厂商官方 SDK 全面入场(OpenAI Agents SDK、Claude Agent SDK、Google ADK、Microsoft Agent Framework),终结了 2023—2024 年 LangChain 的「准垄断」〔18〕。选型本质是在「工程可控性」「生态成熟度」「厂商绑定」之间取舍。

框架 心智模型与状态管理 生产成熟度与代表案例 生态(MCP / A2A / 可观测) 适用团队 / 权衡
LangGraph / LangChain〔16〕〔17〕〔18〕 有状态 StateGraph:节点+条件边,Checkpoint 持久化、时间旅行调试、HITL 节点级审批〔17〕〔18〕 生产级默认选择;PyPI 月下载量千万级;Klarna 客服助手(月 230 万对话 ≈ 700 名全职客服)基于 LangGraph〔16〕 MCP 社区集成;LangSmith/Langfuse 可观测;模型无关〔17〕〔18〕 复杂多步工作流、审计与合规场景;代价:学习曲线陡、API 多次断裂、2025-2026 披露多个高危 CVE〔16〕
CrewAI〔16〕〔17〕〔18〕 「团队」心智:Role/Goal/Backstory/Tools→Crew;顺序/层级/共识流程抽象〔18〕 多 Agent 业务协作增长最快;PwC 内部代码生成 Agent 可用比例从个位数提升至约 70%(估计值)〔16〕 MCP 生态;A2A 支持逐步完善;可观测性持续改进〔17〕〔18〕 业务映射清晰的「Agent 团队」快速搭建;代价:复杂控制流弱于 LangGraph〔17〕
AutoGen / AG2〔16〕〔17〕〔18〕 会话式多 Agent(对话流为原语);v0.4/0.5 后官方移交社区,AG2 为 Apache-2.0 分叉〔16〕〔18〕 研究与人机协同场景首选;生产基座偏小〔17〕〔18〕 模型无关〔17〕;生产项目不建议新起 AutoGen〔16〕 学术研究、对话式多 Agent 实验;企业新项目优先微软 MAF〔16〕〔18〕
Microsoft Agent Framework(AutoGen+Semantic Kernel 合并)〔16〕〔18〕 SK 企业机制(观测/SLA/合规)+ AutoGen 图编排 + A2A/MCP 协议;三语言 API 一致(.NET/Python/Java)〔16〕〔18〕 2026.04.02 1.0 GA;Azure 生态企业标准;企业治理与合规最强〔16〕〔18〕 原生支持 MCP/A2A;Azure AI Foundry 深度集成〔16〕〔18〕 Azure/.NET 栈企业;代价:Python 生态成熟度弱于 LangGraph〔16〕〔18〕
Google ADK(Agent Development Kit)〔18〕 面向 Gemini 生态;Python/Java 双语言;A2A 协议一等公民;Vertex AI 深度集成〔18〕 2025 年中发布;适合已上 GCP/Vertex AI 的团队;Java 支持利于传统企业〔18〕 A2A 原生 + Vertex Model Garden 多模型〔18〕 GCP/Java 栈团队;代价:Gemini 生态绑定〔18〕
OpenAI Agents SDK〔16〕〔17〕〔18〕 Agent/Handoff/Guardrail/Runner 最少原语;内置追踪与护栏〔17〕〔18〕 OpenAI 生态最快上手;切换 Claude/Gemini 需重写〔17〕〔18〕 原生 MCP;追踪深度集成 OpenAI 平台〔17〕〔18〕 深度使用 OpenAI 模型的团队;代价:跨模型支持差〔17〕〔18〕
Claude Agent SDK〔18〕 Sub-agent 任务分解;Claude 长上下文/工具使用深度优化;MCP 一等公民(Claude Code 即构建其上)〔18〕 以 Claude 为核心的 Agent 应用首选〔18〕 MCP 原生〔18〕〔19〕 Claude 深度用户;代价:Anthropic 依赖〔18〕
Dify / Coze Studio(平台型开源)〔13〕〔15〕〔16〕 可视化 DAG 工作流 + DSL(可被 Git 管理);Dify 1.16 支持多人协同编辑与 Agent App〔15〕 企业私有化 AI 中台;案例:东吴证券数据治理、广州金控多模型池〔15〕〔16〕 原生 MCP Client/Server;插件市场国产模型安装量数十万至百万级〔15〕〔16〕 「不写代码也能上线 + 私有化」的团队;代价:非纯框架,企业版能力与协议边界需评估〔15〕

5.2 技术栈分层:2026 年 Agent 架构的「标准答案」

图 3|2026 年 Agent 技术栈分层与协议位置

MCP=Agent 向下连接工具/数据(纵向),A2A=Agent 之间横向协作;两者均已落户 Linux 基金会〔19〕〔20〕〔21〕〔26〕
应用与入口层 ChatGPT / Claude / Gemini / Manus / WorkBuddy / 豆包 / Kimi / CatPaw… 用户直接接触的 Agent 终端:订阅或按量付费 智能体开发 / 企业平台层 扣子 Coze / 千帆 / 百炼 / 元器 / HiAgent / Agentforce / Copilot Studio 零代码搭建、渠道分发、企业治理(SSO/审计/私有化) 框架与编排层 LangGraph / CrewAI / MAF / ADK / OpenAI SDK / Claude SDK / Dify / Coze Studio 状态编排、多 Agent 协作、记忆、可观测性(HITL/审计钩子) 模型层 GPT / Claude / Gemini / GLM / DeepSeek / Qwen / 豆包 / 混元 / 文心 / 星火 企业系统 / 工具 / 数据 CRM / ERP / 数据库 / 浏览器 / 文件 / 邮件 / 知识库 / API 通过 MCP Server 暴露,一处接入、全 Agent 复用 MCP Agent↔工具/数据 (Linux 基金会) A2A(Agent↔Agent 协作,Linux 基金会,150+ 支持组织) 治理与合规层 贯穿全部技术层 政策与备案 《智能体实施意见》(2026.05) 权限分级 用户/授权/自主决策 行为围栏 边界限定+可追溯 审计与追溯 全链路日志/防投毒 数据不出域 私有化/本地模型 OpenClaw 事件警示: 指令诱导可触发网络攻击〔26〕
MCP:Agent 向下连工具/数据 A2A:Agent 之间横向协作 治理与合规贯穿全栈

5.3 框架维度解读

  • 框架决定「工程能力」而非「智能上限」:2026 年共识是「框架不决定智能上限,只决定能不能可靠上生产」〔16〕。Gartner 预警 2027 年底前超过 40% 的 Agentic AI 项目可能被取消〔16〕——多因「Demo 能跑、生产塌方」,框架层的可观测、状态恢复、人审拦截是止血关键。
  • 「标准收敛」的双面性:厂商官方 SDK(OpenAI/Anthropic/Google/微软)+ 中立协议(MCP/A2A)同时出现,意味着生态从「碎片化胶水」走向「分层标准」〔18〕〔20〕〔21〕;但选型时必须警惕厂商绑定——Agent SDK 的 Handoff/护栏/追踪往往只对其自家模型完整可用〔17〕〔18〕。
  • 开源仍是国内私有化的默认选择:Dify 等平台型开源项目在央国企与金融的私有化落地密度最高〔15〕〔16〕,其「低代码 + RAG + MCP + 私有化」组合正与 Coze Studio 等共同成为「信创 Agent 底座」的主流候选〔16〕。

近一年关键动态时间线

Key Dynamics — 2025.08 → 2026.08

6.1 产品与商业化动态

2025.05 → 2025.11
Claude Code 商业化起飞:公开约 6 个月,年化收入运行率破 10 亿美元
终端编码 Agent 首次证明「按结果收费」的 Agent 商业模式;同期 Cursor ARR 破 20 亿美元〔6〕〔8〕。
来源〔6〕〔8〕
2025.10.21
OpenAI 发布 ChatGPT Atlas:Agent 内嵌的浏览器
Agent Mode 在浏览器层直接替用户操作网页,桌面端先行〔9〕。
来源〔9〕
2025.10.22
LangChain 与 LangGraph 双双 1.0 GA
框架层从「胶水库」走向 Agent Runtime;长事务编排交给 LangGraph〔16〕。
来源〔16〕
2025.12.29
Meta 官宣约 20 亿美元收购 Manus(年化收入约 1 亿美元)
通用 Agent 首次被科技巨头以数十亿美元估值并购,随后进入安全审查流程〔1〕〔2〕〔3〕。
来源〔1〕〔2〕〔3〕
2026.01 — 2026.03
Manus 连续迭代:Skills、My Computer、Desktop 应用、Cloud Computer
从「完成一次任务」走向「接管计划→执行→交付的整套工作流」〔2〕〔3〕。
来源〔2〕〔3〕
2026.02
Anthropic 官方披露 Claude Code 年化收入运行率超 25 亿美元;Deep Research 可连任意 MCP
企业客户贡献超一半收入、周活翻倍;研究 Agent 正式进入企业级 API(Azure AI Foundry)〔4〕〔5〕〔6〕〔7〕。
来源〔4〕〔5〕〔6〕〔7〕
2026.03
腾讯 WorkBuddy 上线(3.09);Anthropic 推出 Dispatch 与 macOS 原生 Computer Use(3.17—3.23)
国内「办公 Agent 入口」战打响;海外桌面操作 Agent 从 API 走向消费级产品〔8〕〔9〕。
来源〔8〕〔9〕
2026.04.02
微软合并 AutoGen 与 Semantic Kernel 为 Microsoft Agent Framework 1.0
.NET/Java/Python 三语言一致的官方 Agent 框架,企业治理向 Azure 收敛〔16〕〔18〕。
来源〔16〕〔18〕
2026.04.27
发改委叫停 Meta 收购 Manus;Manus 进入拆分过渡期
地缘政治第一次实质改写通用 Agent 的资本版图;Manus 保持产品迭代〔2〕〔3〕。
来源〔2〕〔3〕
2026.05.04
Google 关停独立 Project Mariner,技术并入 Gemini Agent;Chrome Auto Browse(1 月)接力
「浏览器单点 Agent」让位于「Workspace 内嵌 Agent」;Agent 竞赛收敛到邮箱/日历/文档/搜索〔9〕〔10〕。
来源〔9〕〔10〕
2026.05.28
Anthropic 完成 AI 史上最大单轮融资 650 亿美元,投后估值 9650 亿美元(超 OpenAI)
资金重仓企业 Agent 与算力;市场预计 2026.10 以约 2 万亿美元估值 IPO〔7〕〔8〕。
来源〔7〕
2026.06
OpenAI Codex 周活破 500 万并向非编程场景扩张;Anthropic 企业 LLM 份额反超 OpenAI(32% vs 25%)
Coding Agent 成为两大巨头争夺「企业数字员工入口」的正面战场〔7〕〔8〕。
来源〔7〕〔8〕
2026.07.14
扣子 Coze 3.0 企业版发布并调价(标准版 ¥498→¥980/月)
多 Agent 协作、模型自定义、SSO/VPC/KMS 等企业权益上线,平台从「创作者工具」升级为「企业中台」〔13〕。
来源〔13〕
2026.07.24 — 07.28
Claude Opus 5 发布;MCP 2026-07-28 规范正式发布(无状态核心 + Extensions/Tasks/MCP Apps)
MCP 史上最大版本修订,企业规模化部署门槛大幅下降〔12〕〔19〕〔22〕。
来源〔12〕〔19〕〔22〕
2026.07.27
美团 CatPaw 上线:全场景 Agent 平台(LongCat 2.0 底座)
国内大厂新一轮 Agent 平台卡位;本地生活场景深度整合〔8〕。
来源〔8〕
2026.08.11 — 08.19
Manus 恢复独立运营;DeepSeek V4-Pro GA;智谱 GLM-5.3 上线;Anthropic ARR 被曝 650 亿美元
通用 Agent 重回独立发展;国产模型以「低成本 + 高智能」冲击前沿价格带〔1〕〔7〕〔12〕。
来源〔1〕〔7〕〔12〕

6.2 政策与标准动态

2025.09.01
《人工智能生成合成内容标识办法》施行(配套强制国标 GB 45438-2025)
Agent 生成内容需显式+隐式标识,为 Agent 落地设置「内容可溯源」底线〔29〕。
来源〔29〕
2025.12
Anthropic 将 MCP 捐赠给 Linux 基金会「Agentic AI Foundation」(OpenAI、Google、微软等联合共建)
MCP 从「Anthropic 的协议」成为「行业的协议」,进入中立的标准化治理〔19〕〔21〕〔22〕。
来源〔19〕〔21〕〔22〕
2026.01.01
新修订《网络安全法》施行,设 AI 专条(第 20 条)
明确支持 AI 发展与加强安全监管并重,为智能体监管提供上位法依据〔29〕。
来源〔29〕
2026.04 — 05
A2A v1.0 落地 Linux 基金会(150+ 支持组织);2026.05.08 国家三部委《智能体规范应用与创新发展实施意见》
国内首个国家级智能体专项政策:分类分级监管、统一登记备案平台、三分权限模式、2026 重点行业试点/2027 规模化应用〔20〕〔26〕〔27〕〔28〕。
来源〔20〕〔26〕〔27〕〔28〕
2026.07.15
《人工智能拟人化互动服务管理暂行办法》施行(网信办等五部门)
情感互动类 Agent 纳入专项监管,服务提供者须标识「非真人」并设未成年人保护机制〔29〕。
来源〔29〕
2026.07 — 08
WAIC 2026 发布「智能体互信互联互操作全球合作倡议」;OpenClaw 安全事件引发全球监管讨论
智能体间互操作与安全边界成为国际治理焦点;「指令诱导发起网络攻击」等风险被正式写入政策解读〔26〕〔28〕。
来源〔26〕〔28〕

企业落地路径建议

Enterprise Adoption Roadmap

基于第三至第六章的对比结论,对「先上什么场景、用哪个产品/框架、组织怎么配合」给出 5 条可执行建议。原则:先用成熟品类拿确定性 ROI,再向核心流程扩展;先搭治理框架,再放自主权限

1

场景先行:客服 / 营销 / 研发三条线优先,每个场景设 6 个月 ROI 门槛

已跑通商业闭环的场景依次是编码 Agent(Claude Code/Codex,企业已按结果付费〔6〕〔7〕)、CRM/客服 Agent(Agentforce 按动作计费〔8〕)、知识密集型 Agent(Deep Research 系,HLE 54.6%〔9〕)。建议以「客服(降低成本)+ 营销(拉动收入)+ 研发(交付效率)」三线切入,每个场景上线前定义可量化基线(如首次响应时间、PR 合并数、人效),6 个月不达标即下架——把「40%+ 项目被取消」的风险前置化解〔16〕〔23〕。

2

选型分层:开发团队用框架,业务团队用平台,个人提效用通用 Agent

给三类角色的默认答案:技术团队自建核心流程 → LangGraph/微软 MAF/Dify(生产成熟度最高、可审计〔16〕〔17〕〔18〕);业务团队快速搭建 → 扣子/百炼/元器(零代码 + 渠道分发,按生态归属选择〔13〕〔14〕〔30〕);员工个人提效 → WorkBuddy/豆包/Claude Code 等〔8〕。切忌「一个平台包打天下」——平台与框架应共存,平台做边缘场景的快速交付,框架承载核心生产链路。

3

治理先行:成立「Agent 治理委员会」,按《实施意见》三分权限分级放权

对标 2026.05 政策要求:区分「仅限用户本人决策 / 用户授权决策 / 智能体自主决策」三种模式,明确用户知情权与最终决策权〔26〕〔27〕。建议设跨部门治理委员会(IT + 安全 + 法务 + 业务),对每个 Agent 做「风险等级评估(低/中/高)→ 权限设定 → 上线前评审」,高风险场景(支付、合同、对外发布)强制人工审批节点。组织上同步配置「Agent 运营者」岗位——未来每 10—20 个生产 Agent 需要 1 名运营者负责持续调优与异常处置。

4

安全合规内嵌:MCP 服务器清单化管理 + 数据不出域 + 全链路审计

三件套:① MCP 治理——建立企业批准的 MCP 服务器清单与权限授予流程,MCP 服务器权限过大是 2026 年头号安全风险〔21〕;② 数据边界——敏感数据优先私有化部署(Dify/盘古/HiAgent 私有化方案)或「本地模型 + 云端调用」双轨〔15〕〔16〕〔25〕,严格数据不出域;③ 审计追溯——所有 Agent 执行留日志、可回放、可追溯,对应「行为围栏」与防投毒要求〔26〕〔29〕。OpenClaw 事件表明:自主权限越大,监管与审计成本越高——放权速度应慢于信任建立速度〔26〕。

5

重构预算与采购模式:从「席位」到「任务/成果」,与供应商共担 ROI

Agent 时代采购单位正在从「每人每月的席位」迁移到「每完成一个任务的成本」〔6〕〔7〕〔8〕。建议:① 预算上把「Agent 消耗」从 IT 预算单列,按业务部门「任务量」归集成本,让 ROI 可核算;② 采购时优先选择支持按动作/按成果计费或「基础席位 + 用量」的产品(Agentforce、Claude Code 模式〔6〕〔8〕);③ 与供应商约定「失败共担」条款(试点未达标不续费)——把目前行业最高的信任缺口(40%+ 项目被取消〔16〕)转化为自己的议价筹码。

组织配合要点(一句话版):Agent 落地本质是「把人机协同写进组织」——① 一把手把 Agent 预算与 ROI 纳入业务线考核;② IT 从「运维者」变为「Agent 平台运营者」;③ 法务/合规前置介入每个 Agent 的权限评审;④ 全员「Agent 素养」培训(会下任务、会审结果、会止损)与企业知识库/工具链的持续沉淀。

结论

Conclusions — 从演示到生产

8.1 差距:「演示到生产」的四道门槛

门槛 现状证据 跨越路径
① 可靠性 最强 Computer Use 完成率约 19%(人类 80.8%)〔9〕;88% 企业停在单 Agent Demo〔23〕;Gartner 预警 2027 前超 40% 项目被取消〔16〕 限定任务边界、引入人工审批节点(HITL)、用框架级 Checkpoint/状态恢复兜底〔16〕〔17〕;对「任务越复杂成功率断崖」保持现实预期〔9〕
② 集成 企业最大的障碍不是模型性能而是集成复杂度〔21〕;MCP Tunnels 等内网连接能力仍是新特性〔19〕 以 MCP 为标准做工具接入(一处接入、全 Agent 复用)〔20〕〔21〕;从「连接 API」升级为「连接老系统/无 API 系统」〔14〕
③ 治理 OpenClaw 指令诱导攻击事件〔26〕;政策要求备案、分级、权限三分〔26〕〔27〕;MCP 权限过大是 2026 头号风险〔21〕 把合规从「上线前补课」变成「开发内嵌」:行为围栏、最小权限、全链路审计〔26〕〔29〕
④ ROI 度量 企业开始按「修一个 Bug / 交付一个 PR / 完成一个动作」算账〔6〕〔7〕〔8〕;成功的 Agent 部署平均 ROI 约 171%(美国 192%,估计值)〔23〕 部署前定基线、上线后按月度量、按任务归集成本;用「成果计费」类产品把供应商与自身利益对齐〔6〕〔8〕

8.2 2026 判断:五条方向性结论

  1. Agent 从「演示」走向「生产」是当前最大主题:品类的有效性已被商业化数据证明(Claude Code 25 亿美元 ARR、Agentforce 8 亿美元 ARR〔6〕〔8〕),2026 下半年的竞争焦点是「谁先规模化跨过生产化门槛」,而非「谁的 Agent 更炫」。
  2. 「代码 → 研究 → 客服/营销 → 全流程」是价值兑现的固定顺序:最贵劳动、最易度量、最低风险先跑通〔6〕〔7〕〔8〕;通用「数字员工」短期仍是叙事,中长期才成现实。
  3. 标准协议(MCP/A2A)会把 Agent 变成「可插拔的基础设施」:Linux 基金会治理 + 无状态 MCP 规范 + A2A v1.0,正在复刻「Kubernetes 时刻」〔19〕〔20〕〔21〕——技术选型的锁定风险下降,平台层竞争加剧。
  4. 中国市场的特殊变量是政策与生态:《智能体规范应用与创新发展实施意见》把「合规」变成 Agent 采购的刚需属性〔26〕〔27〕;国产模型(GLM-5.3 并列开源第一、DeepSeek V4-Pro)以低成本追平前沿〔12〕;微信/企微/飞书生态决定分发〔14〕〔30〕——「信创 + 合规 + 生态」组合拳是国内 Agent 落地的门票
  5. 对企业:现在不是「要不要上 Agent」,而是「以多快的速度、在多严的治理下上」。建议按「6 个月三个场景验证 → 12 个月治理体系成型 → 18 个月向核心流程扩展」的节奏推进,并把「Agent 运营者」与「人机协同机制」视为与工具同等重要的投资。
分析师结语:2025.08—2026.08,AI Agent 完成了从「可演示的 Demo」到「可采购的生产力」的品类确立;2026 年下半年的胜负手是「可靠交付 × 治理合规 × ROI 可度量」。对 AICOR 而言,市场最稀缺的不是又一个 Agent 平台,而是能把 Agent「装进组织」的交付能力——这与本机构「企业 AI 重构 + 人机协同组织」的方法论定位高度契合,也是下一阶段最值得押注的能力象限。

数据来源清单与估计值声明

Appendix — Sources & Estimates

数据来源清单(检索时间:2026 年 8 月 19 日)

  1. 财联社/科创板日报《Manus 官宣恢复独立运营 剑指通用 Agent》2026-08-12
  2. 腾讯新闻《Manus 浪子回头,还保住了 20 亿美元身价》(Manus 年化收入 4-5 亿美元、功能迭代等)
  3. zgeo.net《Manus 独立运营:AI Agent 并购审查后的产品迭代与市场启示》2026-08-12
  4. OpenAI 官方博客《Introducing deep research》及 2026-02-10 更新(MCP 连接、使用额度等)
  5. agentmarketcap.ai《OpenAI Deep Research Goes Enterprise》2026-04-08(HLE 26.6%、Azure AI Foundry、企业效率数据)
  6. 北京商报/新浪财经《营收大爆发 Anthropic 冲击史上最大 IPO》2026-08-18(Claude Code ARR、企业份额、微软工程师研究)
  7. 机器之心Pro/网易科技《Anthropic 年化营收突破 650 亿美元》2026-08-18;及编码 Agent 商业化深度分析《Claude Code 到底有多赚钱》
  8. 腾讯新闻·浮世Talk《2026 AI Agent 版图:六类 Agent 全景》(Agentforce、Copilot Studio、WorkBuddy、豆包、CatPaw、垂直 Agent 等)
  9. aiwiki.ai《Computer use》《Gemini (language model)》(Computer Use 19% vs 人类 80.8%、Dispatch、Deep Research Max 分数、Mariner 关停)
  10. ailearningguides.com《Google Folds Project Mariner Into Gemini Agent on May 4》2026-05
  11. agentmarketcap.ai《Google I/O 2026 Post-Event Scorecard》2026-05-21(Mariner 定价与能力、Gemini 3 Deep Think)
  12. 凤凰网科技/IT时代网《智谱 GLM-5.3 上线》2026-08-19(AA 指数 60、Terminal-Bench 4.6→28.3、DeepSWE 66.9、CyberGym 84.5%)
  13. 扣子 Coze 开放平台官方文档《企业版套餐定价调整》《企业版计费规则》及官网 2026-07(3.0、SSO/VPC/KMS、调价)
  14. 腾讯新闻《2026 企业级智能体平台全景盘点:四大类型与选型风向标》2026-07-03(千帆 Agent Infra、元器、Dify、LangChain 定位与选型)
  15. 开源社区深度实践《Dify 开源深度实践:从企业部署到二次开发的全景拆解》2026(15 万 Star、架构、金融案例、协议边界、1.16.0)
  16. CSDN/腾讯云开发者社区《从 API 调用到智能编排:LLM 框架 2026 全景解析》(LangGraph 1.0、MAF 1.0、CVE、Gartner 40% 取消率、PwC/CrewAI 案例)
  17. aiagentrank.io《LangGraph vs CrewAI vs AutoGen vs OpenAI Agents SDK 2026》(心智模型、生产成熟度对比)
  18. agentlist.top《Best AI Agent Frameworks in 2026》(十框架对比、厂商官方 SDK 终结 LangChain 垄断)
  19. agentinterface.app《The agent-interface tracker》2026-08-13(MCP 2026-07-28 规范、官方注册服务器、A2A/A2A v1.0、ACP 合并)
  20. cruxdigits.nl《MCP vs RAG vs AI Agents vs A2A: The 2026 Stack》(分层架构、Linux 基金会治理)
  21. gravity.fast.blog《AI Agent Interoperability Standards 2026》(MCP/A2A/AGNTCY/WebMCP 治理框架)
  22. dev.to《AI Weekly: Stateless MCP》2026-07(2026-07-28 规范、97M 月 SDK 下载、81K Stars)
  23. ima.qq.com 知识库《2026 AI Agent 市场综述》《CIO+AI 中小企业数字化转型》汇总(Gartner 79%/40%、IDC 109 亿美元/503 亿/22 亿、Anthropic 15 倍、ROI 171% 等转述)
  24. 数智前线(腾讯新闻转载)《从个人 Agent 到企业级数字分身:组织 AI native 转型的最后十公里》2026-08-05(IDC 22 亿、中国智能体市场数据、电商 Agent 渗透观察)
  25. CSDN《国内外知名的企业级智能体 Top10 与收费标准》2026(HiAgent/百炼/千帆/元器/盘古定价与定位)
  26. 国家网信办官网《专家解读:把握智能体发展机遇,加快构建智能体治理体系》2026-05-08(《实施意见》解读、OpenClaw 风险)
  27. 深圳市司法局转载《智能体规范应用与创新发展实施意见》全文 2026-05(34 条、分级监管、三分权限)
  28. 江西政务网《2026 年国务院及各部委人工智能、具身智能相关政策梳理》(试点/备案/合规认证时间表)
  29. 银融时代《国内智能体安全规范四层体系全景解读》2026-08-04(《网络安全法》AI 专条、《拟人化互动办法》、标识办法 GB 45438-2025)
  30. 腾讯元器官网、百度文心智能体官网、阿里云百炼文档、讯飞开放平台及第三方平台横评汇总 2026

估计值 / 待核实数据声明

以下数字或来自单一媒体转述、或为预测口径、或为厂商非审计披露,本报告保留并标注「估计值/待核实」,引用时请谨慎:

  • Anthropic 公司整体 ARR「650 亿美元」(2026.07,投资人披露、未经审计;官方最后确认口径为 5 月超 470 亿美元)〔6〕〔7〕
  • Manus 年化收入「4—5 亿美元」、估值「20 亿美元」(媒体转述)〔2〕〔3〕
  • 全球 AI Agent 市场「2026E 109.1 亿美元、2030E 503 亿美元」(IDC/SaaSUltra 口径,另有机构给 100—120 亿美元区间,口径未统一)〔23〕
  • Gartner「79% 组织已启动 Agent 部署」「72% Global 2000 进入试产」(均为二次转述)〔23〕
  • Anthropic 研究「多智能体编排将 90.2% 复杂任务完成度提升 15 倍」「57% 组织部署多阶段 Agent」(研究结论转述)〔23〕
  • 国内平台定价:元器 ¥9,800/29,800 元、HiAgent 私有化百万级、Trae ¥399/人/月、DuClaw ¥199/人/月、千帆/百炼订阅价等(均来自 CSDN 等第三方转述,请以官网实时报价为准)〔25〕
  • MCP「月 SDK 下载量」存在 97M(2026.03,官方规范博客)与 400M(2026.08,媒体)两种口径,官方暂未统一,正文以「近亿次」保守表述〔19〕〔22〕
  • 中国企业级 AI 智能体市场「2029F 3320 亿元」(赛迪顾问预测值,非实际数据)〔23〕〔24〕
  • 腾讯 WorkBuddy「PC 端月访问 2000 万+」「豆包 MAU 3.36 亿」「扣子 1 亿+ Agent」等运营数据(官网/媒体口径,未经第三方审计)〔8〕〔13〕
  • 成功部署的 Agent 项目「平均 ROI 171%(美国 192%)」(IDC/Digital Applied 分析转述)〔23〕
  • GitHub Star 数(Dify 15 万、LangChain 14 万、MCP 8.1 万等)为 2026 年检索时点快照,实时变动〔15〕〔16〕〔22〕
  • 图 2 成熟度矩阵中各家产品定位为分析师基于公开信息的定性判断,非实测数据
← 返回咨询报告列表

对号入座之后,
下一步是一次真实诊断

报告识别的是市场机会,诊断解决的是你的企业机会——2 分钟在线定位,45 分钟真人专家诊断。