从人机交互到机机交互的范式跃迁
当前的 Web 体系是专为人类视力与手工点击设计的(充满 HTML、CSS 渲染与弹窗广告)。对于智能体而言,这些设计充斥着巨大的信息熵增。
机机交互与人机交互的根本差异在于交互对象从"页面"变成了"契约":人类容忍模糊的界面并自行理解意图,智能体需要机器可读的能力描述、明确的调用语义与可验证的授权边界。可以先厘清 MCP 在其中的位置——MCP 解决的是纵向的"模型连接工具",A2A 瞄准的是横向的"智能体连接智能体",两者是互补层而非竞争层,类似的层次之争可参考 MCP 与传统 RESTful API 的终极对比:为什么它是专属于 AI 时代的接口范式。
正在形成的 A2A 协议基座
- 去中心化身份(DID for Agents):每个 Agent 拥有唯一的公私钥对与可验证凭证(Verifiable Credentials),证明其代表的组织与授权范围;
- 语义化服务发现(Semantic Service Brokering):Agent 发布自己的能力描述与 SLA 承诺,其他 Agent 按需实时招标并委托子任务;
- 微支付流转(Machine Micropayments):基于闪电网络或稳定币结算,Agent 调用一次外部专属计算工具即刻完成零点几美分的即时清算。
三大基座缺位时的后果
| 协议层 | 解决的问题 | 如果缺失会发生什么 |
|---|---|---|
| 身份层(DID) | 你是谁、代表谁、被授权做什么 | 无法追责,提示注入可伪装成任意委托方 |
| 发现层(语义招标) | 谁能干这个活、代价与SLA几何 | 只能硬编码点对点集成,生态无法扩展 |
| 结算层(微支付) | 按调用粒度即时清算 | 小额高频调用无账可结,只能粗粒度包月 |
三层必须成环才有意义:没有身份的发现是噪声,没有结算的发现是空谈。
A2A 成熟前的今天:自建 Agent 的准备度自查
- 能力自描述:你的 Agent 是否有一份机器可读、随版本更新的能力清单,而不是只写在产品页的人类文案里?
- 授权独立:每个对外委托是否携带范围受限的凭证,避免一个 Agent 失陷等于整个组织失陷?
- 计量就绪:每次工具调用是否有独立的请求计数与成本归集,为未来按次结算留好数据底座?
- 审计留痕:跨主体委托的完整链路(谁发起、谁接受、结果如何)能否事后还原?
以上四条在现有 MCP 工具生态里就能逐步建设,属于"协议未动、架构先行"的部分,与协议本身何时定稿解耦。
常见问题速查
| 现象/疑问 | 原因/背景 | 处理/建议 |
|---|---|---|
| 担心 Agent 被冒名委托 | 缺少可验证身份与授权凭证 | 先做凭证范围最小化与调用白名单 |
| 跨 Agent 任务失败难定责 | 委托链路没有完整审计日志 | 为每次委托生成可追溯关联 ID |
| 微支付看起来还很远 | 结算层依赖身份与计量先行 | 先做好按次计量,支付通道后接 |
| 与 MCP 该选哪个 | 两者层次不同 | 工具接入用 MCP,主体协作观察 A2A |
小结
对 A2A 的理性姿势是"观察协议、先建地基":可执行的检验标准是上面四条自查——能力可自描述、授权可独立、调用可计量、链路可审计。四条全满足的团队,无论未来哪个协议胜出都能低成本对接;一条都没有的团队,讨论协议先后没有意义。