欢迎光临
我们一直在努力

谷歌再次重磅发布 AI 智能体新标准 A2UI

大家好,我是玄姐。

▼ 《2025年AI 技术总结》直播,预约保你有收获

继多 AI 智能体协议 A2A 之后,谷歌再度抛出 AI 智能体领域的 "王炸":UI 智能体协议 A2UI(Agent-to-User Interface)。A2UI 是一个开源项目,包含一套专为“可更新的智能体生成 UI”而优化的格式,以及首批渲染器,让智能体能够生成或填充丰富的用户界面。这一开源项目凭借创新的技术架构与灵活的应用特性,正为互联网、车载座舱、游戏交互等多个领域带来颠覆性变革,让 AI 智能体生成丰富可交互的用户界面成为现实。

Gallery of A2UI components

一、核心定位:让智能体 "会说 UI"

生成式 AI 在文本与代码生成领域早已展现强大能力,但智能体在向用户呈现丰富、可交互的界面时却常显乏力,尤其在远程运行或跨越信任边界的场景下更是受限。A2UI 的出现恰好解决了这一痛点:它并非复杂的执行代码,而是一套开放标准与库,通过 "声明式 JSON 描述 + 客户端原生渲染" 的模式,让智能体能够安全、高效地生成或填充用户界面。

简单来说,智能体只需发送一份描述 UI 意图的 JSON 文件,客户端应用便可调用自身的原生组件库(例如:Flutter、Angular、Lit 等)完成渲染。这种方式既保留了数据传输的安全性,又具备代码级别的表现力,实现了 "安全与灵活兼得"。

二、四大核心设计理念

A2UI 的突破性源于其底层的设计哲学,四大核心原则支撑起全场景适配能力:

  • 安全优先(Security First):规避 LLM 生成任意代码的安全风险,A2UI 采用声明式数据格式,客户端仅加载预批准的可信组件(例如:卡片、按钮、输入框等),智能体只能请求渲染该组件目录内的元素,从源头筑牢安全防线。

  • LLM 友好且支持增量更新:UI 以带 ID 引用的扁平组件列表形式呈现,便于 LLM 逐步生成,支持渐进式渲染与响应式体验。随着对话推进,智能体可根据新请求高效修改 UI,无需整体重构。

  • 框架无关且可移植:将 UI 结构与实现彻底分离,智能体仅发送组件树描述与数据模型,客户端负责映射到原生控件,无论是 Web 组件、Flutter Widget,还是 React 组件、SwiftUI 视图,同一份 A2UI JSON 可在多框架客户端上正常渲染。

  • 高度灵活性:提供开放注册表模式,支持开发者将服务端类型映射到自定义客户端实现,涵盖原生移动控件、React 组件乃至遗留内容的安全 iframe 容器。开发者可通过 "Smart Wrapper" 接入现有 UI 组件,同时掌控安全沙箱策略与 "信任阶梯",灵活度完全由开发者掌控。

三、典型应用场景

A2UI 的落地能力已在多个场景中得到验证,展现出广泛的实用性:

  • 动态数据收集:智能体可根据对话上下文即时生成定制表单,例如:日期选择器、滑块、输入框等,适配酒店预订、特殊服务申请等场景。

  • 远程子智能体协作:编排智能体将专项任务委派给远程专业智能体(例如:差旅预订智能体),后者返回的 UI 负载可直接嵌入主聊天窗口,实现无缝交互。

  • 自适应工作流:企业场景中,智能体可根据用户查询实时生成审批仪表板、数据可视化界面,提升办公协作效率。此外,A2UI 还支持定制化组件开发与竖屏架构适配,相关 demo 视频如下所示,直观展示其多样化能力。

▼ 定制化组件 demo

▼ 竖屏架构 demo

  • 举个 A2UI 具体的例子:

假设你用手机上的智能助手规划商务出差,A2UI 的作用的具体场景:

你对智能助手说:“帮我订一张下周三从北京去上海的早班机票,要经济舱,顺便选一个离陆家嘴近的四星级酒店,预算每晚不超过 1500 元”。

按传统交互,助手会分多轮问你 “要哪个航空公司”“起飞时间具体在几点到几点之间”“酒店是否需要含早餐” 等问题,来回好几轮才能确认完所有信息;

而有了 A2UI 后,智能助手不会只回复文本,而是直接生成一个 统一风格的交互式界面:

顶部是 “机票预订” 模块(含日期已锁定 “下周三”、出发地 “北京”→目的地 “上海”,下方是筛选组件:航空公司下拉框、起飞时段滑块(6:00-10:00)、舱位默认 “经济舱”,还有实时刷新的机票列表卡片,显示航班号、起飞时间、价格、剩余票数);

中部是 “酒店选择” 模块(已筛选 “陆家嘴周边”“四星级”“≤1500 元 / 晚”,展示酒店卡片:含图片、名称、距离陆家嘴的距离、用户评分、是否含早选项,支持点击 “查看详情” 展开房型列表);

底部是 “确认提交” 按钮和 “修改需求” 入口。

你不用打字回复,直接在这个界面上点选、滑动就能完成所有选择 ,比如选好某趟航班、勾选 “含早” 酒店,点击提交后,助手再通过 A2UI 生成支付表单和订单确认卡片,全程无需多轮文本沟通,所有操作都在可视化界面上完成,且这个界面和你手机系统的原生样式保持一致(比如 iOS 上是 SwiftUI 风格,Android 上是 Flutter 风格),体验流畅又安全。

四、端到端架构流程

A2UI 通过 "生成 – 传输 – 解析 – 渲染" 的全流程解耦设计,确保交互的流畅性与稳定性,具体流程如下:

End-to-End Data Flow

服务端流传输:服务端通过服务器发送事件(SSE)传输 JSONL 流;

客户端缓冲:客户端解析消息,存储组件定义(surfaceUpdate)并构建数据模型(dataModelUpdate);

渲染信号触发:服务端发送 "beginRendering" 信号,避免不完整内容闪现;

客户端渲染:客户端从根节点递归遍历组件树,解析数据绑定,从组件注册表中实例化原生控件;

用户交互:用户执行点击等操作,客户端构建 "userAction" 负载;

事件处理:通过独立的 A2A 消息将 "userAction" 发送至服务端;

动态更新:服务端处理事件后,通过原始 SSE 流发送新的 surfaceUpdate 或 dataModelUpdate 消息,触发 UI 重建。

五、核心能力:三大关键价值

安全可控的界面生成:智能体无法直接生成或执行代码,只能从客户端 “预批准的组件目录”(例如:按钮、日期选择器、图表等)中选择组合;客户端完全掌控渲染过程,规避恶意代码风险,同时确保界面符合自身品牌样式。

跨平台无缝适配:同一份 A2UI JSON 描述,可在不同终端和框架中原生渲染:Web 端映射为 React/Lit 组件、iOS 端渲染为 SwiftUI 视图、Android 端转化为 Flutter 界面,实现 “一次生成,全平台可用”,无需为不同平台单独开发。

高效的交互式体验:替代传统多轮文本对话:用户需求(如订餐厅、查数据)触发智能体即时生成可视化界面(表单、图表、仪表盘),将 “8 轮对话” 压缩为 “3 次点击”;同时支持 “流式渲染”,界面可随智能体思考逐步构建,避免用户长时间等待。

六、实操入口

目前 A2UI 的详细实操教程已托管于 GitHub(https://github.com/google/A2UI),技术开发者可直接前往查看完整文档与部署指南。无论是互联网产品优化、车载交互升级,还是游戏场景创新,A2UI 都为智能体交互提供了全新的标准化解决方案,值得行业重点关注。

好了,这就是我今天想分享的内容。如果你对构建企业级 AI 原生应用新架构设计和落地实践感兴趣,别忘了点赞、关注噢~

PS:

▼ 《2025年AI 技术总结》直播,预约保你有收获

—1—

加我微信

扫码加我👇有很多不方便公开发公众号的我会直接分享在朋友圈,欢迎你扫码加我个人微信来看👇

图片

加星标★,不错过每一次更新!

⬇戳”阅读原文“,立即预约!

赞(0)
未经允许不得转载:171主机测评 » 谷歌再次重磅发布 AI 智能体新标准 A2UI
分享到: 更多 (0)

评论 抢沙发

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址