news 2026/5/11 1:41:32

Skills 之后是什么?Google 刚补上 Agent 生态最后一块拼图!Anthropic未来规划预测 !

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Skills 之后是什么?Google 刚补上 Agent 生态最后一块拼图!Anthropic未来规划预测 !

Google 刚发了个东西叫 A2UI——让 AI 能画界面。

什么意思?我举个例子。

假如豆包用了 A2UI,你说"帮我叫个车去机场",它直接弹出一张地图——你在地图上点一下确认上车点,再选个时间和车型,下单。

全在对话里完成。

MCP、Skills 都搞不定的事,它能搞定——让 AI 不光会说,还会画界面。

如果你用 Claude,这事儿跟你有关——

Anthropic 下一步要干嘛,可能就藏在你天天用的 Artifacts 里。

纯数据流:MCP/Skills 的局限

你可能想:MCP 和 Skills 不是够用了吗?

不够。

因为它们都是纯数据流——

MCP 让 Agent 能调工具,但结果只能用文字告诉你。

Skills 让 Agent 有专业能力,但也只能用文字告诉你。

对话 vs UI:不是偏好,是大脑决定的

举个例子:选航班。

用对话选?你得打字说"我选14点那个850块的"。

用界面?点一下就行。

有些事,对话压根做不到:

想看酒店实拍?对话只能说"房间很大",界面能直接甩图

想选上车地点?对话得打字"东门左边50米",界面点一下就行

纯数据流的问题,就在这。

A2UI:交互补上的一环

回到开头豆包的例子——你说"帮我叫车",它弹出地图让你点。

背后咋回事?

1.Agent 输出一段 JSON,描述要显示什么组件、怎么排列

2.这段数据发给渲染器

3.渲染器有一套组件库(地图、按钮、日历…),从库里找到对应的,画出来

4.你点了确认,渲染器把结果告诉 Agent

5.Agent 收到,继续干活

对Agent的改变

以前:Agent 返回 “请问几点?” → 你打字回答

现在:Agent 返回 { 日历组件 } → 你点一下

等等,你可能会问:既然能画界面,为啥不直接让 Agent 写代码?

为什么不直接写代码?

代码能干的事太多了——能读文件、能发请求、能删东西。

让 Agent 写代码 = 把你的电脑交给它。

A2UI 的做法:给 Agent 一套受限的组件库

能用:日历选择器、地图选点、表单输入、列表选择、确认按钮、图片展示

不能:读写文件、执行代码、发送请求、访问系统

就像给小孩一盒乐高——能拼出各种形状,但不会伤到人。

A2UI干的事:Agent 不光会"说",还能"画"——而且画得安全。

三大产品特性

安全→ Agent 只能画你允许的组件,不会执行恶意代码

实时→ 界面边生成边显示,不用等 AI 想完

跨端→ 手机/网页/桌面都能用,体验一致

一句话:A2UI = 数据安全 + 界面丰富。

三层生态:更大的图景

A2UI 只是拼图的一块。

Agent 要真正好用,得有三层基础设施:

上下文层Skills → Agent 有什么能力

工具层MCP + A2A → Agent 怎么调工具、怎么协作

交互层A2UI → Agent 怎么和人类交互

Skills 定义能力,MCP+A2A 连接工具和 Agent,A2UI 连接人类。

三层生态齐了,Agent 世界才完整。

Artifacts 2.0:Anthropic 的下一步

说完三层生态,回到开头的问题:这跟 Claude 用户有啥关系?

为啥我觉得 Anthropic 会往这走?

Artifacts 已经是动态内容的雏形了。

用户习惯了这个形态。

只差一步——加上交互能力。

Artifacts 1.0(现在)
↓ 能跑代码、能预览,但你点了啥 Agent 不知道

Artifacts 2.0(预判)
↓ 你点了啥,Agent 能收到,还能接着帮你干活

对你意味着啥?

想象一下:你在 Claude 里说"帮我对比这三个方案",它直接弹出一个表格,你边看边勾选,选完它继续帮你分析。

对话中直接弹出交互界面。

不用离开 Claude 就能完成复杂操作。

Claude 从"对话工具"变成"对话式操作系统"。

最后说两句

A2UI 本质就一件事:给纯数据流补上交互层。

它的价值 = 要比好几个选项的时候,不用靠脑子记了。

读完记住这四个词

纯数据流→ MCP/Skills 的局限

A2UI→ 交互补上的一环

三层生态→ 上下文 + 工具 + 交互

Artifacts 2.0→ Anthropic 的下一步

Agent 交互的下一步,已经在路上了。

原文:https://developers.googleblog.com/introducing-a2ui-an-open-project-for-agent-driven-interfaces/

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/5/10 21:40:40

Chrome Tab Modifier 完整使用指南:轻松定制浏览器标签页

Chrome Tab Modifier 完整使用指南:轻松定制浏览器标签页 【免费下载链接】chrome-tab-modifier Take control of your tabs 项目地址: https://gitcode.com/gh_mirrors/ch/chrome-tab-modifier 想要彻底掌控浏览器标签页,让每个标签都按照你的想…

作者头像 李华
网站建设 2026/5/2 15:04:47

EmotiVoice如何处理方言与口音问题?最新进展

EmotiVoice如何处理方言与口音问题?最新进展 在智能语音助手越来越普及的今天,你是否曾因为系统听不懂你的“川普”而无奈地切换成普通话?又或者,在使用有声读物时,听到机器人用标准腔调念出一句“侬好呀”&#xff0c…

作者头像 李华
网站建设 2026/5/10 8:42:38

告别JSON解析噩梦:HugeJsonViewer让GB级文件处理变得如此简单

当你的JSON文件从几十KB膨胀到几个GB,传统的文本编辑器和在线工具纷纷"举手投降"时,你是否感到束手无策?内存溢出、界面卡死、解析超时——这些困扰无数开发者的JSON大文件处理难题,现在有了完美的解决方案。 【免费下载…

作者头像 李华
网站建设 2026/4/29 5:36:10

48、多线程编程全解析

多线程编程全解析 1. 计算机性能发展与多线程编程背景 在2004年之前,提升计算机性能主要依赖于提高单个处理器的性能。然而,如今的硅微芯片技术在物理层面上限制了单处理器性能的进一步提升,计算能力与散热的阈值逐渐稳定,甚至出现了性能提升的瓶颈。 但即便如此,计算机…

作者头像 李华
网站建设 2026/5/5 21:57:49

为什么说ReadCat重新定义了你的阅读体验?

为什么说ReadCat重新定义了你的阅读体验? 【免费下载链接】read-cat 一款免费、开源、简洁、纯净、无广告的小说阅读器 项目地址: https://gitcode.com/gh_mirrors/re/read-cat 你是否曾经被那些充斥着广告、功能臃肿的阅读软件所困扰?在信息过载…

作者头像 李华
网站建设 2026/5/1 0:06:06

52、多线程同步技术全解析

多线程同步技术全解析 1. 使用 lock 关键字 在多线程编程中,经常需要使用 Monitor 进行同步,但 try/finally 块容易被遗忘。为此,C# 提供了 lock 关键字来处理这种锁定同步模式。以下是使用 lock 关键字的示例代码: using System; using System.Threading; u…

作者头像 李华