Ofer Shapira

产品的视觉界面在 AI 时代发生了巨大变化 -- 但我们大多数人仍然像什么都没发生一样在构建。

本页为原文的机器翻译,未经人工译者审核。历史信息可能已发生变化。

产品的视觉界面在 AI 时代发生了巨大变化 -- 但我们大多数人仍然像什么都没发生一样在构建。

我想让你们意识到一件看似自然、几乎透明、但至关重要的事 -- 需要聚光灯照亮的事,这样你们开发的下一个界面里就会有它:

一个新的组件加入了我们的生活,并显著占据了屏幕 -- 聊天。这件事对界面构建者的世界来说有多戏剧性,对我们这些用户来说就有多自然流畅。

聊天已成为系统中 AI 含量的视觉标志。当用户遇到你的系统时,会立刻注意到这一点:

- 如果角落里有一个会打开聊天的悬浮圆圈,用户就明白这里有一个客服机器人。

- 如果遇到一个带有大聊天框的落地页,而且系统内四分之一的屏幕都用于聊天,用户就明白自己进入的是一个 AI First 产品。

- 而当整个界面就是聊天时 -- 用户明白这是一个 AI Chat 产品,像 ChatGPT 之类。

(与此同时,我们仍能看到 UX 骗局。首页上的聊天没有内部连续性。这主要发生在尚未内化新界面目的的公司。在 Airtable 或 Bubble 这样的产品中就能看到 -- 聊天只是启动初始流程,但实际上修正和设置都是在传统界面中手动完成的)

构建一个懂得在新世界中生存的界面所面临的挑战,也触及了技术的旗手们:例如 Claude,它展示的聊天界面带有用于自动操作的 MCP 按钮。

一方面,这是对先进自动化的宣示。另一方面,感觉是把完全的控制权交给了系统 -- 在后台运行的流程没有解释、没有透明度,也无法监控。

这清楚地说明了界面仍在试图解决的问题:如何在允许自主性的同时不放弃掌控感?

我最近看了安德烈·卡帕西(Andrej Karpathy)的一场演讲,他是 OpenAI 的联合创始人之一(也是创造 Vibe coding 一词的人)。

他把成功的界面描述为允许沿着"自主性滑块"移动的界面 -- 从用户自己触发的小任务,到在后台执行的完全自主的操作。

他说:"你是控制自主性滑块的人,根据任务的复杂程度,你决定愿意把多少控制权让给系统。"

以代码开发界面 Cursor 为例,它展示了从基础到完全自动化的自主性滑块:

- 输入时自动补全
- 修改一个代码块
- 修改整个文件
- 在整个 repo 层面做出修改的智能体

只要用户握着方向盘,即使是 AI 在驾驶 -- 掌控感和信任就能得以保持。

也可以通过一个条件来看:AI 执行的流程的复杂程度,应当取决于你给用户的信心水平:
他能在多大程度上跟踪、理解并核实发生了什么以及为什么。

顺便说一句,还有另一股正在发展的潮流,隐形 AI -- No-UI AI 界面。
在这类系统中,智能不以聊天或机器人的形式出现,而是简单地融入现有流程:Gmail 补全句子。Google Photos 识别并分类,或 Notion 把 AI 能力整合进编辑本身,而不增加新的界面层。
这是另一种方法 -- 安静、精确、几乎隐形。

在语言模型不断进步的时代,界面开发者必须了解这个新世界带来的行为和细微差别,因为一个正确的界面等待更好的模型只会变得更好,而一个糟糕的界面 -- 就连 GPT-7 也救不了它。

Illustration for “Designing AI interfaces around the autonomy slider”