一句话定义:Intelligent UI(智能界面)指聊天式 AI 的回答不再局限于纯文字,而是由模型判断内容适合什么形态,自动混排表格、图表、图片、按钮、卡片等组件,让人在对话里直接"看懂"甚至"点得动"。
原理:模型不画像素,只出"单子"
最容易误解的一点是:模型并不负责画出那个漂亮的卡片。它做的是输出结构化描述——Markdown、JSON、或一次工具调用(tool call)的返回结果;真正把它变成像素的,是客户端里的渲染器(renderer)。
打个比方:模型像餐厅里写单子的服务员,它只写"宫保鸡丁一份、微辣",盘子什么形状、摆在桌子哪个位置,是厨房的事。服务员写得越规范,厨房越不容易做错。
由此有两条路径:
- 轻量路径:模型输出 Markdown 或 JSON,宿主应用本来就有渲染器,表格变表格、代码块带复制按钮、图片直接内嵌。这是最常见的一层。
- 组件路径:平台允许开发者注册可交互组件,模型只负责决定"何时用、用哪个、填什么参数",渲染在客户端沙箱里完成。这也解释了为什么同样一句话,在不同客户端上呈现可能不同——渲染是宿主的事。
什么时候会触发
通常有三种情况:你在提示词里明确要求("用表格对比""给我三个可点选项");内容本身适合结构化(对比、清单、步骤、多轮流程);或者工具返回了结构化数据(查天气回传一张卡片)。注意模型的判断带随机性,别把它当成稳定契约。
| 维度 | 传统 GUI | 富文本回答 | Intelligent UI |
|---|---|---|---|
| 形态来源 | 设计师预先固定 | 文本加基础渲染 | 模型按内容动态决定 |
| 谁渲染 | 客户端 | 客户端 | 客户端/宿主应用 |
| 可交互性 | 完整 | 基本没有 | 可点、可选、可回传 |
和相邻概念的区别
跟 GUI(Graphical User Interface,图形用户界面)相比,后者的布局是人提前设计好的,Intelligent UI 的元素是当场组合出来的。跟常说的 Generative UI(生成式界面)相比,后者更强调"界面本身由模型生成",Intelligent UI 范围更宽,包含"模型只是挑了某个已注册组件"这种情形。
对从业者的实际意义
写提示词时,把"想要什么形态"写进去,往往比只描述内容更有效;要给程序消费的结果,直接要求结构化输出。但重要结论必须保证在纯文本下也读得通,否则渲染失败就等于信息丢失。
做集成时,把能力拆成"工具 + 组件"两半:工具返回结构化字段,组件负责好看和可点,模型只做路由与填参,并准备好降级方案。
对普通人来说,好处是少复制粘贴、直接在对话里完成闭环;需要留个心的是——卡片和图表同样是生成的,好看不等于正确。各家平台支持范围和注册方式不同,具体以官方文档为准。
