跳到主内容
快讯直播
AI智模界
AI 词典

助手预填:让模型从你写好的开头续写

Assistant Prefill(助手预填)指在请求里预先填入 assistant 角色的开头内容,让模型接着这个开头继续生成,而不是从空白开始回答。

打个比方:普通对话像让演员自由发挥,你只给一句“请演一段客服回复”;助手预填则像把提词板先亮出来,上面写着“尊敬的客户,关于您反馈的问题,我们的处理方案是:”。演员没有选择,只能顺着这句往下演。模型也一样:对话本质是预测下一个 token,当你在上下文末尾放一段“它自己已经说过的话”,它就会把这段当成既成事实,继续补全后面的 token。

用法通常是这样:消息列表里最后一条不是 user,而是 assistant,并且内容故意不完整。比如想让它输出 JSON,就预填 { 或 {"name": ";想让它用表格,就预填表头 | 项目 | 说明 |;想跳过寒暄,就预填“结论:”。模型会从这个锚点续写,格式和语气都被“带”了过去。

它和相邻概念容易混,可以这样区分:

概念作用点类比
Assistant Prefill直接给回答开头替演员说出第一句台词
AI 词典:System Prompt">System Prompt给规则和身份导演说“你要演客服”
Few-shot 示例给几个示范给演员看几段参考表演
Stop Sequence指定在哪里停告诉演员说到哪句就谢幕
Structured Output用 schema 约束结构给剧本规定好字段格式

其中,system prompt 是“请你用 JSON 回答”,模型可能仍会加一句“好的”;prefill 直接写 {,约束更硬。Few-shot 是教它模仿,prefill 是替它起头。Stop sequence 管终点,prefill 管起点。Structured Output 或 function calling 是 API 层面的结构约束,prefill 是文本层面的软约束,更通用,但通常需要自己再做一次解析和校验。

对从业者,助手预填是个低成本的“格式开关”:稳定 JSON、XML、YAML、代码块,减少解析失败;控制多语言、客服话术、邮件开头;还能先写“分析:”“结论:”来引导推理顺序。对普通职场人,它的意义是:如果 AI 总是先寒暄再回答,或者格式老跑偏,可以在支持该能力的工具里,把回答的第一句先写好,让模型顺着写。

局限也要知道:预填不是硬保证,模型仍可能跑偏;和 system 规则冲突时可能不稳定;预填太长会占 token。不同平台对最后一条 assistant 消息的支持程度不同,具体以官方页面为准。

AI 生成本文由 AI 基于公开信息自动生成,仅供参考。