如何优化GPT-4o-mini提示词以适配YouTube聊天Chrome扩展
优化长视频GPT-4o-mini提示词的策略与最佳实践
一、上下文精简与结构化处理
- 字幕文本预处理:对1小时以上的字幕按时间切片(如每10-15分钟为一个片段),用轻量模型预先生成分段核心摘要,保留关键观点、事件及对应时间戳,仅传入摘要而非完整字幕,大幅压缩上下文体积。
- 规则分层优先级排序:将核心规则(身份定位、格式要求、必守行为规范)放在系统消息最前端,用明确标签区分;非核心规则(边缘用例、次要规范)仅在用户提问涉及对应场景时动态插入,避免一次性塞入所有规则。
- 结构化上下文标记:用分隔符和标签明确区分不同类型的上下文,示例格式如下:
---视频元数据--- 标题:xxx 时长:1h30m ---核心规则--- 1. 身份:仅基于提供的视频内容回答的YouTube智能助手 2. 格式:时间戳统一用[MM:SS]格式,总结需分点呈现 ---分段字幕摘要--- [00:00-15:00]:介绍xxx核心概念,关键信息包括... [15:00-30:00]:演示xxx操作步骤,[20:15]为核心节点
二、提示词指令优化
- 指令前置与明确约束:在提示词开头直接明确任务边界,比如:“你是YouTube视频智能助手,需基于提供的分段字幕摘要、视频元数据和核心规则回答用户问题,严格遵循格式要求,仅使用给定上下文,禁止生成无关内容。当前用户提问:[用户问题]”
- 规则具象化替换模糊表述:将模糊规则替换为具体示例,比如把“返回上下文感知的回答”改为“回答必须关联对应时间戳,总结时每个关键点标注对应的片段时间范围”;针对常见用例,直接给出正确输出样例作为规则参考。
- 控制提示词总长度:拆分规则为核心集和可选集,核心规则保留在系统消息,可选规则(特殊场景处理)仅在对应提问出现时动态加载,减少单次提示的冗余内容。
三、适配GPT-4o-mini特性
- 强化一致性约束:结合当前0.3的温度值,在提示词中增加“输出需保持高度一致,严格遵循给定规则,避免发散内容”的指令,进一步稳定输出质量。
- 强制结构化输出:针对不同类型提问指定固定输出格式,比如总结类问题要求:
用明确格式指令降低输出混乱概率。### 核心总结 - 关键点1:[内容]([时间范围]) - 关键点2:[内容]([时间范围]) - 高效利用上下文窗口:优先保证核心规则、视频核心片段(开头引入、结尾结论)的摘要传入,次要片段的摘要可适当合并精简,最大化利用128k窗口的高价值空间。
四、动态适配与预处理
- 按时长调整摘要策略:1-2小时视频采用10分钟切片摘要;2小时以上视频合并相似主题片段,生成主题式摘要而非纯时间切片,减少摘要数量。
- 预缓存核心规则模板:将核心规则整理为固定模板,每次调用直接插入;针对不同提问类型(总结、细节查询、时间点定位),动态加载对应场景的规则片段,避免冗余。
内容的提问来源于stack exchange,提问作者Martin
相关产品推荐
相关产品推荐

