视频总结 Prompt:10 条可复制模板(2026)
你刚把两小时讲座丢进对话框,只打了四个字:帮我总结。出来的东西像说明书目录——正确、空、没法用。真正缺的不是更聪明的模型,是一段能直接粘贴的视频总结 prompt:角色、长度、时间戳、输出格式、哪些段落必须忽略。
这就是搜 video summarizer prompt 的人实际在找的东西。根据 Overseeros 对 1257 条长视频的分析,样本中位时长 21.7 分钟,中间 50% 落在 13.8 到 35.9 分钟——你不可能把这种长度「看完再记」。prompt 的工作是把线性视频压成你能扫、能引用、能接着干活的文本。
下面不是方法论课。每条技巧都带完整可复制块;反例写的是同一意图被空形容词写废之后长什么样。抄完可以存进 自定义提示词,或去 Prompt 市场直接调用别人已经调过的模板。
目录
- 为什么「帮我总结这段视频」几乎总是失败
- 视频总结 prompt 真正吃的槽位
- 10 条可复制技巧
- 6 个场景的完整模板
- 空 prompt 和可复制 prompt 差在哪
- 复制之后:自定义提示词和 Prompt 市场
- 常见问题
为什么「帮我总结这段视频」几乎总是失败
空 prompt 失败的原因很具体:模型不知道你是谁、输出给谁看、多长算完、哪一段是广告。它会默认写「引言 / 主体 / 结论」三段,把赞助口播和核心论点揉在一起,时间戳要么没有,要么对不上你真正想回看的那一句。
公开的 prompting 基础指南把有效输入拆成三件事:任务、上下文、理想输出。视频总结把这三件事写成槽位,比写成原则有用得多。指令放在最前,再用分隔符把指令和正文隔开。处理带章节的长视频时,骨架直接复用 YouTube 官方章节。
把同一件事丢进 BibiGPT 视频总结 时,默认智能总结已经能给出摘要、亮点和问答。自定义提示词的价值是:你把下面这些槽位写成自己的公式,下次不用重打。
几秒读完任何视频
选个样例,看 AI 总结——一句话结论、要点清单、可跳转的时间戳。
一句话: Karpathy 用代码从零搭出一个 GPT 风格的语言模型,逐行讲清每个部件——从最小的字符级模型到完整的 Transformer。
要点
- 先做一个 bigram 基线模型,再加自注意力,让 token 之间能"互相对话"
- 一个 Transformer 块 = 多头注意力 + 前馈网络 + 残差连接 + 层归一化
- 训练本质就是"预测下一个 token";剩下的交给规模和数据
- nanoGPT 背后的架构,放大后就是 ChatGPT
跳转
- 00:07 为什么要从零搭 GPT
- 08:23 直观理解自注意力
- 1:00:00 拼出 Transformer 块
- 1:35:00 从 nanoGPT 到 ChatGPT
实用规则: 如果你的 prompt 里找不到「给谁看、多长、什么格式、忽略什么」这四项,输出几乎一定是空总结。
视频总结 prompt 真正吃的槽位
不要把「写得好」理解成文采。视频总结模型真正吃的是字段。把厂商文档里的「说清楚任务 / 给上下文 / 规定输出」拆成下面这张表,填完就能粘贴。
| 槽位 | 填什么 | 反例 |
|---|---|---|
| 角色 | 你要它扮演的工作身份,带领域 | 「你是一个有帮助的助手」 |
| 观众 | 读这份总结的人,带决策场景 | 「给大家看看」 |
| 长度 | 字数、条数、或「一屏能看完」 | 「尽量详细」 |
| 结构 | TL;DR + 要点 + 待办 + 风险,写成标题 | 「结构化输出」 |
| 时间戳 | 要不要、格式、对应到原片哪一层 | 「如果可以的话标一下时间」 |
| 忽略清单 | 片头自我介绍、赞助、重复回顾、片尾订阅 | (空) |
| 禁编造 | 听不清就标不确定,禁止补事实 | 「补充相关背景」 |
| 语言 | 输出语言,和视频语言分开写 | 「翻译得自然一点」 |
如下图所示,BibiGPT 在这一步的处理方式是这样的:先出一份常规总结,再让你用自定义提示词按自己的公式重跑。

截图:BibiGPT 功能演示
实用规则: 槽位表里空着的那一格,模型会用最平庸的默认值填上。你不写忽略清单,它就会把广告当论点。
10 条可复制技巧
每一条都是完整可复制块。反例是同一意图写成空形容词之后的样子。在 BibiGPT 里:打开自定义提示词,整段贴进去,保存,下次一键调用。
1. 给它一个岗位,而不是「总结一下」
一句话规则:模型需要知道自己在替谁干活。
你是一名企业培训专员。请总结这段视频,给没时间看原片、但下周要给团队做 10 分钟同步的同事。
只保留他们做决策需要的信息。不要写成观后感。
反例:帮我好好总结一下这个视频。
在 BibiGPT 里怎么用:保存为「培训同步」,置顶后打开任意培训录像都会按这个身份出稿。
2. 把长度写成预算,不要写成「详细」
一句话规则:没有上限的总结会膨胀到你懒得读。
输出硬限制:
- 开头 80 字 TL;DR,必须能单独转发
- 要点不超过 7 条,每条不超过 40 字
- 禁止超过 600 字
如果内容很多,删掉背景和情绪,只留可执行信息。
反例:尽量详细,不要漏掉任何重点。
在 BibiGPT 里怎么用:需要一屏纪要时用这条;需要深度笔记时另存一条「详细版」,不要混用。
3. 强制时间戳,并规定格式
一句话规则:没有时间戳的总结没法回看,等于把视频又藏起来了。
每条要点后面必须跟时间戳,格式 [mm:ss]。
时间戳必须指向说话人开始讲这个论点的位置,不要标章节标题出现的位置。
听不清就写 [不确定],不要编一个听起来合理的时间。
反例:如果方便的话标一下大概在哪。
在 BibiGPT 里怎么用:详情页带时间戳的摘要可以直接点回原片;这条 prompt 是在要求自定义总结也保持同样可跳转。
4. 把事实、观点、待办拆开
一句话规则:混在一起的总结,开会时你没法引用。
请分成三个标题输出,不要混写:
## 事实(视频里明确说了的)
## 观点(说话人的判断,标注是谁说的)
## 待办(听完之后我可能要做的事,每条带负责人假设:我 / 对方 / 待确认)
事实里禁止出现「应该」「最好」「显然」。
反例:提炼核心观点。
在 BibiGPT 里怎么用:适合会议录像和访谈;和默认「亮点」互补,默认亮点偏记忆,这条偏行动。
5. 明确要求「可核对」,禁止补全
一句话规则:模型最爱帮你圆上没说的话。
只使用视频里出现的信息。
遇到数字、人名、产品名、日期:原文怎么说就怎么写,加引号。
视频没说的行业背景、竞品对比、后续预测一律不要写。
如果某句听不清,写「原片此处口齿不清」,不要猜。
反例:可以结合你的知识补充背景,让总结更完整。
在 BibiGPT 里怎么用:财报、合规培训、合同讲解必须开这一条。默认总结已经偏忠实,这条是把「禁止补全」写成硬约束。
6. 输出语言和视频语言分开写
一句话规则:你可能看英片、要中文纪要,这两件事必须拆开。
视频可能是英语或中英夹杂。
请用简体中文输出总结。
专有名词保留原文,第一次出现时在括号里给中文。
不要把英文口头禅翻译成文学句子。
反例:翻译得自然一点。
在 BibiGPT 里怎么用:看海外课、英文播客时保存为「英片中文纪要」。站点本身支持多语言输出,这条是规定纪要语言,不是规定识别语言。
7. 列出必须跳过的垃圾段
一句话规则:不写忽略清单,模型会认真总结片头问候和「记得订阅」。
请忽略并在总结里删除:
- 前 60 秒自我介绍和频道宣传
- 任何赞助口播、优惠码、联盟链接
- 「上期回顾」超过两句的部分
- 片尾求点赞、求订阅、下期预告
如果某段同时包含广告和有效信息,只保留有效信息,并标注「夹在赞助段中」。
反例:重点说干货。
在 BibiGPT 里怎么用:对教程和评测频道特别有效。保存后,同一创作者的视频可以反复用。
想看长讲座被压成可跳转笔记是什么体验,下面这条两小时的公开课就是典型输入——先有 prompt,再决定要不要把 120 分钟看完:
视频来源:YouTube · Andrej Karpathy · Let’s build GPT
8. 写死读者是谁
一句话规则:给学生的总结和给老板的总结,删的东西完全不同。
读者:产品经理,要在 15 分钟站会上讲清楚「这个视频跟我们这周的需求有没有关系」。
请按这个人的注意力写:
- 先给结论:要不要跟
- 再给 3 个会在会上被问到的问题
- 最后给「跟我们无关、可以不看」的部分
不要写学习感想。
反例:写得专业一点。
在 BibiGPT 里怎么用:为每种读者各存一条。职场、学生、创作者不要共用一个「万能 prompt」。
9. 指定复用格式,而不是「整理成笔记」
一句话规则:你要的如果是卡片、纪要或粘贴进 Notion 的块,就直接把容器写进 prompt。
请按下面容器输出,方便我整段粘进 Notion:
- 一句话标题(不超过 20 字)
- 3 张问答卡片:问 / 答 / 原片时间戳
- 一段可直接发给同事的 Slack 消息(不超过 500 字,不要 markdown 标题)
不要输出思维导图式的层级树。
反例:整理成方便我学习的笔记。
在 BibiGPT 里怎么用:需要闪卡时用问答卡片;需要群同步时用 Slack 消息。BibiGPT 也能生成思维导图和闪卡,这条是让自定义总结的正文形状直接等于你要粘贴的形状。
回到 BibiGPT 这边,下面这张产品实拍展示了对应的入口:点开自定义提示词后,模板内容和跑出来的深度分析是分开呈现的。

截图:BibiGPT 功能演示
10. 加一句「做不到就说做不到」
一句话规则:模型遇到不够长的字幕或空音频时,仍会写一篇像模像样的总结。
如果视频没有有效对白、字幕缺失、或有效内容不足 2 分钟:
不要硬写总结。
只输出:
1. 失败原因(一句)
2. 你实际听到/读到的全部文字(原文)
3. 建议我下一步怎么做(换清晰版本 / 上传本地文件 / 只用画面分析)
禁止编造章节。
反例:实在没有就根据主题发挥一下。
在 BibiGPT 里怎么用:处理用户上传的会议录音、现场手机视频时打开。宁可不写,也不要一份假纪要进知识库。
实用规则: 每条技巧至少保留一个完整 prompt 块。只记原则、不给可粘贴文本,等于没写。
6 个场景的完整模板
下面每个模板都是一整段,复制即可。标题就是场景名。把 {视频主题} 换成真实主题,其余不用改。
讲座 / 网课
你是一名课程助教。总结这堂关于「{视频主题}」的讲座,给缺席但要补作业的学生。
输出:
1. 80 字 TL;DR
2. 本节必须记住的 5 个概念,每个配 1 句人话解释 + 时间戳
3. 作业或课后动作(视频里点名的才写)
4. 学生最可能考到的 3 个问题(必须能在原片找到答案)
忽略点名、调设备、迟到的寒暄。
听不清的公式写「板书/口头公式不清楚」,不要补全推导。
财报 / 行业访谈
你是一名卖方分析助理。总结这段关于「{视频主题}」的访谈或财报讲解。
分成:
## 数字(全部带单位和原话引号 + 时间戳)
## 管理层原话(只摘可核对的句子)
## 风险与未回答的问题
## 跟我无关、可跳过的寒暄
禁止:预测股价、补宏观背景、把比喻写成事实。
长度上限 700 字。
播客访谈
你是录音制作人的文字编辑。总结这期播客,给只想要金句和可引用段落的读者。
输出:
- 3 句可单独发社交平台的引语(必须是原话,带时间戳)
- 5 个话题时间线(每条:时间戳 + 10 字标题 + 40 字说明)
- 「如果只听 8 分钟」该听哪一段
忽略广告插入、互相吹捧、片尾预告。
操作教程
你是一名技术写作者。把这段「{视频主题}」教程变成可执行步骤。
输出:
## 适用前提(系统、材料、版本,视频没说就写未提及)
## 步骤(编号,每步一个动作 + 时间戳)
## 常见翻车(视频里演示失败或口头警告的才写)
## 完成标准(怎么判断自己做对了)
不要写成原理课。不要补充视频里没出现的菜单名称。
新闻 / 简报
你是早报编辑。把这段新闻视频压成一份 90 秒能读完的简报。
结构固定:
- 发生了什么(1 句)
- 谁说了什么(姓名 + 原话或转述,转述必须标明)
- 接下来 72 小时可能受影响的人
- 视频没说、因此我不能写的东西(列标题即可,保持诚实)
禁止标题党。禁止把评论区情绪写进简报。
会议录像
你是会议纪要员。根据这段录像写纪要,给没参会但要执行的人。
输出:
## 决议(每条:决议内容 / 负责人 / 截止日期;视频没说负责人就写待指定)
## 未决问题
## 停车位(提到但今天不处理的)
## 原话备份(最多 5 句,带时间戳)
忽略闲聊、进门、测试麦克风。
不要把讨论过程写成小说。
BibiGPT 里同一件事是怎么做的?下面这张实拍可以参考:自定义提示词跑完后,深度分析结果和默认总结是两份东西,方便你对照公式有没有生效。

截图:BibiGPT 功能演示
这些模板挂在现有的 AI 视频总结指南 簇下,不另起炉灶。已经拿到字幕、想贴进任意对话框的 12 条作业型 prompt,见 视频总结 Prompt 库。操作层(粘贴链接、出思维导图)见 如何用 AI 总结 YouTube 视频;YouTube 专属槽位(章节、赞助口播、自动字幕)见 YouTube 视频总结 Prompt 模板。
空 prompt 和可复制 prompt 差在哪
把同一段 40 分钟教程丢进去,差别通常不是文采,是你能不能拿着输出去干活。
| 维度 | 空 prompt | 可复制模板 |
|---|---|---|
| 开头 | 「本视频介绍了……」 | 80 字 TL;DR,能直接转发 |
| 时间戳 | 无,或只有章节名 | 每条论点带 [mm:ss] |
| 广告 | 被写成「创作者推荐了工具」 | 被删除或标成夹带 |
| 不确定处 | 被圆成流畅句子 | 标明听不清 |
| 下一步 | 「希望对你有帮助」 | 待办 / 步骤 / 完成标准 |
| 复用 | 每次重打 | 存成自定义提示词,一键调用 |
Little Dot 对 800+ 频道的观察写过:最热门视频的平均时长从大约 35 分钟掉到大约 28 分钟,仍然远超你愿意线性看完的长度。prompt 不是为了让模型「更懂视频」,是为了让 28 分钟变成 90 秒能用的文本。
复制之后:自定义提示词和 Prompt 市场
三步就结束,不要把它学成一门课。
- 从上面复制一段完整 prompt,按场景改
{视频主题}。 - 打开 BibiGPT 视频总结,在自定义提示词里保存;常用的可以置顶成默认。
- 自己不想写时,去侧边栏的 Prompt 市场挑一条现成模板,一键套到当前视频。
BibiGPT 已服务超过 100 万用户、累计生成超过 500 万次 AI 总结,支持 30+ 平台。自定义提示词解决的是「同一条公式反复用」;Prompt 市场解决的是「我不想从零写」。两者都比在 ChatGPT 对话框里每次重打更稳,因为公式跟视频绑在一起,不会随着聊天记录翻页丢掉。
下面这张是 Prompt 市场的入口实拍,侧边栏「提示词」进去就是列表、分类和立即使用。

截图:BibiGPT 功能演示
常见问题
我应该把字幕贴进 ChatGPT,还是直接丢链接?
能丢链接就丢链接。贴字幕会丢掉画面信息,也会在超长视频上撞上下文上限。公开的 prompting 指南也强调把指令和正文分开,但视频场景里「正文」往往比一次能贴进去的更长。BibiGPT 是为链接 / 本地文件设计的,prompt 只管输出形状。
自定义提示词和 Prompt 市场有什么区别?
自定义提示词是你的私人公式,可保存、可置顶成默认。Prompt 市场是官方和其他用户分享的模板,能浏览、筛选、一键用到当前总结,也可以把自己的公式拿出去分享。日常:私有流程用自定义;试新场景用市场。
为什么我的 prompt 在通用聊天里好用,换到视频总结就变差?
因为聊天模型看到的是你贴进去的文字,视频总结还要处理口误、广告、章节和听不清的片段。把忽略清单和禁编造写进去,差距会立刻缩小。
一条 prompt 能通吃所有视频吗?
不能。讲座、财报、教程、会议删的东西不一样。至少按「学习 / 决策 / 操作」存三条。万能 prompt 最后会退回空总结。
时间戳对不上怎么办?
先要求格式 [mm:ss],并写明「对准论点开始说的位置」。仍然漂的话,用默认带时间戳的摘要跳一次原片核对,再把漂的那条改成「不确定」。不要让模型为了对齐章节标题去编时间。
公式对了,总结才是你的。把今天抄的第一条存下来,下一段视频直接调用。
BibiGPT 团队