Gemini 3.8 Flash 来了:BibiGPT 当天接入,音视频总结可在选择器里直接用(2026 年 9 月)
Gemini 3.8 Flash 来了:BibiGPT 当天接入,音视频总结可在选择器里直接用(2026 年 9 月)
先说结论: 截至 2026 年 9 月 4 日,BibiGPT 已支持 Gemini 3.8 Flash。打开偏好设置里的默认模型,搜索 gemini 3.8,就能看到带 New 标记的条目。它不是又一篇「模型发布通稿」——这条链接要解决的是:新模型来了,怎么把它用在一条 B 站 / YouTube / 播客链接上,而不是先去 Gemini 官网上传文件。
Google 在 2026 年 9 月 2 日发布 Gemini 3.8 Flash,定位是「目前最聪明的工作马模型」,相对 3.7 Flash 在软件工程、智能体任务和多步推理上有明显提升。BibiGPT 在同一窗口完成接入。下面按「改了什么 → 接入哪一个 SKU → 为什么不直接去原厂 → 三步切换 → 适用场景」写完。
目录
- Gemini 3.8 Flash 这次改了什么
- 两个变体,BibiGPT 接入的是哪一个
- 为什么用 BibiGPT 的 3.8 Flash,而不是直接去 Gemini
- 三步切到 Gemini 3.8 Flash
- 这几个场景,切过去会立刻有感
- 模型不再稀缺,稀缺的是消费内容的速度
- 常见问题(FAQ)
Gemini 3.8 Flash 这次改了什么
据 Google 官方发布博文,Gemini 3.8 是六周内第三款 Flash,距离 3.7 Flash(8 月 13 日)只有三周。Ars Technica 的报道 把这次节奏概括成:Pro 线更新放缓,Flash 线连续加码。
对音视频总结真正有用的,不是「又快了一代」这句话,而是规格表里能核对的几项。据 Google Cloud 的 Gemini 3.8 Flash 文档 与 Gemini API 更新说明:
| 项 | 数字 / 能力 | 对总结意味着什么 |
|---|---|---|
| 上下文窗口 | 1,048,576 token | 一场两小时访谈的字幕,不必先切成十几段再拼 |
| 最大输出 | 65,536 token | 章节摘要、要点、追问可以一次写完,不容易中途截断 |
| 输入模态 | 文本、图片、音频、视频 | 不只听声音,也能看画面(视频为输入、文本为输出) |
| 思考档位 | low / medium / high | 短 Vlog 用低档,财报电话会用高档 |
| 智能体视频理解 | Preview | 官方文档标明的预览能力,不是「已经完美看懂每一帧」 |
| 上市价(截至 2026-12-31) | 输入 $0.75 / 百万 token,输出 $3.75 | 2027-01-01 起回到 $1.50 / $7.50 |
SiliconANGLE 引述 Google 的评测:在 16 项基准里,3.8 Flash 有 9 项超过 Claude Opus 5 和 GPT-5.6 Sol;DeepSWE-1.1 得分 73.7%。同一篇报道还写到 Terminal-bench 2.1 从 3.7 Flash 的 81.6% 升到 90.8%,SWE-Bench Pro 从 60.4% 升到 61.6%。这些数字衡量的是编码与智能体任务,不是「视频总结准确率」。不要把基准表直接翻译成「总结更好」——总结好不好,卡点往往在字幕拿取和关键帧,不在 SWE 分数。
模型卡入口在 Google DeepMind 的模型卡目录,页面列出 Gemini 3.8 Flash 更新日期为 2026 年 9 月 2 日。
实用规则: 读新模型发布,先把「编码基准」和「音视频工作流」拆开。前者告诉你模型更会规划,后者才决定你能不能把一条链接变成带时间戳的笔记。
两个变体,BibiGPT 接入的是哪一个
同一天发布的其实是两个模型,规格接近、受众完全不同:
| 变体 | 定位 | 谁能用 | BibiGPT 选择器 |
|---|---|---|---|
| Gemini 3.8 Flash | 通用工作马:工程、智能体、多步推理 | Gemini API、AI Studio、Gemini 应用的 Pro / Ultra | ✅ 已上线,标签为 Gemini 3.8 Flash (new) (pro) |
| Gemini 3.8 Flash Cyber | 漏洞检测与补丁,面向可信防御方 | Fairwind 早期访问,不面向普通用户 | ❌ 未接入,也不会出现在选择器 |
BibiGPT 接入的是通用 Flash,不是 Cyber。选择器里这一条带 New 和钻石标记,额度消耗为标准档,面向 Plus / Pro 会员。不要把「支持 Gemini 3.8 Flash」读成「每一条视频都自动走它」——它在列表里,你选中才用。
打开偏好设置,点「默认模型」,搜索 gemini 3.8,目前只会命中这一条。这就是接入完成的收据:

截图:BibiGPT · 模型选择器,Gemini 3.8 Flash 带 New 标记,Plus/Pro 可选用。
实用规则: 原厂发两个 SKU 时,先问「哪一个会出现在我每天点的那个下拉框里」。出现了,才叫接入;没出现的那个,写进文章当背景即可,不要假装用户也能选。
为什么用 BibiGPT 的 3.8 Flash,而不是直接去 Gemini
这是这篇接入文最该回答的问题。Gemini 官网、AI Studio、Gemini API 都能跑 3.8 Flash。为什么还要在 BibiGPT 里选它?
因为原厂给你的是模型,音视频总结缺的是输入层:
B 站 / YouTube / 播客 / 本地文件
│
▼
拿字幕或转写音频 + 抽关键帧
│
▼
把整理好的材料交给你选的模型
(今天可以是 Gemini 3.8 Flash)
│
├── 带时间戳的章节摘要
├── 可跳转的字幕
└── 思维导图 / 追问 / 导出
直接去 Gemini 应用 或 AI Studio,你得先自己把视频下下来、切好、传上去。一条两小时的视频动辄几个 GB;B 站、抖音、小红书各有各的拿取方式。模型再聪明,也接不住「剪贴板里的那条链接」。
BibiGPT 已经服务超过 100 万用户、累计生成超过 500 万次 AI 总结,覆盖 YouTube、B 站、抖音、TikTok、小红书、播客等 30+ 平台。新模型叠在这条管线上,继承的是「粘贴链接 → 结构化笔记」,不是从空白控制台开始。相关能力页:
- AI 视频总结 — 粘链接出章节要点
- 浏览器内免费视频总结 — 本地文件不上传
- YouTube 字幕提取 — 先拿可搜索的文字,再决定要不要总结
下面这个演示是同一条路径的形状——先粘链接,再谈模型:
几秒读完任何视频
选个样例,看 AI 总结——一句话结论、要点清单、可跳转的时间戳。
一句话: Karpathy 用代码从零搭出一个 GPT 风格的语言模型,逐行讲清每个部件——从最小的字符级模型到完整的 Transformer。
要点
- 先做一个 bigram 基线模型,再加自注意力,让 token 之间能"互相对话"
- 一个 Transformer 块 = 多头注意力 + 前馈网络 + 残差连接 + 层归一化
- 训练本质就是"预测下一个 token";剩下的交给规模和数据
- nanoGPT 背后的架构,放大后就是 ChatGPT
跳转
- 00:07 为什么要从零搭 GPT
- 08:23 直观理解自注意力
- 1:00:00 拼出 Transformer 块
- 1:35:00 从 nanoGPT 到 ChatGPT
演示:粘贴视频链接,得到带时间戳的章节要点。Gemini 3.8 Flash 是这条路径上可选的模型,不是替代这条路径。
想看完整操作,而不是另一份规格表,可以先看这段产品演示:
视频:粘贴一条链接,得到带时间戳的要点、思维导图和可追问的问答。
画面里的图表、板书、一闪而过的操作步骤,只存在于关键帧,不在语音里。通用聊天框很容易漏;专门对关键帧做画面分析,才会把这些信息写进总结:

截图:BibiGPT · 关键帧画面分析。模型不只听声音,还会看画面里的字。
实用规则: 模型变便宜、变聪明,不会吃掉总结工具;它把胜负手从「算力成本」挪到了「输入层」。打不开你要看的那条视频,总结再漂亮也是零分。
三步切到 Gemini 3.8 Flash
入口就在偏好设置,不需要等一次总结跑完再找。

截图:BibiGPT · 偏好设置,默认模型是切换入口。
- 打开 BibiGPT,把 YouTube / B 站 / 播客链接贴进输入框,或先进入偏好设置。
- 点击「默认模型」,在搜索框输入
gemini 3.8。 - 选中 Gemini 3.8 Flash(New,Plus/Pro),回到输入框点「一键总结」。
选好的模型会保留到下一次。短内容不必强行切;长访谈、多观点对谈、需要分步推理的课,再把它打开。
上一档 Gemini Flash 的手感,可以对照 Gemini 3.6 Flash 视频总结实测。若你要的是「把说话变成带说话人的文字」而不是「把视频变成章节摘要」,走的是另一条引擎:Gemini 3.5 Transcribe 视频转文字工作流。不要把 Flash 推理模型和 Transcribe 语音模型当成同一个开关。
实用规则: 切换模型最多三步。第四步开始,就是在找借口——入口不在发布会海报上,在选择器里。
这几个场景,切过去会立刻有感
不是所有视频都值得换成 3.8 Flash。标准档额度,留给「需要多步推理」的内容:
- 两小时以上的发布会、财报电话会、长访谈。 100 万 token 上下文让整场字幕可以一次喂进去,减少「分段再拼接」带来的前后矛盾。
- 课上有板书、图表、演示操作的录像。 视频输入 + 关键帧分析,比只听语音更不容易漏掉画面信息。
- 需要追问、对比观点、写出可执行下一步的内容。 官方强调的多步推理,用在「这段讲了什么」之后的「所以我该做什么」。
- 同一条视频要出摘要、思维导图、可跳转字幕。 模型负责理解;导出和跳转是产品层已经接好的。
同一份总结换成可复习的形态,是思维导图,不是再生成一段白文:

截图:BibiGPT · 视频要点生成思维导图,节点可点回原片对应时间。
短 Vlog、已经有官方字幕的通稿、只想抽三句话的新闻,用更轻的模型就够。把 3.8 Flash 留给「看完要做事」的那一类。
模型不再稀缺,稀缺的是消费内容的速度
六周三款 Flash,说明工作马模型正在被当成日用品迭代。再过一个季度,选择器里会出现 3.9 或别的名字。这不是坏事:模型不再是护城河,把一条还没看的视频变成能搜索、能跳转、能追问的文本,才是每天要重复的动作。
BibiGPT 不是另一个模型聚合器。它在模型前面补字幕和关键帧,在模型后面补时间戳、导图、导出和合集。100 万用户、500 万次总结、30+ 平台,说的是这条管线已经被走通,而不是某个模型「由谁驱动」。
可打脸预判:到 2027 年 3 月 1 日,如果音视频总结产品的主战场仍然是「谁家模型参数更大」,而不是「谁能稳定打开你剪贴板里的那条链接」,上面这句判断作废。
想当天就试:打开 BibiGPT 桌面,把一条你本来打算「回头再看」的链接贴进去,在默认模型里选 Gemini 3.8 Flash。
常见问题(FAQ)
BibiGPT 支持 Gemini 3.8 Flash 了吗?
支持。截至 2026 年 9 月 4 日,模型选择器里可以搜到 Gemini 3.8 Flash (new) (pro),面向 Plus / Pro。它不会自动套到每一条视频上,需要你选中。
为什么不直接去 Gemini 官网 / AI Studio / 原厂 API?
原厂给你模型和聊天框。一条 B 站或 YouTube 链接要先变成音频和关键帧,才能交给模型;总结之后还要时间戳、导图和导出。BibiGPT 补的是这一层,不是再包一层聊天。
Gemini 3.8 Flash Cyber 也能选吗?
不能。Cyber 走 Fairwind 早期访问,面向可信防御方,不在 BibiGPT 选择器里。日常音视频总结用通用 Flash 即可。
免费用户能用吗?
选择器里这条带钻石标记,额度消耗为标准档,需要 Plus / Pro。免费档可以继续用列表里的低消耗模型;升级后再把 3.8 Flash 打开。
它和 Gemini 3.5 Transcribe 有什么区别?
3.8 Flash 是通用推理模型,适合章节摘要和追问。3.5 Transcribe 是语音转文字引擎,适合说话人标签和字级时间戳。总结选 Flash,转写选 Transcribe,不要混成一个开关。