BibiGPT ブログ
AI 音声・動画ナレッジハブ — ベンチマーク、ガイド、リリースノート。
トピックから探す
- AI 動画要約 「AI 動画要約」について公開した記事を 1 ページにまとめました(全 54 本)。 54 本の記事
- 動画を文字起こし 「動画を文字起こし」について公開した記事を 1 ページにまとめました(全 26 本)。 26 本の記事
- YouTube を文字起こし 「YouTube を文字起こし」について公開した記事を 1 ページにまとめました(全 8 本)。 8 本の記事
- ポッドキャストと音声 「ポッドキャストと音声」について公開した記事を 1 ページにまとめました(全 18 本)。 18 本の記事
- 会議メモ 「会議メモ」について公開した記事を 1 ページにまとめました(全 20 本)。 20 本の記事
- 学習法 「学習法」について公開した記事を 1 ページにまとめました(全 44 本)。 44 本の記事
- セカンドブレインと PKM 「セカンドブレインと PKM」について公開した記事を 1 ページにまとめました(全 36 本)。 36 本の記事
- モデル更新 「モデル更新」について公開した記事を 1 ページにまとめました(全 47 本)。 47 本の記事
- ツール比較と選び方 「ツール比較と選び方」について公開した記事を 1 ページにまとめました(全 54 本)。 54 本の記事
Featured
BibiGPT v4.598.0 アップデート:WeChat ClawBot と Agent Skill
公開日
今週の主線は Agent です。WeChat でスキャンしてリンクを送ると要約が届きます。WorkBuddy / 豆包工作 / 千問工作にも Skill を入れられます。あわせて音動画要約に速いモデル 3 つ、フローティングミニプレーヤー、Gemini 3.5 文字起こし、ima へのプッシュも開放しました。
続きを読む →すべての記事
すべての記事 →-
トレンド ·
Muse Image登場:読める静止画では「先ほどの1時間」は検索できない
Metaは2026-08-26にMuse Imageを公開(OpenRouter 1枚 $0.01)。描く前に推論し、画面内の文字を読めるようにする。それでもタイムスタンプ付きの講義ノートは残せない。本稿はカバー画像と事後の動画要約を切り分ける。
-
トレンド ·
豆包工作徹底レビュー:機能と料金の先に、なぜ Bilibili も YouTube も見られないのか
ByteDance が独立オフィス Agent「豆包工作」を発表。資料生成と動画出稿に対応し、月額 68 元から。しかし Bilibili と YouTube を直接解析できるのか。能力の境界を徹底レビューし、音動画を構造化して渡すワークフローを示します。
-
ガイド ·
動画要約プロンプト:コピー&ペーストできるテンプレート10選(2026)
video summarizer prompt を探す人が欲しいのは貼れるテンプレートであり、授業ではない。コピー可能なコツ10本+シーン別の完全プロンプト6本。カスタムプロンプトや Prompt Market に保存できる。
-
ガイド ·
YouTube動画要約プロンプト:コピー&ペーストできるテンプレート10選(2026)
best youtube video summary prompt を探すとき欲しいのは、貼れる YouTube 専用テンプレート。チャプター、スポンサー読み上げ、自動字幕、ピン留めコメント。コピー可能なコツ10本をカスタムプロンプトに保存できる。
-
リリースノート ·
BibiGPT v4.583.0 アップデート:音動画要約に GLM-5.3 と Qwen3.8 27B、翻訳専用モデル、未読バッジ
音動画要約と対話で Zhipu GLM-5.3 とアリババ Qwen3.8 27B を選べるようになりました。翻訳は専用モデルグループを分離し、テンセント Hy-MT2 の 2 段階を追加。文字起こしは無料か自前キーかがひと目で分かり、OpenRouter 経由も可能。サイドバーの「フィード」は Beta を外し、未読件数をそのまま表示します。
-
ガイド ·
YouTube 動画要約 API キー開発者ガイド(2026)
YouTube は要約用 API キーを発行しません。BibiGPT の設定 → Open API でキーを取得し、会員とは別の API 残高(分)をチャージしてから、Agent Skill または Open API で YouTube URL を要約します。
-
トレンド ·
DeepSeek V4-Flash-Vision-Exp:視覚 Agent は Opus 4.8 に近いが、動画全体の理解とは別物
DeepSeek が 2026-08-21 に実験的ビジョンモデル V4-Flash-Vision-Exp を公開。テキスト能力は V4-Flash と同等、視覚 Agent ベンチマークは Opus-4.8 に接近。数字を分解し、動画の画面理解ワークフローと対照する。
-
トレンド ·
Claude Skills API が正式公開:スキルはすでに標準化され、フレームワークこそ差し替え可能な部品
Anthropic は 2026-08-20 に Skills API、Computer Use、Files API を正式公開しました。スキルは依然として SKILL.md フォルダです。DeepSeek Harness はすでに同じ契約で実装しています。本稿では API 層が何を補ったのか、そして音声・動画スキルをどう横断フレームワークで再利用するかを整理します。
人気の記事
人気のツール
BibiGPT とは
BibiGPT は音声・動画を理解する AI アシスタント。Bilibili、YouTube、ポッドキャスト、ローカルファイルを要約し、マインドマップ、文字起こしタイムライン、長文リライトを生成します。複数の大規模言語モデルをサポートし、個性的な出力スタイルに対応。
Notion や Obsidian などの主要なナレッジベースと連携し、「速く見る・賢く探す・上手く使う」を実現します。
01
速く見る
長尺メディアを全体のコンテキストを失わずにざっと確認できます。
02
賢く探す
文字起こしとハイライトは完全検索可能、タイムスタンプで即時再生。
03
上手く使う
どんなメディアとも対話し、目的の記事を下書きし、手作業なしで洞察を再利用。