ジェミニ 3.8 ライブおよび 3.8 ライブ エクステンデッド シンキング
概要
- Gemini 3.8 Live と Gemini 3.8 Live Extended Thinking の登場
- 音声対話AIの 直感性・知能・複雑タスク対応 の大幅強化
- 開発者・企業向けAPI やGoogle Workspace/検索での展開
- 多言語対応・リアルタイム処理・API連携 の特徴
- SynthID透かし によるAI音声の透明性確保
Gemini 3.8 LiveおよびGemini 3.8 Live Extended Thinkingの概要
- Gemini 3.8 Live は、スケール・コスト効率を重視した 音声対話AIモデル
- Gemini 3.8 Live Extended Thinking は、 高度な推論・複雑タスク対応 に特化
- どちらも リアルタイム推論 と 直感的な会話体験 を提供
- Google Workspace や 検索、Geminiアプリでの利用を想定
- 開発者・企業 向けに Gemini API や Google AI Studio で提供
主な特徴と性能
- Gemini 3.8 Live Extended Thinking は、Artificial Analysisの Speech to Speech Quality Index で 82.6点 を獲得し、業界トップ
- τ-Voice や Sierra’s τ-Voice-banking ベンチマークでも高評価
- Big Bench Audio で 97.7% の推論精度を実現
- Gemini 3.8 Live はユーザー満足度が高く、 Speech Agent Arena で2位
- ServiceNow’s EVA-Bench で複雑な業務フローにおける 精度と会話品質のバランス を証明
- 97言語の自動認識・切替 に対応
- 視覚情報のリアルタイム処理 による文脈理解
- API/ツール呼び出し を会話中に裏で実行し、 中断なく応答
会話体験とワークフロー
- 複雑なタスク に対しては 同時推論・発話 を行い、リアルタイムで進捗を案内
- 「 Let me check that...」のような自然な応答でユーザーをガイド
- Google Workspaceや検索 での リアルタイムトラブルシューティング を実現
- Search Live 内でのステップバイステップのサポート
開発者・企業エコシステムへの展開
- Gemini Live API を通じて Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel, Vision Agents 等の開発プラットフォームで利用可能
- リアルタイムメディアストリーミング インフラを自動管理
- 開発者は UX設計 に集中可能
- Salesforce, Genspark, Lumeris 等とのパートナーシップにより、 低遅延・流暢性・ツール連携 の強みをアピール
セキュリティ・透明性
- SynthID透かし を全AI生成音声に埋め込み
- 偽情報防止 や AI生成音声の検出 に寄与
- 詳細は モデルカード を参照
提供開始情報
- Gemini 3.8 Live は本日より順次展開
- 開発者: Gemini API・Google AI Studio
- 企業: Gemini Enterprise(プライベートプレビュー)
- 一般ユーザー: Search Live
- Gemini 3.8 Live Extended Thinking も同時展開
- 開発者: Gemini API・Google AI Studio
- 企業: Gemini Enterprise(プライベートプレビュー)、Google Workspaceビジネス顧客向け
- 一般ユーザー: Gemini Live、Google AI Pro/Ultraサブスク(Docs/Gmail/Keep)
ニュース・アップデートの入手
- Googleニュースレター で最新情報やイベント、特別オファーを配信
- 個人情報は Googleプライバシーポリシー に従い管理
- いつでも配信停止 可能