Gemini Live Thinking Mode が Google App 17.2 で発見される
- Aisha Washington

- 6月6日
- 読了時間: 7分

最新のGoogle App 17.2アップデートに隠されたコードは、Googleがようやくその音声AIに関する最大の不満に対処し始めていることを明らかにしている。この解析により、専用機能のGemini Live Thinking Modeの imminent なローンチと、新たな「Labs」設定の下に収められた一連の実験的機能が示唆されている。
ここ数ヶ月、現在のGemini Live(より高速だがしばしば浅いGemini 2.5 Flashを搭載)のバージョンと格闘してきたユーザーにとって、これは転換点となる。リークは、Googleが複雑なクエリを処理するために一時停止するモデルへと移行し、幻覚の最初の兆候を吐き出すのではなく、論理的アプローチを取ることを確認している。
以下では、発見された内容、コミュニティがこれらの特定の変更を求めている理由、そして新しいLabs機能の仕組みについて解説する。
Why Users Need a Slower, Smarter AI

コードを解析する前に、Gemini Live Thinking Modeが埋めることを意図しているユーザー体験のギャップについて触れておく必要がある。現在のGemini Liveは高速だが、その速度には代償が伴っている。
初期採用者からのフィードバックは一貫している。現在のモデルは、ニュアンスのある会話中にしばしば「頭が死んでいる」ように感じられる。システムは論理よりもレイテンシを優先し、精査に耐えられない表面的な回答につながる。しかし不満は単なる悪い回答にとどまらない。
The Interruption Problem
最も声高に挙げられる不満は、攻撃的な音声アクティビティ検出(VAD)に関するものだ。流暢な会話をしようとするユーザーは、息をしたり考えたりするために一時停止した瞬間に遮断されてしまう。
システムは沈黙をタスク完了とみなす。ユーザーが考えを終える前に応答をトリガーする。これにより、ユーザーが急かされていると感じる不自然なループが生まれる。求められているのは明確だ。人々は「手動送信」ボタンや、AIに待機を強制するトグルを望んでいる。バージョン17.2のリークでは手動ボタンが明示的に確認されていないものの、Thinking Modeの導入は、AIが時間とペーシングを管理する方法の根本的な変化を示唆している。
Exploring the New "Labs" in Google App 17.2

Googleは他のテック大手と同様の戦略を採用し、これらの先進的で潜在的に不安定な機能を「Labs」トグルの背後に隠しているようだ。これにより、主流の体験を乱すことなくパワーユーザー向けにGemini Live Thinking Modeをプッシュできる。
ファイルの解析によると、Labsセクションには主に2つのカテゴリが用意される。
Live Thinking Mode
Live Experimental Features
この区分は、Googleが速度と知能のトレードオフを認識していることを示唆している。彼らは高速でチャット的なバージョンのGeminiを置き換えるのではなく、重い作業のための別レーンを提供している。
How Gemini Live Thinking Mode Works
コード文字列は、Gemini Live Thinking Modeを、AIが「より詳細な応答を提供するために考える時間」を取る状態として説明している。
これは2025年11月にリリースされたGemini 3 Proモデルに見られる推論機能のモバイル実装である可能性が高い。これまでモバイルユーザーは、バッテリー消費とレイテンシ低減のために軽量なFlashモデルに制限されていた。
このモードを有効にすると、ユーザーは基本的に、エージェントがチェーン・オブ・ソート処理を実行できるなら5〜10秒の遅延を気にしないことをアプリに伝えていることになる。コーディングの質問、複雑な旅行計画、または哲学的な議論の場合、この追加のレイテンシはバグではなく機能となる。
ただし、一部のユーザーは懐疑的だ。「Thinking Mode」が本物の認知処理ではなく、追加の安全レイヤーとPRフレンドリーなフィルタリングのためのバッファとして機能するだけではないか、という懸念がある。遅延がより洗練された「企業安全」な応答しかもたらさない場合、採用は急落するだろう。この価値提案は、その一時停止中に得られる洞察の質に完全に依存している。
Project Astra and Vision Capabilities
おそらくGemini Live Thinking Modeと並んで見つかった最もエキサイティングな追加は、ビジョンに関する言及だ。実験的フラグには「何かを見たときに応答する」機能が含まれている。
これはProject Astraのリアルタイムマルチモーダル機能の待望の到着である。静止画像を撮影して分析を求めるのではなく、Geminiがカメラが見ているものを継続的に監視し、リアルタイムでコメントするビデオストリームを意味している。
ハードウェアのトラブルシューティングや新しい街のナビゲーションにおいて、この機能は電話を受動的な画面から能動的な観察者へと変える。また「エージェント」の概念にも結びつき、AIは単なるチャットボットではなく、物理的環境を理解するインターフェースとなる。
Multimodal Memory and Context

「Experimental Features」セクションでは「multimodal memory」にも言及されている。これは標準的な履歴とは異なる。標準的な履歴はテキストのログである。multimodal memoryとは、先週表示した画像、昨日分析したサウンドクリップ、1時間前に行った音声会話の文脈をAIが記憶することを意味する。
現在、モバイルのコンテキストウィンドウは制限されている。画像を再アップロードしたり、以前の制約をボットに思い出させたりしなければならないことが多い。Gemini Live Thinking Modeが永続的でクロスメディアのメモリバンクにアクセスできれば、長期的なAIインタラクションを悩ませる継続性の問題が解決する。
The Problem of Noise and Reliability
このリークを解析したRedditスレッドが強調したもう一つの重要な領域はノイズキャンセレーションだ。コードは「better noise handling」がこのアップデートの一部であることを示している。
音声優先の機能にとって、Gemini Liveは静かなホームオフィス以外の環境で historically 苦戦してきた。車内や賑やかなカフェで使用すると、AIが背景の雑音をユーザー入力として書き起こす結果になることが多かった。ノイズゲーティングの改善はThinking Modeほど「セクシー」ではないが、現実世界で製品を使えるようにするために技術的に必要である。
When Will We See Gemini Live Thinking Mode?
Google App 17.2にこれらの文字列が存在することは、コードがすでにデバイス上にあることを示唆している。サーバー側のスイッチはまだ有効化されていない。
歴史的に、Googleはこれらの機能を段階的なロールアウトでリリースしており、しばしば米国英語ユーザーとAI Premiumサブスクライバーを優先する。コミュニティの感情は、この地域制限に強く反対している。ヨーロッパやアジアのユーザーは、2025年に発表された機能が2026年初頭になっても自地域に存在しないことにすでに不満を表明している。
Developer Access
また、これらの機能をAI Studioで開放するよう求める動きもある。開発者はGeminiアプリのラッパーなしで「Thinking」エンドポイントを利用するアプリケーションを構築したいと考えている。アーキテクチャがサポートすれば、サードパーティアプリが医療診断支援や法的文書レビューなどの専門タスクにGemini Live Thinking Modeを利用するようになるかもしれない。
Assessing the Upgrade Path

このアップデートはmobile AIの成熟のマイルストーンを表している。私たちはインスタント音声生成の「wow factor」を超え、実用性の段階に入りつつある。
ユーザーはAIが即座に返事をするだけでなく、いつ黙るべきか、いつ聞くべきか、いつ考えるべきかを理解するAIを求めている。Gemini Live Thinking Modeの成功は、モデルがどれだけ賢いかにかかっているわけではない——Gemini 3が capable であることはわかっている。成功は実装にかかっている。
Googleが割り込みの問題を解決し、「thinking」の時間が具体的な価値を生むことを証明できれば、これは2026年のモバイルエージェントのスタンダードを定義するだろう。もしそれが単に回答に時間がかかるだけの失礼で割り込みがちなチャットボットにとどまるなら、トグルはオフのままになる可能性が高い。
FAQ
Gemini Live Thinking Modeと標準モードの違いは何ですか?
標準モードは速度を優先し、インスタント返信のためにGemini 2.5 Flashモデルを使用している可能性が高い。Thinking Mode allows the AI to pause and process complex logicで、より深い推論とより詳細な回答のためにGemini 3 Proを活用する可能性が高い。
Gemini Live Thinking ModeはAIが私を遮るのを止めますか?
「do not interrupt」設定として明示的に確認されているわけではないが、thinkingベースのアーキテクチャへの移行はペーシングの変化を示唆している。ただし、ユーザーは早まった割り込みを完全に防ぐために手動の「send」ボタンを具体的に求めている。
新しいGemini Live機能を有効にするにはどうすればよいですか?
これらの機能はGoogle App設定内の新しい「Labs」または「Opt-in」セクションに表示される。バージョン17.2以上である必要があり、機能はGoogleからのサーバーサイドアップデートで有効化されなければならない。
Does the new update include vision capabilities?
はい。コードは「responding when it sees something」を参照しており、これはProject Astraの技術と一致する。これにより、AIは静止画像だけでなく、カメラからのリアルタイムビデオフィードを分析できるようになる。
Is Gemini Live Thinking Mode free to use?
リークでは価格は指定されていないが、高度な推論機能はしばしばGoogle One AI Premiumサブスクリプションにバンドルされる。基本機能は無料かもしれないが、完全な「Thinking」機能は制限される可能性がある。


