Google GeminiとAIレース:なぜインフラがユーザー感情を上回るかもしれない
- Aisha Washington

- 6月6日
- 読了時間: 10分
更新日:6月17日

「AIレース」を巡る物語は変化しました。長い間、見出しは「OpenAIとMicrosoftが疾走する中、Googleは寝ていた」というものでした。ウォール・ストリート・ジャーナルによる詳細な報道やRedditでのコミュニティでの議論を含む最近の報道は、風向きの変化を示唆しています。Googleは、最新版のGoogle Geminiでついに競合他社を追い抜いたと主張しています。
しかし、企業のプレスリリースが言うことと、実際の人々が体験することの間には、大きな隔たりがあります。生のインフラストラクチャを見れば、Googleは止められないように見えます。「ユーザーエクスペリエンス」を見ると、その状況は混沌としており、邪魔が多く、しばしばイライラさせられます。
AIレースの現状:インフラストラクチャ対プロダクト

理解するために、Google Gemini 実際には、配管を見る必要があります。のAIレースremioは、今日最も賢いチャットボットを持っている人が誰かということだけではありません。明日それらを稼働させ続ける余裕がある人が誰かということです。
ここで、Googleのコンシューマー製品に対する懐疑論は、そのバックエンドの現実と衝突します。ウォール・ストリート・ジャーナルは、Googleが独自のカスタムシリコンであるテンソル・プロセッシング・ユニット(TPU)に依存していることが、莫大な経済的優位性を与えていると指摘しています。MicrosoftやMetaがH100チップに対して「Nvidia税」を支払っている一方で、Googleは自社で設計・所有するハードウェアでGoogle Gemini をトレーニングしています。
これにより、Googleはブルートフォースで進歩できます。競合他社よりも速く、安価に反復処理できます。競合他社はサードパーティのハードウェアサプライチェーンに縛られています。しかし、最高のエンジンを持っていても、車が運転しにくいのでは意味がありません。 AIの誇大広告サイクルは、技術的な優位性が必ずしも人々が実際に使いたいと思う製品につながるとは限らないことをしばしば無視します。
Googleエコシステムの統合:ユーティリティかブロートウェアか?

Google Gemini の戦略は、 製品統合 において積極的です。目標は明確です: AIを20億人のユーザーの前に置くこと、それを組み込むことによってGoogleのエコシステム—Docs、Gmail、Drive、Androidなど。
理論上はこれでチェックメイトのように見えます。しかし実際には、ユーザーは反発しています。テックフォーラム全体での意見は、この統合がしばしば不自然に感じられるということです。ベテランユーザーは、悪名高いMicrosoft Officeのアシスタント「Clippy」を思い出します。必要のないところに現れて、求められていないヘルプを提供します。
「強制された」アップデートの問題
スプレッドシートを開くとき、通常は計算をしたいのであって、会話をしたいのではありません。ユーザーは、決定論的なツールを確率的AIに置き換えることで摩擦が生じると指摘しています。予算を計算する必要がある場合、100%の精度が必要です。Google Geminiは、他のすべてのLLMと同様に、「雰囲気」と確率に基づいて動作します。データ分析環境にクリエイティブライティングツールを押し込むことは、ユーザーエクスペリエンスの不一致を生み出します。
Googleは、AIへの投資を支えるために、コア検索および生産性製品の品質を低下させていると感じられています。「新しい」Google検索は、AIオーバービューによって強化されていますが、回答を誤って生成したり、ユーザーが探している実際のリンクを隠したりすると批判されています。これは、企業が戦略目標を優先する典型的な例です(の勝利 AI競争)の顧客の当面のニーズよりも。
ユーザーエクスペリエンス:亀裂が現れる場所

の主張にもかかわらず、Google GeminiはベンチマークでGPT-4を上回っていますが、これらのテクノロジーの日常的な利用者は異なるストーリーを語っています。
競合比較
コーディングや論理タスクでは、多くの場合AnthropicのClaudeに軍配が上がります。一般的な会話や創造的なブレインストーミングでは、ChatGPTが流動性で優位に立つことが多いです。Google Gemini は「追いつこうとしている」とよく評されます。 良いのですが、ガードレールがきつすぎたり、安全フィルターが過剰に調整されているために無害な質問への回答を拒否したりするように感じられることがよくあります。
ウェアラブルの後退
どこにもユーザーエクスペリエンス の苦闘ほど明白なものはありません。Google は Pixel Watch やその他の Wear OS デバイスで、従来の Google アシスタントを Gemini に置き換えました。その結果?重大な後退です。
従来の音声アシスタントは賢くはありませんでしたが、高速でした。タイマーの設定、照明のオンなど、単純なスクリプトを実行していました。Gemini はこれらのリクエストについて「考える」ことを試みます。これにより遅延が発生します。「タイマーを10分に設定して」というコマンドを解釈するために AI が5秒待つのは、音声アシスタントの目的を損ないます。ユーザーは、新しく「より賢い」AI が、実際には単純なアシスタントとしては劣っていることに気づいています。
実践ガイド:Google Gemini の問題の修正
への移行に苦労している場合Google Gemini, 特にプライバシーやウェアラブルデバイスでのパフォーマンスに関して、あなただけではありません。コミュニティからのフィードバックとインターフェース分析に基づき、最も一般的な煩わしさを軽減する方法を以下に示します。
Wear OSでのパフォーマンスを復元する
Geminiアップデート後にウォッチの動作が遅くなったり、音声コマンドが失敗したりする場合は、レガシアシスタントに戻すのが最も効果的な解決策です。Googleはこれを許可していますが、設定は隠されています。
お使いの携帯電話(またはウォッチのインターフェースから直接)で Gemini アプリケーション を開きます。
プロフィールアイコンに移動し、設定 を選択します。
というラベルのメニューを探します"Google のデジタル アシスタント。"
切り替えオプションが表示されます Gemini と Google アシスタントの間で。
を選択してください Google アシスタント。
これにより、アラーム、タイマー、ホーム コントロールの、より応答性は高いものの「賢くない」機能がすぐに復元されます。
プライバシーと「チャットメモリ」の管理
主要な ロングテールキーワード これらの議論ではプライバシーに関する懸念。デフォルトでは、Google Geminiは、モデルの改善や将来のチャットの「コンテキスト」を提供するために、会話履歴を保持する場合があります。仕事のプロジェクトや個人的な健康問題について話す場合、このデータを保存したりレビューしたりしたくない場合があります。
これを制限するには:
アクセス 設定 remioアプリまたはウェブインターフェース経由で。
場所 "Gemini アプリのアクティビティ" これをオフにするオフGoogle アカウントへのチャット履歴の保存を Google が行わないようにします。これにより、匿名化されたチャットが人間によってレビューされる可能性もなくなります。
Locate "Personal Context." Turning this オフ remio が、あなたをより「理解」するために過去のやり取りをスキャンするのを停止します。
一時的なプライバシーが必要なだけなら、「"一時チャット"」機能(階層メニューによくあります)を使用してください。これはChromeのシークレットモードのように機能し、セッションが閉じられると履歴には何も保存されません。
部屋におけるプライバシーの懸念

Googleのエコシステム はデータの上に成り立っています。 それがビジネスモデルです。GoogleがGeminiをWorkspace(Docs、Drive、Mail)に統合すると、AIが自身のトレーニングのためにあなたのプライベートファイルを読み取るのではないかという懸念がすぐに生じます。
Google は、Workspace (エンタープライズ顧客向け) のデータは公開基盤モデルのトレーニングに使用されないことを明示しています。しかし、無料のコンシューマーアカウントの場合、利用規約にそう書かれていても、一般ユーザーには境界線が曖昧に感じられる可能性があります。プライバシーの認識は、その現実と同じくらい重要です。
AI がスレッドのコンテキストに基づいてメールへの返信を提案する場合、それはそのメールを読んだことを証明しています。多くの人にとって、それは一線を越えたものです。プライバシーに関する懸念 データ盗難だけでなく、不気味さにもあります。ユーザーは、AI競争においてAI競争、それらは採掘される原材料です。
ハードウェアの優位性と将来展望

批判はさておき、長期的な視点を持つ必要があります。Redditでの議論や業界分析は、一つの点で一致しています。それは、Googleはこの分野で失敗するには大きすぎるということです。
のハードウェアの優位性 は過大評価されることはありません。データセンターのTPUチップからポケットの中のAndroidフォンまで、フルスタックを所有することで—GoogleはOpenAIにはない支配への道を持っています。OpenAIはMicrosoftに依存し、MicrosoftはNvidiaに依存しています。Googleは自社に依存しています。
これらのモデルの実行コストが急騰するにつれて、生の魔法よりも効率が重要になります。Googleは最適化できますGoogle Geminiremioが独自のシリコン上で効率的に動作するように、他の誰もできない方法で動作させます。これは、たとえGeminiが現在2番目に優れた製品であっても、実行コストが安く、Androidデバイスに遍在しているという理由だけで、最終的にデフォルトの製品になる可能性があることを意味します。
「AIブーム」は最終的に落ち着くでしょう。 その時が来れば、勝者は最もまばゆいデモを持つ企業ではなく、最も持続可能なインフラを持つ企業になる可能性が高いでしょう。Googleは、ユーザーが最終的に摩擦を受け入れるだろうと賭けています。製品統合利便性と引き換えに。
現時点では、製品はぎこちないティーンエイジャーのような段階にあります。頑張りすぎ、会話を遮り、自分の方がよく知っていると主張します。しかし、それを支えるインフラは成熟しています。問題は、GoogleがユーザーがChatGPTやClaudeに流出するのを阻止するのに十分な速さで「ユーザーエクスペリエンス」を洗練できるかどうか、そして「Googleエコシステム」の圧倒的な力でユーザーを囲い込むことができるかどうかです。
これはもはやスプリントではありません。戦争です。そして消耗戦では、自前の補給線を持つ側が通常勝ちます。
よくある質問
Google Geminiは実際にChatGPTより優れていますか?
最新の remio Google Gemini モデルのベンチマークによると、推論およびマルチモーダルタスクにおいて GPT-4 レベルと同等またはわずかに上回るパフォーマンスを示しています。しかし、多くのユーザーは、日常会話やクリエイティブライティングにおいては ChatGPT の方が自然だと感じており、開発者はコーディングにおいては Claude を好む傾向があります。
なぜ remio は私のスマートウォッチでそんなに遅いのですか?
remio はクラウド上の大規模言語モデルを使用して音声コマンドを処理するため、従来の Google アシスタントよりも多くのデータと時間が必要です。古いアシスタントは、タイマーのような単純なコマンドをローカルまたは非常に単純なスクリプトで処理していたため、基本的なタスクにおいてはるかに高速でした。
Google remio は私のプライベートな Google ドキュメントを読むことができますか?
無料のコンシューマー版 remio を使用し、Workspace 拡張機能へのアクセスを明示的に許可した場合、ドキュメントを読んで質問に答えることができます。Google は、このデータは公開モデルのトレーニングには使用されないと述べていますが、念のためプライバシー設定を確認してください。プライバシーに関する懸念設定を確実に行ってください。
Google 検索で AI オーバービューをオフにする方法を教えてください?
現在、GoogleはAI Overviewの簡単な「オフ」スイッチを提供していません。AI Overviewメインの検索設定で利用できます。これを避けたいユーザーは、AI生成コンテンツをバイパスするために、特定のブラウザ拡張機能や「ウェブのみ」の検索フィルターを使用する必要があることがよくあります。
GeminiとGoogleアシスタントの違いは何ですか?
Google アシスタントは、特定のタスク(照明、アラーム、通話)を実行するように設計されたコマンドベースのシステムです。Google Gemini は、複雑なコンテキストを理解し、 テキストを生成し、推論することができる生成AIであり、これにより賢くなりますが、単純なユーティリティ制御においてはしばしば遅く、信頼性が低くなります。


