Gemini デスクトップ版に Gemini Live がない理由と、Mac ユーザーへの影響
2026 年 4 月 15 日、Google は Gemini for Mac を正式に公開しました。このアプリは Gemini をデスクトップに持ち込み、画面共有、テキストチャット、Google エコシステムとの連携に対応しています。実際にダウンロードして使える、本物のプロダクトです。
しかし、Gemini Live は入っていません。
iPhone や Android で Gemini Live を使ってきた人——Gemini とリアルタイムに双方向で話し、話している途中でも割り込め、話しながら画面やカメラ映像を共有できるあの機能——なら、Mac 版にも当然あるだろうと思ったはずです。ところが、ありません。Google 公式ブログ、TechCrunch、9to5Mac、MacRumors のいずれの報道でも、Gemini Live が Mac 版の機能として挙げられていません。画面共有はある。リアルタイム音声対話はない。
これは小さな抜け漏れではなく、構造的な欠落です。Google のデスクトップ戦略が今どこにあるのかを露わにし、Apple が近く投入する Siri のアップデートに直結する話でもあります。
Gemini Live とは何ができる機能なのか?
Gemini Live は、Google が Gemini 向けに作ったリアルタイム音声対話モードです。2024 年にモバイルで登場し、その後も能力を拡張し続けてきました。通常の Gemini チャットとの根本的な違いは次のとおりです。
リアルタイム双方向音声
Gemini Live は「音声をテキストに変換 → テキストで返答 → テキストを読み上げ」という直列の流れではありません。連続的にストリーミングされる音声のやり取りです。あなたが話し、Gemini が話す。検索窓に向かって口述して結果を待つのではなく、電話のように会話が自然に流れます。
いつでも割り込める(バージイン)
Gemini が話している最中に割り込めます。話の途中で口を開けば、Gemini は止まり、あなたの言葉を聞き、それに応じて返します。これが「本物の音声対話」と「ボタンを押して AI の独白が終わるまで待つ体験」を分ける決定的な能力です。バージインのない音声 AI は、録音に話しかけているような感覚になります。バージインがあって初めて、やり取りは会話になります。
画面とカメラの共有
モバイルの Gemini Live は、あなたの画面やカメラが捉えている映像を見ながら、リアルタイムに話し合えます。書類、ホワイトボード、棚の商品、壊れた家電にスマホを向けて、見えているものについて声で相談できます。視覚入力と音声出力が同時に走るため、「写真を撮る → アップロードする → 解析を待つ」という手順が要りません。
感情を汲んだ対話(Affective Dialog)
Gemini Live は文脈に応じて口調、テンポ、話し方を調整します。技術的な話題ではよりフォーマルに、ブレインストーミングではよりくだけた調子に。細かいようですが、長時間使うと効いてきます。どんな場面でも同じ話し方をする音声インターフェースは、使い込むほど耳障りになります。
複数の音声から選べる
ユーザーは複数の声から好みのものを選べます。機械的な読み上げ音声ではなく、長時間の会話に耐えるよう自然さを設計された声です。
ここまで挙げたすべてが、iOS と Android では既に使えます。Gemini for Mac では、ひとつも使えません。
Mac 版には実際に何が入っているのか?
Gemini for Mac に中身がないわけではありません。このアプリには次が含まれます。
- Gemini モデルとのテキストベースのチャット
- 画面共有——Gemini が Mac の画面を見て、そこに映っているものについて答える
- Google Workspace 連携(Docs、Sheets など)
- メニューバー常駐と、ショートカットによる呼び出し
- Apple Silicon ネイティブ対応(M シリーズのみ。Intel Mac は非対応)
画面共有は注目に値します。Live 体験の半分だからです。Gemini はあなたの画面を見られる。しかし、見えているものについて声で話し合うことはできず、タイプする必要があります。目はあるが、口がない。
その結果、Mac 版の使い心地は「たまたま画面が見えるテキストアシスタント」であって、「作業しながら会話できる相棒」ではありません。ワークフロー上の差は決定的です。タイプして質問するには、作業から意識を切り替え、文章を組み立て、返答を待つ必要があります。同じ質問を声で言えば 2 秒で済み、しかも手は今やっている作業から離れません。
実際にユーザーは不満を口にしているのか?
はい、既に具体的な不満が出ています。デスクトップで音声対話が心もとないという話は理論上の懸念ではありません。MacRumors のフォーラムには、あるユーザーがこう書き込んでいます。
“as long as it gets better voice transcription than the gemini ios app or gemini in the browser…this alone makes gemini unusable for me. I PRAY to Steve Jobs that the new siri will not rely on this, otherwise it will be DOA.”
(Gemini の iOS アプリやブラウザ版より音声の文字起こしがマシになってさえいれば……この一点だけで、私にとって Gemini は使い物になりません。新しい Siri がこれに依存しないよう、スティーブ・ジョブズに祈ります。さもないと出た瞬間に終わりです。)
この一言は二つの痛点を同時に突いています。第一に、既存の音声入力(タイプ用の音声文字起こし)ですら「使い物にならない」と言わせるほど不安定であること。第二に、Apple が近く出す Siri のアップデートが Google の音声基盤に依存することへの、切実な不安です。
自社技術が次期 OS アップデートを動かさないよう、ユーザーが故人となった創業者に祈っているとしたら、プロダクトのどこかが壊れています。
Apple の Siri にはどう影響するのか?
Mac に Gemini Live がないことは、Google 社内の話にとどまらず Apple の問題にもなります。理由はこうです。
Apple は大規模言語モデルを頭脳とする大幅な Siri 刷新を、公然と進めてきました。Bloomberg、The Information をはじめ複数のメディアの報道により、Apple が次世代 Siri の駆動エンジンとして Google の Gemini を選んだことは確認済みです。この取引は双方にとって戦略的に理にかなっています。Apple は自前で作らずに最前線のモデル能力を得られ、Google はすべての Apple デバイスへの配信網を得られます。
しかし、ここで問題が出てきます。Google 最良の音声対話技術である Gemini Live が Mac に載る準備すらできていないなら、Mac 上の Siri 刷新を動かすのは一体何なのでしょうか。
考えられる筋書きはいくつかあり、どれも安心できるものではありません。
可能性 1:Apple は別系統の Gemini 音声技術を受け取っている
Apple は、消費者向けの Gemini Live とは別のプライベート API 経由で Gemini の音声能力にアクセスしている可能性があります。この場合、Gemini for Mac に Live がないことは、Mac の Siri にもないことを必ずしも意味しません。ただしそれは、Google が Mac 向けのリアルタイム音声を作っておきながら、自社アプリでは先に出さないと決めたということでもあります。プロダクト判断としては異例です。
可能性 2:Mac の Siri が受け取るのはテキスト版 Gemini で、音声版ではない
Mac の Siri 刷新は、言語理解と応答生成に Gemini を使いつつ、音声の層は Apple 既存の音声認識・音声合成のしくみに任せ続けるのかもしれません。この場合、Siri の答えは賢くなりますが、Gemini Live のような会話の滑らかさは得られません。割り込みなし、感情を汲んだ対話なし、リアルタイムの往復なし。同じぎこちない Siri の操作感のまま、答えの質だけが上がる形です。
可能性 3:Siri 刷新が Mac と iPhone で足並みを揃えない
Apple は Gemini 駆動の Siri を先に iPhone で出し(Gemini Live はスマホで実証済みのため)、Mac 版を後回しにするかもしれません。格好は悪いですが前例がないわけではなく、Apple は iPhone で先行投入した機能を数か月後に Mac へ持ってくることを何度も繰り返してきました。
可能性 4:すべてが延期される
最もありそうな筋書きは、いちばん単純なものかもしれません。Apple が当初想定した時期には何も間に合わず、Gemini 駆動の Siri 刷新が全プラットフォームで遅れる、というものです。Gemini for Mac が Live なしで出たことは、Google が Apple に納めるべき音声基盤がまだ整っていないという早期のサインなのかもしれません。
どの筋書きが現実になるにせよ、Mac の初回リリースで Gemini Live が欠けているという事実は、Apple と Google の Siri 提携に賭けている全員が注視すべきものです。
技術はもう存在しているのか? Live API という答え
存在しています。話をややこしくしているのは、デスクトップでリアルタイム音声対話を実現するのに必要な技術基盤を、Google が既に公開している点です。Gemini Live API は今日から使え、デスクトップ用途にも対応しています。
Live API が提供する能力は次のとおりです。
WebSocket ベースのストリーミング通信
この API は WebSocket 接続で双方向のリアルタイム通信を行います。音声は両方向へ同時にストリーミングされます。モバイルの Gemini Live を動かしているアーキテクチャとまったく同じ形であり、技術的に Mac で動かせない根本的な理由は存在しません。
画面共有とカメラ入力
Live API は、音声に加えて画面の内容やカメラ映像を入力ストリームとして同時に送れます。この API で作られたアプリなら、「Gemini に話しかけながら、Gemini があなたの画面を見ている」体験を実現できます。まさに公式の Gemini for Mac アプリに欠けているものです。
割り込みへのネイティブ対応
この API はプロトコルの層で割り込みを扱います。モデルが音声を生成している最中にユーザーが話し始めれば、モデルは停止して新しい入力を処理します。アプリ側の小細工ではなく、プロトコルに組み込まれた挙動です。
感情を汲んだ対話の能力
ストリーミングされる音声応答は、モバイルの Gemini Live と同じ抑揚の変化と会話への適応性に対応しています。
安全のための一時トークン(Ephemeral Tokens)
この API は寿命の短い認証トークンを提供し、長期の API キーを晒さずにクライアントアプリで使えます。コードがユーザーのマシン上で動くデスクトップや Web アプリのために、まさに設計されたしくみです。
つまり、Mac で Gemini Live を作るのに必要なものは、すべて開発者向け API として既に存在しています。Google は配管をすべて敷き終えています。自社のデスクトップ向け消費者プロダクトに、それをつないでいないだけです。
ここから奇妙な状況が生まれます。Live API を使う第三者の開発者なら、Google 自身のアプリより優れた音声体験を Mac 上に作れてしまう。技術はそこにあります。出さないのは、意図的なプロダクト判断です。
Live はいつ Mac に来るのか?
2026 年半ばまでに来る公算が大きく、Google I/O での発表が最有力です。Google は Gemini for Mac の発表時、慎重に含みを持たせた言い回しをしました。Mac アプリは “just the beginning”(まだ始まりにすぎない)であり、“more news in the coming months”(今後数か月でさらなる知らせがある)と約束しています。
行間を読めば、これはほぼ確実に Google I/O 2026——5 月か 6 月の開催見込み——を指しています。Google I/O はデスクトップ版 Gemini Live を発表する場として自然です。開発者向けイベントであり、Live API 自体が開発者向けプロダクトであり、時期的にも Mac アプリの実使用データを数週間ぶん集めてから機能を広げられます。
初回リリースに Live が含まれなかった実務的な理由も、いくつか考えられます。
macOS のマイク権限
macOS はマイクへのアクセスを厳しく管理しています。インストール直後の新しいアプリが「常時マイクを使用」の許可をいきなり求めれば、初回体験の摩擦は極めて大きくなります。Google はまず画面共有とテキストチャットでアプリの価値を示し、その後のアップデートで音声を入れる道を選んだのかもしれません。その頃にはユーザーにもマイク許可を出す理由ができています。
常時オンの音声に求められる品質水準
デスクトップのリアルタイム音声は、ある一点でモバイルより難しくなります。環境ノイズです。スマホのユーザーは端末を顔に近づけるかイヤホンを使いますが、デスクトップのユーザーはオフィス、カフェ、他人が話している部屋にいます。音声認識も割り込み検知もこうした環境に合わせた調整が必要で、Google はまだデスクトップの騒音下で満足できる品質に達していないのかもしれません。
戦略的なタイミング調整
まず Live なしで Mac アプリを出し、数週間後に I/O で Live を追加すれば、Google はニュースサイクルを一度ではなく二度作れます。標準的なプロダクトマーケティングの手法であり、技術が未熟である証拠ではなく、単なるビジネス上の計算です。
最も可能性が高いのは、2026 年半ばまでに Gemini Live が Mac へ到達し、Google I/O で発表されてから数週間かけて展開されるという筋書きです。ただし「可能性が高い」と「確定」は別物であり、Google が実際に出すまで、Mac ユーザーは音声対話が最も効くプラットフォームでテキスト優先のアシスタントに向き合うほかありません。
なぜ音声はデスクトップでこそ重要なのか?
デスクトップにはフルサイズのキーボードがあるから音声はそれほど重要ではない、という見方があります。この見方は誤りで、その理由は人が実際にデスクトップでどう働いているかを考えれば分かります。
モバイルでは、端末を持つために手がふさがっています。音声は主に、小さなキーボードでの入力を避けるための便利手段です。デスクトップでは、手は実際の作業でふさがっています。コードを書き、文書を編集し、表計算を操作し、Figma でデザインしている。ここでの音声は便利手段ではなく、主たる作業の流れを止めずに AI アシスタントとやり取りする手段です。
理想的なデスクトップ AI 体験はこうです。両手はずっとキーボードに置いたまま実作業を進め、その間に声で AI と今やっていることを相談する。「ねえ、画面に出てるこのエラー見て。どういう意味?」「今書いた最後の 3 段落を読んで、論の筋が通ってるか教えて」「この PR をマージするから、変更点をもう一度ざっと確認して」。
これらはすべて音声優先のやり取りであり、両手が別の作業でふさがっている最中に起きます。タイプして尋ねるには作業を止める必要がありますが、声で言うなら止めなくて済みます。
だからこそ、Mac に Gemini Live がないのは小さな機能差ではありません。デスクトップ AI アシスタントを「役に立つ」から「本当に手放せない」へ変える、その対話様式そのものの欠落です。
今 Mac で音声対話が必要なユーザーはどうすればいい?
公式の Gemini for Mac では実現できないため、次の三つから選ぶことになります。
- スマホで Gemini Live を使う——Mac の横にスマホを立てかけ、作業しながら話しかける。優雅ではありませんが機能します。
- Live API で自作する——開発者なら、Gemini Live API が完全な体験を構築するのに必要なものをすべて提供しています。
- サードパーティのクライアントを使う——Live API で作られたアプリなら、Google 自身のアプリにない音声対話を提供できます。
Gemini for Mac は、実用的な画面共有を備えた及第点のテキストアシスタントです。しかし、モバイルの Gemini Live がユーザーに期待させてきた音声優先のデスクトップ AI 体験ではありません。Google がこの差を埋めるまで、スマホで完全版を体験した人にとって、Mac アプリは半分のプロダクトに感じられるでしょう。
これから
Google は Mac 版のリリースを “just the beginning” だと言いました。私たちはその言葉を信じます。ただし同時に、その「始まり」から、Gemini の対話モデルを「ChatGPT に文字を打ち込む体験」と本当に差別化していた機能が抜け落ちていたことにも気づいています。
Gemini Live API は技術が可能であることを証明しました。モバイルアプリはプロダクトとして成立することを証明しました。残る問いは、Google がいつデスクトップでその点と点をつなぐのか、そして Apple の Siri のスケジュールがそれを待てるのか、です。
私たちは GeminiDesktop を作っています。目指しているのは本物のネイティブ Mac クライアントであり、Gemini の能力一式(Live API を含む)をロードマップ上の宿題ではなく一級の機能として扱うことです。いちばん良い部分をスマホに置き去りにしないデスクトップ Gemini 体験が欲しい方は、こちらをご覧ください。