Googleは「Gemini」の音声入力機能をGboardに統合し、音声入力スタートアップ各社に挑んでいる

火曜日の午前中に開催された「Android Show: I/O Edition 2026」イベントで、Googleは、広く利用されているAndroid用キーボードアプリ「Gboard」向けの新しいAI駆動型音声入力機能「Rambler」を発表した。 今回の発表により、Googleは、ここ数年でデスクトップやモバイルで人気を集めている「Wispr Flow」や「Typeless」といった新興のAI音声入力アプリと直接競合する立場に立った。もっとも、これらのアプリの多くは、Androidではまだ確固たる地位を築けていない。
他の音声入力アプリと同様、Ramblerは「えー」や「あー」といった間投詞を除去します。また、文の途中で修正を加えることも理解します。例えば、「水曜日の午後3時にいつものカフェで会う予定なんだけど…えーと、午後2時だ」といった場合です。
Googleによると、RamblerはGeminiベースの多言語モデルを採用しており、コードスイッチングにも対応している。コードスイッチングにより、ユーザーは文の途中で言語を切り替えることが可能になる(例えば、英語からヒンディー語へ)。Ramblerは、文脈を途切れさせることなく処理を継続する。 この機能は、多くの多言語話者が自然にコミュニケーションをとる方法を反映したものであり、欧米の音声入力アプリの多くが導入に遅れをとってきた機能です。
Googleによると、GboardではRamblerがアクティブになっている際、ユーザーに明確に通知されるという。音声記録は一切保存されず、音声は音声の文字起こしのみに使用される。ブリーフィングの中でGoogleは、Ramblerがすべてのアプリで機能するため、これは「キーボードの再発明」に等しいと述べた。
プレーヤーを読み込み中…
プライバシーに関して、Android Core Experiences担当ディレクターのベン・グリーンウッド氏は、Googleが端末内処理とクラウドベースの処理を組み合わせており、機能が「安全かつプライバシーが保護された」ものであることを保証するために「長年にわたり多大な投資を行ってきた」と述べた。これは、データの取り扱い方が異なる可能性のあるサードパーティ製の音声入力アプリとRamblerを比較するユーザーに向けた、意図的なメッセージである。
ここ数年、Wispr Flow、Willow、SuperWhisper、Monoglogue、Handy、Typelessなど、数多くの音声入力アプリが登場している。しかし、その活動のほとんどはデスクトップやiOSに集中しており、Androidは比較的取り残された状態にある。 Google自身も先月、iOS向けに、端末上のGemma AIモデルを搭載したオフライン優先の音声入力アプリ「AI Edge Eloquent」をリリースした。
Ramblerは、そのギャップを埋めるためのGoogleによる、これまでで最も決定的な一歩です。当初、これらの新機能は夏の展開期間中、Samsung GalaxyおよびGoogle Pixelスマートフォンでのみ利用可能ですが、最終的には他のAndroid端末にも拡大される予定です。 最大の強みは普及率にある。Gboardは世界中のAndroidユーザーの大半にとってデフォルトのキーボードとして機能しており、つまり「Rambler」は数億人のユーザーにプリインストールされた状態で提供されることになる。 プラットフォーム大手がOSレベルで市場に参入する場合、独立系アプリは、追加のダウンロードを正当化するための説得力のある理由――優れた精度、より充実した機能、あるいはより強力なプライバシー保証――を提供しなければなりません。
音声入力スタートアップにとって、課題は「優れた製品を作れるか」から、「ユーザーが積極的に求めるほど十分に優れた製品を作れるか」へとシフトしている。
関連記事
Gemini SparkがGoogleフォトのライブラリを管理するようになりました
Googleは、Gemini SparkがGoogle Photosライブラリを管理できるようにすることで、AI統合を拡大している。ユーザーは現在、エージェントに画像の編集、アルバムの整理、お気に入りのショットから共有コレクションの生成、コンサートフライヤーをカレンダーイベントへの変換、その他のワークフローの自動化などの指示を出すことができる。Google Photos責任者のShimrit Ben-Yair氏はX上でこれらの新機能を発表し、米国在住のGemini AI ProおよびUltra
Google、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、偽の着信検知機能を導入
Googleは火曜日、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、Androidに「偽の着信検出」機能を導入すると発表した。この機能は今月、Pixel端末を皮切りに、Android 12以降の端末向け「Phone by Google」アプリを通じて世界中で順次提供される。見知らぬ番号からの着信に応答することを避ける人が増えるにつれ、詐欺師たちは手口を変え、信頼できる電話
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
関連特集おすすめ
コメント (0)
0/500

火曜日の午前中に開催された「Android Show: I/O Edition 2026」イベントで、Googleは、広く利用されているAndroid用キーボードアプリ「Gboard」向けの新しいAI駆動型音声入力機能「Rambler」を発表した。 今回の発表により、Googleは、ここ数年でデスクトップやモバイルで人気を集めている「Wispr Flow」や「Typeless」といった新興のAI音声入力アプリと直接競合する立場に立った。もっとも、これらのアプリの多くは、Androidではまだ確固たる地位を築けていない。
他の音声入力アプリと同様、Ramblerは「えー」や「あー」といった間投詞を除去します。また、文の途中で修正を加えることも理解します。例えば、「水曜日の午後3時にいつものカフェで会う予定なんだけど…えーと、午後2時だ」といった場合です。
Googleによると、RamblerはGeminiベースの多言語モデルを採用しており、コードスイッチングにも対応している。コードスイッチングにより、ユーザーは文の途中で言語を切り替えることが可能になる(例えば、英語からヒンディー語へ)。Ramblerは、文脈を途切れさせることなく処理を継続する。 この機能は、多くの多言語話者が自然にコミュニケーションをとる方法を反映したものであり、欧米の音声入力アプリの多くが導入に遅れをとってきた機能です。
Googleによると、GboardではRamblerがアクティブになっている際、ユーザーに明確に通知されるという。音声記録は一切保存されず、音声は音声の文字起こしのみに使用される。ブリーフィングの中でGoogleは、Ramblerがすべてのアプリで機能するため、これは「キーボードの再発明」に等しいと述べた。
プレーヤーを読み込み中…
プライバシーに関して、Android Core Experiences担当ディレクターのベン・グリーンウッド氏は、Googleが端末内処理とクラウドベースの処理を組み合わせており、機能が「安全かつプライバシーが保護された」ものであることを保証するために「長年にわたり多大な投資を行ってきた」と述べた。これは、データの取り扱い方が異なる可能性のあるサードパーティ製の音声入力アプリとRamblerを比較するユーザーに向けた、意図的なメッセージである。
ここ数年、Wispr Flow、Willow、SuperWhisper、Monoglogue、Handy、Typelessなど、数多くの音声入力アプリが登場している。しかし、その活動のほとんどはデスクトップやiOSに集中しており、Androidは比較的取り残された状態にある。 Google自身も先月、iOS向けに、端末上のGemma AIモデルを搭載したオフライン優先の音声入力アプリ「AI Edge Eloquent」をリリースした。
Ramblerは、そのギャップを埋めるためのGoogleによる、これまでで最も決定的な一歩です。当初、これらの新機能は夏の展開期間中、Samsung GalaxyおよびGoogle Pixelスマートフォンでのみ利用可能ですが、最終的には他のAndroid端末にも拡大される予定です。 最大の強みは普及率にある。Gboardは世界中のAndroidユーザーの大半にとってデフォルトのキーボードとして機能しており、つまり「Rambler」は数億人のユーザーにプリインストールされた状態で提供されることになる。 プラットフォーム大手がOSレベルで市場に参入する場合、独立系アプリは、追加のダウンロードを正当化するための説得力のある理由――優れた精度、より充実した機能、あるいはより強力なプライバシー保証――を提供しなければなりません。
音声入力スタートアップにとって、課題は「優れた製品を作れるか」から、「ユーザーが積極的に求めるほど十分に優れた製品を作れるか」へとシフトしている。
Gemini SparkがGoogleフォトのライブラリを管理するようになりました
Googleは、Gemini SparkがGoogle Photosライブラリを管理できるようにすることで、AI統合を拡大している。ユーザーは現在、エージェントに画像の編集、アルバムの整理、お気に入りのショットから共有コレクションの生成、コンサートフライヤーをカレンダーイベントへの変換、その他のワークフローの自動化などの指示を出すことができる。Google Photos責任者のShimrit Ben-Yair氏はX上でこれらの新機能を発表し、米国在住のGemini AI ProおよびUltra
Google、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、偽の着信検知機能を導入
Googleは火曜日、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、Androidに「偽の着信検出」機能を導入すると発表した。この機能は今月、Pixel端末を皮切りに、Android 12以降の端末向け「Phone by Google」アプリを通じて世界中で順次提供される。見知らぬ番号からの着信に応答することを避ける人が増えるにつれ、詐欺師たちは手口を変え、信頼できる電話
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli





家






