Googleは、高度なAI推論モデルファミリーを立ち上げます

火曜日に、GoogleはGemini 2.5を展開しました。これは、回答を出す前に一瞬「考える」新しいAIモデルのセットです。まるで人間の私たちを真似しようとしているみたいですよね?
先頭に立つのはGemini 2.5 Pro Experimentalで、Googleがこれまでで最も賢いモデルと宣伝しています。このすごい奴はマルチモーダルで、推論タスクをバッチリこなせます。火曜日からGoogle AI Studioで試すことができますし、Gemini Advancedに月額20ドルを払っているなら、Geminiアプリを通じてアクセス可能です。
Googleは推論に関する取り組みにかなり本気で、将来のすべてのAIモデルにこれを組み込む予定です。
2024年9月にOpenAIが最初のAI推論モデルo1を発表して以来、テック業界は追いつくために大忙しです。今、Anthropic、DeepSeek、Google、xAIがそれぞれ独自の推論モデルで競争に参加しています。これらのモデルは、事実を再確認し、問題をじっくり考えるために少し時間と計算能力を必要とします。
推論技術は、AIにとって特に数学やコーディングにおいて革新的な変化をもたらしました。テック業界の多くの人々は、これらの推論モデルがAIエージェント—人間が常に見守らなくても動作できる自律システム—にとって重要になると考えています。ただ、コストも高めですけどね。
Googleはこの分野に慣れ親しんでいます。以前にも、12月にリリースした「考える」バージョンのGeminiのような推論モデルを試してきました。でも、Gemini 2.5? これはOpenAIの「o」シリーズを超えるための大きな一撃です。
Googleは、Gemini 2.5 Proがこれまでのモデルや競合のトップモデルを多くのベンチマークで上回っていると主張しています。彼らは、Gemini 2.5を、視覚的に魅力的なウェブアプリや独自に動作するコーディングプロジェクトで圧倒的な成果を上げるように調整しました。
コード編集のAider Polyglotテストでは、Gemini 2.5 Proは68.6%の堅実なスコアを獲得し、OpenAI、Anthropic、DeepSeekの最高モデルを上回りました。しかし、ソフトウェア開発のSWE-bench Verifiedテストでは63.8%を記録—OpenAIのo3-miniやDeepSeekのR1を上回るには十分でしたが、AnthropicのClaude 3.7 Sonnetの70.3%には及ばなかったです。
そして、数学、人文、科学に関する何千もの質問を含む厳しいマルチモーダルテスト、Humanity's Last Examでは、Gemini 2.5 Proは18.8%を達成し、他のビッグネームのほとんどのモデルを上回りました。
Gemini 2.5 Proは、最初から100万トークンのコンテキストウィンドウを備えています—まるで「ロード・オブ・ザ・リング」シリーズ全体を一気に読むようなものです。そして、近いうちにこれを200万トークンに倍増する予定です。
GoogleはAPIの価格についてはまだ明らかにしていませんが、数週間以内には詳細を公開すると約束しています。
関連記事
Gemini SparkがGoogleフォトのライブラリを管理するようになりました
Googleは、Gemini SparkがGoogle Photosライブラリを管理できるようにすることで、AI統合を拡大している。ユーザーは現在、エージェントに画像の編集、アルバムの整理、お気に入りのショットから共有コレクションの生成、コンサートフライヤーをカレンダーイベントへの変換、その他のワークフローの自動化などの指示を出すことができる。Google Photos責任者のShimrit Ben-Yair氏はX上でこれらの新機能を発表し、米国在住のGemini AI ProおよびUltra
Google、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、偽の着信検知機能を導入
Googleは火曜日、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、Androidに「偽の着信検出」機能を導入すると発表した。この機能は今月、Pixel端末を皮切りに、Android 12以降の端末向け「Phone by Google」アプリを通じて世界中で順次提供される。見知らぬ番号からの着信に応答することを避ける人が増えるにつれ、詐欺師たちは手口を変え、信頼できる電話
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
関連特集おすすめ
コメント (39)
0/500
Googleがまた新しいAIを発表したね。人間みたいに「考える」時間を設けるって、本当に可能なのかな?倫理的な問題も気になるし、技術が進むほど不安になることもある。でも、これで検索がもっと便利になるなら試してみたいかも😅
C'est marrant comment Google essaie de faire 'réfléchir' ses IA maintenant... Sauf que moi quand je réfléchis je mets 3h à choisir entre deux parfums de glace 😂 Vivement qu'ils améliorent la version Pro pour nos dilemmes du quotidien !
Whoa, Google’s Gemini 2.5 sounds like it’s got a brain of its own, pausing to ‘think’ before answering! 😮 Makes me wonder if it’ll outsmart us at pub quizzes soon. Cool tech, but I hope it doesn’t start overanalyzing my bad jokes.
Google's Gemini 2.5 sounds like a brainy upgrade! I wonder if it’ll outsmart my math homework. 🤓 Excited to see how it stacks up against other AI models.
Gemini 2.5 is pretty cool! It's like it pauses to think before answering, which is kinda human-like. I tried it out and it's definitely smarter than the last version. Only thing is, sometimes it takes too long to respond, but hey, I guess that's the price of deep thinking! 🤔

火曜日に、GoogleはGemini 2.5を展開しました。これは、回答を出す前に一瞬「考える」新しいAIモデルのセットです。まるで人間の私たちを真似しようとしているみたいですよね?
先頭に立つのはGemini 2.5 Pro Experimentalで、Googleがこれまでで最も賢いモデルと宣伝しています。このすごい奴はマルチモーダルで、推論タスクをバッチリこなせます。火曜日からGoogle AI Studioで試すことができますし、Gemini Advancedに月額20ドルを払っているなら、Geminiアプリを通じてアクセス可能です。
Googleは推論に関する取り組みにかなり本気で、将来のすべてのAIモデルにこれを組み込む予定です。
2024年9月にOpenAIが最初のAI推論モデルo1を発表して以来、テック業界は追いつくために大忙しです。今、Anthropic、DeepSeek、Google、xAIがそれぞれ独自の推論モデルで競争に参加しています。これらのモデルは、事実を再確認し、問題をじっくり考えるために少し時間と計算能力を必要とします。
推論技術は、AIにとって特に数学やコーディングにおいて革新的な変化をもたらしました。テック業界の多くの人々は、これらの推論モデルがAIエージェント—人間が常に見守らなくても動作できる自律システム—にとって重要になると考えています。ただ、コストも高めですけどね。
Googleはこの分野に慣れ親しんでいます。以前にも、12月にリリースした「考える」バージョンのGeminiのような推論モデルを試してきました。でも、Gemini 2.5? これはOpenAIの「o」シリーズを超えるための大きな一撃です。
Googleは、Gemini 2.5 Proがこれまでのモデルや競合のトップモデルを多くのベンチマークで上回っていると主張しています。彼らは、Gemini 2.5を、視覚的に魅力的なウェブアプリや独自に動作するコーディングプロジェクトで圧倒的な成果を上げるように調整しました。
コード編集のAider Polyglotテストでは、Gemini 2.5 Proは68.6%の堅実なスコアを獲得し、OpenAI、Anthropic、DeepSeekの最高モデルを上回りました。しかし、ソフトウェア開発のSWE-bench Verifiedテストでは63.8%を記録—OpenAIのo3-miniやDeepSeekのR1を上回るには十分でしたが、AnthropicのClaude 3.7 Sonnetの70.3%には及ばなかったです。
そして、数学、人文、科学に関する何千もの質問を含む厳しいマルチモーダルテスト、Humanity's Last Examでは、Gemini 2.5 Proは18.8%を達成し、他のビッグネームのほとんどのモデルを上回りました。
Gemini 2.5 Proは、最初から100万トークンのコンテキストウィンドウを備えています—まるで「ロード・オブ・ザ・リング」シリーズ全体を一気に読むようなものです。そして、近いうちにこれを200万トークンに倍増する予定です。
GoogleはAPIの価格についてはまだ明らかにしていませんが、数週間以内には詳細を公開すると約束しています。
Gemini SparkがGoogleフォトのライブラリを管理するようになりました
Googleは、Gemini SparkがGoogle Photosライブラリを管理できるようにすることで、AI統合を拡大している。ユーザーは現在、エージェントに画像の編集、アルバムの整理、お気に入りのショットから共有コレクションの生成、コンサートフライヤーをカレンダーイベントへの変換、その他のワークフローの自動化などの指示を出すことができる。Google Photos責任者のShimrit Ben-Yair氏はX上でこれらの新機能を発表し、米国在住のGemini AI ProおよびUltra
Google、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、偽の着信検知機能を導入
Googleは火曜日、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、Androidに「偽の着信検出」機能を導入すると発表した。この機能は今月、Pixel端末を皮切りに、Android 12以降の端末向け「Phone by Google」アプリを通じて世界中で順次提供される。見知らぬ番号からの着信に応答することを避ける人が増えるにつれ、詐欺師たちは手口を変え、信頼できる電話
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
Googleがまた新しいAIを発表したね。人間みたいに「考える」時間を設けるって、本当に可能なのかな?倫理的な問題も気になるし、技術が進むほど不安になることもある。でも、これで検索がもっと便利になるなら試してみたいかも😅
C'est marrant comment Google essaie de faire 'réfléchir' ses IA maintenant... Sauf que moi quand je réfléchis je mets 3h à choisir entre deux parfums de glace 😂 Vivement qu'ils améliorent la version Pro pour nos dilemmes du quotidien !
Whoa, Google’s Gemini 2.5 sounds like it’s got a brain of its own, pausing to ‘think’ before answering! 😮 Makes me wonder if it’ll outsmart us at pub quizzes soon. Cool tech, but I hope it doesn’t start overanalyzing my bad jokes.
Google's Gemini 2.5 sounds like a brainy upgrade! I wonder if it’ll outsmart my math homework. 🤓 Excited to see how it stacks up against other AI models.
Gemini 2.5 is pretty cool! It's like it pauses to think before answering, which is kinda human-like. I tried it out and it's definitely smarter than the last version. Only thing is, sometimes it takes too long to respond, but hey, I guess that's the price of deep thinking! 🤔





家






