研究者は、50ドル未満のOpenaiの50ドルの「推論」モデルのオープンソースのライバルを開発します

先週の金曜日、スタンフォード大学とワシントン大学のAI専門家による画期的な研究論文が発表され、クラウドコンピューティングクレジットで50ドル未満でAI「推論」モデル「s1」を開発したことが明らかになりました。この発見はAI業界を揺さぶっており、s1は数学やコーディングの課題において、OpenAIのo1やDeepSeekのR1といったトップティアのモデルと互角に渡り合っています。
s1モデルは、トレーニングデータやコードの詳細とともに、現在GitHubで公開されています。チームは平凡なベースモデルから始め、蒸留と呼ばれる技術で厳しい試練を課しました。このプロセスでは、別のAIモデルの応答をトレーニングに使用して「推論」のエッセンスを抽出します。この場合、s1はGoogleのGemini 2.0 Flash Thinking Experimentalモデルからその知能を得ました。これは、昨年バークレー大学の研究者が約450ドルで独自のAI推論モデルを作成した際に使用した手法と似ています。
一部の人々にとって、少人数の研究者チームが巨額の予算なしにAI分野で影響を与えられるというアイデアは刺激的です。しかし、s1の登場はAIモデル開発の将来について深刻な疑問も投げかけています。何百万ドルもかけて構築されたモデルに匹敵するモデルが低予算で再現できるなら、誰もが同じことをするのを止めるものは何でしょうか?
当然のことながら、AIの大手企業はこの状況に満足していません。例えば、OpenAIはDeepSeekが彼らのAPIデータを使用してモデル蒸留を行ったと非難しています。一方、s1チームは、堅実な推論パフォーマンスと「テスト時スケーリング」と呼ばれる、AIモデルが答える前に考える時間を増やす手法を最も簡単な方法で実現することに注力していました。これらはOpenAIのo1モデルが導入した同じ革新であり、DeepSeekのような他社が独自の方法で模倣しようとしたものです。
s1の論文では、監視付き微調整(SFT)と呼ばれる技術を使用して、比較的小さなデータセットで推論モデルを蒸留できると示唆されています。これは、AIモデルにデータセットから特定の行動を模倣するようトレーニングするもので、DeepSeekがR1モデル(OpenAIのo1と競合)に使用した大規模な強化学習よりも安価です。
GoogleはGemini 2.0 Flash Thinking ExperimentalをGoogle AI Studioプラットフォームを通じて無料で提供していますが、1日の制限があります。ただし、Googleの規約では、競合サービスを作成するためにモデルをリバースエンジニアリングすることは許可されていません。この点について、Googleからの回答を待っています。
s1モデル自体は、AlibabaのQwenラボから無料でダウンロードできる、控えめな既製のAIモデルとして始まりました。s1をトレーニングするために、研究者たちは慎重に選んだ1,000の質問とその回答、そしてGoogleのGemini 2.0による各「思考」プロセスを含むデータセットを用意しました。トレーニングプロセス全体は、16個のNvidia H100 GPUで30分未満で完了しました。プロジェクトに関わったスタンフォードの研究者ニクラス・ムーニンゴフによると、今日これを約20ドルの計算コストで実現できるとのことです。
研究者たちはまた、s1が自身の作業を再確認し、「思考」時間を延ばすように巧妙な工夫をしました。単に「待つ」と指示するだけです。論文によると、s1の推論プロセス中にこの言葉を追加することで、わずかに正確な回答を導き出すのに役立ったとされています。
2025年に向けて、Meta、Google、Microsoftなどのテック大手はAIインフラに数千億ドルを投じる予定で、その多くは次世代のAIモデルトレーニングに使われます。蒸留はAI機能を低コストで再現する効果的な方法であることが証明されていますが、すぐに全く新しい画期的なAIモデルを生み出すことにはつながらないでしょう。
関連記事
サム・アルトマン氏によるAIの減速論が議論を呼ぶ
Apple Podcastsで聴くSpotifyで聴くOpenAIのCEO、サム・アルトマン氏は最近、社会が「これらの新しい能力レベルのいくつかに対して強固になる」時間を確保するため、「AI開発の速度を制御する」時期が来た可能性を示唆した。TechCrunchの「Equity」ポッドキャストの最新回で、ケルステン・コロセック、ショーン・Oケイン、そして私自身は、アルトマン氏の発言が、OpenAIのエージェントがHugging Faceのシステムに侵入した最近のハッキング事件をきっかけとしたも
OpenAIはアップルの営業秘密訴訟と戦っている
OpenAIは火曜日、Appleの営業秘密に関する主張に反論し、同訴訟は根拠がないと主張した。「これらの主張を真剣に受け止めているが、それを支持する証拠は見当たらない」とOpenAIは述べた。これはBloombergのEd LudlowがXで報じたものである。「私たちは公正な競争とどこでも働く自由を支持しており、世界中のユーザーを強化する技術の創出に注力しています。」これは、Appleが金曜日に米国北カリフォルニア連邦地方裁判所に提起した訴訟に続くものである。同訴訟は、OpenAIが元App
OpenAIのロボティクス部門ヘッド、ケイトリン・カリノフスキー氏がペンタゴンとの提携を理由に辞任
OpenAIのロボティクスリーダーであるケイトリン・カリノフスキーは、同社と国防総省との論争の的となったパートナーシップの後に辞任した。「これは簡単な決断ではなかった」と、カリノフスキーはソーシャルメディアでの声明で説明した。「AIが国家安全保障において重要な役割を果たしていることは事実だが、司法の監督なしにアメリカ国民の監視を行い、人間の承認なしに致死性の自律システムを展開することは、はるかに慎重な検討を必要とする境界線である」。Metaの拡張現実(AR)グラス部門を率いていたことで知られ
関連特集おすすめ
コメント (11)
0/500
스탠포드랑 워싱턴 대학 팀이 50달러 코스트로 만들어낸 s1 리서치, 진짜 충격이에요. 🤯 오픈소스 개발이랑 저비용 학습 실험 덕분에 AI 대중화가 더 가까워진 느낌인데, 저비용 고성능 모델이 점점 많아지면 AI 기술 격차도 줄어들까요?
Это просто невероятно! 🔥 Открытые модели вроде s1 могут полностью изменить правила игры в ИИ. Если команда из двух университетов смогла создать конкурента OpenAI за $50, представьте, что произойдет, когда такие инструменты станут доступны всем исследователям. Может, скоро увидим взрыв инноваций в малом бюджете? Правда, интересно, как это повлияет на бизнес-модели крупных компаний...
¡Qué pasada! Un modelo de razonamiento por menos de 50 dólares... La verdad es que demuestra cómo el código abierto puede cambiar las reglas del juego en IA. ¿Cuánto tiempo pasará antes que OpenAI tenga que bajar sus precios? 🔥
Это просто невероятно! 🚀 Создать аналог OpenAI за $50 — это настоящий прорыв. Интересно, какие возможности откроются для небольших стартапов и исследователей? Может, скоро мы увидим взлет новых AI-проектов без гигантских бюджетов.
Wow, $50 to rival OpenAI’s model? That’s wild! Makes me wonder how many garage startups are gonna jump on this to build their own AI. Super cool, but I’m curious if it’s as reliable as they claim. 🤔

先週の金曜日、スタンフォード大学とワシントン大学のAI専門家による画期的な研究論文が発表され、クラウドコンピューティングクレジットで50ドル未満でAI「推論」モデル「s1」を開発したことが明らかになりました。この発見はAI業界を揺さぶっており、s1は数学やコーディングの課題において、OpenAIのo1やDeepSeekのR1といったトップティアのモデルと互角に渡り合っています。
s1モデルは、トレーニングデータやコードの詳細とともに、現在GitHubで公開されています。チームは平凡なベースモデルから始め、蒸留と呼ばれる技術で厳しい試練を課しました。このプロセスでは、別のAIモデルの応答をトレーニングに使用して「推論」のエッセンスを抽出します。この場合、s1はGoogleのGemini 2.0 Flash Thinking Experimentalモデルからその知能を得ました。これは、昨年バークレー大学の研究者が約450ドルで独自のAI推論モデルを作成した際に使用した手法と似ています。
一部の人々にとって、少人数の研究者チームが巨額の予算なしにAI分野で影響を与えられるというアイデアは刺激的です。しかし、s1の登場はAIモデル開発の将来について深刻な疑問も投げかけています。何百万ドルもかけて構築されたモデルに匹敵するモデルが低予算で再現できるなら、誰もが同じことをするのを止めるものは何でしょうか?
当然のことながら、AIの大手企業はこの状況に満足していません。例えば、OpenAIはDeepSeekが彼らのAPIデータを使用してモデル蒸留を行ったと非難しています。一方、s1チームは、堅実な推論パフォーマンスと「テスト時スケーリング」と呼ばれる、AIモデルが答える前に考える時間を増やす手法を最も簡単な方法で実現することに注力していました。これらはOpenAIのo1モデルが導入した同じ革新であり、DeepSeekのような他社が独自の方法で模倣しようとしたものです。
s1の論文では、監視付き微調整(SFT)と呼ばれる技術を使用して、比較的小さなデータセットで推論モデルを蒸留できると示唆されています。これは、AIモデルにデータセットから特定の行動を模倣するようトレーニングするもので、DeepSeekがR1モデル(OpenAIのo1と競合)に使用した大規模な強化学習よりも安価です。
GoogleはGemini 2.0 Flash Thinking ExperimentalをGoogle AI Studioプラットフォームを通じて無料で提供していますが、1日の制限があります。ただし、Googleの規約では、競合サービスを作成するためにモデルをリバースエンジニアリングすることは許可されていません。この点について、Googleからの回答を待っています。
s1モデル自体は、AlibabaのQwenラボから無料でダウンロードできる、控えめな既製のAIモデルとして始まりました。s1をトレーニングするために、研究者たちは慎重に選んだ1,000の質問とその回答、そしてGoogleのGemini 2.0による各「思考」プロセスを含むデータセットを用意しました。トレーニングプロセス全体は、16個のNvidia H100 GPUで30分未満で完了しました。プロジェクトに関わったスタンフォードの研究者ニクラス・ムーニンゴフによると、今日これを約20ドルの計算コストで実現できるとのことです。
研究者たちはまた、s1が自身の作業を再確認し、「思考」時間を延ばすように巧妙な工夫をしました。単に「待つ」と指示するだけです。論文によると、s1の推論プロセス中にこの言葉を追加することで、わずかに正確な回答を導き出すのに役立ったとされています。
2025年に向けて、Meta、Google、Microsoftなどのテック大手はAIインフラに数千億ドルを投じる予定で、その多くは次世代のAIモデルトレーニングに使われます。蒸留はAI機能を低コストで再現する効果的な方法であることが証明されていますが、すぐに全く新しい画期的なAIモデルを生み出すことにはつながらないでしょう。
サム・アルトマン氏によるAIの減速論が議論を呼ぶ
Apple Podcastsで聴くSpotifyで聴くOpenAIのCEO、サム・アルトマン氏は最近、社会が「これらの新しい能力レベルのいくつかに対して強固になる」時間を確保するため、「AI開発の速度を制御する」時期が来た可能性を示唆した。TechCrunchの「Equity」ポッドキャストの最新回で、ケルステン・コロセック、ショーン・Oケイン、そして私自身は、アルトマン氏の発言が、OpenAIのエージェントがHugging Faceのシステムに侵入した最近のハッキング事件をきっかけとしたも
OpenAIはアップルの営業秘密訴訟と戦っている
OpenAIは火曜日、Appleの営業秘密に関する主張に反論し、同訴訟は根拠がないと主張した。「これらの主張を真剣に受け止めているが、それを支持する証拠は見当たらない」とOpenAIは述べた。これはBloombergのEd LudlowがXで報じたものである。「私たちは公正な競争とどこでも働く自由を支持しており、世界中のユーザーを強化する技術の創出に注力しています。」これは、Appleが金曜日に米国北カリフォルニア連邦地方裁判所に提起した訴訟に続くものである。同訴訟は、OpenAIが元App
OpenAIのロボティクス部門ヘッド、ケイトリン・カリノフスキー氏がペンタゴンとの提携を理由に辞任
OpenAIのロボティクスリーダーであるケイトリン・カリノフスキーは、同社と国防総省との論争の的となったパートナーシップの後に辞任した。「これは簡単な決断ではなかった」と、カリノフスキーはソーシャルメディアでの声明で説明した。「AIが国家安全保障において重要な役割を果たしていることは事実だが、司法の監督なしにアメリカ国民の監視を行い、人間の承認なしに致死性の自律システムを展開することは、はるかに慎重な検討を必要とする境界線である」。Metaの拡張現実(AR)グラス部門を率いていたことで知られ
스탠포드랑 워싱턴 대학 팀이 50달러 코스트로 만들어낸 s1 리서치, 진짜 충격이에요. 🤯 오픈소스 개발이랑 저비용 학습 실험 덕분에 AI 대중화가 더 가까워진 느낌인데, 저비용 고성능 모델이 점점 많아지면 AI 기술 격차도 줄어들까요?
Это просто невероятно! 🔥 Открытые модели вроде s1 могут полностью изменить правила игры в ИИ. Если команда из двух университетов смогла создать конкурента OpenAI за $50, представьте, что произойдет, когда такие инструменты станут доступны всем исследователям. Может, скоро увидим взрыв инноваций в малом бюджете? Правда, интересно, как это повлияет на бизнес-модели крупных компаний...
¡Qué pasada! Un modelo de razonamiento por menos de 50 dólares... La verdad es que demuestra cómo el código abierto puede cambiar las reglas del juego en IA. ¿Cuánto tiempo pasará antes que OpenAI tenga que bajar sus precios? 🔥
Это просто невероятно! 🚀 Создать аналог OpenAI за $50 — это настоящий прорыв. Интересно, какие возможности откроются для небольших стартапов и исследователей? Может, скоро мы увидим взлет новых AI-проектов без гигантских бюджетов.
Wow, $50 to rival OpenAI’s model? That’s wild! Makes me wonder how many garage startups are gonna jump on this to build their own AI. Super cool, but I’m curious if it’s as reliable as they claim. 🤔





家






