ミストラルAI、数学研究の参入障壁を下げるため「Leanstral 1.5」をオープンソース化
Mistral AIは最近、数学的形式証明言語「Lean4」専用に構築された「Leanstral1.5」というオープンソースモデルを公開しました。Apache-2.0ライセンスの下で提供されるこのモデルは、パラメータ総数が119Bでありながら、アクティブ化されているのはわずか6Bに留まっており、高いパフォーマンスを維持しつつコストを大幅に削減しています。
数学的推論に特化したツールとして、Leanstral1.5は目覚ましい成果を上げています。 権威ある形式数学ベンチマーク「miniF2F」において、検証セットとテストセットの両方で100%の完了率を達成しました。また、難易度の高いPutnamBenchコンテストの問題に取り組んだ際、このモデルは672問のLean4問題のうち587問を正しく解きました。 また、抽象代数学のFATEベンチマークシリーズでも優れた成績を収め、修士レベルのFATE-Hテストで87%の成功率、博士レベルのFATE-Xテストで34%の成功率を記録し、この種のモデルとしては新記録を樹立しました。

コスト効率の良さも、今回のリリースのもう一つの大きな利点として際立っている。Mistral AIは、既存の代替手段と比較して、Leanstral1.5が科学的試行錯誤にかかるコストを劇的に削減することを強調している。 例えば、PutnamBenchの問題をLeanstral1.5で解く場合の平均コストはわずか4ドルであるのに対し、比較対象となるモデルであるSeed-Prover1.5は300ドル以上、Aleph Proverは54ドルから68ドルの範囲に及ぶ。 この大幅なコスト削減により、高精度な数学的証明支援が研究室の枠を超えて、より広範な研究用途に活用されることが期待されます。
実際のコード開発のシナリオにおいても、Leanstral1.5は強力なバグ検出能力を発揮しています。 57のコードリポジトリでテストを行った結果、47件の違反を特定し、そのうち11件が真の欠陥であることが確認されました。特に、これらの脆弱性のうち5件はGitHub上でこれまで報告されたことのないものであり、プログラムの検証やセキュリティ監査を支援するこのモデルの可能性を浮き彫りにしています。
Leanstral1.5のオープンソース化により、数学およびコンピュータサイエンスの分野は、強力な証明支援ツールに容易にアクセスできるようになります。計算コストと財政的コストの両方を削減することで、このモデルは形式的な数学的証明の普及を加速させ、研究者が煩雑な計算や検証作業から解放され、根本的な科学的ブレークスルーに注力できるよう支援するものと期待されています。
関連記事
米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める
エロン・マスク、サム・アルトマン、ダリオ・アモダイというテクノロジー業界の三巨頭が、それぞれの事業で初公開株式発行(IPO)に向けて進んでいる。スペースX、OpenAI、Anthropicという業界の巨人3社が1兆ドル規模の企業価値に近づき、上場準備を進める中、2026年は米国史上、新規株式発行が最も重要な年となる見込みだ。この歴史的な資金増強は世界の金融の注目を集めており、公的市場がこのような規模の資金を吸収する能力に対する重要なストレステストとなっている。これらの主要な資金調達が一斉に開始
スウェーデンのAIスタートアップ「Lovable」が主要な資金調達ラウンド終了後、132億ドルの評価額を達成
AI駆動のコーディングツールが注目を集める中、スウェーデンのスタートアップ企業Lovableは大型の資金調達ラウンドを獲得した。同社は30億ドルの調達を目指しており、これにより評価額が昨年12月に記録された66億ドルの倍となる132億ドルに達する可能性がある。この投資をリードするのはMenlo Venturesと見られている。Lovableの魅力は、複雑なコーディングスキルを不要とし、ソフトウェア作成を簡素化する中核の「ヴァイブコーディング」技術に由来する。ユーザーは自然言語で要件を記述するだ
Google、Geminiへの焦点がユーザー制御へシフトする中で、Remy AIエージェントをテスト
『Business Insider』によると、GoogleはGemini向けの新しいAIパーソナルエージェント「Remy」をテスト中である。このツールはユーザーに代わってタスクを実行することを目的としており、業務フローと日常のルーチンの両方を効率化する。現在、RemyはGeminiアプリケーションの社内限定版においてテストが行われている。この報道は社内文書と、プロジェクトに精通した2人の人物へのインタビューを引用している。社内資料では、Remyを「24時間365日のパーソナルエージェント」と位
関連特集おすすめ
コメント (0)
0/500
Mistral AIは最近、数学的形式証明言語「Lean4」専用に構築された「Leanstral1.5」というオープンソースモデルを公開しました。Apache-2.0ライセンスの下で提供されるこのモデルは、パラメータ総数が119Bでありながら、アクティブ化されているのはわずか6Bに留まっており、高いパフォーマンスを維持しつつコストを大幅に削減しています。
数学的推論に特化したツールとして、Leanstral1.5は目覚ましい成果を上げています。 権威ある形式数学ベンチマーク「miniF2F」において、検証セットとテストセットの両方で100%の完了率を達成しました。また、難易度の高いPutnamBenchコンテストの問題に取り組んだ際、このモデルは672問のLean4問題のうち587問を正しく解きました。 また、抽象代数学のFATEベンチマークシリーズでも優れた成績を収め、修士レベルのFATE-Hテストで87%の成功率、博士レベルのFATE-Xテストで34%の成功率を記録し、この種のモデルとしては新記録を樹立しました。

コスト効率の良さも、今回のリリースのもう一つの大きな利点として際立っている。Mistral AIは、既存の代替手段と比較して、Leanstral1.5が科学的試行錯誤にかかるコストを劇的に削減することを強調している。 例えば、PutnamBenchの問題をLeanstral1.5で解く場合の平均コストはわずか4ドルであるのに対し、比較対象となるモデルであるSeed-Prover1.5は300ドル以上、Aleph Proverは54ドルから68ドルの範囲に及ぶ。 この大幅なコスト削減により、高精度な数学的証明支援が研究室の枠を超えて、より広範な研究用途に活用されることが期待されます。
実際のコード開発のシナリオにおいても、Leanstral1.5は強力なバグ検出能力を発揮しています。 57のコードリポジトリでテストを行った結果、47件の違反を特定し、そのうち11件が真の欠陥であることが確認されました。特に、これらの脆弱性のうち5件はGitHub上でこれまで報告されたことのないものであり、プログラムの検証やセキュリティ監査を支援するこのモデルの可能性を浮き彫りにしています。
Leanstral1.5のオープンソース化により、数学およびコンピュータサイエンスの分野は、強力な証明支援ツールに容易にアクセスできるようになります。計算コストと財政的コストの両方を削減することで、このモデルは形式的な数学的証明の普及を加速させ、研究者が煩雑な計算や検証作業から解放され、根本的な科学的ブレークスルーに注力できるよう支援するものと期待されています。
米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める
エロン・マスク、サム・アルトマン、ダリオ・アモダイというテクノロジー業界の三巨頭が、それぞれの事業で初公開株式発行(IPO)に向けて進んでいる。スペースX、OpenAI、Anthropicという業界の巨人3社が1兆ドル規模の企業価値に近づき、上場準備を進める中、2026年は米国史上、新規株式発行が最も重要な年となる見込みだ。この歴史的な資金増強は世界の金融の注目を集めており、公的市場がこのような規模の資金を吸収する能力に対する重要なストレステストとなっている。これらの主要な資金調達が一斉に開始
スウェーデンのAIスタートアップ「Lovable」が主要な資金調達ラウンド終了後、132億ドルの評価額を達成
AI駆動のコーディングツールが注目を集める中、スウェーデンのスタートアップ企業Lovableは大型の資金調達ラウンドを獲得した。同社は30億ドルの調達を目指しており、これにより評価額が昨年12月に記録された66億ドルの倍となる132億ドルに達する可能性がある。この投資をリードするのはMenlo Venturesと見られている。Lovableの魅力は、複雑なコーディングスキルを不要とし、ソフトウェア作成を簡素化する中核の「ヴァイブコーディング」技術に由来する。ユーザーは自然言語で要件を記述するだ





家






