「数学」の検索結果: ユーザー 0件・記事 7件
リード Mistral AIが2026年8月3日、最上位モデル「Mistral Large 3」をAPIおよびMistral Platformで正式公開した。数学推論ベンチマーク(MATH)89.3%、コーディング評価(HumanEval)92.1%を記録し、主要3指標でGPT-4oを上回る。欧州発LLMがグローバルランキングのトップ3に入るのはこれが初となる。 何が起きているのか 発表は日本時間...
リード DeepSeekが2026年8月29日、推論特化モデル「R3」を正式公開した。AMATH(高度数学推論)ベンチマークでOpenAI「o3」を0.8ポイント上回り、SWE-bench Verifiedでも72.4%という新記録を更新。MITライセンスでモデルウェイトを同時公開しており、API単価はo3比で約8分の1とされる。「オープン・安価・ベンチ首位」の三条件が重なったのは初めてで、企業の...
2026年4月27日:23歳のアマチュア数学愛好家リアム・プライス氏がChatGPT GPT-5.4 Proで60年未解決のエルデシュ問題#1196を解明 所要時間わずか80分:AIの推論80分+論文化30分、合計2時間以内で世界の数学者が60年解けなかった問題を撃破 フィールズ賞テレンス・タオ氏が認定:『重要な貢献』『これまで誰も結びつけなかった発想』と評価、人間側に思考の癖があったと指摘 キー...
2026年4月27日:23歳のアマチュア数学愛好家リアム・プライス氏がChatGPT GPT-5.4 Proで60年未解決のエルデシュ問題#1196を解明 所要時間わずか80分:AIの推論80分+論文化30分、合計2時間以内で世界の数学者が60年解けなかった問題を撃破 フィールズ賞テレンス・タオ氏が認定:『重要な貢献』『これまで誰も結びつけなかった発想』と評価、人間側に思考の癖があったと指摘 キー...
リード 60年間、専門家たちが解けなかった数学の問題を、23歳のアマチュアが解いた。武器はChatGPT——正確には、その「使い方」だ。4月27日にGIGAZINEが報じたこのニュースは、「AIが解いた」のではなく「AIと組んだ人間が解いた」という点で、研究者コミュニティに静かな衝撃を与えている。 何が起きているのか 報道によれば、高度な数学の専門教育を受けていないリアム・プライス氏(23歳)が、...