「LLM競争」の検索結果: ユーザー 0件・記事 4件
リード AlibabaのクラウドAI部門が2026年6月25日、235Bパラメータの大規模言語モデル「Qwen 3-235B」をApache 2.0ライセンスで公開した。MMLUで91.4点、数学ベンチマークAIME 2025で72.8%、コーディング評価LiveCodeBenchではOpenAIのo3-miniを上回るスコアを計測。OSS陣営から初めて「フロンティアモデル相当」と評価される水準に...
リード DeepSeekが推論特化モデル「R2」を2026年8月9日22:00(UTC+8)に正式公開した。入力トークン単価$0.014/Mは現行GPT-4o比で約89%安く、同時に主要ベンチマーク(AIME 2025: 92.3%、SWE-bench Verified: 61.8%)でGPT-5水準に並ぶと発表している。オープンウェイト配布・商用利用解放の組み合わせは、2025年1月のR1公開時...
リード Metaが2026年8月22日、オープンソース大規模言語モデル「Llama 4 Ultra」をHugging Faceおよび同社開発者ポータルで正式公開した。総パラメータ4050億(MoE構造・実効活性化パラメータ約860億)、MMLU 93.2%。「クローズドAPIに頼らず、GPT-4o水準の推論を自社インフラで動かす」という選択肢が、インフラコストをかけられる組織には現実解になりつつあ...