「中国AI」の検索結果: ユーザー 0件・記事 7件
リード DeepSeekが「V4」を2026年8月15日に正式公開した。総671Bながら推論時の活性化パラメータを67Bに絞るMixture-of-Experts(MoE)設計を採用し、MMLU・HumanEvalでGPT-4oと同等水準のスコアを記録しながらAPIコストをV3比約70%削減している。MoEアーキテクチャがMITライセンスで公開されたのは実質初となり、オープンソースLLM競争の軸が...
リード AlibabaのQwen Teamが2026年7月8日、オープンウェイトシリーズ最大モデル「Qwen 3-235B-A22B」をHugging Faceで一般公開した。Mixture-of-Experts(MoE)構造により推論時の実効パラメータは22Bに絞りながら、数学推論ベンチ「MATH-500」で92.4点、コーディング評価「LiveCodeBench」で63.7点を記録——いずれも...
リード DeepSeekが2026年8月29日、推論特化モデル「R3」を正式公開した。AMATH(高度数学推論)ベンチマークでOpenAI「o3」を0.8ポイント上回り、SWE-bench Verifiedでも72.4%という新記録を更新。MITライセンスでモデルウェイトを同時公開しており、API単価はo3比で約8分の1とされる。「オープン・安価・ベンチ首位」の三条件が重なったのは初めてで、企業の...
リード DeepSeekが推論特化モデル「R2」を2026年8月9日22:00(UTC+8)に正式公開した。入力トークン単価$0.014/Mは現行GPT-4o比で約89%安く、同時に主要ベンチマーク(AIME 2025: 92.3%、SWE-bench Verified: 61.8%)でGPT-5水準に並ぶと発表している。オープンウェイト配布・商用利用解放の組み合わせは、2025年1月のR1公開時...
リード AlibabaのクラウドAI部門が2026年6月25日、235Bパラメータの大規模言語モデル「Qwen 3-235B」をApache 2.0ライセンスで公開した。MMLUで91.4点、数学ベンチマークAIME 2025で72.8%、コーディング評価LiveCodeBenchではOpenAIのo3-miniを上回るスコアを計測。OSS陣営から初めて「フロンティアモデル相当」と評価される水準に...
この記事でわかること 中国AIスタートアップDeepSeekが設立3年で600億ドル規模に成長した背景 量子ヘッジファンド出身の創業者がAI開発に転じた理由 「残業ゼロ・KPIなし」の働き方でChatGPTに挑む組織文化 2026年にAI業界の価格競争を加速させた技術革新 3年でChatGPTのライバルに躍り出たDeepSeek 2023年に設立された中国AI企業DeepSeekが、わずか3年で6...
この記事でわかること Alibabaが公開した「Qwen3.8-Max」の性能と特徴 GPT-5.6やFable 5を超えた理由 2.4兆パラメータなのに低コストで動く仕組み 日本企業に与える影響 Alibabaが「Qwen3.8-Max」を正式リリース 中国のAlibaba Cloudが2026年8月3日、最新AIモデル「Qwen3.8-Max」を公開しました。 このモデルは2.4兆パラメータと...