「推論効率」の検索結果: ユーザー 0件・記事 2件
リード 「大きいほど賢い」という常識が揺らいでいる。2026年8月、パラメータ数が1〜3B程度の小型言語モデルが、医療記録の要約・法的文書の分類・コード補完といった特定タスクで、GPT-4クラスの大型モデルと同等以上の精度を示す事例が相次いで報告されている。クラウドへのデータ送信ゼロで動くことから、プライバシー規制が厳しい企業での採用が一気に加速しつつある。 何が起きているのか 8月初旬、医療系ス...
リード 「とりあえずGPT-4クラスを使う」時代が静かに終わりつつある。2026年に入り、MicrosoftのPhi-4-miniやGoogleのGemma 3など、パラメータ数が7〜14Bクラスの小型言語モデル(SLM:Small Language Model)が、特定ドメインで大型モデルと肩を並べる結果を出し始めた。企業の調達担当者がコストと性能のトレードオフを真剣に計算し始めている。 何が起...