「LLMインフラ」の検索結果: ユーザー 0件・記事 2件
リード 米Cerebras Systemsは2026年8月11日(現地時間)、次世代AIアクセラレータ「Wafer-Scale Engine 4(WSE-4)」を正式発表した。単体チップで推論速度2,100トークン/秒・平均レイテンシ47ミリ秒を達成し、現行H100クラスタ(8枚構成)比で5.3倍の応答速度と公表されている。「推論コスト削減」の戦場がソフトウェア最適化からシリコン設計そのものへと移...
リード NVIDIAは2026年8月14日、次世代AIアクセラレータ「GB300 Blackwell Ultra」の量産出荷開始を公式発表した。前世代「H100」比でAI推論スループットが最大2.5倍、HBM4メモリ容量288GBを搭載し、AWS・Azure・GCPへの納入が同日より始まった。LLMホスティングの単価コスト構造が今後3〜6ヶ月で書き換えられると見られる。 何が起きているのか NVI...