Skip to contentGoogleのTurboQuantがKVキャッシュを最大6分の1に圧縮しLLM推論を刷新。Gemma 4はスマホで動く高性能オープンモデルを実現し、MetaのMuse SparkはSNS34億人へフロンティアAIを無料開放した。
MiniMax M3の登場でオープン陣営が本格的にフロンティアへ到達しつつある一方、NVIDIAのCosmos 3はロボット・自動運転向けの世界モデルを民主化し、Perplexityはデバイス上とクラウドをシームレスに繋ぐ推論の新設計を示した。