ツール/フレームワーク4本の記事が同じ件を報じた·初出 5/19 09:00· On-device AI LiteRT-LMによる、オンデバイスでの超高速GenAI
Google AI EdgeのLiteRT-LMは、Gemma 4モデルファミリーをAndroid、iOS、Webプラットフォーム全体で高速に実行するための最適化されたランタイムです。GPU、CPU、NPU(Android)のハードウェアバックエンドをサポートし、WebGPU経由でMacBook Proでは最大76トークン/秒のデコード速度を実現します。