ハードウェア初出 8/14 04:16
HeyGenとGoogle Cloud:Avatar IVをTPUにもたらす
HeyGen x Google Cloud: Bringing Avatar IV to TPUs
https://developers.googleblog.com/feed2026/8/14
AI要約
HeyGenがGoogle Cloud TPUs(v6e Trillium)上で18B以上のパラメータを持つ動画生成モデル「Avatar IV」を動作させることに成功。torchax、XLA、FSDP、Ulyssesなどを活用し、8チップ構成でリアルタイムストリーミングを1.86倍高速化。カスタムPallasカーネルや最適化手法が貢献した。
AI要点
- HeyGenはAI動画生成プラットフォーム「Avatar IV」をGoogle CloudのTPU上で動作させ、1.86倍高速化に成功した。
- Avatar IVは180億以上のパラメータを持つディフュージョンモデルで、話す顔の動画生成を担う。
- Google CloudのAIインフラ最適化チームと連携し、TPU v6eホスト上で性能向上を実現した。
- 速度向上のための最適化は、メッシュのコレクティブ通信、スパースアテンション、ソフトマックス内部ループの並列化など多岐にわたる。
- GPU向けに開発されたモデルコードをJAXのPyTorchフロントエンドであるtorch.jax経由でTPU上で動作させることに成功した。
なぜ重要か
HeyGenのAI動画生成モデルAvatar IVをGoogle CloudのTPU上で高速化させたことで、大規模AIモデルの推論性能向上のためのインフラ最適化技術が実証され、より高品質でリアルタイム性の高いAI動画生成サービスの提供に貢献する可能性がある。