IBC 2026 カンファレンスにおいて、NVIDIAは「NVIDIA AI for Media」コレクションの大幅な拡張を発表しました。これは、メディアワークフローにおけるオーディオ、ビデオ、拡張現実(AR)エフェクトを強化するために設計された、GPU加速型のソフトウェア開発キット(SDK)およびマイクロサービスのスイートです。
NVIDIA、放送およびストリーミング向けの新ツールにより「NVIDIA AI for Media」コレクションを拡張
この記事は翻訳です。 原文を読む
このコレクションに含まれる新しいツールには、NVIDIA 3D Body Poseがあります。これは、ビデオから 2D および 3D の人間の関節の位置と角度を推定し、マーカーベースのシステムなしでのモーショントラッキングを可能にします。この技術は、スポーツのリプレイ強化、バイオメカニクス分析、およびアニメーションワークフローをサポートするように設計されています。
また、NVIDIAはVideo Frame Generation (VFG) を導入しました。これは生成AIを使用して既存のフレームの間に新しいフレームを挿入し、動きを滑らかにするものです。VFGはフレームレートを 2x 倍または 4x 倍に増加させることができ、現在進行中の開発では 8x スローモーションサポートを目指しています。さらに、NVIDIA Video Super Resolution (VSR) は、AIを使用してノイズ、ぼけ、圧縮アーティファクトを低減しながらビデオをアップスケールし、現在は 10 ビットのビデオフォーマットをサポートしています。
その他のアップデートには、標準ダイナミックレンジ(SDR)ビデオを、最大 2,000 ニトの輝度を持つハイダイナミックレンジ(HDR)出力にリアルタイムで変換できるNVIDIA TrueHDRが含まれます。ローカライズに関しては、NVIDIAは LipSync および Active Speaker Detection サービスを強化しました。これらは、開発者が口の動きを対象のオーディオに一致させるシステムや、シーン内の複数の話者を特定するシステムの構築を支援します。
出典
- NVIDIAが映像フレーム補間や生中継翻訳などの放送業界向けAIコレクション「NVIDIA AI for Media」の大幅拡充を発表 (GIGAZINE, 2026-09-15)
- NVIDIA Blog