Skip to content
ツール・製品

NVIDIA、IBCで放送・スポーツ向けリアルタイムAIツールの拡充を発表

NVIDIA announced expanded AI software, media workflows and sports-intelligence tools at IBC 2026 in Amsterdam.

DigitalNeuron Desk2026年9月9日 最終更新約1分

ひとことで言うと

NVIDIAはIBC 2026でメディアおよびスポーツ分野向けに何を発表しましたか?

NVIDIA announced an expansion of NVIDIA AI for Media at IBC 2026, adding tools and partner integrations for video authenticity checks, body-pose tracking, frame generation, video enhancement, HDR conversion, lip-synced translation and speech processing. NVIDIA also highlighted Holoscan for Media, Sports Intelligence Playbooks and a real-time content-localization workflow for broadcasters, sports organizations and streaming services.

要点

  • NVIDIA announced a major expansion of NVIDIA AI for Media, a collection of GPU-accelerated SDKs, NIM microservices, playbooks and blueprints for media workflows.
  • 同社は、テキストから動画を生成するコンテンツで合成動画検出器の精度が99.3%、画像から動画を生成するコンテンツでは97.7%に達したと報告した。
  • NVIDIA highlighted partner integrations involving Dalet, TwelveLabs, Wowza, Vizrt, Ross Video and NDI.
  • 同社はまた、メディア向けHoloscan、スポーツ・インテリジェンス・プレイブック、多言語コンテンツのローカライズ・ワークフローを紹介した。

アムステルダムで開催されたIBC 2026で、NVIDIAはNVIDIA AI for Mediaの大幅な拡充を発表した。これは、メディアおよびエンターテインメントのワークフロー向けに、GPUで高速化されたソフトウェア開発キット、NVIDIA NIMマイクロサービス、プレイブック、ブループリントを集めたものだ。

映像の真正性とライブ分析

NVIDIAによると、Synthetic Video Detector NIMマイクロサービスは、テキストから動画を生成したコンテンツで99.3%、画像から動画を生成したコンテンツで97.7%の精度を達成した。Daletはこのサービスを、安全なクラウドホスト型の検証ワークフローに統合している。これにより、ニュース編集者は映像を提出し、スコアやメタデータを確認できる。

TwelveLabsによると、同社のCompliance by TwelveLabsアプリケーションは現在、検出器によるフレーム単位の真正性シグナルと信頼度スコアを統合している。Wowzaは、検出された物体、シーン、AI生成の兆候など、ライブ映像をリアルタイムで分析するため、このサービスをVideo Intelligence Frameworkを通じて提供する。NVIDIAによると、このフレームワークはオンプレミス、エッジ、クラウド、ハイブリッド環境、またはエアギャップ環境で稼働できる。

NVIDIAはまた、単一カメラの映像から人間の関節の2D・3D位置と角度を推定する3D Body Poseも紹介した。同社によると、スポーツ団体はこのデータを、動作追跡、生体力学、パフォーマンス分析、リプレー、審判、安全対策、バーチャル体験などに活用できる。Vizrtはこの技術を使い、バーチャルスタジオでリアルタイムの照明効果を制御している。

フレーム生成と映像強化

NVIDIAによると、Video Frame Generationは中間フレームを生成して動きを滑らかにし、フレームレートを2倍または4倍に引き上げる。Ross VideoはこれをRio Replayに統合し、AI支援によるスポーツのスローモーションに利用している。現在は6倍のスローモーション生成に対応し、8倍の補間に向けた開発も進めている。

NVIDIA Video Super Resolutionは、ノイズ、ぼけ、圧縮アーティファクトを低減しながら映像をアップスケールする。同社によると、新たなストリーミングモードでは、開発者がリアルタイム性能と高画質のどちらを優先するかを選択でき、調整可能な制御機能、10ビット対応、性能向上も実現している。NVIDIA TrueHDRは、標準ダイナミックレンジの映像をリアルタイムでハイダイナミックレンジ出力に変換し、約2,000ニトに達する。NVIDIAによると、VSR、VFG、TrueHDRは1つの映像エフェクトパイプラインに組み合わせることができる。

メディアインフラ、スポーツモデル、ローカライゼーション

NVIDIAは、分散したソフトウェア定義型制作環境間でライブ映像、音声、データをやり取りするオープンな交換レイヤー、Media Exchange Layerを備えたHoloscan for Mediaを発表した。

Sports Intelligence Playbooksは、独自のスポーツ映像やアノテーションを用いてNVIDIAのオープンモデルをファインチューニングするためのフレームワークを提供する。NVIDIAは、複数選択式の正答率で約53~94%、自由記述式の評価で5.7~66%という、未見の映像を対象とした初期テスト結果を報告した。

NVIDIAはContent Localization技術もHoloscan for Mediaに導入する。リファレンスワークフローは、字幕、翻訳音声、吹き替え、映像との同期、ローカライズされたグラフィックスに対応する。NVIDIAは、多言語放送や音声の強化に向けたLipSync、Active Speaker Detection、Studio Voiceの各機能を強調した。

出典:2026年9月9日公開のNVIDIA発表。

よくある質問

What is NVIDIA AI for Media?
NVIDIAは、音声、動画、拡張現実(AR)メディアのワークフロー向けに、GPUで高速化されたソフトウェア開発キット、NIMマイクロサービス、プレイブック、ブループリントをまとめたものだと説明している。
What does the Synthetic Video Detector do?
NVIDIA Synthetic Video Detector NIMマイクロサービスは、映像が本物か、AIによって生成されたものかを組織が判定するのに役立つ。NVIDIAによると、テキストから動画を生成したコンテンツでは99.3%、画像から動画を生成したコンテンツでは97.7%の精度を達成した。
What are Sports Intelligence Playbooks?
NVIDIAは、これらのプレイブックが、組織のスポーツ映像やアノテーションを用いて同社のオープンモデルを微調整するための枠組みを提供し、データ準備、微調整、推論、評価、最適化、展開までを網羅すると述べている。
What does Holoscan for Media provide?
Holoscan for Mediaは、AIを活用したソフトウェア定義型ライブ制作のためのオープンなリファレンスアーキテクチャおよび開発者向けツールキットです。Media Exchange Layerとの統合により、分散環境間でライブ映像、音声、データを交換できます。

出典

  1. NVIDIA Brings Real-Time AI to Broadcast, Sports and Global Streaming at IBC | NVIDIA BlogNVIDIA
タグnvidiabroadcastsports-aivideostreamingmedia-localization

あわせて読みたい

NVIDIA、ローカルAIを高速化するPAIRとRTX Spark PCを発表

NVIDIA announced PAIR, a free open-source tool that distributes AI inference across compatible computers on a local network. The company also introduced simplified local setup for several agent applications, new llama.cpp and vLLM optimizations, and RTX Spark Windows PCs from Acer and Lenovo scheduled to arrive in October 2026.

約3分