Vidu Q4 logo

Vidu Q4

最大15枚の画像と3つの音声を、1つの4Kシーンに集約

Artificial Intelligence Video Art Video

概要

  • Vidu Q4は、複数の画像や音声素材を組み合わせて、最大4K解像度の動画シーンを生成できるAI動画モデルです。
  • Reference-to-Videoでは、最大15枚の画像と3つの音声クリップを参照素材として読み込み、人物や空間の一貫性を保った映像を作れます。

主な特徴

  • 人物の異なるアングルや衣装、部屋、 props、声を指定し、会話内容やカメラワークまで自然言語で指示できます。
  • 従来の7枚から画像参照数を15枚へ拡大し、2K・4K出力に対応。表情、身体の動き、カット切り替えも強化されています。
  • ネイティブ音声とマルチショット動画に対応し、1本あたり最大16秒の短い映像を、音声付きで構成できます。

こんな人におすすめ

  • 複数の登場人物や背景素材を活用して、会話のある短編映像やストーリー性の高いシーンを制作したいクリエイターに適しています。
  • 映像の画質だけでなく、表情や身体の動き、カメラの切り替え、音声演出まで細かくコントロールしたい人に向いています。
投票数: 0
← 投稿一覧に戻る