Qwen3.5-Omni
ストックにはログインが必要です
音声・動画・ツールに対応するネイティブオムニモデル
Artificial Intelligence
API
Development
Qwen3.5-Omniは、テキスト・画像・音声・動画を1つの統合プラットフォームで扱えるネイティブオムニモデルです。多言語対応の音声機能を強化し、リアルタイム音声対話、Web検索、機能呼び出し、音声クローンなど実務的なインタラクションを実現します。音声・動画のキャプション、音声-映像の雰囲気コードのアイデアなどユニークなアプローチも特徴。現状はオープンソースではなく、Hugging Faceのオフライン/オンラインデモや公式APIを通して試用可能。コードプランへの統合を早期に期待。
投票数: 139