Cohere Transcribe
ストックにはログインが必要です
オープンソース音声認識の新たな最先端
Artificial Intelligence
Open Source
Audio
Cohere Transcribe は20億パラメータのオープンウェイト音声認識モデルで、エンタープライズ向けに最適化。高スループットと14言語でのWER 5.42%を実現し、プライベート/ローカル/デスクトップ展開に適している。前処理・後処理を自前で補完する前提だが、言語指定とコードスイッチ回避で性能を最大化。プライバシー重視のローカル音声ワークフローに有望。
投票数: 130