PANews 9月11日の報道によると、小米は正式に産業用ターゲット話者音声認識大規模モデルXiaomi-CocktailASR-1を発表し、オープンソース化しました。説明によると、Xiaomi-CocktailASR-1は「カクテルパーティー問題」を解決することを目的としています。このモデルはエンドツーエンドのLLMアーキテクチャを採用し、ターゲット話者の参照音声を声紋の手がかりとして使用することで、複数人が同時に話す複雑な環境において、ターゲットユーザーの音声を正確に分離し、文字起こしします。
小米がXiaomi-CocktailASR-1 を発表しオープンソース化
共有先:
著者:PA一线
この内容は市場情報の提供のみを目的としており、投資助言を構成しません。
PANews公式アカウントをフォローして、強気・弱気相場を一緒に乗り越えましょう
おすすめ記事
PANewsアプリ
24時間ブロックチェーン業界情報を追跡し、深掘り記事を解析。



