PANews 9月11日消息,小米正式發佈並開源工業級目標說話人語音識別大模型Xiaomi-CocktailASR-1。據介紹,Xiaomi-CocktailASR-1旨在解決「雞尾酒會」難題。該模型採用端到端LLM架構,以目標說話人的一段參考音頻作為聲紋提示,可在多人同時說話的複雜環境中,精準提取並僅轉錄目標用戶的語音。
小米發佈並開源Xiaomi-CocktailASR-1
分享至:
作者:PA一线
本內容只為提供市場資訊,不構成投資建議。
關注PANews官方賬號,一起穿越牛熊
推薦閱讀
PANews APP
24小時追蹤區塊鏈行業資訊,行業深度文章解析。



