市場動態 生活 網路 觀察 軟體

Google研究團隊提出可聆聽理解語音內容的AudioPaLM模型,並且能自動生成口說內容
更可對應多種語言翻譯功能

Google研究團隊近期提出一項名為AudioPaLM的大型自然語言模型,將能實現語音內容聆聽理解,並且自動生成口說內容。

AudioPaLM, Google研究團隊提出可聆聽理解語音內容的AudioPaLM模型,並且能自動生成口說內容<br><span style='color:#848482;font-size:16px;'>更可對應多種語言翻譯功能</span>, mashdigi-科技、新品、趣聞、趨勢

AudioPaLM的背後是由PaLM 2與AudioLM兩種模型組合,並且對應多模運作框架,使其能聆聽、理解語言內容,並且藉由自動生成式人工智慧產生口說內容。

除了識別語音內容,並且進行自然互動之外,AudioPaLM更可對應多種語言翻譯功能,因此預期未來將能直接聆聽特定口語內容,隨即轉換成另一種語言呈現或許將能帶動更多跨語言溝通的便利性。

不過,目前此項技術仍處於研究階段,Google方面並未透露是否會將此技術應用在旗下諸如Google翻譯等服務,或是作為其他產品、服務應用。

楊又肇 (Mash Yang)
mashdigi.com網站創辦人兼主筆,同時也是科技新聞業流浪漢。

發表迴響