谷歌推出新Gemini模型 強化語音代理對話能力!

谷歌發布了兩款新Gemini模型,旨在提升語音代理的交互性能,並與多家企業合作探索應用。

谷歌於週二正式推出全新Gemini 3.8 Live及3.8 Live Extended Thinking模型,這些模型專為增強語音代理的對話能力而設計。谷歌工程師Tom Ouyang在部落格中表示:「這些模型為開發者和企業提供可靠、可投入生產的語音代理基礎構件。」他指出,使用者可以透過Gemini應用程式、Google Workspace及搜尋功能更流暢地與Gemini進行交談,從而利用聲音輕鬆處理複雜任務。

根據人工智慧語音轉語音指數,Gemini 3.8 Live Extended Thinking以82.6%的成績超越OpenAI的GPT-Live-1 Astra(81.5%)及SpaceXAI的Grok Voice Think Fast 2.0(81.3%)。Ouyang補充道:「針對需要深入推理的任務,3.8 Live Extended Thinking能同時進行推理和對話,使得複雜工作流程中的智能性大幅提升。」

此外,谷歌還與Salesforce、Genspark及Lumeris等公司展開合作,探索新模型的應用場景。Salesforce產品副總裁Bob Van Osten表示:「結合即時的多模態能力與自主AI,我們正在尋找創造更豐富、直觀的客戶體驗的新方法。」目前,Gemini 3.8 Live已向開發者開放,而3.8 Live Extended Thinking也已供企業私下預覽,未來將持續擴大其應用範圍。

點擊下方連結,開啟「美股K線APP」,獲得更多美股即時資訊喔!
https://www.cmoney.tw/r/56/9hlg37

免責宣言
本網站所提供資訊僅供參考,並無任何推介買賣之意,投資人應自行承擔交易風險。


文章相關標籤
喜歡這篇文章嗎?
歡迎分享,讓更多人可以看到!
  • facebook
  • line
作者文章
最新文章