
Google(GOOGL)於週二宣布推出兩款全新的Gemini人工智慧模型,分別為「3.8 Live」與「3.8 Live Extended Thinking」。這兩款最新模型專為提升語音助理能力而設計,期望為開發者與企業提供更穩定、可投入生產環境的語音代理建構模組。Google(GOOGL)工程師Tom Ouyang表示,這些升級將使跨應用程式的語音互動變得更加流暢,幫助使用者僅透過語音就能處理複雜任務。
實測評分亮眼,效能超越同業競爭對手
在技術表現上,主打深度思考的Gemini 3.8 Live Extended Thinking在「人工智慧語音對語音指數」中獲得了82.6%的優異成績。這項數據不僅展現了其強大的運算能力,更超越了競爭對手OpenAI(OPENAI)的GPT-Live-1 Astra所獲得的81.5%,同時也微幅領先SpaceXAI(SPCX)旗下Grok Voice Think Fast 2.0的81.3%。
具備同步思考與說話能力,應對複雜任務
針對需要深度邏輯推理的任務,新款模型展現了能夠「同步思考與說話」的技術突破。Tom Ouyang指出,該模型在處理複雜工作流程時,能維持不中斷的對話流暢度。例如,它會使用「讓我檢查一下」等口語化提示來自然地回應使用者,並在背景執行多步驟任務時,即時透過語音回報進度,引導使用者完成操作。
攜手軟體巨頭合作,探索多元商業應用
為了加速技術落地,Google(GOOGL)也宣布與Salesforce(CRM)、Genspark以及Lumeris等企業結盟,共同探索新模型的實際應用場景。Salesforce(CRM)產品副總裁Bob Van Osten強調,透過結合即時多模態能力與代理式AI,企業正積極尋找全新的方式,從客戶首次接觸到問題解決,創造出更豐富且直覺的客戶體驗。
最新模型即日上線,全面開放開發者測試
目前這兩款模型已正式開放使用。Gemini 3.8 Live已提供給使用Gemini API和Google AI Studio的開發者,並在Gemini Enterprise進行內部預覽,一般用戶則可透過Search Live體驗。高階的Gemini 3.8 Live Extended Thinking同樣開放給開發者與企業預覽,所有大眾用戶也能在Gemini Live與Google AI Pro中實際操作。

我的網誌