Google 发布 Gemini 3.8 Live 与扩展思考版
Google 釋出 Gemini 3.8 Live 與擴充套件思考版
事件事實
Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking 是 Google 釋出的兩款語音到語音(speech-to-speech)實時對話模型,Google 稱其為迄今最先進的實時對話模型。據 Google 介紹,Gemini 3.8 Live 面向規模化與成本效率,側重流暢對話與視覺接地(visual grounding);Gemini 3.8 Live Extended Thinking 則面向高複雜度任務,具備更強的智慧與多步推理能力。其形態與 OpenAI 的 GPT-Live 系列類似,屬於實時語音互動模型這一產品類別。
背景與判斷
對開發者而言,Gemini 3.8 Live 需要從 Gemini 3.1 Flash Live 遷移,並帶來超低延遲的音訊到音訊互動以及對非同步工作流的擴充套件支援;社群反饋也顯示其在口音處理、語音自然度和延遲方面表現良好,並可在 Workspace 賬戶中使用。
這條訊息的關鍵,不只是單一產品或專案的更新,而是它把技術能力、工程約束和實際使用場景放在了同一個判斷框架裡。公開資料能夠確認的內容以來源連結為準;尚未公佈的效能、時間表或商業結果,不應被解讀為已經兌現的承諾。
可能影響與適用場景
評論整體偏正面,使用者稱讚延遲低、語音悅耳、口音處理能力強,並認可其在 Workspace 賬戶上的可用性。也有使用者質疑 Google 儘管擁有資料、TPU 硬體和廣告資金優勢,卻仍在競爭中落後,並詢問 Gemini 4 的釋出時間;另有使用者認為 Gemini 生成的文字是少數讀起來尚可接受的。
對開發者和企業而言,較穩妥的做法是先把它當作評估物件:核對相容性、成本、資料許可權和可維護性,再決定是否納入生產流程。若後續出現公開基準、正式版本或更多獨立測試,結論還應隨證據更新。
來源
- https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking/
- https://www.thurrott.com/a-i/google-gemini-a-i/341685/google-announces-gemini-3-8-live-and-3-8-live-extended-thinking
- https://9to5google.com/2026/09/15/gemini-3-8-live-announced/