LOWNLAB News
AIระดับ 8/10Google Blog · 15 กันยายน 2026

Google เปิดตัว Gemini 3.8 Live และ Live Extended Thinking โมเดลเสียงที่สลับได้ 97 ภาษากลางบทสนทนา

Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking

Google เปิดตัวโมเดลเสียงใหม่สองตัวเมื่อวันที่ 15 กันยายน 2026 คือ Gemini 3.8 Live ที่วางตำแหน่งเป็นตัวเลือกที่คุ้มค่าและขยายสเกลได้ เน้นบทสนทนาลื่นไหลพร้อมความเข้าใจภาพ และ Gemini 3.8 Live Extended Thinking ที่ออกแบบสำหรับงานซับซ้อนซึ่งต้องการการให้เหตุผลหลายขั้น โดยยังรักษาจังหวะการสนทนาไว้ได้

ความสามารถที่โดดเด่นที่สุดคือการตรวจจับและสลับระหว่าง 97 ภาษาที่รองรับได้เองกลางบทสนทนา ประมวลผลภาพแบบเกือบเรียลไทม์ และเรียกใช้ tool หรือส่ง API request เบื้องหลังไปพร้อมกับที่ยังคุยต่อได้ ส่วนรุ่น Extended Thinking จะคิดและพูดไปพร้อมกัน โดยส่งเสียงตอบรับสั้น ๆ ระหว่างคิดเพื่อไม่ให้บทสนทนาสะดุด

ด้านผลทดสอบ Gemini 3.8 Live ขึ้นอันดับ 1 บน Speech to Speech Quality Index ของ Artificial Analysis ด้วยคะแนน 82.6 ทำได้ 68.6% บนงาน agentic τ-Voice และ 35.1% บน τ-Voice-banking ของ Sierra ส่วนงาน reasoning จากเสียงบน Big Bench Audio ทำได้ 97.7% และอยู่อันดับสองในการจัดอันดับตามความชอบข��งผู้ใช้บน Speech Agent Arena

การเปิดให้ใช้งานเริ่มทันที นักพัฒนาเข้าถึงได้ผ่าน Gemini API และ Google AI Studio องค์กรเข้าผ่าน private preview ของ Gemini Enterprise ส่วนผู้ใช้ทั่วไปจะเจอใน Search Live, Gemini Live และ Google Workspace ทั้ง Docs, Gmail และ Keep พร้อมรองรับการเชื่อมต่อกับแพลตฟอร์มอย่าง LangChain, LiveKit, Pipecat และ Vercel

เสียงทั้งหมดที่โมเดลสร้างจะฝังลายน้ำ SynthID เพื่อให้ตรวจสอบย้อนหลังได้ว่าเป็นเสียงที่ AI สร้างขึ้น ซึ่งเป็นมาตรการที่ Google ใช้กับสื่อสังเคราะห์ทุกประเภท

แหล่งอ้างอิง

อ่านต้นฉบับที่ Google Blog

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking/