Google เปิดตัว Gemini 3.8 Live และ Gemini 3.8 Live Extended Thinking โมเดล AI สนทนาด้วยเสียงรุ่นใหม่ที่ฉลาดและเป็นธรรมชาติมากขึ้น สามารถรับภาพแบบเกือบเรียลไทม์ สลับภาษาอัตโนมัติ และทำงานเบื้องหลังไปพร้อมกับพูดคุยกับผู้ใช้ โดยเตรียมนำไปใช้กับ Gemini Live, Gmail, Docs, Keep และ Search Live
Gemini 3.8 Live คืออะไร?
Gemini 3.8 Live คือโมเดล AI สำหรับการสนทนาแบบเรียลไทม์รุ่นใหม่ของ Google พัฒนาต่อจาก Gemini 3.1 Flash Live ที่เปิดตัวเมื่อเดือนมีนาคม 2026 โดยมุ่งทำให้การพูดคุยกับ AI ลื่นไหล เป็นธรรมชาติ และฉลาดกว่าเดิม
Google เปิดตัวโมเดลใหม่พร้อมกัน 2 รุ่น ได้แก่
- Gemini 3.8 Live เน้นการสนทนาที่รวดเร็ว ลื่นไหล ประหยัดต้นทุน และรองรับการใช้งานในวงกว้าง
- Gemini 3.8 Live Extended Thinking เน้นการใช้เหตุผลหลายขั้นตอนและงานซับซ้อน ซึ่งต้องวิเคราะห์หรือประสานงานกับเครื่องมือหลายอย่าง
จุดสำคัญคือ AI รุ่นใหม่นี้ไม่จำเป็นต้องหยุดสนทนาระหว่างทำงาน แต่สามารถรับคำสั่ง ตอบรับผู้ใช้ และทำงานต่อในเบื้องหลังได้พร้อมกัน
Gemini 3.8 Live Extended Thinking คิดและพูดพร้อมกันได้
ความสามารถเด่นของ Gemini 3.8 Live Extended Thinking คือการ ใช้เหตุผลและพูดตอบผู้ใช้ไปพร้อมกัน หรือ “reasons and speaks simultaneously”
เมื่อได้รับคำสั่งซับซ้อน AI สามารถตอบรับด้วยคำพูดอย่างเป็นธรรมชาติ เช่น “ขอตรวจสอบข้อมูลสักครู่” จากนั้นจึงรายงานความคืบหน้าเป็นระยะ ขณะที่ระบบกำลังทำงานหลายขั้นตอนอยู่เบื้องหลัง
แนวทางนี้ช่วยลดช่วงเวลาที่ผู้ใช้ต้องรอโดยไม่รู้ว่า AI กำลังทำอะไร และทำให้การสั่งงานด้วยเสียงมีลักษณะใกล้เคียงกับการพูดคุยกับผู้ช่วยจริงมากขึ้น
Google วางตำแหน่งโมเดลนี้ไว้สำหรับงานที่มีความซับซ้อน เช่น
- ค้นหาข้อมูลจากอีเมลด้วยการสนทนาผ่าน Gmail Live
- ร่างและแก้ไขเอกสารด้วย Docs Live
- สร้างและจัดการบันทึกผ่าน Keep Live
- ทำงานหลายขั้นตอนโดยเรียกใช้เครื่องมือหรือ API เบื้องหลัง
- ประสานงานการจองหรือจัดการคำสั่งหลายรายการต่อเนื่องกัน
มองภาพและตอบได้เกือบเรียลไทม์
Gemini 3.8 Live สามารถประมวลผลข้อมูลจากภาพแบบเกือบเรียลไทม์ หรือ Visual Grounding ทำให้ AI เข้าใจสิ่งที่กล้องกำลังมองเห็นและนำข้อมูลนั้นมาใช้ประกอบการสนทนาได้
ตัวอย่างการใช้งาน ได้แก่ การให้ AI ดูหน้าจอหรือวัตถุที่อยู่ตรงหน้า แล้วถามวิธีใช้งาน ขอคำแนะนำ หรือให้ช่วยแก้ปัญหาทีละขั้นตอน
นอกจากนี้ โมเดลยังเรียกใช้เครื่องมือและ API อยู่เบื้องหลังได้โดยไม่ขัดจังหวะการสนทนา ผู้ใช้จึงสามารถพูดคุยต่อได้ในระหว่างที่ระบบกำลังจัดการงานก่อนหน้า
รองรับ 97 ภาษา และสลับภาษาได้กลางบทสนทนา
อีกหนึ่งจุดเด่นคือ Gemini 3.8 Live รองรับการตรวจจับและสลับระหว่าง 97 ภาษา โดยอัตโนมัติ แม้ผู้ใช้จะเปลี่ยนภาษาในระหว่างบทสนทนาก็ตาม
ความสามารถดังกล่าวมีประโยชน์กับการสนทนาหลายภาษา การแปลแบบเรียลไทม์ งานบริการลูกค้าระหว่างประเทศ และการสร้าง Voice Agent สำหรับผู้ใช้จากหลายภูมิภาค
อย่างไรก็ตาม รายงานต้นทางยังไม่ได้ระบุรายละเอียดแยกเป็นรายประเทศว่าฟีเจอร์สำหรับผู้ใช้ทั่วไปทั้งหมดจะเปิดให้บริการในประเทศไทยพร้อมกันหรือไม่ ผู้ใช้ไทยจึงควรตรวจสอบความพร้อมจากบัญชีและบริการของตัวเองอีกครั้ง
คะแนนทดสอบ Gemini 3.8 Live Extended Thinking
จากข้อมูลที่ Google เปิดเผย Gemini 3.8 Live Extended Thinking ทำคะแนนในการทดสอบหลายประเภท ดังนี้
- ได้คะแนน 82.6 และครองอันดับหนึ่งใน Speech to Speech Quality Index ของ Artificial Analysis
- ทำคะแนน 68.6% ในการทดสอบความสำเร็จของงานแบบ Agentic บน τ-Voice
- ทำคะแนน 35.1% ใน Sierra’s τ-Voice Banking Benchmark
- ทำคะแนนด้านการใช้เหตุผล 97.7% บน Big Bench Audio
ส่วน Gemini 3.8 Live รุ่นมาตรฐานอยู่ในอันดับสองของ Speech Agent Arena พร้อมชูจุดเด่นด้านประสิทธิภาพและต้นทุนสำหรับนักพัฒนาและองค์กร
ทั้งนี้ คะแนน Benchmark เป็นผลการทดสอบในเงื่อนไขที่กำหนด และอาจไม่สะท้อนประสบการณ์ของผู้ใช้ทุกสถานการณ์โดยตรง
Gemini 3.8 Live ใช้กับบริการใดบ้าง?
Google เริ่มทยอยนำ Gemini 3.8 Live และ Gemini 3.8 Live Extended Thinking ไปใช้กับผลิตภัณฑ์หลายกลุ่ม ได้แก่
- Gemini Live สำหรับสนทนาด้วยเสียงกับ Gemini
- Gmail Live สำหรับค้นหาและจัดการข้อมูลในอีเมลด้วยการสนทนา
- Docs Live สำหรับสร้างและแก้ไขเอกสาร
- Keep Live สำหรับสร้างและจัดการโน้ต
- Search Live ใน AI Mode สำหรับการค้นหาด้วยเสียงแบบโต้ตอบ
- Gemini API และ Google AI Studio สำหรับนักพัฒนา
Gemini 3.8 Live Extended Thinking กำลังเริ่มทยอยเปิดใช้กับ Gemini Live ส่วนใน Google Workspace การเข้าถึงฟีเจอร์บางรายการจะแตกต่างกันตามประเภทบัญชีและแพ็กเกจ Google AI ที่สมัคร
ทำไม Gemini 3.8 Live จึงสำคัญ?
การเปลี่ยนแปลงครั้งนี้แสดงให้เห็นว่า Google ต้องการพัฒนา Gemini จากแชตบอตที่รอรับคำถามแล้วตอบกลับ ให้กลายเป็น ผู้ช่วย AI แบบเรียลไทม์ ที่สามารถเข้าใจเสียง ภาพ บริบท และจัดการงานหลายขั้นตอนได้พร้อมกัน
จุดเปลี่ยนสำคัญจึงไม่ได้อยู่แค่การตอบคำถามเก่งขึ้น แต่คือการลดเวลารอระหว่างสนทนา ผู้ใช้สามารถพูดแทรก เปลี่ยนภาษา หรือสั่งงานต่อ ขณะที่ AI ยังคงจัดการงานเดิมอยู่เบื้องหลังได้
หากทำงานได้ตามที่ Google ประกาศ Gemini 3.8 Live อาจช่วยให้การค้นหาอีเมล แก้ไขเอกสาร จดบันทึก ขอคำแนะนำจากภาพ และสั่งงานบริการต่าง ๆ ด้วยเสียง มีความต่อเนื่องและเป็นธรรมชาติมากกว่าเดิม
Gemini 3.8 Live รองรับภาษาไทยหรือไม่?
Google ระบุว่าโมเดลรองรับการตรวจจับและสลับระหว่าง 97 ภาษา แต่รายงานต้นทางไม่ได้แจกแจงรายชื่อภาษาทั้งหมดหรือยืนยันรายละเอียดการเปิดใช้ทุกฟีเจอร์ในประเทศไทย จึงต้องรอตรวจสอบจากบริการจริงอีกครั้ง
Gemini 3.8 Live เปิดให้ใช้งานเมื่อไร?
Google เริ่มทยอยเปิดใช้งานตั้งแต่วันที่ 15 กันยายน 2026 ผ่าน Gemini Live, Search Live, Google Workspace, Gemini API และ Google AI Studio โดยความพร้อมใช้งานอาจแตกต่างกันตามผลิตภัณฑ์ บัญชี แพ็กเกจ และประเทศ
อ้างอิง Google Cover iT24Hrs
อ่านบทความและข่าวอื่นๆเพิ่มเติมได้ที่ it24hrs.com
Google เปิดตัว Gemini 3.8 Live คุยไปคิดไป ทำงานซับซ้อนโดยไม่ต้องรอ AI ตอบจบ
อย่าลืมกดติดตามอัพเดตข่าวสาร ทิปเทคนิคดีๆกันนะคะ Please follow us
Youtube it24hrs
Twitter it24hrs
Tiktok it24hrs
facebook it24hrs
