Google เปิดตัว Gemini 3.8 Flash TTS และ Gemini 3.8 Flash-Lite TTS ซึ่งเป็นโมเดลสร้างเสียง (Audio Generation) ที่แสดงอารมณ์ได้ดีที่สุดในปัจจุบัน โดยมุ่งเน้นการเปลี่ยนจากการใช้เสียงสังเคราะห์แบบเดิมๆ มาเป็นการเป็นสตูดิโอสร้างสรรค์เสียงที่ปรับแต่งได้เต็มรูปแบบ โมเดลเหล่านี้เปิดให้นักพัฒนาใช้งานผ่าน Google AI Studio และ Gemini API แล้ว
จุดเด่นอยู่ที่ความสามารถในการสร้างเสียงใหม่จากคำสั่งภาษาธรรมชาติ (Natural Language Prompts) ซึ่งรองรับกว่า 100 ภาษาและสำเนียง ผู้ใช้สามารถควบคุมอารมณ์ จังหวะการพูด และแม้กระทั่งเสียงประกอบการสนทนาเช่น เสียงหัวเราะหรือเสียงถอนหายใจ นอกจากนี้ยังมีฟีเจอร์ Voice Replication ที่เลียนแบบเสียงได้จากตัวอย่างเพียง 30 วินาที โดยมาพร้อมระบบรักษาความปลอดภัยอย่าง SynthID เพื่อป้องกันการนำไปใช้ในทางที่ผิด