posttoday
Gemini 3.5 Transcribe โมเดล AI แปลงเสียงรุ่นใหม่ หมดปัญหาอ้ำอึ้ง

Gemini 3.5 Transcribe โมเดล AI แปลงเสียงรุ่นใหม่ หมดปัญหาอ้ำอึ้ง

28 สิงหาคม 2569

Google เปิดตัว Gemini 3.5 Transcribe โมเดล AI ถอดเสียงเรียลไทม์ที่แม่นยำขึ้น ตัดคำอ้ำอึ้งอัตโนมัติ พร้อมรองรับกว่า 85 ภาษา

Google ประกาศเปิดตัวโมเดล Gemini 3.5 Transcribe โมเดล AI รุ่นใหม่สำหรับแปลงเสียงเป็นข้อความแบบเรียลไทม์ ที่สามารถถอดเสียงเนื้อหาออกมาได้อย่างแม่นยำ พร้อมแก้ปัญหาการพูดวกวนอ้ำอึ้งซึ่งเคยเป็นการติดขัด มาเรียบเรียงเป็นเนื้อหาประโยคที่เข้าใจง่ายได้ทันที

 

ตัวโมเดลมีขีดความสามารถในการถอดเสียงเป็นข้อความสูงมาก ด้วยระดับความแม่นยำในการถอดเนื้อหาเสียงแบบเรียลไทม์ที่มีอัตราความผิดพลาดที่ 4% ในขณะที่เนื้อหาแบบไฟล์บันทึกเสียงจะมีอัตาการผิดพลาดเพียง 2.6% เท่านั้น และสามารถถอดเสียงได้เร็วกว่าโมเดลรุ่นเก่าถึง 70%

 

ฟีเจอร์ไฮไลท์ของโมเดลคือ Smart Transcription สำหรับแก้ไขอาการอ้ำอึ้งติดขัดระหว่างการพูด ระหว่างการสนทนาบางครั้งอาจมีคำจากอาการติดขัด เช่น อืม เอ่อ อ่า AI จะทำการตัดทอนเนื้อหาเหล่านี้ออก แล้วจัดเรียบเรียงประโยคให้อ่านและนำไปใช้ได้ง่ายขึ้นโดยอัตโนมัติ

 

นอกจากนี้ตัวโมเดลยังรองรับการระบุตัวผู้พูดในไฟล์เสียงสูงสุดถึง 3 คน สามารถพูดคุยโต้ตอบการสนทนาได้โดยมีความหน่วงไม่ถึง 1 วินาที รองรับการปรับแต่งเพิ่มเติมเพื่อให้เข้าใจคำศัพท์เฉพาะทางเทคนิค พร้อมสามารถทำความเข้าใจและถอดความเนื้อหาได้มากกว่า 85 ทั่วโลก รวมถึงสำเนียงและภาษาถิ่นที่แตกต่างกัน

 

โดยพื้นฐาน Gemini 3.5 Transcribe เป็นโมเดลตัวเดียวกับที่ใช้งานในฟีเจอร์ Rambler ของ Pixel 11 และเป็นส่วนหนึ่งในนวัตกรรมของ Google ที่จะเพิ่มขีดความสามารถของเครื่องมือ AI ไปอีกขั้น อย่างไรก็ตาม Google ยังคงได้รับการตั้งคำถามอยู่ไม่น้อย เนื่องจากโมเดลหลักที่เล็งเปิดตัวอย่าง Gemini 3.5 Pro หายเงียบไปพักใหญ่

 

สำหรับท่านที่สนใจสามารถทดลองใช้งานโมเดลนี้ได้แล้วผ่านช่องทาง Google AI Studio

ข่าวล่าสุด

“ชัยชนะ” ชงพักโอนเกิน 5 หมื่น 6 ชั่วโมง สกัดเงินสแกมเมอร์

“ชัยชนะ” ชงพักโอนเกิน 5 หมื่น 6 ชั่วโมง สกัดเงินสแกมเมอร์