광고
광고

SKIDIA's PaperBoy

TH WIRE · 2026-09-24 14:59

กูเกิลเปิดตัวโมเดล TTS ของ Gemini 2 รุ่น พร้อม AI พากย์เสียงขนาดใหญ่

เป็นจริง

กูเกิลเปิดตัวโมเดล Text-to-Speech (TTS) ใหม่ 2 รุ่นภายใต้แบรนด์ Gemini ซึ่งรองรับการสร้างเสียงพูดเทียมจากข้อความ รวมถึงความสามารถด้านการพากย์เสียง (dubbing) ด้วย AI ในระดับใหญ่ สะท้อนการขยายความสามารถของ Gemini จากงานข้อความและภาพ สู่งานด้านเสียงโดยตรง

원문 주장 (KR)
구글, 대규모 더빙용 AI까지…제미나이 TTS 모델 2종 출시

โมเดล TTS 2 รุ่นใต้แบรนด์ Gemini

โมเดลทั้งสองถูกวางตำแหน่งเป็นเครื่องมือสร้างเสียงพูดจากข้อความ โดยกูเกิลนำเสนอผ่านระบบนิเวศของ Gemini ทำให้นักพัฒนาและผู้ใช้สามารถเรียกใช้งานการสังเคราะห์เสียงได้ผ่านแพลตฟอร์มเดียวกับโมเดล AI หลักของบริษัท

การเปิดตัวครั้งนี้ทำให้ Gemini ครอบคลุมงานหลายรูปแบบ (multimodal) มากขึ้น โดยเพิ่มขีดความสามารถด้านเสียงเข้าไปเคียงข้างความสามารถด้านข้อความ รูปภาพ และวิดีโอที่มีมาก่อนหน้า

เน้นการพากย์เสียงด้วย AI ขนาดใหญ่

จุดเด่นที่กูเกิลเน้นย้ำคือการใช้งานด้านการพากย์เสียงขนาดใหญ่ (large-scale dubbing) ซึ่งโมเดล TTS สามารถนำไปประยุกต์กับเนื้อหาที่ต้องการแปลงเสียงพูดจำนวนมาก เช่น สื่อวิดีโอ คอนเทนต์ระดับโปรดักชัน หรือบริการที่ต้องการเสียงบรรยายหลายภาษา

การใช้ AI ทำพากย์เสียงถือเป็นตลาดที่แข่งขันสูง เมื่อผู้ให้บริการ AI รายใหญ่ต่างขยายความสามารถด้านเสียงของโมเดลตนเอง การที่กูเกิลเลือกเปิดตัวโมเดล TTS 2 รุ่นพร้อมกันแสดงถึงการกำหนดตำแหน่งผลิตภัณฑ์ให้แยกขั้นความสามารถหรือกรณีการใช้งาน

ขยายระบบนิเวศ Gemini สู่งานเสียง

การเปิดตัวครั้งนี้ต่อยอดกลยุทธ์ของกูเกิลที่พยายามทำให้ Gemini เป็นแพลตฟอร์ม AI แบบครบวงจร โดยการเพิ่มโมเดล TTS ช่วยให้ธุรกิจและนักพัฒนาสามารถสร้างแอปพลิเคชันที่มีทั้งการสนทนาและการสร้างเสียงได้ในระบบเดียว

อย่างไรก็ตาม รายละเอียดเชิงเทคนิคของโมเดลทั้งสองรุ่น อาทิ ข้อแตกต่างเฉพาะระหว่างรุ่น หรือเงื่อนไขการใช้งาน ยังควรติดตามประกาศอย่างเป็นทางการจากกูเกิลเพิ่มเติม

โมเดล TTS ของ Gemini ทั้ง 2 รุ่นและความสามารถด้านการพากย์เสียงด้วย AI ขนาดใหญ่ของกูเกิลนั้น เป็นจริง

Sources — primary documents (10)
  1. https://www.etnews.com/20260924000040`
  2. https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/
  3. https://ai.google.dev/gemini-api/docs/changelog
  4. https://deepmind.google/models/gemini-audio/speech-generation/
  5. https://news.ycombinator.com/item?id=49817615
  6. https://developers.googleblog.com/gemini-api-io-updates/
  7. https://blog.google/innovation-and-ai/technology/developers-tools/gemini-2-5-text-to-speech/
  8. https://storage.googleapis.com/gweb-uniblog-publish-prod/images/gemini-audio__keyword__metacard_.width-1600.format-webp.webp
  9. https://storage.googleapis.com/gweb-uniblog-publish-prod/images/blog-gemini-3.8-flash-tts__evals_.width-100.format-webp_21WnKg9.webp
  10. https://lh3.googleusercontent.com/zyzIRuFpStX_vv6j8p-kdFyr6CAWeQZox6qgnTEkUEZreYR1XsJaTpfzCOmkSkogTmGEmVr9bDkwp8RI_plwzGnG4yft_EohErd8lI0_UgdiTw6RAg=w1440-h1440-n-nu-rw-lo

KR: /news/20260924-c72ac3 · 판정: 사실