Alphabet Inc Class CGoogle unveils Gemini 3.5 Transcribe, a new speech-to-text model with superior accuracy, enhancing its AI product lineup.

Google ได้เปิดตัว Gemini 3.5 Transcribe ซึ่งเป็นโมเดลแปลงเสียงพูดเป็นข้อความที่มีความแม่นยำที่สุดในปัจจุบัน โดยแปลงเสียงดิบเป็นข้อความที่ถูกต้อง เรียบร้อย และจัดรูปแบบอย่างดี โมเดลนี้ถูกออกแบบมาสำหรับเวิร์กโฟลว์ของนักพัฒนา รองรับเอเจนต์เสียง คำบรรยายแบบเรียลไทม์ และการวิเคราะห์หลังการโทร และสามารถใช้งานได้ทั้งแบบสตรีมมิงแบบเรียลไทม์ผ่าน Live API และสำหรับเสียงที่บันทึกไว้ล่วงหน้าผ่าน Interactions API รองรับมากกว่า 85 ภาษา ระบุผู้พูดได้สูงสุด 3 คน และมีอัตราคำผิดเพียง 4% สำหรับการสตรีมมิง และ 2.6% สำหรับการใช้งานแบบไม่สตรีมมิง ซึ่งเหนือกว่า GPT Live Transcribe ของ OpenAI ในการวัดผล FLEURS โมเดลนี้เปิดให้ใช้งานในรูปแบบพรีวิวสาธารณะสำหรับนักพัฒนาและองค์กรแล้ว และในแอป Gemini บน macOS และ Android ในบางประเทศ โดยจะรองรับ Chrome ในเร็วๆ นี้ การเปิดตัวครั้งนี้เกิดขึ้นหลังจาก Google เปิดตัว Gemini 3.7 Flash และแอป Gemini มีผู้ใช้เกิน 1 พันล้านคน ขณะที่โมเดลเรือธงรุ่นถัดไปอย่าง Gemini 3.5 Pro ยังไม่เปิดตัว
Alphabet Inc Class CGoogle unveils Gemini 3.5 Transcribe, a new speech-to-text model with superior accuracy, enhancing its AI product lineup.