Google представила нову модель Gemini 3.5 Transcribe, яка покликана зробити голосове введення швидшим і природнішим. Її особливість у тому, що система не просто перетворює сказане на текст, а намагається одразу привести результат до нормального вигляду. Модель розпізнає самовиправлення, прибирає слова-паразити та зайві паузи, а також може враховувати власний словник користувача. Менше помилок і швидша обробка За даними Google, Gemini 3.5 Transcribe демонструє середню частоту помилок на рівні 2,6% під час обробки записів і 4% у режимі потокового розпізнавання. Ще одна перевага — швидкість. Час до отримання фінальної транскрипції скоротився приблизно на 70% порівняно з попередньою технологією Chirp 3. Модель автоматично розпізнає понад 85 мов, а також здатна визначати до трьох співрозмовників. Більша кількість спікерів поки залишається експериментальною функцією. Для роботи в реальному часі Google пропонує окрему версію Gemini 3.5 Transcribe Live із затримкою менш ніж одна секунда. Google вже інтегрує технологію у свої продукти Gemini 3.5 Transcribe не залишиться виключно інструментом для розробників. Google уже використовує його у власних сервісах, зокрема в Gemini для macOS, Google AI Studio та функції Rambler у Gboard на Android. Наступним може стати Chrome. Компанія планує дозволити використовувати голосове введення практично в будь-якому текстовому полі на вебсторінках. Для розробників модель уже доступна у форматі публічної попередньої версії через Gemini API. Якщо заявлена точність збережеться під час реального використання, голосове введення може стати значно комфортнішим. Адже коли система не просто записує кожне слово, а сама виправляє обмовки та прибирає зайві фрази, говорити стає набагато природніше. І тоді клавіатура для багатьох повсякденних завдань справді може поступитися місцем голосу.