Новини України
Підбірка новин з українських джерел

Gemini 3.5 Transcribe: Google робить голосове введення значно розумнішим
Google представила нову модель Gemini 3.5 Transcribe, яка покликана зробити голосове введення швидшим і природнішим. Її особливість у тому, що система не просто перетворює сказане на текст, а намагається одразу привести результат до нормального вигляду. Модель розпізнає самовиправлення, прибирає слова-паразити та зайві паузи, а також може враховувати власний словник користувача.
Менше помилок і швидша обробка
За даними Google, Gemini 3.5 Transcribe демонструє середню частоту помилок на рівні 2,6% під час обробки записів і 4% у режимі потокового розпізнавання. Ще одна перевага — швидкість. Час до отримання фінальної транскрипції скоротився приблизно на 70% порівняно з попередньою технологією Chirp 3.
Модель автоматично розпізнає понад 85 мов, а також здатна визначати до трьох співрозмовників. Більша кількість спікерів поки залишається експериментальною функцією. Для роботи в реальному часі Google пропонує окрему версію Gemini 3.5 Transcribe Live із затримкою менш ніж одна секунда.
Google вже інтегрує технологію у свої продукти
Gemini 3.5 Transcribe не залишиться виключно інструментом для розробників. Google уже використовує його у власних сервісах, зокрема в Gemini для macOS, Google AI Studio та функції Rambler у Gboard на Android.
Наступним може стати Chrome. Компанія планує дозволити використовувати голосове введення практично в будь-якому текстовому полі на вебсторінках. Для розробників модель уже доступна у форматі публічної попередньої версії через Gemini API.
Якщо заявлена точність збережеться під час реального використання, голосове введення може стати значно комфортнішим. Адже коли система не просто записує кожне слово, а сама виправляє обмовки та прибирає зайві фрази, говорити стає набагато природніше. І тоді клавіатура для багатьох повсякденних завдань справді може поступитися місцем голосу.