Перетворення голосу на чіткий текст. Google представила Gemini 3.5 Transcribe

Редакційний огляд
Компанія Google офіційно презентувала нову розробку — модель розпізнавання мовлення Gemini 3.5 Transcribe, призначену для роботи з аудіоматеріалами. Головною особливістю цієї системи є здатність перетворювати хаотичну, неструктуровану усну мову на чіткий, впорядкований текст із високою точністю. Повний фактаж щодо можливостей новинки читайте у виданні «NV».
Поява подібних інструментів суттєво спрощує обробку великих обсягів аудіоданих, адже технологія здатна автоматично розпізнавати понад 85 різних мов. Це відкриває нові можливості для автоматизації транскрипції інтерв'ю, лекцій та інших аудіоформатів у всьому світі, роблячи процес переведення голосу в текст максимально швидким і зручним.
Ключові тези
- •Google анонсувала нову модель Gemini 3.5 Transcribe для розпізнавання мовлення.
- •Технологія перетворює неструктуровану усну мову на впорядкований текст.
- •Система здатна визначати та опрацьовувати понад 85 мов.
Повний текст — на сайті видання
Ми даємо власний огляд і не відтворюємо статтю. Деталі, цитати й оновлення — у першоджерелі.