Gemini 3.5 Transcribe хочет сделать устную речь профессиональной
19:09, 27.08.2026
Ввод текста во время разговора может вскоре остаться в прошлом. Google представил Gemini 3.5 Transcribe — новую модель искусственного интеллекта, предназначенную для преобразования естественной речи в чистый и удобочитаемый текст.
Эта модель выходит за рамки простой транскрипции. Она может удалять слова-заполнители, автоматически структурировать текст и форматировать результат, избавляя вас от необходимости самостоятельно исправлять каждое предложение. Вы даже можете редактировать текст с помощью голоса, что значительно ускорит создание заметок, черновиков и сообщений.
По заявлению Google, Gemini 3.5 Transcribe превосходит предыдущую модель Chirp 3, особенно в случаях, когда люди говорят на разных языках. Она поддерживает более 85 языков, включая русский, и может распознавать смену языка в пределах одной записи.
Ваш словарный запас может научить ИИ тому, что важно
Специализированная лексика часто создает проблемы для распознавания речи. Gemini 3.5 Transcribe решает эту проблему с помощью настраиваемого словаря. Вы можете добавлять имена, технические термины и необычные варианты написания, помогая модели распознавать слова, которые стандартные инструменты распознавания речи могут пропустить.
В случае записанного аудио модель также может различать до трёх говорящих и добавлять временные метки к отдельным словам. Это может значительно упростить обработку интервью, встреч и исследований.
Google также работает над Gemini 3.5 Live и Live Experimental. Эти модели могут улучшить качество голосовых разговоров в режиме реального времени, включая обработку перебиваний и визуальное понимание. Однако Google пока не объявила даты их выпуска.
Это может изменить ваш подход к работе
Мы считаем, что такие инструменты, как Gemini 3.5 Transcribe, могут незаметно изменить повседневные рабочие процессы. Вы сможете тратить меньше времени на набор текста и исправление стенограмм, а больше — на работу с самими идеями.
Модель уже доступна на английском языке через приложение Gemini для macOS, а также в режиме публичной предварительной версии через API Gemini. Google также планирует внедрить её в Chrome.
Хотите быть в курсе последних разработок в области ИИ? Поделитесь этой статьёй со своей командой и ознакомьтесь с другими материалами об ИИ в нашем блоге.