Сбер выпустил GigaChat Audio: нейросеть лучше распознает речь и интонации
В ИИ-помощнике ГигаЧат появилась обновленная аудиомодель GigaChat Audio, которая позволяет нейросети напрямую работать с голосовыми сообщениями и аудиофайлами, понимая интонации пользователей.
Пресс-служба Сбера сообщила об обновлении своего ИИ-помощника ГигаЧат. Теперь в нём интегрирована модель GigaChat Audio, способная обрабатывать звуковой контент более эффективно. Ключевая особенность нововведения заключается в том, что нейросеть может анализировать аудиофайлы и голосовые сообщения без предварительного преобразования речи в текст.
Благодаря прямому анализу аудио, GigaChat Audio способен распознавать интонацию пользователя, что открывает возможности для более глубокого понимания контекста и эмоционального состояния собеседника. Кроме того, модель оптимизирована для работы с длинными звуковыми записями, что расширяет её применимость для различных бизнес-задач.


Комментарии (0)
Без регистрации. Комментарии проверяются автоматически перед публикацией.
Пока нет комментариев. Будьте первым!