Google DeepMind представила миниатюрную мультимодальную модель EmbeddingGemma 2
Google DeepMind выпустила EmbeddingGemma 2 — новую открытую модель эмбеддингов, способную преобразовывать текст, код, изображения, видео и аудио в единое векторное пространство для сравнения.
Модель EmbeddingGemma 2, представленная Google DeepMind 6 октября 2026 года, представляет собой открытую разработку, которая может конвертировать различные типы данных — текст, код, изображения, видео и аудио — в унифицированные 768-мерные векторы (эмбеддинги). Это позволяет сравнивать между собой совершенно разные форматы информации, например, находить видеоконтент по текстовому запросу.
Ключевая особенность новой модели — её компактный размер, что даёт возможность запускать операции поиска и сравнения данных непосредственно на пользовательских устройствах без необходимости отправки информации на удалённые серверы. По данным Google, текстовая часть модели потребляет около 191 МБ оперативной памяти на смартфоне Pixel 11 Pro, а полная мультимодальная версия занимает около 567 МБ.


Комментарии (0)
Без регистрации. Комментарии проверяются автоматически перед публикацией.
Пока нет комментариев. Будьте первым!