🤖 ИИ

Как Google научил крошечную модель понимать текст, картинки, видео и звук: разбираем EmbeddingGemma 2

Как Google научил крошечную модель понимать текст, картинки, видео и звук: разбираем EmbeddingGemma 2
Фото: Хабр — ИИ

6 октября 2026 года Google DeepMind выпустила EmbeddingGemma 2 — открытую модель эмбеддингов, которая превращает в векторы текст, код, изображения, видео и аудио. Все они попадают в одно общее 768-мерное пространство, поэтому их можно сравнивать между собой, например искать видео по текстовому запро…

Полный материал — на сайте первоисточника

Мы публикуем лишь краткий анонс. Все права на материал принадлежат Хабр — ИИ.

Читать на habr.com ↗

Ещё по теме