PROMPTOWY_
Newsy

Google DeepMind wypuściło EmbeddingGemma 2 - multimodalny model do osadzania tekstu, obrazu, dźwięku i wideo na urządzeniu

promptowy@ai:~$ cat news_1

› EmbeddingGemma 2 ma 740 mln parametrów, działa na licencji Apache 2.0 i łączy tekst, kod, obrazy, wideo oraz audio w jednej przestrzeni osadzeń.

promptowy@ai:~$ cat news_2

› Model wymaga zaledwie ~191 MB RAM dla trybu tekstowego i ~567 MB dla pełnego multimodalnego na Pixel 11 Pro, a okno kontekstu wynosi 8K tokenów.

promptowy@ai:~$ cat news_3

› Poprzednia wersja EmbeddingGemma osiągnęła ponad 20 milionów pobrań; nowa poprawia wyniki w kodzie o 9,92 punktu w benchmarku MTEB Code.

promptowy@ai:~$ open --full
Czytaj całość

Google DeepMind wypuściło EmbeddingGemma 2 - multimodalny model do osadzania tekstu, obrazu, dźwięku i wideo na urządzeniu

Otwórz artykuł na promptowy.com