← 2026년 10월 7일 브리핑

P1 모델 가중치 공개 GoogleHugging Face

Google, 텍스트·이미지·오디오·비디오를 하나의 벡터 공간에 담는 오픈 임베딩 모델 'EmbeddingGemma 2' 공개

발표 2026년 10월 6일

무슨 일인가

Google DeepMind가 가벼운 오픈 멀티모달 임베딩 모델 EmbeddingGemma 2를 공개했다. Hugging Face Transformers v5.19.0 릴리스 노트에 따르면 Gemma 4 아키텍처를 기반으로 하며, 텍스트·이미지·오디오·비디오를 따로 또는 함께 입력받아 768차원 공유 벡터 공간에 인코딩한다. Matryoshka Representation Learning을 적용해 임베딩을 512·256·128차원으로 줄여 쓸 수 있다. 쓰지 않는 비전·오디오 타워는 로드할 때 꺼서 메모리를 아낄 수 있다.

의미

Transformers와 Ollama(MLX)가 공개 당일 바로 지원해 크로스모달 검색·RAG에 곧바로 쓸 수 있다. Simon Willison은 Apache 2.0 라이선스라는 점이 임베딩 재계산 위험을 줄여 준다고 평가했다.

출처

Google 관련 다른 소식