구글, 온디바이스 멀티모달 검색용 임베딩 공개
인공지능신문 ·
✦ AI 요약
텍스트 넘어 코드·이미지·오디오·비디오 하나의 임베딩 공간으로 통합...8K 토큰 컨텍스트 지원, 최대 6배 저장공간 절감
인공지능신문에 따르면 구글은 10월 7일 텍스트를 넘어 코드·이미지·오디오·비디오를 하나의 임베딩 공간에서 처리하는 온디바이스 오픈 모델 '임베딩젬마2'를 공개했습니다. 이 모델은 약 7억 파라미터 규모로, 로컬 벡터 데이터베이스와 메모리 사용량을 최대 6배까지 줄일 수 있도록 설계됐습니다. 구글은 기존 텍스트 중심 임베딩을 멀티모달로 넓히면서 검색과 검색증강생성 시스템을 기기 내부에서 직접 돌릴 수 있는 기반을 제시했습니다. 데이터가 외부 서버를 거치지 않도록 해 개인정보 보호와 오프라인 활용성을 함께 노렸다는 점도 핵심입니다. 또 작업 종류와 하드웨어 여건에 맞춰 일부 모듈만 골라 쓰는 구조를 채택해 모바일과 엣지 환경에서의 적용 가능성을 높였습니다. 성능 경쟁력뿐 아니라 배포 경로와 개발 도구 지원까지 함께 내놓으면서 실제 서비스에 바로 연결되는 생태계 확장에도 무게를 뒀습니다.
관점
이번 공개는 멀티모달 AI의 무게중심이 클라우드 중심 실험에서 기기 안 실행으로 옮겨가고 있음을 보여줍니다. 같은 임베딩 공간에서 여러 형식의 데이터를 다루고 자원 제약에 맞춰 구성을 조정할 수 있게 되면, 검색과 생성 기능은 더 넓은 기기와 서비스로 내려올 가능성이 커집니다. 결국 경쟁의 초점도 단순한 모델 성능보다 개인정보 보호, 지연시간, 배포 유연성처럼 실제 제품화 조건을 얼마나 만족시키느냐로 이동할 수 있습니다.
이 관점은 비즈크러시가 작성한 자체 의견이며, 인공지능신문의 보도 내용과 무관합니다.
이 기사는 자동생성 알고리즘의 도움을 받아 작성되었습니다.
출처 인공지능신문
원문 확인이 기사는 인공지능신문 원문을 바탕으로 비즈크러시가 요약 정리했습니다. 정확한 인용과 세부 내용은 원문을 확인해 주세요.