제논, 실행형 AI 겨냥한 훈민 VLM 공개
인공지능신문 ·
✦ AI 요약
실행 능력 강화에도 한국어 성능 유지… 모델·FP8 버전·평가 방법론 전면 공개
인공지능신문에 따르면 제논은 9월 18일 컴퓨터 화면을 보고 직접 조작하는 실행형 AI 모델 '훈민 VLM 397B'를 오픈소스로 공개했다. 이 모델은 엔비디아 B200 GPU 8장으로 후학습해 초거대 공개 모델에 컴퓨터 사용 능력을 얹으면서도 한국어 성능 저하를 크게 줄인 것이 핵심이다. 화면 속 버튼과 입력창 같은 대상을 찾아내는 능력에서 강점을 보였고, 실제 운영체제와 애플리케이션을 넘나드는 작업 수행까지 겨냥했다. 회사는 단순한 답변 생성보다 사용자의 의도를 실행으로 옮기는 방향에 초점을 맞췄다고 설명했다. 모델뿐 아니라 FP8 버전과 평가 방법론까지 함께 공개해 성능 비교와 후속 연구에 활용할 수 있게 했다. 공개 모델을 바탕으로 필요한 능력을 효율적으로 덧붙이는 개발 방식이 실제 업무형 AI 확장의 한 축이 될지 주목된다.
관점
이번 공개의 의미는 더 큰 모델 경쟁보다 어떤 능력을 실제로 얹어 쓸 수 있느냐로 무게중심이 이동하고 있음을 보여준다는 점이다. 특히 실행형 AI는 기업 환경에서 도입 효과가 답변 품질보다 업무 연결성에서 갈릴 가능성이 커, 성능뿐 아니라 개발 방식과 공개 범위가 산업 파급력을 좌우할 수 있다. 결국 이런 접근이 자리 잡으면 국내에서도 초거대 모델을 그대로 따라가는 대신, 필요한 실행 능력을 덧붙여 현장형 AI를 만드는 흐름이 한층 빨라질 수 있다.
이 관점은 비즈크러시가 작성한 자체 의견이며, 인공지능신문의 보도 내용과 무관합니다.
이 기사는 자동생성 알고리즘의 도움을 받아 작성되었습니다.
출처 인공지능신문
원문 확인이 기사는 인공지능신문 원문을 바탕으로 비즈크러시가 요약 정리했습니다. 정확한 인용과 세부 내용은 원문을 확인해 주세요.