AI

디노티시아, 서버형 VDPU로 검색 가속 승부수

인공지능신문 ·

양세현 디노티시아 최고기술책임자(CTO)의 발표 모습(사진:디노티시아)

✦ AI 요약

FPGA 4카드 서버, 동일 소프트웨어 기반 CPU 서버 대비 벡터 검색 처리량 최대 5.77배

인공지능신문에 따르면 디노티시아는 미국에서 VDPU 카드 4장을 얹은 서버 구성을 공개하며, 생성형 AI 인프라에서 검색을 전담하는 전용 프로세서 전략을 전면에 내세웠습니다. 9월 15일부터 17일까지 열린 행사에서 이 서버는 CPU 전용 서버보다 벡터 검색 처리량이 최대 5.77배 높았다고 밝혔습니다. 회사는 앞서 공개한 칩과 가속기 카드를 실제 서버 환경으로 넓혀, 모델 실행은 GPU가 맡고 외부 정보 검색은 VDPU가 담당하는 역할 분담 구조를 강조했습니다. 특히 검색 품질 저하 없이 처리량을 끌어올렸다는 점을 내세우며, 검색 증강 생성과 AI 에이전트 같은 활용처를 겨냥하고 있습니다. 국내에서는 자사 데이터베이스와 묶어 기업용 AI 데이터 인프라로 제품화를 추진하고, 해외에서는 관련 업계를 상대로 평가와 검증 범위를 넓히고 있습니다. 회사는 이번 공개를 계기로 실제 고객의 워크로드를 바탕으로 서버형 VDPU의 적용 가능성을 더 구체화하겠다는 방향도 제시했습니다.

관점

이 사안의 핵심은 생성형 AI 경쟁의 무게중심이 모델 연산만이 아니라 검색 인프라로 이동하고 있다는 점입니다. 전용 프로세서를 서버 단위로 제시했다는 것은 보조 가속기 수준을 넘어 아키텍처 선택지로 자리 잡겠다는 뜻에 가깝습니다. 검색을 따로 떼어 최적화하는 방식이 통한다면, 기업들은 같은 AI 시스템 안에서도 연산과 검색을 분리해 설계하는 흐름을 더 적극적으로 검토하게 될 가능성이 큽니다. 결국 AI 성능을 좌우하는 기준이 모델 자체뿐 아니라, 어떤 데이터를 얼마나 빠르고 안정적으로 끌어와 쓰느냐로 넓어지고 있음을 보여줍니다.

이 관점은 비즈크러시가 작성한 자체 의견이며, 인공지능신문의 보도 내용과 무관합니다.

이 기사는 자동생성 알고리즘의 도움을 받아 작성되었습니다.


출처 인공지능신문

원문 확인

이 기사는 인공지능신문 원문을 바탕으로 비즈크러시가 요약 정리했습니다. 정확한 인용과 세부 내용은 원문을 확인해 주세요.