하드웨어

퀄컴, 스마트폰용 AI 칩 구조를 에이전트 중심으로 재설계

인공지능신문 ·

이미지:퀄컴

✦ AI 요약

트랜스포머 전용 ‘엘리먼트 가속기’ 탑재…NPU 공유 메모리 50% 확대, MoE·INT2부터 FP16까지 지원

인공지능신문에 따르면 퀄컴은 9월 10일 스마트폰에서 에이전틱 AI를 직접 돌리기 위한 차세대 헥사곤 NPU를 공개하며, 여러 특화 모델을 상황에 따라 골라 실행하는 쪽으로 모바일 AI 구조를 바꾸겠다는 방향을 내놨다. 새 NPU에는 트랜스포머용 전용 가속기와 기존보다 50% 커진 공유 메모리가 들어갔다. 핵심은 스마트폰 AI의 목표가 단일 모델을 빠르게 돌리는 데서 벗어나, 긴 문맥을 붙들고 여러 앱과 도구를 넘나들며 작업을 이어가는 방식으로 옮겨가고 있다는 점이다. 이를 위해 퀄컴은 연산 장치뿐 아니라 메모리 구조까지 손봐 지연을 줄이고 반응성을 높이는 데 초점을 맞췄다. 또 필요한 전문 모델만 골라 쓰는 구조와 다양한 연산 정밀도를 함께 지원해, 더 큰 AI 기능을 기기 안에서 처리하는 기반을 넓히려 한다. 스마트폰이 단순한 AI 실행 단말을 넘어 사용자의 맥락을 이해하고 일을 수행하는 에이전트의 플랫폼이 되도록 하겠다는 구상이다.

관점

이 변화가 중요한 이유는 모바일 AI 경쟁의 기준이 모델 크기나 단순 속도보다, 기기 안에서 얼마나 자연스럽게 여러 작업을 이어 붙이고 즉시 반응하느냐로 옮겨가고 있기 때문이다. 결국 칩 설계의 무게중심도 CPU나 GPU 보조 수준의 AI 처리에서, 메모리와 전용 가속기를 함께 묶어 실제 사용 흐름을 떠받치는 방향으로 이동한다. 이는 스마트폰 제조사와 앱 생태계에도 영향을 줘, 앞으로는 어떤 기능을 넣었는지보다 그것들이 얼마나 유기적으로 연결돼 돌아가는지가 차별점이 될 가능성을 보여준다.

이 관점은 비즈크러시가 작성한 자체 의견이며, 인공지능신문의 보도 내용과 무관합니다.

이 기사는 자동생성 알고리즘의 도움을 받아 작성되었습니다.


출처 인공지능신문

원문 확인

이 기사는 인공지능신문 원문을 바탕으로 비즈크러시가 요약 정리했습니다. 정확한 인용과 세부 내용은 원문을 확인해 주세요.