AI

엔비디아, IFA 2026서 ‘로컬 AI’ 생태계 확장…‘RTX 스파크·페어’ 공개

테크월드뉴스 ·

[사진=엔비디아]

✦ AI 요약

엔비디아는 IFA 2026에서 로컬 AI 접근성·성능 향상 신기술과 파트너사 협력을 발표했다.

공개 제품으로 RTX 스파크와 페어가 제시됐고, RTX 스파크는 10월 출시되는 소형 윈도우 PC다.

페어는 로컬 네트워크 내 여러 PC로 추론 요청을 분산하고, 퍼플렉시티 포터블 컴퓨터는 DGX 스파크 등 리눅스 시스템에서 로컬로 구동된다.

엔비디아가 로컬 환경 AI 실행용 생태계 확대를 본격화한다. 엔비디아는 4일 독일 베를린 'IFA 2026'에서 로컬 AI 접근성·성능 향상 신기술 발표 계획을 내놓고, 이를 계기로 다양한 파트너사와 로컬 AI 생태계 확대 추진도 발표했다. 기사 제목상 공개 제품은 'RTX 스파크·페어'다.

프론티어 인텔리전스는 로컬 환경으로 확장되는 흐름이다. 엔비디아는 이 흐름 속에서 마이크로소프트 포함 파트너사와 협력해 엔비디아 하드웨어에서 AI 에이전트 설정·실행 용이화 지원에 나선다.

엔비디아의 전략은 빠른 추론 성능·새 도구로 로컬 AI 활용 과정 단순화에 맞춰졌다. 이를 통해 하드웨어 기반에서 AI 에이전트를 보다 쉽게 구동할 수 있도록 하는 방향이다.

이 방향의 구체적 제품으로 RTX 스파크가 제시됐다. RTX 스파크는 오는 10월 출시되는 소형 윈도우 PC로, AI 애호가·개발자·크리에이터를 대상으로 하며 강력한 AI 에이전트의 로컬 실행용으로 설계됐다.

엔비디아는 IFA 2026에서 엔비디아 GPU 대상 로컬 AI 지원 확대를 발표했다. 지원 대상 예시로는 헤르메스 에이전트(Hermes Agent), 오픈클로(OpenClaw), 퍼플렉시티 포터블 컴퓨터(Perplexity Portable Computer)가 제시됐다. 엔비디아 GPU 기반 간소화 로컬 AI 지원도 제공될 예정이다.

이와 함께 엔비디아는 로컬 추론 성능을 강화하고 최대 1.9배 빠른 로컬 추론을 지원한다. 또한 신규 llama.cpp 최적화와 신규 vLLM 최적화를 직접 활용할 수 있으며, LM 스튜디오(LM Studio)와 올라마(Ollama)를 통해 이용할 수 있다.

기존에는 로컬 모델 기반 AI 에이전트 실행에 앞서 일정 수준의 작업이 필요했다. 사전 작업 항목으로는 모델 선택, 호환 추론 서버 탐색, 양자화 설정 조정, 구성 요소 최신 상태 유지가 있었다.

엔비디아는 RTX·DGX 시스템에서 해당 과정 추가 간소화 방침을 세우고, 가장 널리 사용되는 에이전트 애플리케이션 3종에 대해 윈도우 환경용 간소화된 로컬 모델 설정을 제공할 예정이다. 각 애플리케이션은 llama.cpp를 기반으로 구축됐으며 엔비디아의 최신 추론 최적화를 활용한다.

엔비디아는 이와 함께 '엔비디아 페어(PAIR)'를 공개했다. 페어는 '퍼스널 AI 라우터(Personal AI Router)' 도구로, 로컬 네트워크 내 PC를 자동 검색하고 여유 컴퓨팅 용량을 보유한 시스템으로 개별 추론 요청을 전달하는 기능을 갖췄다.

페어는 AI 에이전트 작업을 여러 작은 작업으로 분할할 수 있고, 분할된 작업을 병렬 실행할 수 있다. 이는 하나의 GPU가 집중 처리하는 방식 대신 여러 PC에 분산 처리하는 방식이며, 로컬 AI의 전체 컴퓨팅 성능 향상으로 이어진다. 페어의 목적은 로컬 네트워크에 연결된 여러 PC의 컴퓨팅 자원을 AI에 활용 가능하게 하는 데 있다.

헤르메스는 복잡한 메일함 정리처럼 주의 필요·연기 가능·건너뜀 항목을 우선순위별로 분류하는 요청 예시와 함께, 한 작업을 여러 하위 에이전트로 분할하는 기능을 갖췄다. 페어는 이렇게 나뉜 각 작업을 네트워크 내에서 사용 가능한 여러 PC에 분산하는 기능을 제공한다.

이 같은 구성으로 작업의 병렬 실행이 확대된다. 또한 메인 PC를 게임·콘텐츠 제작에 사용하는 동안에도 AI 워크로드를 다른 PC로 이전할 수 있다.

페어는 올라마, LM 스튜디오에서 활용할 수 있으며, 네트워크에 연결된 기기와 연결 해제된 기기에 대응한다. 엔비디아 페어 베타는 그래픽 인터페이스, 터미널 인터페이스를 통해 윈도우, 맥OS, 리눅스에서 이용할 수 있다. 지원 제품은 엔비디아 지포스 RTX 20 시리즈 및 이후 제품군, 튜링 또는 이후 아키텍처 기반 RTX PRO 워크스테이션 GPU, DGX 스파크, 애플 M4 및 이후 제품이다.

지난달 공개된 퍼플렉시티 포터블 컴퓨터가 엔비디아의 로컬 AI 생태계에 편입됐다. 이에 따라 퍼플렉시티는 모델·오케스트레이션·도구를 아우르는 통합 앱 환경을 엔비디아 DGX 스파크 등 리눅스 시스템에서 로컬로 구동할 수 있게 됐다. 퍼플렉시티 포터블 컴퓨터를 이용하려면 리눅스 구동과 최소 24GB VRAM 엔비디아 RTX GPU가 필요하며, 윈도우 지원은 추후 제공될 예정이다.

이 기기에서는 사용자가 크레딧 없이 전체 워크플로우를 로컬에서 실행할 수 있다. 추가 조사·추론이 필요한 경우에는 작업 일부를 클라우드의 15개 이상 프론티어 모델로 확장할 수 있는 구조다. 이때 포터블 컴퓨터는 콘텐츠를 클라우드로 보내기 전에 사용자 권한을 요청하며, 민감한 정보는 기기 내부에 보관할 수 있도록 지원한다.

엔비디아는 오는 10월 RTX 스파크 윈도우 PC를 출시할 예정이다. IFA 2026에서는 레노버와 에이서가 RTX 스파크 기반 신제품을 공개했다. 에이서는 소형 데스크톱 RTX 스파크 콘셉트를 선보였고, 레노버는 요가 프로 9n·요가 9n 2-in-1을 발표했다.

RTX 스파크는 크리에이터·게이머·AI 에이전트를 대상층으로 한다. RTX 스파크 구성은 1페타플롭 RTX 블랙웰 GPU·최대 128GB 통합 메모리·20코어 그레이스 CPU다.

RTX 스파크 슈퍼칩 지원 범위는 고성능 슬림 노트북~상시 실행 AI 에이전트용 소형 데스크톱이다. 여기에 새로운 윈도우 에이전트 프레임워크를 결합하면 운영체제 수준 제어와 AI 에이전트의 안전한 백그라운드 실행 기능을 지원한다.

게임 생태계도 확대되고 있다. 엔비디아는 지난주 게임스컴에서 일렉트로닉 아츠(EA)·엠바크(Embark)·유비소프트(Ubisoft)가 RTX 스파크 윈도우 PC용 최신 블록버스터 타이틀 제공 개발사·배급사 대열에 합류했다고 발표했으며, 지난 5월 컴퓨텍스에서는 크래프톤·넷이즈·라이엇게임즈·엑스박스의 RTX 스파크 지원이 발표됐다. 일렉트로닉 아츠(EA)·엠바크(Embark)·유비소프트(Ubisoft)는 기존 발표 기업들과 함께 RTX 스파크 지원 생태계를 확대하고 있다.

엔비디아는 지난 8월 다양한 로컬 AI 모델·기술 공개에 나서며 생태계 확대 지속 흐름을 이어갔다. 그 연장선에서 네모트론 3.5 라이트닝(Nemotron 3.5 Lightning)은 300억 파라미터 모델로 제시됐다.

네모트론 3.5 라이트닝(Nemotron 3.5 Lightning)은 RTX PC 실행 가능하고, RTX PRO 워크스테이션 실행 가능하며, DGX 스파크 실행 가능하고, 젯슨 실행 가능하다. 엔비디아는 AI 모델·추론 최적화·에이전트·전용 하드웨어·게임 생태계 연결에 나서며 로컬 AI 시장 생태계 확장 가속에 힘을 싣고 있다.

출처: 테크월드뉴스 · 박규찬 기자
원문: https://www.epnc.co.kr/news/articleView.html?idxno=406538

참고자료

이 기사는 자동생성 알고리즘의 도움을 받아 작성되었습니다.


출처 테크월드뉴스

원문 확인

이 기사는 테크월드뉴스 원문을 바탕으로 비즈크러시가 요약 정리했습니다. 정확한 인용과 세부 내용은 원문을 확인해 주세요.