Skip to content
DigitalNeuron
도구·제품

엔비디아, 로컬 AI 가속 기술 PAIR와 RTX Spark PC 발표

엔비디아는 IFA 2026에서 PAIR 라우팅 도구와 로컬 추론 최적화 기술, 간소화된 에이전트 설정 기능, RTX Spark 윈도우 PC를 발표했다.

DigitalNeuron Desk2분 읽기

한 줄 답

엔비디아는 IFA 2026에서 로컬 AI와 관련해 무엇을 발표했나?

엔비디아는 로컬 네트워크에서 호환 컴퓨터들에 AI 추론 작업을 분산하는 무료 오픈소스 도구 PAIR를 발표했다. 또한 여러 에이전트 애플리케이션을 위한 간소화된 로컬 설정 기능과 새로운 llama.cpp 및 vLLM 최적화 기술을 공개했으며, 에이서와 레노버의 RTX Spark 윈도우 PC가 2026년 10월 출시될 예정이라고 밝혔다.

핵심 요약

  • 엔비디아는 로컬 네트워크의 호환 컴퓨터들에 개별 추론 요청을 라우팅하는 무료 오픈소스 도구 PAIR를 공개했다.
  • 엔비디아는 새로운 llama.cpp 및 vLLM 최적화 기술이 특정 RTX 및 DGX 구성에서 추론 처리량을 높인다고 밝혔다.
  • Hermes Agent와 OpenClaw, Perplexity Portable Computer에 엔비디아 하드웨어에서 로컬 모델을 실행하기 위한 간소화된 지원 기능이 추가된다.
  • 엔비디아는 에이서와 레노버의 RTX Spark 윈도우 PC가 2026년 10월 출시될 예정이라고 밝혔다.

엔비디아는 IFA 2026에서 인근 컴퓨터들이 추론 워크로드를 분담하는 도구와 두 가지 추론 백엔드의 성능 최적화 기술, 에이전트 애플리케이션을 위한 간소화된 모델 설정 기능 등 로컬 AI 관련 업데이트를 대거 발표했다. 엔비디아 RTX Spark 윈도우 PC도 2026년 10월 출시될 예정이라고 밝혔다.

로컬 컴퓨터 간 작업 라우팅

엔비디아는 로컬 네트워크의 호환 컴퓨터들에 개별 AI 추론 요청을 분산하는 무료 오픈소스 소프트웨어 도구인 Personal AI Router(PAIR)를 공개했다. 엔비디아에 따르면 PAIR는 지원 기기를 자동으로 검색하고 여유 용량이 있는 시스템을 선택하며, 기기가 네트워크에 접속하거나 이탈할 때 그에 맞춰 조정한다.

이 도구는 Ollama 및 LM Studio와 연동되며, 그래픽 인터페이스와 터미널 인터페이스를 통해 베타 버전으로 제공된다. 엔비디아는 윈도우와 macOS, 리눅스뿐 아니라 지포스 RTX 20 시리즈 이상 GPU, 튜링 이상 아키텍처를 사용하는 RTX PRO 워크스테이션 GPU, DGX Spark, 애플 M4 이상 실리콘을 지원한다고 밝혔다.

엔비디아는 PAIR가 여러 하위 에이전트에서 생성된 작업을 하나의 GPU에 대기시키는 대신 분산할 수 있다고 설명했다. 사용자가 주 시스템을 게임이나 창작 작업, 기타 업무에 이용하는 동안 AI 워크로드를 다른 컴퓨터로 옮길 수도 있다.

간소화된 에이전트 설정

엔비디아는 Hermes Agent와 OpenClaw, Perplexity Portable Computer가 자사 하드웨어에서 로컬 모델을 더욱 간편하게 사용할 수 있도록 지원한다고 밝혔다. 이 설정 환경은 llama.cpp를 사용하며 엔비디아의 추론 최적화 기술을 포함한다.

Hermes Agent는 RTX 및 DGX 시스템 전반에서 원클릭 로컬 모델 설정 기능을 윈도우용으로 제공하며, 리눅스 지원도 계획돼 있다. 엔비디아에 따르면 이 소프트웨어는 설치된 GPU를 감지하고 모델과 구성을 선택한 뒤, 통합된 llama.cpp 구현을 통해 모델을 실행한다. Hermes는 도구를 사용하고, 작업 전반의 맥락을 유지하며, 세션 간 정보를 보존하고, 재사용 가능한 스킬을 만들 수 있다.

엔비디아에 따르면 Perplexity Portable Computer는 VRAM이 24GB 이상인 엔비디아 RTX GPU 탑재 리눅스 시스템에서 이용할 수 있으며, 윈도우 지원도 계획돼 있다. 이 애플리케이션은 크레딧을 소모하지 않고 워크플로를 로컬에서 실행할 수 있으며, 15개가 넘는 클라우드 모델 가운데 하나로 콘텐츠를 전송하기 전에 사용자에게 허가를 요청할 수 있다고 엔비디아는 설명했다.

엔비디아와 마이크로소프트, OpenClaw는 OpenClaw 윈도우 애플리케이션도 공동 개발하고 있다. 엔비디아에 따르면 이 애플리케이션은 VRAM이 24GB 이상인 RTX GPU에서 최적화된 로컬 모델을 간편하게 설정할 수 있게 해준다.

추론 성능 업데이트

엔비디아는 커널 변경과 추측 디코딩 개선, 프리필 가속을 통해 지포스 RTX 5090에서 llama.cpp 처리량을 최대 1.9배로 높일 수 있다고 밝혔다. 또한 RTX PRO 6000 블랙웰 워크스테이션 에디션에서 vLLM 성능이 1.2배, 두 개의 DGX Spark 클러스터에서는 최대 1.4배 향상됐다고 발표했다.

엔비디아는 이러한 개선 사항을 llama.cpp와 vLLM 추론 백엔드를 통해 이용할 수 있으며, LM Studio와 Ollama에서도 활용할 수 있다고 밝혔다.

RTX Spark 시스템

엔비디아는 RTX Spark 윈도우 PC가 10월 출하될 예정이라고 밝혔다. 에이서는 소형 데스크톱 콘셉트를 선보였으며, 레노버는 Yoga Pro 9n과 Yoga 9n 2-in-1을 발표했다. 엔비디아에 따르면 RTX Spark 구성에는 1페타플롭 성능의 RTX 블랙웰 GPU와 최대 128GB 통합 메모리, 20코어 Grace CPU가 포함된다.

CyberLink의 PhotoDirector AI PC Mode도 10월 RTX Spark와 함께 출시될 예정이다. 엔비디아는 생성형 편집과 이미지 개선, 객체 제거, 배경 도구, 인물 사진 보정, 이미지 생성 기능을 제공하며 사용자가 로컬 처리와 클라우드 처리 중 하나를 선택할 수 있다고 밝혔다.

출처: 엔비디아가 2026년 9월 3일 발행한 “불꽃 튀는 혁신: 엔비디아, IFA 2026에서 로컬 AI 가속”.

자주 묻는 질문

엔비디아 PAIR란 무엇인가?
엔비디아는 Personal AI Router(PAIR)를 로컬 네트워크에서 호환 컴퓨터를 검색하고 개별 추론 요청을 여유 용량이 있는 시스템으로 라우팅하는 무료 오픈소스 도구라고 설명한다.
PAIR는 어떤 운영체제와 하드웨어를 지원하나?
엔비디아에 따르면 PAIR 베타 버전은 윈도우와 macOS, 리눅스에서 이용할 수 있다. 지원 하드웨어에는 지포스 RTX 20 시리즈 이상 GPU, 튜링 이상 아키텍처 기반 RTX PRO 워크스테이션 GPU, DGX Spark, 애플 M4 이상 실리콘이 포함된다.
어떤 에이전트 애플리케이션에 간소화된 로컬 설정 기능이 제공되나?
엔비디아는 Hermes Agent와 OpenClaw, Perplexity Portable Computer를 언급했다. 이들 애플리케이션의 로컬 설정 지원 기능은 llama.cpp를 사용하고 엔비디아의 추론 최적화 기술을 통합한다고 밝혔다.
엔비디아 RTX Spark PC는 언제 출시되나?
엔비디아는 에이서와 레노버의 제품을 포함한 RTX Spark 윈도우 PC가 2026년 10월 출시될 예정이라고 밝혔다.

출처

  1. Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026 | NVIDIA BlogNVIDIA
태그nvidialocal-aiai-agentsrtxpairinferencewindows

함께 읽기

앤트로픽, 연구자를 위한 워크벤치 '클로드 사이언스' 출시

앤트로픽은 과학 도구와 전문 에이전트, 데이터베이스, 컴퓨팅 자원을 결합한 연구 워크벤치 '클로드 사이언스'를 공개했다. 베타 버전은 macOS와 리눅스에서 클로드 프로, 맥스, 팀, 엔터프라이즈 이용자에게 제공되며, 재현 가능한 분석과 문헌 작업, 도표 작성, 논문 초고, 관리형 컴퓨팅 작업 등의 기능을 갖췄다.

3분 읽기

Anthropic, 'Model Hardware Standard' 연구 프리뷰 공개

Anthropic은 AI 에이전트가 프로그래밍 가능한 물리적 장치를 조작할 수 있도록 하는 공통 규격인 Model Hardware Standard의 연구 프리뷰를 공개했다. 회사에 따르면 MHS는 현미경, 액체 취급 장치, 로봇 팔 등 장비와의 통신을 표준화하며, 우선 선정된 연구소와 첨단 제조업체를 대상으로 제공된다.

3분 읽기

구글, 신뢰받는 파트너를 위한 사이버 방어 프로그램 '페어윈드' 출시

구글은 정부기관, 구글 클라우드 고객, 사이버보안 파트너를 대상으로 한 제한적 접근 프로그램 '페어윈드'를 출시했다. 이 프로그램은 제미나이 3.8 플래시 사이버와 구글의 코드멘더 하니스를 결합해 취약점을 자율적으로 찾아내고 검증하며 수정한다. 구글에 따르면 전 세계 650개 이상의 파트너가 운영 보안 요건 아래 이 프로그램에 참여하고 있다.

3분 읽기