Skip to content
DigitalNeuron
Tools & Produkte

NVIDIA kündigt PAIR, schnellere lokale KI und RTX-Spark-PCs an

NVIDIA announced its PAIR routing tool, local inference optimizations, simplified agent setup and RTX Spark Windows PCs at IFA 2026.

Von DigitalNeuron Desk3 Min. Lesezeit

Kurze Antwort

Was hat NVIDIA auf der IFA 2026 für lokale KI angekündigt?

NVIDIA announced PAIR, a free open-source tool that distributes AI inference across compatible computers on a local network. The company also introduced simplified local setup for several agent applications, new llama.cpp and vLLM optimizations, and RTX Spark Windows PCs from Acer and Lenovo scheduled to arrive in October 2026.

Das Wichtigste

  • NVIDIA introduced PAIR, a free open-source tool for routing independent inference requests among compatible computers on a local network.
  • NVIDIA zufolge erhöhen neue Optimierungen für llama.cpp und vLLM den Inferenzdurchsatz auf bestimmten RTX- und DGX-Konfigurationen.
  • Hermes Agent, OpenClaw and Perplexity Portable Computer are adding simplified support for running local models on NVIDIA hardware.
  • NVIDIA teilte mit, dass RTX-Spark-Windows-PCs von Acer und Lenovo im Oktober 2026 auf den Markt kommen werden.

NVIDIA hat auf der IFA 2026 eine Reihe von Neuerungen für lokale KI-Anwendungen angekündigt. Dazu zählen ein Tool, das Inferenz-Workloads auf Computer in der näheren Umgebung verteilt, Leistungsoptimierungen für zwei Inferenz-Backends und eine vereinfachte Modelleinrichtung für Agentenanwendungen. Zudem teilte das Unternehmen mit, dass Windows-PCs mit NVIDIA RTX Spark im Oktober 2026 auf den Markt kommen werden.

Verteilung von Aufgaben auf lokale Computer

NVIDIA stellte Personal AI Router, kurz PAIR, als kostenlose Open-Source-Software vor, die voneinander unabhängige KI-Inferenzanfragen auf kompatible Computer in einem lokalen Netzwerk verteilt. Nach Angaben von NVIDIA erkennt PAIR unterstützte Geräte automatisch, wählt Systeme mit freien Kapazitäten aus und passt sich an, wenn Geräte dem Netzwerk beitreten oder es verlassen.

Das Tool unterstützt Ollama und LM Studio und ist als Betaversion über grafische Benutzeroberflächen und Terminaloberflächen verfügbar. NVIDIA nennt Windows, macOS und Linux als unterstützte Betriebssysteme. Kompatibel sind außerdem GPUs der GeForce-RTX-20-Serie und neuer, RTX-PRO-Workstation-GPUs mit Turing- oder neueren Architekturen, DGX Spark sowie Apple-Chips der Reihe M4 oder neuer.

Laut NVIDIA kann PAIR Aufträge mehrerer Subagenten verteilen, statt sie in der Warteschlange einer einzigen GPU zu belassen. Zudem lassen sich KI-Workloads auf einen anderen Computer verlagern, während das primäre System für Spiele, kreative Aufgaben oder andere Arbeiten genutzt wird.

Vereinfachte Einrichtung von Agenten

NVIDIA teilte mit, dass Hermes Agent, OpenClaw und Perplexity Portable Computer künftig eine vereinfachte Unterstützung für lokale Modelle auf der Hardware des Unternehmens erhalten. Die Einrichtung basiert auf llama.cpp und umfasst NVIDIAs Optimierungen für die Inferenz.

Für Hermes Agent ist unter Windows eine Einrichtung lokaler Modelle mit nur einem Klick auf RTX- und DGX-Systemen verfügbar; Linux-Unterstützung ist geplant. Laut NVIDIA erkennt die Software die installierte GPU, wählt ein Modell samt Konfiguration aus und führt es über eine integrierte Implementierung von llama.cpp aus. Hermes kann Werkzeuge nutzen, Kontext über mehrere Aufgaben hinweg bewahren, Informationen sitzungsübergreifend speichern und wiederverwendbare Fähigkeiten erstellen.

Perplexity Portable Computer ist laut NVIDIA auf Linux-Systemen mit NVIDIA-RTX-GPUs und mindestens 24 GB VRAM verfügbar; eine Windows-Version ist geplant. Nach Angaben des Unternehmens kann die Anwendung Arbeitsabläufe lokal ausführen, ohne Guthaben zu verbrauchen, und um Erlaubnis bitten, bevor sie Inhalte an eines von mehr als 15 Cloud-Modellen übermittelt.

NVIDIA, Microsoft und OpenClaw arbeiten zudem an einer OpenClaw-Anwendung für Windows. Laut NVIDIA vereinfacht sie die Einrichtung eines optimierten lokalen Modells auf RTX-GPUs mit mindestens 24 GB VRAM.

Leistungsverbesserungen bei der Inferenz

NVIDIA berichtete, dass llama.cpp durch Änderungen an den Kerneln, Verbesserungen beim spekulativen Decodieren und ein schnelleres Prefill auf einer GeForce RTX 5090 einen bis zu 1,9-mal höheren Durchsatz erreichen kann. Das Unternehmen meldete außerdem eine 1,2-fache Leistungssteigerung für vLLM auf einer RTX PRO 6000 Blackwell Workstation Edition und eine Steigerung um das bis zu 1,4-Fache auf zwei DGX-Spark-Clustern.

Nach Angaben von NVIDIA sind die Verbesserungen über die Inferenz-Backends llama.cpp und vLLM verfügbar und lassen sich auch über LM Studio und Ollama nutzen.

RTX-Spark-Systeme

Laut NVIDIA werden Windows-PCs mit RTX Spark ab Oktober ausgeliefert. Acer zeigte ein Konzept für einen kompakten Desktop-PC, während Lenovo das Yoga Pro 9n und das 2-in-1-Gerät Yoga 9n ankündigte. Nach Angaben des Unternehmens umfassen RTX-Spark-Konfigurationen eine RTX-Blackwell-GPU mit einer Rechenleistung von 1 Petaflop, bis zu 128 GB gemeinsamen Arbeitsspeicher und eine Grace-CPU mit 20 Kernen.

Der Start des KI-PC-Modus von CyberLinks PhotoDirector ist ebenfalls für Oktober zusammen mit RTX Spark vorgesehen. Laut NVIDIA bietet er generative Bildbearbeitung, Bildverbesserung, Objektentfernung, Hintergrundwerkzeuge, Porträtoptimierung und Bilderzeugung. Nutzer können dabei zwischen lokaler Verarbeitung und Cloud-Verarbeitung wählen.

Quelle: NVIDIAs „Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026“, veröffentlicht am 3. September 2026.

Häufige Fragen

What is NVIDIA PAIR?
NVIDIA beschreibt Personal AI Router, kurz PAIR, als ein kostenloses Open-Source-Tool, das kompatible Computer in einem lokalen Netzwerk erkennt und unabhängige Inferenzanfragen an Systeme mit freien Kapazitäten weiterleitet.
Which operating systems and hardware does PAIR support?
NVIDIA zufolge ist die Betaversion von PAIR für Windows, macOS und Linux verfügbar. Unterstützt werden unter anderem GPUs der GeForce-RTX-20-Serie und neuer, RTX-PRO-Workstation-GPUs auf Basis der Turing-Architektur oder neuerer Architekturen, DGX Spark sowie Apple-Chips der M4-Generation oder neuer.
Which agent applications are receiving simplified local setup?
NVIDIA nannte Hermes Agent, OpenClaw und Perplexity Portable Computer. Nach Angaben des Unternehmens nutzt deren Unterstützung für die lokale Einrichtung llama.cpp und umfasst NVIDIA-Optimierungen für die Inferenz.
When will NVIDIA RTX Spark PCs arrive?
NVIDIA teilte mit, dass Windows-PCs mit RTX Spark im Oktober 2026 auf den Markt kommen werden, darunter auch Modelle von Acer und Lenovo.

Quellen

  1. Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026 | NVIDIA BlogNVIDIA
Schlagwörternvidialocal-aiai-agentsrtxpairinferencewindows

Passend dazu

Anthropic bringt Forschungs-Workbench Claude Science für Wissenschaftler an den Start

Anthropic hat Claude Science vorgestellt, eine Forschungs-Workbench, die wissenschaftliche Werkzeuge, spezialisierte Agenten, Datenbanken und Rechenressourcen vereint. Die Betaversion ist für macOS und Linux verfügbar und richtet sich an Nutzer von Claude Pro, Max, Team und Enterprise. Sie bietet Funktionen für reproduzierbare Analysen, Literaturarbeit, Abbildungen, Manuskripte und verwaltete Rechenaufträge.

2 Min. Lesezeit

Anthropic startet Forschungsvorschau des Model Hardware Standard

Anthropic hat eine Forschungsvorschau des Model Hardware Standard veröffentlicht, einer gemeinsamen Spezifikation, mit der KI-Agenten programmierbare physische Geräte bedienen können. Das Unternehmen erklärt, MHS standardisiere die Kommunikation mit Geräten wie Mikroskopen, Liquid Handlern und Roboterarmen und stehe zunächst ausgewählten Forschungslaboren und fortschrittlichen Fertigungsbetrieben zur Verfügung.

2 Min. Lesezeit

Google startet das Cyberabwehrprogramm Fairwind für vertrauenswürdige Partner

Google hat das Fairwind Program gestartet, eine Initiative mit begrenztem Zugang für Regierungen, Google-Cloud-Kunden und Cybersicherheitspartner. Das Programm kombiniert Gemini 3.8 Flash Cyber mit Googles CodeMender-Harness, um Schwachstellen eigenständig aufzuspüren, zu verifizieren und zu beheben. Nach Angaben von Google nehmen weltweit mehr als 650 Partner unter strengen Sicherheitsauflagen teil.

2 Min. Lesezeit