NVIDIA hat am 19. August 2025 das ACE Game Agent SDK als Beta vorgestellt und damit ein quelloffenes C/C++-Framework für die native Integration von KI-Companions direkt in Spiele veröffentlicht. Das SDK richtet sich an Entwickler, die dialogfähige NPCs lokal auf GeForce-RTX-Hardware betreiben wollen, statt auf Cloud-Dienste zuzugreifen. Begleitend dazu erscheint eine Reihe neuer Plugins für die Unreal Engine 5, die Spracherkennung, kleine Sprachmodelle und Sprachsynthese als fertige Bausteine bereitstellen.
Das Framework ist als leichtgewichtige, vollständig anpassbare Bibliothek ausgelegt und auf den Betrieb kleiner Modelle auf RTX-Hardware optimiert. Die Verarbeitung erfolgt damit auf dem Endgerät. Auf diese Weise lassen sich die für cloudbasierte Companion-Lösungen typische Latenz und die schwer kalkulierbaren Betriebskosten umgehen.
Drei APIs für Agentenlogik, Inferenz und Wissensabruf
Das ACE Game Agent SDK stellt drei API-Kategorien bereit. Die Agent API ist eine zustandsbehaftete Schnittstelle, die den Gesprächsverlauf verwaltet und mehrstufiges Schlussfolgern mit geringem Programmieraufwand erlaubt. Die Chat API arbeitet zustandslos und gibt Entwicklern direkte Kontrolle über die Inferenz. Die RAG API ermöglicht semantischen und hybriden Wissensabruf aus eigenen Datenbanken der Entwickler, sodass NPCs auf spielspezifische Informationen zugreifen können.
Die Einsatzfähigkeit demonstriert NVIDIA anhand konkreter Titel. Als Beispiele führt das Unternehmen PUBG: BATTLEGROUNDS und Total War: PHARAOH an, in denen die Technik für reaktive, dialogfähige Spielfiguren genutzt wird.
Unreal-Engine-5-Plugins mit fertigen Modellen
Für die Unreal Engine 5 erscheinen drei Plugin-Kategorien mit vorkonfigurierten Modellen. Im Bereich automatische Spracherkennung kommt das englische Modell nemo-conformer-ctc-120m zum Einsatz, ergänzt um sieben weitere Sprachoptionen. Für kleine Sprachmodelle besteht lokale GGUF-Unterstützung, ausgeliefert mit dem Modell Qwen 3.5 4B für Dialoge mit geringer Latenz. Die Sprachsynthese basiert auf dem Modell Chatterbox Turbo 350M samt Beispielstimmen.
Die Plugins unterstützen sowohl Blueprint- als auch C++-Integration ab Werk und liefern die genannten Modelle gebündelt aus. In Verbindung mit dem SDK ergibt sich damit eine Toolchain, die den gesamten Ablauf von der Spracheingabe über die Modellantwort bis zur Sprachausgabe lokal und RTX-beschleunigt abbildet. Cloud-Anbindungen bleiben optional, sind für den Kernbetrieb der Companions jedoch nicht erforderlich. NVIDIA flankiert seine GeForce-Plattform zunehmend mit solchen Entwickler-Werkzeugen, wie zuvor schon beim RTX-Remix-Workflow.
