---
type: "FAQPage"
title: "FAQ: Lokale KI-Agenten auf eigener Hardware"
description: "Frequently asked questions about Lokale KI-Agenten auf eigener Hardware at Context Studios."
resource: "https://www.contextstudios.ai/de/leistungen/lokale-ki-agenten/faq"
language: "de"
generated:
  by: "process:contextstudios-md/1"
  at: "2026-09-26T11:47:24.052Z"
status: "stable"
---

# FAQ: Lokale KI-Agenten auf eigener Hardware

## FAQ

**Welche Hardware brauchen wir?**

Das hängt von der Modellgröße und der Zahl der Nutzer ab. Für Modelle bis rund 120 Milliarden Parameter in 4-Bit-Quantisierung reichen Geräte mit 128 GB gemeinsamem Speicher, etwa eine NVIDIA DGX Spark oder ein Rechner mit AMD Ryzen AI Max+ 395. Größere Modelle brauchen einen Mac Studio mit M5 Ultra (bis zu 512 GB, Auslieferung dieser Konfigurationen ab Ende Oktober 2026) oder mehrere vernetzte Geräte. Im Workshop legen wir fest, welche Klasse zu Ihren Aufgaben passt.

**Sind lokale Modelle so gut wie ChatGPT oder Claude?**

Für viele Aufgaben im Unternehmen – Zusammenfassen, Suchen in eigenen Dokumenten, Entwürfe, Klassifizieren, Programmieren – reichen aktuelle offene Modelle aus. Bei sehr komplexen Aufgaben liegen die großen Cloud-Modelle oft noch vorn. Wir testen die Modelle deshalb vorab mit Ihren eigenen, deutschsprachigen Daten, statt uns auf Benchmarks zu verlassen.

**Verlassen wirklich keine Daten das Haus?**

Die Verarbeitung durch das Modell läuft vollständig auf Ihrer Hardware. Ob ein Agent zusätzlich ins Internet darf, etwa für eine Websuche, legen Sie fest. Ein komplett abgeschotteter Betrieb ohne Internetverbindung ist möglich, erfordert aber zusätzliche Härtung bei Installation und Updates – das planen wir auf Wunsch mit ein.

**Warum Hermes Agent?**

Hermes Agent ist ein quelloffenes Agenten-Framework von Nous Research unter MIT-Lizenz. Es arbeitet mit jedem lokalen Modellserver zusammen, bringt Gedächtnis, Skills, Zeitplaner und Anbindungen an Slack, Telegram oder E-Mail mit und bindet Ihre Systeme über MCP an. Weil es sich schnell weiterentwickelt, gehört ein geregelter Update-Prozess zu unserer Übergabe.

**Dürfen wir Modelle wie Qwen, DeepSeek oder GLM einsetzen?**

Lokal ausgeführt senden diese Modelle keine Daten an den Hersteller – die Modellgewichte sind Dateien auf Ihrer Hardware. Viele Varianten stehen unter Apache-2.0- oder MIT-Lizenz und sind gewerblich nutzbar; die Lizenz prüfen wir je Modell. Wie jedes Modell brauchen sie Leitplanken für ihr Verhalten, und für Anwendungen mit Kundenkontakt wählen wir Modell und Schutzmaßnahmen besonders sorgfältig aus.

**Gilt die EU-KI-Verordnung auch für lokale KI?**

Ja. Welche Pflichten gelten, hängt vom Einsatzzweck ab, nicht davon, wo das Modell läuft. Lokaler Betrieb erleichtert aber Kontrolle und Dokumentation, weil Sie wissen, welches Modell in welcher Version welche Daten verarbeitet.

