Lokale KI · Rezept · 1× RTX 5090

Llama 8B FP16 mit vLLM auf 1× RTX 5090

von DaytonLecoq

Für dieses Rezept ist kein Tempowert belegt. Die Seite ist deshalb nicht indexiert.

Intelligenz (Originalmodell) · Artificial Analysis7ohne Denken

Engine

Engine
vLLM nightly
Quantisierung
FP16
Modellfamilie
Llama
Kontext
—
Parameter
8B dense
Kreator
DaytonLecoq
GitHub-Sterne
0
Repo-Stand
11. Mai 2026

Messwerte

Alle belegten Werte dieses Rezepts, je mit Bedingung und Quelle. Balken im Verhältnis zum größten Wert der Gruppe.

Für dieses Rezept sind keine Messwerte mit Quelle belegt.

Was brauche ich

Hardware
1 × NVIDIA RTX 5090
Gewichte
Engine
vLLM nightly

Hinweise

Was vor dem Nachbauen wichtig ist.

  • Kurztest
  • Zugang auf Anfrage

Quellen

Verwandte Rezepte

← Zur Übersicht

Lokale KI im eigenen Unternehmen?

Im Workshop klären wir, welche Modelle und welche Hardware zu Ihren Aufgaben passen, und bauen den ersten Agenten auf Ihrer Infrastruktur.