LLMs
16 Go suffisent : le tableau de mesures Qwen3.8-27B GGUF (11,8 Go, 40 tok/s @ 5060 Ti) pour le stack portable
IST-DASLab livre Qwen3.8-27B en GGUF de 8,4 à 11,8 Go. IQ3_S garde 99,8 % des performances de base avec une réduction de 4,6× et tient sur les cartes 16 Go. Tableau des fichiers, débits mesurés et règle de décision.
il y a 2 jours