(01)De quel matériel avons-nous besoin ?
Cela dépend de la taille du modèle et du nombre d’utilisateurs. Pour des modèles jusqu’à environ 120 milliards de paramètres en quantification 4 bits, des appareils dotés de 128 Go de mémoire unifiée suffisent, comme un NVIDIA DGX Spark ou une machine équipée d’AMD Ryzen AI Max+ 395. Les modèles plus grands nécessitent un Mac Studio M5 Ultra (jusqu’à 512 Go ; ces configurations sont livrées à partir de fin octobre 2026) ou plusieurs appareils en réseau. Lors de l’atelier, nous déterminons la classe adaptée à vos tâches.
(02)Les modèles locaux valent-ils ChatGPT ou Claude ?
Pour de nombreuses tâches en entreprise – résumer, chercher dans vos propres documents, rédiger, classer, programmer – les modèles ouverts actuels suffisent. Pour des tâches très complexes, les grands modèles cloud gardent souvent une avance. C’est pourquoi nous testons les modèles au préalable avec vos propres données plutôt que de nous fier aux benchmarks.
(03)Aucune donnée ne sort-elle vraiment ?
Le traitement par le modèle s’effectue entièrement sur votre matériel. C’est vous qui décidez si un agent peut en plus accéder à Internet, par exemple pour une recherche web. Un fonctionnement totalement isolé, sans connexion Internet, est possible mais demande un durcissement supplémentaire pour l’installation et les mises à jour – nous pouvons le prévoir sur demande.
(04)Pourquoi Hermes Agent ?
Hermes Agent est un framework d’agents open source de Nous Research sous licence MIT. Il fonctionne avec n’importe quel serveur de modèles local, apporte mémoire, compétences, planificateur et connexions à Slack, Telegram ou l’e-mail, et relie vos systèmes via MCP. Comme il évolue rapidement, un processus de mise à jour encadré fait partie de notre transfert.
(05)Pouvons-nous utiliser des modèles comme Qwen, DeepSeek ou GLM ?
Exécutés localement, ces modèles n’envoient aucune donnée à leur éditeur – les poids du modèle sont des fichiers sur votre matériel. De nombreuses variantes sont sous licence Apache 2.0 ou MIT et utilisables commercialement ; nous vérifions la licence de chaque modèle. Comme tout modèle, ils ont besoin de garde-fous pour leur comportement, et pour les applications en contact avec la clientèle nous choisissons modèle et protections avec un soin particulier.
(06)Le règlement européen sur l’IA s’applique-t-il aussi à l’IA locale ?
Oui. Les obligations dépendent de la finalité, pas de l’endroit où tourne le modèle. L’exploitation locale facilite toutefois le contrôle et la documentation, car vous savez quel modèle, dans quelle version, traite quelles données.