
Un chat IA 100 % local, hébergé en France
Serge est une interface de chat IA entièrement locale, propulsée par LLaMA.cpp : aucune clé API, aucun appel externe. Installée et supervisée par DINAO, hébergée en France — vos prompts ne quittent jamais le serveur.
Qu'est-ce que Serge ?
Serge est une interface de chat IA auto-hébergée et entièrement locale, bâtie autour de LLaMA.cpp. Sans clé API ni appel à un service externe, elle permet de dialoguer avec des modèles de langage open-weight directement depuis le navigateur, dans une interface épurée. Le téléchargement et la bascule entre modèles GGUF / LLaMA se font depuis l'application elle-même.
Pensée pour être simple à déployer (un conteneur Docker regroupant l'API Python/FastAPI, le frontend et le moteur d'inférence), elle convient aux organisations qui veulent une IA conversationnelle sans aucune fuite de données. Les modèles quantifiés tournent sur CPU ; un GPU accélère l'inférence et autorise de plus grands modèles.
DINAO l'héberge en France, gère les modèles, les mises à jour, les sauvegardes et la supervision — pour une IA réellement souveraine.
Hébergez Serge chez DINAO
Paliers de ressources compatibles avec les pré-requis de Serge (2 vCPU / 8 Go / 10 Go minimum). Hébergé en France, infogéré.
- 4 vCPU alloués
- 8 Go de RAM
- 80 Go NVMe
- Sauvegardes quotidiennes
- Infogéré & supervisé par DINAO
- 8 vCPU alloués
- 16 Go de RAM
- 160 Go NVMe
- Sauvegardes quotidiennes
- Infogéré & supervisé par DINAO
2 palier(s) masqué(s) (ressources insuffisantes pour cette app) : Découverte, Standard
Hébergement Serge managé en France
Héberger Serge soi-même suppose un serveur à maintenir, des mises à jour de sécurité, des sauvegardes et de la supervision. Avec notre hébergement Serge managé, vous utilisez l'application : nous opérons l'infrastructure.
- Déploiement en quelques minutes, version maintenue à jour
- Sauvegardes quotidiennes incluses
- Supervision continue, données hébergées en France (RGPD)
- Envie de self-hosted avec accès root ? Serge s'installe aussi sur notre VPS Docker.
Cette application utilise l'IA
Le conteneur héberge l'application, pas le moteur d'IA (qui exige des GPU dédiés) : l'inférence se branche à l'extérieur, avec votre propre clé fournisseur. Privilégiez un moteur souverain — Mistral AI, NumSpot, Scaleway ou OVHcloud AI Endpoints (France, RGPD) ; un acteur international (OpenAI, Anthropic…) seulement si une capacité précise l'exige. Abonnements d'inférence non inclus dans l'hébergement.
Détails techniques
Vous vous demandez…
Serge envoie-t-il mes messages à OpenAI ou ailleurs ?
Non, jamais. Serge effectue l'inférence localement avec LLaMA.cpp. Aucune clé API, aucun appel sortant : vos prompts et réponses restent intégralement sur votre serveur en France.
Quels modèles puis-je utiliser ?
Des modèles open-weight au format GGUF (familles LLaMA, Mistral, etc.), téléchargeables et changeables depuis l'interface. La taille recommandée dépend de votre formule et de la présence d'un GPU.
Ai-je besoin d'un GPU ?
Non pour démarrer : les petits modèles quantifiés tournent sur CPU. Un GPU (en option dès la formule Équipe) accélère nettement et permet des modèles plus grands.
L'historique de mes conversations est-il privé ?
Oui. Il est stocké sur votre instance dédiée, en France, et n'est ni partagé ni utilisé pour entraîner quoi que ce soit.
Quelle différence avec un ChatGPT classique ?
Serge privilégie la confidentialité absolue : tout est local. La qualité dépend du modèle open-weight choisi, mais aucune donnée ne quitte votre infrastructure, contrairement aux services cloud.
Cette application est-elle testée avant d'être proposée ?
Oui. La version latest a été déployée sur notre infrastructure le 4 septembre 2026 et son démarrage a été vérifié automatiquement : tous les services attendus doivent répondre pour que la fiche porte cette mention. Le modèle de déploiement utilisé a été mis à jour pour la dernière fois le 3 juillet 2026. Chaque nouvelle version publiée par l'éditeur relance ce test : la date ci-dessus suit donc la version réellement proposée.
Que couvre exactement l'infogérance ?
L'infogérance DINAO est incluse dans le prix de votre conteneur. Elle couvre le fonctionnement technique du serveur et des couches logicielles : système, base de données, environnement d'exécution et application (installation, mises à jour de sécurité, sauvegardes, supervision). Elle n'inclut pas l'aide à l'utilisation quotidienne de l'application, qui reste de la compétence du client. Elle est fournie en « best effort », dans le cadre d'une obligation de moyens : vos demandes sont traitées selon leur nature et leur criticité, dans l'ordre de priorité déterminé par DINAO au regard notamment de l'impact sur la disponibilité du service. Aucun délai de prise en compte ni de rétablissement n'est garanti : ce niveau ne comporte ni garantie de temps d'intervention (GTI), ni garantie de temps de rétablissement (GTR). La supervision technique est automatique 24h/24 et 7j/7 — une indisponibilité est détectée sans intervention de votre part ; les interventions humaines sont assurées aux jours et heures ouvrés de DINAO, hors jours fériés. Si votre activité demande davantage — traitement prioritaire, plage d'intervention élargie, engagements de délai, rétention de sauvegarde étendue ou copie sur un second site —, des formules d'infogérance étendue peuvent être mises en place : leur contenu et leur tarif sont établis avec vous selon vos besoins. Contactez notre service Conteneur applicatif pour en discuter.