Vos salariés collent vos documents dans un chatbot. Interdire ne marche pas.

Actualités

6 Min

Héberger un modèle d'IA sur sa propre infrastructure : ce que ça demande, ce que ça sait faire, et à partir de quelle taille d'entreprise c'est raisonnable.

🎯 L'essentiel

Interdire les outils d'IA ne fonctionne pas : les salariés continuent, simplement sans le dire. La seule réponse qui tient dans la durée est de proposer une alternative acceptable. Et cette alternative peut tourner sur votre propre infrastructure.

  • Un modèle de langage peut fonctionner entièrement sur un serveur de votre entreprise, sans qu'aucune donnée ne sorte.

  • L'élément déterminant n'est pas le processeur mais la carte graphique et sa mémoire, qui décide de la taille de modèle utilisable.

  • Cela s'installe très bien dans une machine virtuelle sur Proxmox VE, avec la carte réservée à cette machine.

  • Ce que ça fait bien : reformuler, résumer, traduire, rédiger un premier jet, répondre à partir de vos documents. Ce que ça fait moins bien qu'un service en ligne : le raisonnement complexe.

  • En dessous d'une quinzaine de personnes, la question mérite d'être posée mais rarement tranchée dans ce sens. Au-delà, elle devient économiquement sérieuse.

📌 Pourquoi ce sujet maintenant

Nous avons publié en août un article sur les salariés qui utilisent déjà l'IA avec les documents de l'entreprise. Il posait le problème. Plusieurs dirigeants nous ont posé la même question derrière : concrètement, on fait quoi ? Voici la réponse côté infrastructure. Nous décrivons ici ce qu'il faut prévoir, sans annoncer de performances chiffrées que nous n'aurions pas mesurées chez vous.


Le constat de départ est simple et il n'a rien de moral. Vos équipes utilisent des outils d'IA parce qu'ils leur font gagner du temps. Une note de synthèse, une reformulation de mail, un compte rendu à partir de notes. Le gain est réel.

Le problème n'est pas l'usage, c'est le trajet. Le document part sur un service dont vous ne maîtrisez ni la localisation, ni la durée de conservation, ni ce qui est fait des contenus.

Et l'interdiction ne règle rien. Elle rend l'usage invisible, ce qui est strictement pire : vous perdez le gain de productivité et vous gardez le risque.

Ce que veut dire « faire tourner un modèle en local »


Un modèle de langage, c'est un fichier. Un très gros fichier, contenant les paramètres appris pendant l'entraînement. Ce fichier, une fois téléchargé, fonctionne sans connexion Internet. Il ne va rien chercher ailleurs, il ne renvoie rien.

Il existe des modèles ouverts, librement téléchargeables, dont plusieurs sont développés en Europe et se comportent très bien en français. Ils sont moins puissants que les plus grands services en ligne. Sur les usages de bureau quotidiens, l'écart est nettement plus faible que ce que l'on imagine.

ℹ️ Le seul élément technique qui compte vraiment

Ce n'est pas le processeur, c'est la carte graphique, et plus précisément la quantité de mémoire qu'elle embarque.


Un modèle doit tenir dans cette mémoire pour répondre à une vitesse confortable. Plus de mémoire graphique veut dire un modèle plus grand, donc des réponses de meilleure qualité. C'est le seul arbitrage réellement structurant du projet, et c'est aussi le principal poste de dépense.

Où ça s'installe, chez vous


Si vous êtes déjà virtualisé, ce qui est le cas de la plupart de nos clients, l'installation se fait dans une machine virtuelle dédiée sur Proxmox VE, avec la carte graphique réservée à cette machine. C'est un mécanisme standard et bien documenté.

L'avantage de cette approche est qu'elle ne crée pas une exception dans votre système d'information. La machine est sauvegardée comme les autres, avec Proxmox Backup Server ou Veeam selon votre environnement. Elle est supervisée comme les autres. Elle est isolée par les mêmes règles réseau, avec le même pare-feu. Elle n'est pas un objet à part posé dans un coin du bureau.

Et pour l'accès des utilisateurs, une interface web interne suffit. Ce qu'ils voient ressemble à ce qu'ils utilisent déjà. C'est important : une alternative moins pratique que l'outil qu'elle remplace ne sera pas utilisée.

Le matériel, et pourquoi le reconditionné a du sens ici


Un serveur capable d'accueillir une carte graphique de ce type demande de la place, de l'alimentation et du refroidissement. Les châssis Dell et HPE de génération récente le font très bien, et le marché du reconditionné garanti permet d'y accéder pour une fraction du prix du neuf.

C'est cohérent avec ce que nous défendons par ailleurs : sur ce type de projet, où la machine n'est pas en production critique au démarrage, le reconditionné garanti est le bon compromis entre coût et fiabilité. Cela permet aussi de tester avant d'investir lourdement, ce qui est exactement ce qu'il faut faire.


Ce que ça sait faire, et ce que ça ne sait pas faire

Ce qui fonctionne bien
  • Reformuler, résumer, traduire. L'usage le plus fréquent, et celui où l'écart avec les services en ligne est le plus faible.

  • Rédiger un premier jet de courrier, de compte rendu, de description technique.

  • Répondre à partir de vos propres documents. C'est l'usage le plus intéressant et le plus sous-estimé : on donne au modèle l'accès à vos procédures, vos contrats types, votre documentation interne, et il répond en s'appuyant dessus. Cet usage est presque impossible à faire proprement avec un service public, précisément parce qu'il faudrait y envoyer tous ces documents.

Ce qui fonctionne moins bien
  • Le raisonnement complexe sur plusieurs étapes. Là, les très grands modèles en ligne conservent une avance réelle.

  • Les tâches très spécialisées, notamment sur du code élaboré.

  • L'usage simultané par beaucoup de personnes, qui demande plus de matériel.

📌 À partir de quelle taille c'est raisonnable

Moins d'une quinzaine de personnes. La question se pose surtout si vous manipulez des données particulièrement sensibles. Sinon, un abonnement professionnel avec des garanties contractuelles claires est souvent plus simple.

Entre quinze et cent personnes. La zone où le calcul devient intéressant, surtout si le sujet de la confidentialité est déjà sur la table.

Au-delà. Le coût des abonnements individuels finit par dépasser celui d'une machine, et la question de la maîtrise des données devient structurante.

La bonne façon de démarrer


Pas par un projet. Par un test.

Une machine, un modèle, cinq utilisateurs volontaires, un mois. On regarde ce qu'ils en font réellement, ce qui les gêne, et ce qu'ils continuent d'aller chercher ailleurs. C'est cette dernière information qui vaut le plus cher, parce qu'elle dit exactement où votre alternative n'est pas suffisante.

Et si le test ne convainc pas, vous aurez dépensé le prix d'un serveur d'occasion, qui servira à autre chose.

🧭 Ce que nous faisons sur ce sujet

SPM Digital dimensionne et déploie l'infrastructure nécessaire à ce type d'usage : machine virtuelle dédiée sur Proxmox VE avec carte graphique réservée, isolation réseau, sauvegarde par Proxmox Backup Server ou Veeam, et supervision au même titre que le reste du parc.

Côté matériel, nous recherchons la configuration adaptée en neuf ou en reconditionné garanti sur des châssis Dell, HPE ou 2CRSI, et nous l'intégrons à votre environnement existant.


❓ Questions fréquentes


Faire tourner une IA en interne, cela veut dire qu'aucune donnée ne sort ?

Oui, c'est tout l'intérêt. Le modèle est un fichier hébergé sur votre serveur, il fonctionne sans connexion Internet et n'envoie rien à l'extérieur. Le document traité ne quitte pas votre réseau.

Quel est le principal poste de dépense ?

La carte graphique et sa quantité de mémoire, qui détermine la taille de modèle utilisable et donc la qualité des réponses. Le reste du serveur peut souvent être du matériel reconditionné garanti.

Est-ce aussi bon que les services en ligne ?

Sur la reformulation, le résumé, la traduction et la rédaction d'un premier jet, l'écart est faible. Sur le raisonnement complexe, les très grands modèles en ligne gardent une avance réelle. Le bon usage détermine le bon choix.

Comment démarrer sans engager un gros budget ?

Par un test : une machine, un modèle, quelques utilisateurs volontaires, un mois. Ce qu'ils continuent d'aller chercher ailleurs vous dira précisément où l'alternative interne ne suffit pas.

Sources & Références
  • Documentation officielle Proxmox VE sur l'affectation de matériel à une machine virtuelle.

  • Documentation publique des modèles de langage ouverts et de leurs prérequis matériels.

  • Retours terrain SPM Digital sur le dimensionnement et l'intégration de serveurs équipés de cartes graphiques.

Une alternative interne, sur votre infrastructure

Nous dimensionnons la machine, nous l'intégrons à votre environnement virtualisé et nous la sauvegardons comme le reste. Le test coûte le prix d'un serveur d'occasion.

Virtualisation & Matériel

Une alternative interne, sur votre infrastructure

Nous dimensionnons la machine, nous l'intégrons à votre environnement virtualisé et nous la sauvegardons comme le reste. Le test coûte le prix d'un serveur d'occasion.

Virtualisation & Matériel

Rédigé par Sylvain Sarazin

Expert IT pour PME en Île-de-France · virtualisation, sécurité, infogérance.