Un bon fumet.
Le chef est aux fourneaux.
Derrière une intelligence artificielle bien conçue, il y a une cuisine qui tourne rond. Laissez-nous vous présenter la brigade, poste par poste, et vous montrer, très concrètement, comment tout cela fonctionne.
Quatre postes,
une seule cuisine.
Pourquoi parler de cuisine ? Une intelligence artificielle reste abstraite tant qu’on ne peut pas se la représenter. Nous avons donc choisi un cadre que tout le monde connaît déjà : celui d’un restaurant, avec sa brigade et son organisation. Chaque poste de cuisine correspond ici à un élément technique bien réel de votre IA, et à chaque étape, nous vous donnons son nom exact, celui que vous avez peut-être déjà croisé sans le rattacher à rien de concret. Et si notre chef porte quatre étoiles, ce n’est pas tout à fait un hasard : il lui en fallait une par pilier.
Le modèle
Le Grand Chef, c’est le modèle d’intelligence artificielle lui-même, celui qui réfléchit, compose, propose. Vous choisissez le vôtre : nous ne vous imposons pas de carte fixe.
En clair : un LLM (Large Language Model) à poids ouverts (Mistral Large, Llama 3.3, DeepSeek, ou équivalent), quantifié (GGUF, AWQ) pour tourner localement sans dilapider la mémoire GPU. Vous en possédez les poids : aucune dépendance à une API distante, aucun appel qui sort de votre réseau.
Le serveur d’inférence
Les fourneaux, c’est la puissance de calcul qui fait tourner le chef en cuisine. Plus ils sont puissants, plus il travaille vite, et sur plusieurs plats à la fois.
En clair : une ou plusieurs cartes GPU (Nvidia RTX 4090/5000 Ada, A6000, L40S), pilotées par un moteur d’inférence comme vLLM ou Ollama, avec traitement par lots (batching) et gestion du contexte pour plusieurs utilisateurs simultanés, mesuré en tokens par seconde.
L’interface
La salle, c’est là où vous passez commande : la même sorte d’interface que celle utilisée pour interroger ChatGPT, Gemini ou Claude, sauf qu’ici, tout reste chez vous. Chacun y retrouve son historique de conversation et l’outil dont il a besoin.
En clair : une interface web comme Open WebUI, connectée au modèle via une API compatible OpenAI, avec gestion des droits d’accès par utilisateur, historique des conversations, et intégration à vos outils internes (Office, messagerie, applicatifs métier).
Le RAG
Le classeur, c’est la mémoire de la maison : vos documents, vos dossiers, votre savoir accumulé, que le chef consulte avant de répondre, pour ne jamais improviser sur ce qu’il ne connaît pas.
En clair : un pipeline de RAG (Retrieval-Augmented Generation) : vos documents sont découpés, transformés en vecteurs (embeddings) via un modèle comme BGE-M3, indexés dans une base vectorielle (Qdrant), puis recherchés par similarité sémantique à chaque question posée.
Plus de couverts ?
On ajoute des fourneaux.
Le besoin grandit rarement d’un coup : de plus en plus de collaborateurs s’en servent, ou ceux qui l’utilisent déjà s’en servent davantage, à mesure que l’outil devient indispensable au quotidien. Dans les deux cas, la réponse est la même.
On ajoute des fourneaux. On ne change rien d’autre.
Une carte GPU supplémentaire, un second serveur si le volume l’exige : on ajoute de la puissance de calcul, point final. Aucune migration, aucun programme à reconfigurer, aucune rennégociation de contrat, aucun changement d’habitude pour vos équipes. La cuisine s’agrandit ; la recette ne change pas.
Trois savoir-faire,
un seul chantier.
Faire fonctionner cette cuisine demande trois compétences distinctes. Nous ne les maîtrisons pas toutes depuis aussi longtemps, et nous préférons vous le dire.
Le matériel
Serveurs, réseaux physiques, hardware professionnel : un métier que nous pratiquons depuis la fondation de F6, via notre société sœur FSYS Informatique.
Les réseaux sécurisés
Segmentation, architecture, gestion des flux : le cœur historique de notre métier d’inféogérance pour des clients exigeants.
L’intelligence artificielle elle-même
Ici, personne au monde n’a trente ans d’ancienneté, mais cela fait déjà dix mois que nous travaillons intensivement sur le sujet, et nous commençons aujourd’hui à déployer nos premières architectures. Nous avons pris le temps de construire notre propre approche, fondée sur une logique stricte de propriété et d’indépendance, plutôt que de reproduire ce qui se fait ailleurs. Nous avançons avec une équipe motivée en interne et des consultants de grande qualité, et nous apprenons vite.
Envie de voir la cuisine de plus près ?
Un premier échange suffit pour situer, chez vous, ce qui relève du chef, des fourneaux, ou du classeur.
Prendre contact Revoir notre positionUn terme vous échappe ? Consultez le lexique →