LLM (grand modèle de langage)
Un LLM (large language model) est un modèle d’IA entraîné sur d’immenses volumes de texte, capable de comprendre une consigne et de produire du texte, du code ou des réponses structurées : GPT, Gemini, Claude, Mistral.
Mise en contexte
Le LLM est le moteur de l’IA générative. En entreprise, on ne l’utilise pas « brut » : on lui donne un contexte (vos documents, vos données), des consignes précises et des garde-fous, et on mesure ses réponses. Le choix du modèle dépend du cas d’usage, du coût par traitement et de la localisation des données.
Nous travaillons avec plusieurs fournisseurs sans dépendance : Gemini (Vertex AI), OpenAI, Mistral, et des modèles open source déployés en Europe pour les données sensibles. Par exemple, Cabiine orchestre Vertex AI avec un secours OpenAI, et nos outils de génération documentaire utilisent le plus petit modèle suffisant pour chaque tâche.
Un LLM se teste sur vos propres cas avant tout engagement.
Questions fréquentes
Celui qui répond à votre cas au meilleur coût et dans le bon cadre de données : nous comparons plusieurs modèles sur vos exemples réels, en mesurant qualité, latence et prix par traitement.
Pas avec les offres professionnelles des principaux fournisseurs, qui l’excluent contractuellement. Pour les données sensibles, un modèle open source hébergé en Europe supprime la question.