LLM (Large Language Model)
Un LLM (Large Language Model, ou grand modèle de langage) est un modèle d'intelligence artificielle entraîné sur d'immenses volumes de texte, capable de comprendre une demande en langage naturel et de générer une réponse cohérente : rédaction, résumé, traduction, génération de code, conversation. GPT (OpenAI) et Claude (Anthropic) en sont des exemples connus.
Dans un produit, le LLM sert rarement de brique isolée. Un outil de rédaction d'emails commerciaux, par exemple, combine un LLM avec les données du CRM (via du RAG) pour personnaliser chaque message avec l'historique réel du client. Le choix du modèle influence le coût, la latence et la qualité, mais c'est presque toujours l'intégration autour du modèle (données, prompts, contrôles) qui détermine si le produit final est utilisable en production.
Un piège courant est de choisir le modèle le plus puissant du marché par défaut, sans comparer coût et latence par rapport au besoin réel. Pour une tâche simple et à fort volume (classification, extraction), un modèle plus petit et moins cher fait souvent aussi bien, à une fraction du coût. Le bon réflexe est de tester plusieurs modèles sur le cas d'usage précis avant de figer un choix.
