Une fois décidé d'installer un LLM local, une question technique se pose vite : quel modèle installer ? L'offre open source s'est étoffée, et le bon choix dépend moins de la notoriété du nom que de votre usage réel.
Quel modèle de langage local choisir ?
Le choix dépend de trois critères : la puissance de calcul disponible, la langue de travail principale, et le type de tâche visé. Mistral convient bien aux usages francophones sur matériel modéré, Llama offre un bon équilibre polyvalent, DeepSeek se distingue sur le raisonnement à matériel équivalent.
La taille du modèle, premier critère pratique
Les modèles open source existent en plusieurs tailles, exprimées en milliards de paramètres (les valeurs internes que le modèle ajuste pour produire ses réponses). Plus un modèle est volumineux, plus il est capable, mais plus il demande de puissance de calcul. Un modèle de 7 à 8 milliards de paramètres tourne sur un serveur d'entrée de gamme dédié à l'IA ; un modèle de plusieurs dizaines de milliards demande une infrastructure nettement plus conséquente.
Exemple type : un bureau d'études techniques teste un modèle de grande taille sur son serveur existant, qui devient inutilisable tant les réponses sont lentes. Un modèle plus léger, mieux dimensionné pour son matériel, répond en quelques secondes avec une qualité suffisante pour son usage.
La langue de travail principale
Mistral, développé par une entreprise française, se distingue sur la qualité du français et bénéficie d'une communauté active en France, un atout pour un support technique en langue française. Llama, développé par Meta, reste très polyvalent et bien documenté, avec un écosystème d'outils particulièrement large. DeepSeek se distingue sur les tâches de raisonnement pas à pas, à vérifier selon les conditions d'usage de chaque version.
Le type de tâche visé
Un modèle destiné à résumer des documents ou classer des courriers n'a pas besoin de la même puissance qu'un modèle destiné à répondre à des questions complexes nécessitant plusieurs étapes de raisonnement. Il est souvent plus efficace de choisir un modèle léger spécialisé sur la tâche visée plutôt qu'un modèle généraliste surdimensionné.
Exemple type : une agence immobilière choisit un modèle léger pour classer automatiquement ses emails entrants par type de demande, tandis qu'un cabinet d'avocats retient un modèle plus volumineux pour synthétiser des dossiers juridiques complexes.
L'essentiel à retenir
Le meilleur modèle local n'est pas le plus connu, mais celui dimensionné pour votre matériel et votre usage réel. Notre article sur les prérequis d'un LLM local détaille comment évaluer votre infrastructure en amont, et notre comparatif LLM local vs API cloud aide à trancher en amont sur l'approche générale.
Vous hésitez entre plusieurs modèles pour votre projet ? Parlons de votre cas d'usage.