Outils · Le 8 heures IA
Le modèle IA le plus cher n’est plus le choix par défaut
Article produit par une intelligence artificielle à partir de sources nommées et datées, publié sous la responsabilité éditoriale d’Oriq. Nos systèmes d’IA · Le responsable éditorial
Le rapport annuel de Mozilla, publié le 15 septembre 2026, chiffre l’écart entre les modèles à poids ouverts et les modèles fermés : deux à trois points de capacité, et une facture bien plus basse. Le même jour, une offre française annonce d’opérer ces modèles pour les entreprises qui n’ont pas d’équipe infrastructure. Voici comment arbitrer, tâche par tâche.
Deux ou trois points d’écart, 30 à 60 % du prix
Le rapport annuel de Mozilla, « The State of Open Source AI » (version 1.1, septembre 2026), situe le meilleur modèle à poids ouverts à deux ou trois points du meilleur modèle fermé selon l’indice retenu, pour 30 à 60 % du prix. Le document donne les deux formulations : on retient la fourchette, pas un chiffre unique.
Conséquence directe pour un dirigeant : choisir un modèle IA ouvert n’est plus un renoncement à la qualité, c’est un arbitrage de coût. Et cet arbitrage se fait tâche par tâche, pas entreprise par entreprise.
Le même rapport mesure le retard de l’ouvert sur le fermé à environ 4,4 mois (calcul Mozilla sur données METR). Epoch AI aboutit à quatre mois et huit points d’écart d’indice. Deux méthodes, un même ordre de grandeur.
L’écart entre l’IA ouverte et l’IA fermée ne se compte plus en générations de modèles, il se compte en mois.
Autre repère du rapport : le prix d’inférence d’un modèle de classe GPT-4 a été divisé par environ soixante en quarante-cinq mois. Ce que vous payiez cher en 2022 est devenu une ligne de frais marginale.
La frontière est en dents de scie
Ce n’est pas un camp qui gagne, c’est une carte à lire. Toujours selon Mozilla, septembre 2026 :
- Parité, voire avance de l’ouvert, sur le code front-end et le suivi d’instructions.
- Résultat contesté sur le travail agentique, celui où le modèle enchaîne des actions seul.
- Avance nette du fermé sur le travail expert : 92 points Elo d’écart sur le test GDPval-AA v2.
- Avance nette du fermé sur la recherche en contexte long : 89 % de réussite contre 41 % sur un test de récupération à un million de tokens.
Traduction opérationnelle : le tri de messages, l’extraction de données de factures, les premiers jets de réponses et la génération d’interfaces peuvent basculer sur un modèle économique. La lecture de trois cents pages de dossier, l’analyse à enjeu juridique et la synthèse experte restent sur le modèle premium.
Faut-il héberger soi-même un modèle IA ouvert pour faire des économies ?
Non, dans la très grande majorité des PME. Faire tourner le meilleur modèle ouvert en interne demande plusieurs dizaines d’accélérateurs ; sur un seul GPU, Mozilla mesure une perte d’environ 23 points d’indice (septembre 2026). Le gain vient du choix du modèle et de son tarif d’usage, pas de la possession des machines. Passez par un fournisseur qui l’exploite pour vous.
Ce qui bloque n’est pas la capacité, c’est l’exploitation
L’enquête développeurs Mozilla / SlashData 2026 (1 411 répondants) est claire : 79 % utilisent des modèles ouverts, 71 % des modèles fermés, 50 % les deux. Mais l’ouvert atteint la production douze points moins souvent. Les freins cités sont opérationnels, jamais capacitaires : coûts d’infrastructure (27 %), sécurité et conformité (26 %), maintenance (24 %), complexité de déploiement (23 %).
Un modèle ouvert se télécharge facilement et se déploie difficilement. C’est précisément le trou que visent les offres managées.
Le 15 septembre 2026, Numspot et Mistral AI ont annoncé une plateforme réunissant la suite de modèles Mistral, une infrastructure hébergée en France, l’orchestration, la supervision et une exploitation opérée de bout en bout avec un interlocuteur unique. Cible affichée : les organisations sans compétences internes pour opérer une infrastructure d’IA. Point à vérifier avant de signer : la qualification SecNumCloud est obtenue pour l’IaaS de Numspot et encore en cours pour les services managés.
Trois précautions avant de basculer une tâche :
- Le tarif affiché n’est pas le tarif payé. Mozilla cite un modèle listé à 15 dollars le million de tokens de sortie qui facture comme 31 dollars une fois sa verbosité prise en compte.
- « Poids ouverts » ne veut pas dire « open source ». Sur seize sorties ouvertes notables, aucune ne publie la recette de données attendue par la définition de l’OSI. Lisez la licence : certaines sont sur mesure, avec des seuils de chiffre d’affaires.
- La réversibilité compte. Un modèle de frontière est resté indisponible dix-neuf jours, du 12 juin au 1er juillet 2026, après une décision d’export américaine.
Et dans votre entreprise ?
- Prenez une tâche routinière à gros volume (tri de mails, extraction de factures) et faites-la juger à l’aveugle sur trente cas réels : modèle ouvert contre modèle actuel, critère unique, le coût par tâche réussie.
- Écrivez votre règle d’aiguillage en une ligne, du type « au-delà de X pages ou en cas d’enjeu juridique, modèle premium ». Affichez-la à côté des consignes de vos outils.
- Vérifiez que vos consignes et vos jeux de test sont exportables et rejouables sur un autre modèle en une journée. C’est votre assurance fournisseur.
Premier pas cette semaine, en moins d’une heure : listez vos cinq usages IA actuels et notez en face de chacun « routinier » ou « expert ». Les lignes « routinier » sont vos candidates au changement de modèle.
Sources
- Mozilla, The State of Open Source AI, v1.1, septembre 2026
- Mozilla et SlashData, enquête développeurs 2026 (n = 1 411), publiée dans The State of Open Source AI, septembre 2026
- Numspot et Mistral AI, communiqué commun sur une offre d’IA managée en infrastructure souveraine, 15 septembre 2026
Le 8 heures IA, le magazine quotidien de l’IA
Un article par jour sur l’actualité de l’intelligence artificielle et ce qu’elle change pour votre entreprise. Publié chaque matin à 8h, lu en 3 minutes.
Gratuit. Un email par jour, désabonnement en un clic. Vos données restent en Europe.
Et dans votre entreprise, l’IA en est où ?
Un expert Oriq analyse gratuitement vos besoins et vous rend un avis clair sous 24 heures. Nous formons aussi vos équipes, dans vos locaux : ateliers, formations métier, conférences.
Demander mon audit gratuitGratuit, sans engagement · Formations et conférences IA · Données hébergées en Europe