May 8, 2026
Lorsque cet article a été publié pour la première fois en avril 2025, il comparait trois modèles actifs d’OpenAI. En quelques mois, deux d'entre eux ont pris leur retraite. GPT-4.5 a été déprécié de l'API le 14 juillet 2025 et retiré de ChatGPT en août 2025. GPT-4o a suivi : retiré de la plupart des forfaits ChatGPT avec le lancement de GPT-5 le 7 août 2025. OpenAI a depuis lancé GPT-5, GPT-5.2 (janvier 2026) et GPT-5.5 (avril 2026).
Cet article a été mis à jour pour refléter le paysage actuel des modèles d'OpenAI, expliquer ce que chaque modèle GPT-4 offrait réellement pour la traduction, documenter ce qui est maintenant disponible et expliquer ce que le passage à GPT-5 signifie en pratique pour le travail de traduction.
Trois modèles distincts d'OpenAI ont défini l'ère GPT-4 pour la traduction :
GPT-4o a été lancé en mai 2024 en tant que modèle multimodal traitant les entrées de texte, de voix et d'images. C'était le modèle phare d'OpenAI pendant la majeure partie de 2024, obtenant un score de 94,2/100 dans les bancs d'essai de traduction internes de MachineTranslation.com — l'un des plus élevés de tous les modèles individuels mesurés. Pour les paires de langues européennes et est-asiatiques riches en ressources, GPT-4o a produit un résultat contextuellement solide et naturel. Sa limite, spécifiquement pour la traduction, était la même que celle de tous les outils à modèle unique : il ne fournissait qu'un seul résultat, sans indicateur de qualité, sans contre-vérification et sans moyen pour l'utilisateur d'évaluer la fiabilité du résultat.

GPT-4.5, lancé en février 2025 en tant que grand modèle de recherche en préversion, a été décrit par OpenAI comme son modèle « le plus grand jamais conçu » en termes de puissance de calcul à l'époque. Il a été principalement entraîné à l'aide de l'apprentissage non supervisé, ce qui a amélioré la reconnaissance de motifs et la cohérence créative. Pour la traduction, GPT-4.5 a produit des résultats dotés de fortes qualités créatives et tonales. Sa limitation pratique était le coût : à 75 $ par million de jetons d'entrée à son lancement, il était 30× plus cher que GPT-4o. OpenAI a elle-même conclu que GPT-4.1 offrait des performances similaires ou améliorées à un coût bien moindre, ce qui a accéléré la décision de dépréciation.
GPT-4.1 a été lancé en avril 2025, positionné comme une mise à niveau rentable par rapport à GPT-4o avec des gains importants dans le suivi des instructions, le codage et la compréhension de contextes longs. Pour la traduction, la principale amélioration de GPT-4.1 par rapport à GPT-4o a été la conformité aux instructions : il respecte les exigences de traduction explicites (contraintes terminologiques, spécifications de registre, règles de mise en forme) de manière plus fiable dans les documents longs. Dans State of Translation Automation 2025 d'Intento, GPT-4.1 était en tête des solutions à agent unique avec les meilleures performances dans 7 paires de langues sur 11 — la plus forte performance pour un modèle unique lors de l'évaluation. GPT-4.1 est toujours activement utilisé via l'API en mai 2026.
Chronologie de GPT-4.5 :
GPT-4.5 a eu la plus courte durée de vie active de tous les modèles commerciaux d'OpenAI, soit environ quatre mois dans l'API. OpenAI a cité la performance équivalente de GPT-4.1 à un coût et une latence beaucoup plus faibles comme raison principale.
Chronologie de GPT-4o :
Pour la plupart des utilisateurs aujourd'hui, GPT-4o n'est plus le modèle qu'ils reçoivent lorsqu'ils utilisent ChatGPT ou l'API standard d'OpenAI. Il s'agit en fait d'un ancien modèle.
Voici ce que cela signifie pour le contenu qui fait référence à ces modèles : Tout article, flux de travail ou évaluation basé sur GPT-4.5 doit être mis à jour. Les benchmarks de GPT-4o de 2024 restent utiles comme points de référence historiques, mais ne devraient pas être considérés comme des comparaisons des capacités actuelles. GPT-4.1 demeure la référence pertinente de la famille GPT-4 pour les travaux actuels sur l'API.
En mai 2026, GPT-4.1 est le seul modèle de la famille GPT-4 qui bénéficie d'un soutien API actif et maintenu. Caractéristiques clés pertinentes pour la traduction :
Poste de référence. Dans l'évaluation de 2025 d'Intento, GPT-4.1 était en tête des solutions à agent unique — 7 « meilleures » performances sur 11 paires de langues. Il figure dans la catégorie « meilleur » pour les traductions de l'anglais vers l'arabe, l'espagnol, le français, l'italien, le coréen, le néerlandais, le portugais, l'ukrainien et le chinois (évaluation automatisée). Dans l'évaluation LQA humaine, il est en tête parmi les modèles d'OpenAI pour l'arabe, le français, l'italien, le japonais, le coréen, le néerlandais, le portugais, l'ukrainien et le chinois.
Suivi des instructions. L'amélioration mesurable de GPT-4.1 par rapport à GPT-4o est le respect des consignes. Pour les tâches de traduction avec des exigences explicites (utiliser uniquement ces termes, maintenir ce registre, conserver cette mise en forme), GPT-4.1 les suit de manière plus cohérente dans de longs documents.
Fenêtre de contexte. GPT-4.1 prend en charge une fenêtre de contexte d’un million de tokens, ce qui permet de traiter de très longs documents en une seule passe sans découpage. Les documents traités en fragments présentent un taux d'incohérence terminologique 28 % plus élevé comparativement au traitement de documents complets. Source : Données internes de MachineTranslation.com.
Coût de l'API. GPT-4.1 est significativement moins cher que ne l'était GPT-4.5 : $2/million input tokens and $8 $ par million de jetons de sortie, ce qui le rend pratique pour les flux de traduction à grand volume.
GPT-5 a été lancé le 7 août 2025 en tant que système unifié qui combine une réponse rapide et un raisonnement approfondi dans un seul modèle, effectuant un routage automatique entre les deux en fonction de la complexité de la requête. Pour la traduction, les changements les plus pertinents sur le plan pratique sont :
Un taux d'hallucination considérablement réduit, les données d'OpenAI montrant que les réponses de GPT-5 sont environ 45 % moins susceptibles de contenir des erreurs factuelles que celles de GPT-4o (avec la recherche web, sur des requêtes anonymisées). Pour la traduction, cela signifie moins d'erreurs sémantiques dans le contenu impliquant des noms propres, de la terminologie technique et des entités nommées.
Fenêtre de contexte élargie, 400 000 jetons via l'API, avec une fenêtre de contexte de plus d'un million de jetons en cours de développement. Cela dépasse la fenêtre déjà grande de GPT-4.1, ce qui réduit davantage le besoin de fragmenter les longs documents.
Indices de référence multilingues améliorés, GPT-5 testé dans 15 langues sur le MMLU, surpassant GPT-4o dans toutes. Dans les flux de travail spécifiques à la traduction, les entreprises signalent une meilleure gestion de l'ambiguïté dans les contextes cliniques et techniques.
GPT-5.2 (janvier 2026) a spécifiquement souligné les améliorations en matière de traduction dans ses notes de version : « des améliorations nettes en rédaction technique et en traduction ». GPT-5.2 Instant est décrit comme étant conçu pour les tâches de travail intellectuel quotidiennes, y compris la traduction.
GPT-5.5 (avril 2026) est le principal modèle d'OpenAI au moment de cette mise à jour.
En matière de traduction, la plus importante implication de l'ère GPT-5 n'est pas de savoir quelle version choisir — c'est plutôt que le résultat d'un modèle unique, aussi performant soit-il, produit toujours des erreurs qu'il est incapable de détecter dans son propre résultat. GPT-5 réduit le taux d'hallucination de manière significative. Cela n'élimine pas les erreurs propres au modèle.
ChatGPT (le modèle d'OpenAI) est l'un des 22 modèles d'IA du système SMART de MachineTranslation.com. SMART exécute les 22 modèles simultanément et renvoie le résultat sur lequel la majorité s'entend.
Ce que la transition de GPT-4 à GPT-5 signifie pour les utilisateurs de SMART : La contribution des modèles d'OpenAI au consensus continue de s'améliorer à mesure qu'OpenAI publie des modèles plus performants. Les utilisateurs n'ont pas besoin de suivre ou de sélectionner manuellement les générations de GPT, le système SMART intègre automatiquement le modèle OpenAI actuel dans le cadre du consensus de 22 modèles.
Dans les tests de performance internes de MachineTranslation.com, les modèles individuels de premier plan (y compris GPT-4o à 94,2/100) sont constamment surpassés par le résultat consensuel, qui atteint 98,5/100. L'écart entre un modèle individuel et le consensus reflète le fait que les erreurs propres au modèle sont mises en minorité avant d'atteindre la sortie. Cet écart existe indépendamment de la génération par GPT. Source : Benchmarks internes de MachineTranslation.com et résultats généraux de la traduction automatique du WMT24.

Les utilisateurs qui sont passés de la traduction monomoteur à SMART ont consacré 27 % moins de temps à la vérification et à la correction des résultats. Source : Données internes de MachineTranslation.com.
Pour le contenu à enjeux élevés (documents juridiques, dossiers réglementaires, documents cliniques), la Vérification humaine transmet le consensus SMART à un réviseur professionnel certifié au sein de la même plateforme, avec une garantie d’exactitude de 100 %. Aucune agence externe requise.
Traduisez avec ChatGPT et 21 autres modèles d'IA sur MachineTranslation.com — gratuit, sans inscription.
GPT-4.5 a été déprécié de l'API d'OpenAI le 14 juillet 2025, et retiré de la plupart des niveaux de ChatGPT lors du lancement de GPT-5 le 7 août 2025. Les utilisateurs Pro peuvent toujours y accéder sous « Anciens modèles ». Pour la plupart des développeurs et des utilisateurs, GPT-4.5 n'est plus le modèle actif.
GPT-4o a été retiré de la plupart des forfaits ChatGPT avec le lancement de GPT-5 en août 2025. Certaines versions de l'API sont demeurées disponibles jusqu'au début de 2026, mais sont en cours de remplacement par GPT-5.1. Pour les travaux de traduction actuels, GPT-4.1 et GPT-5 sont les modèles OpenAI pertinents.
Parmi la famille GPT-4, GPT-4.1 s'est classé en tête de l'évaluation 2025 d'Intento avec le plus grand nombre de « meilleures » performances sur 11 paires de langues. GPT-5 et GPT-5.2 sont les modèles phares actuels, qui offrent des capacités multilingues améliorées et des taux d'hallucination réduits. Pour les flux de travail de traduction professionnelle, le choix du modèle OpenAI a moins de conséquences que l'utilisation d'un modèle unique ou d'un système de consensus.
Le principal avantage documenté de GPT-4.1 est le respect des consignes, il se conforme de manière plus fiable aux exigences de traduction explicites (contraintes terminologiques, spécifications de registre, règles de formatage) dans de longs documents. Il dispose également d'une fenêtre de contexte de 1 million de jetons et d'un coût d'API inférieur à celui de GPT-4o.
GPT-5 réduit les erreurs factuelles d'environ 45 % par rapport à GPT-4o (avec la recherche web, selon la propre évaluation d'OpenAI). Il possède une fenêtre de contexte plus grande (400K jetons via l'API), une meilleure couverture multilingue et un raisonnement unifié. En traduction clinique et technique, les entreprises rapportent une meilleure gestion de la terminologie ambiguë.
ChatGPT (les modèles d'OpenAI) est l'un des modèles individuels les plus performants pour la traduction, et GPT-4.1 mène l'évaluation 2025 d'Intento pour les agents uniques. Mais chaque modèle, y compris celui d'OpenAI, produit des erreurs qu'il est incapable de détecter dans sa propre production. Le système SMART de MachineTranslation.com exécute ChatGPT parallèlement à 21 autres modèles et fournit le résultat sur lequel la majorité s'entend, atteignant 98,5/100 contre 94,2/100 pour le meilleur modèle individuel d'OpenAI.
Le système SMART de MachineTranslation.com inclut ChatGPT comme l'un des 22 modèles. La plateforme intègre la version actuelle du modèle d’OpenAI — les utilisateurs bénéficient automatiquement des améliorations de chaque génération dans le cadre du consensus de 22 modèles, sans avoir à suivre quelle version de GPT est la plus récente.