May 8, 2026
Lorsque cet article a été publié pour la première fois en avril 2025, il comparait trois modèles actifs d'OpenAI. En quelques mois, deux d'entre eux ont été mis à la retraite. GPT-4.5 a été déprécié de l'API le 14 juillet 2025 et retiré de ChatGPT en août 2025. GPT-4o a suivi : retiré de la plupart des paliers de ChatGPT avec le lancement de GPT-5 le 7 août 2025. OpenAI a depuis lancé GPT-5, GPT-5.2 (janvier 2026) et GPT-5.5 (avril 2026).
Cet article a été mis à jour pour refléter le paysage actuel des modèles d'OpenAI, expliquer ce que chaque modèle GPT-4 offrait réellement pour la traduction, documenter ce qui est maintenant disponible et expliquer ce que le passage à GPT-5 signifie en pratique pour le travail de traduction.
Trois modèles distincts d'OpenAI ont défini l'ère GPT-4 pour la traduction :
GPT-4o lancé en mai 2024 en tant que modèle multimodal gérant les entrées de texte, de voix et d'images. C'était le modèle phare d'OpenAI pendant la majeure partie de 2024, obtenant un score de 94,2/100 dans les benchmarks de traduction internes de MachineTranslation.com — l'un des plus élevés de tous les modèles individuels mesurés. Pour les paires de langues européennes et est-asiatiques à ressources élevées, GPT-4o a produit des résultats contextuellement solides et à la sonorité naturelle. Sa limitation spécifique à la traduction était la même que pour tous les outils à modèle unique : il fournissait un seul résultat, sans indicateur de qualité, sans vérification croisée et sans aucun moyen pour l'utilisateur d'évaluer la fiabilité du résultat.

GPT-4.5 lancé en février 2025 en tant que grand modèle de recherche en préversion, OpenAI l'a décrit comme son « plus grand modèle jamais créé » en termes de puissance de calcul à l'époque. Il a été principalement entraîné grâce à l'apprentissage non supervisé, ce qui a amélioré la reconnaissance de formes et la cohérence créative. Pour la traduction, GPT-4.5 a produit un résultat doté de fortes qualités créatives et tonales. Sa limitation pratique était le coût : à 75 $ par million de jetons d'entrée à son lancement, il était 30 fois plus cher que GPT-4o. OpenAI a elle-même conclu que GPT-4.1 offrait des performances similaires ou améliorées à un coût bien inférieur, ce qui a accéléré la décision de dépréciation.
GPT-4.1 a été lancé en avril 2025, positionné comme une mise à niveau rentable par rapport à GPT-4o avec des gains majeurs dans le suivi des instructions, le codage et la compréhension de contextes longs. Pour la traduction, la principale amélioration de GPT-4.1 par rapport à GPT-4o a été le respect des consignes : il suit de manière plus fiable les exigences de traduction explicites (contraintes terminologiques, spécifications de registre, règles de mise en forme) sur l'ensemble des documents longs. Dans le rapport State of Translation Automation 2025 d'Intento, GPT-4.1 était en tête des solutions à agent unique avec les meilleures performances dans 7 des 11 paires de langues — la plus forte performance pour un modèle unique de l'évaluation. GPT-4.1 reste en utilisation active de l'API en mai 2026.
Chronologie de GPT-4.5 :
GPT-4.5 a eu la durée de vie active la plus courte de tous les modèles commerciaux d'OpenAI, soit environ quatre mois dans l'API. OpenAI a cité comme raison principale les performances équivalentes de GPT-4.1 pour un coût et une latence bien plus faibles.
Chronologie de GPT-4o :
Pour la plupart des utilisateurs aujourd'hui, GPT-4o n'est plus le modèle qu'ils reçoivent lorsqu'ils utilisent ChatGPT ou l'API standard d'OpenAI. Il s'agit effectivement d'un modèle hérité.
Voici ce que cela signifie pour le contenu faisant référence à ces modèles : Tout article, flux de travail ou évaluation basé sur GPT-4.5 doit être mis à jour. Les benchmarks de GPT-4o de 2024 restent utiles comme points de référence historiques, mais ne devraient pas être considérés comme des comparaisons de capacités actuelles. GPT-4.1 reste la référence pertinente de la famille GPT-4 pour les travaux actuels sur l'API.
À partir de mai 2026, GPT-4.1 est le seul modèle de la famille GPT-4 avec un support API actif et maintenu. Caractéristiques principales pertinentes pour la traduction:
Position de référence. Dans l'évaluation 2025 d'Intento, GPT-4.1 est arrivé en tête des solutions à agent unique — 7 meilleures performances sur 11 paires de langues. Il apparaît dans la catégorie « meilleur » pour l'anglais vers l'arabe, l'anglais vers l'espagnol, l'anglais vers le français, l'anglais vers l'italien, l'anglais vers le coréen, l'anglais vers le néerlandais, l'anglais vers le portugais, l'anglais vers l'ukrainien et l'anglais vers le chinois (évaluation automatisée). Lors de l'évaluation LQA humaine, il est en tête parmi les modèles d'OpenAI pour l'arabe, le français, l'italien, le japonais, le coréen, le néerlandais, le portugais, l'ukrainien et le chinois.
Suivi des instructions. L'amélioration mesurable de GPT-4.1 par rapport à GPT-4o est le respect des instructions. Pour les tâches de traduction ayant des exigences explicites (utiliser uniquement ces termes, maintenir ce registre, préserver cette mise en forme), GPT-4.1 les suit de manière plus cohérente sur de longs documents.
Fenêtre de contexte. GPT-4.1 prend en charge une fenêtre de contexte de 1 million de tokens, ce qui permet de traiter de très longs documents en un seul passage sans découpage. Les documents traités par fragments présentent un taux d'incohérence terminologique 28% plus élevé par rapport au traitement intégral. Source : Données internes de MachineTranslation.com.
Coût de l'API. GPT-4.1 est nettement moins cher que ne l'était GPT-4.5 : $2/million input tokens and $8/million de jetons de sortie, ce qui le rend pratique pour les flux de travail de traduction à grand volume.
GPT-5 a été lancé le 7 août 2025 en tant que système unifié qui combine une réponse rapide et un raisonnement approfondi dans un seul modèle, basculant automatiquement entre les deux en fonction de la complexité de la requête. Pour la traduction, les changements les plus pertinents sur le plan pratique sont :
Un taux d'hallucination considérablement réduit : les données d'OpenAI montrent que les réponses de GPT-5 sont environ 45 % moins susceptibles de contenir des erreurs factuelles que celles de GPT-4o (avec recherche web, sur des prompts anonymisés). Pour la traduction, cela signifie moins d'erreurs sémantiques dans les contenus impliquant des noms propres, de la terminologie technique et des entités nommées.
Fenêtre de contexte élargie, 400K tokens via l'API, avec une fenêtre de contexte de plus de 1M de tokens en cours de développement. Cela dépasse la fenêtre de contexte déjà large de GPT-4.1, réduisant encore plus le besoin de fractionner les documents longs.
Amélioration des benchmarks multilingues, GPT-5 testé dans 15 langues sur MMLU, surpassant GPT-4o dans toutes. Dans les flux de travail spécifiques à la traduction, les entreprises signalent une meilleure gestion de l'ambiguïté dans les contextes cliniques et techniques.
GPT-5.2 (janvier 2026) a spécifiquement mentionné des améliorations en matière de traduction dans ses notes de version : « des améliorations nettes en rédaction technique et en traduction. » GPT-5.2 Instant est décrit comme étant conçu pour les tâches de travail intellectuel quotidiennes, y compris la traduction.
GPT-5.5 (avril 2026) est le modèle OpenAI de pointe actuel à la date de cette mise à jour.
Pour la traduction en particulier, l'implication la plus importante de l'ère GPT-5 n'est pas de savoir quelle version choisir — c'est que n'importe quel résultat d'un modèle unique, quelle que soit la capacité du modèle, produit toujours des erreurs qu'il ne peut pas détecter dans ses propres résultats. GPT-5 réduit de manière significative le taux d'hallucination. Cela n'élimine pas les erreurs spécifiques au modèle.
ChatGPT (le modèle d'OpenAI) est l'un des 22 modèles d'IA au sein du système SMART de MachineTranslation.com. SMART exécute les 22 modèles simultanément et renvoie le résultat sur lequel la majorité s'accorde.
Ce que la transition de GPT-4 à GPT-5 signifie pour les utilisateurs de SMART : La contribution des modèles d'OpenAI au consensus continue de s'améliorer à mesure qu'OpenAI publie des modèles plus performants. Les utilisateurs n'ont pas besoin de suivre ou de sélectionner manuellement entre les générations de GPT, le système SMART intègre automatiquement le modèle OpenAI actuel dans le cadre du consensus de 22 modèles.
Dans les benchmarks internes de MachineTranslation.com, les meilleurs modèles individuels (y compris GPT-4o à 94,2/100) sont systématiquement surpassés par le résultat du consensus, qui atteint 98,5/100. L'écart entre un modèle individuel et le consensus reflète la mise en minorité des erreurs spécifiques au modèle avant qu'elles n'atteignent la sortie. Cet écart existe indépendamment de la génération par GPT. Source : Benchmarks internes de MachineTranslation.com et résultats de la Traduction Automatique Générale de WMT24.

Les utilisateurs qui sont passés de la traduction mono-moteur à SMART ont passé 27 % de temps en moins à vérifier et à corriger les résultats. Source : Données internes de MachineTranslation.com.
Pour les contenus à fort enjeu (documents juridiques, dossiers réglementaires, matériel clinique), la Vérification Humaine fait remonter le consensus SMART à un réviseur professionnel certifié au sein de la même plateforme, avec une garantie d'exactitude de 100 %. Aucune agence externe requise.
Traduisez avec ChatGPT et 21 autres modèles d'IA sur MachineTranslation.com — gratuit, aucune inscription requise.
GPT-4.5 a été déprécié de l'API d'OpenAI le 14 juillet 2025, et retiré de la plupart des paliers ChatGPT lors du lancement de GPT-5 le 7 août 2025. Les utilisateurs Pro peuvent toujours y accéder sous « Anciens modèles ». Pour la plupart des développeurs et des utilisateurs, GPT-4.5 n'est plus le modèle actif.
GPT-4o a été retiré de la plupart des forfaits ChatGPT lors du lancement de GPT-5 en août 2025. Certaines versions de l'API sont restées disponibles jusqu'à début 2026, mais sont remplacées par GPT-5.1. Pour les travaux de traduction actuels, GPT-4.1 et GPT-5 sont les modèles OpenAI pertinents.
Parmi la famille GPT-4, GPT-4.1 était en tête de l'évaluation 2025 d'Intento avec le plus grand nombre de « meilleures » performances sur 11 paires de langues. GPT-5 et GPT-5.2 sont les modèles phares actuels, dotés de capacités multilingues améliorées et de taux d'hallucination plus faibles. Pour les flux de travail de traduction professionnels, le choix du modèle OpenAI a moins d'incidence que le fait d'utiliser un modèle unique ou un système de consensus.
Le principal avantage documenté de GPT-4.1 est sa capacité à suivre les instructions, il se conforme de manière plus fiable aux exigences de traduction explicites (contraintes terminologiques, spécifications de registre, règles de formatage) dans des documents longs. Il dispose également d'une fenêtre de contexte de 1M de jetons et d'un coût d'API plus faible que GPT-4o.
GPT-5 réduit les erreurs factuelles d'environ 45 % par rapport à GPT-4o (avec la recherche web, selon la propre évaluation d'OpenAI). Il dispose d'une fenêtre de contexte plus grande (400 000 jetons via l'API), d'une couverture multilingue améliorée et d'un raisonnement unifié. En matière de traduction clinique et technique, les entreprises signalent une meilleure gestion de la terminologie ambiguë.
ChatGPT (les modèles d'OpenAI) fait partie des modèles individuels les plus performants pour la traduction, GPT-4.1 est en tête de l'évaluation mono-agent 2025 d'Intento. Mais chaque modèle, y compris celui d'OpenAI, produit des erreurs qu'il ne peut pas détecter dans sa propre production. SMART de MachineTranslation.com exécute ChatGPT aux côtés de 21 autres modèles et renvoie le résultat sur lequel la majorité s'accorde, atteignant 98,5/100 contre 94,2/100 pour le meilleur modèle individuel d'OpenAI.
Le système SMART de MachineTranslation.com inclut ChatGPT comme l'un des 22 modèles. La plateforme intègre la version actuelle du modèle OpenAI — les utilisateurs bénéficient automatiquement des améliorations de chaque génération dans le cadre du consensus de 22 modèles, sans avoir à suivre quelle est la version actuelle de GPT.