September 25, 2026
يفصل بين GPT-3 وGPT-4 وGPT-5 خمس سنوات وعدة أجيال من البنى المعمارية، لكن السؤال المفيد في الترجمة ليس "أيها الأذكى". بل هو أكثر تحديداً: ما الذي تغير تحديداً في كيفية تعامل هذه النماذج مع أجزاء اللغة التي لا تُترجم حرفياً، مثل التعبيرات الاصطلاحية والغموض والأسلوب؟ لقد حدث التحسن في مواضع محددة وفي نقاط معينة، ولم يسر في خط مستقيم من الأقدم إلى الأحدث.
أطلقت OpenAI نموذج GPT-3 في 2020، قبل وجود برنامج الاختبار الخاص بموقع MachineTranslation.com، لذا لا يوجد هنا أي معيار تقييمي خاص. إنها حقائق تاريخية موثقة وليست نتائج اختبارات داخلية. كان GPT-3 أول نموذج من نوعه قادراً على إنتاج نصوص بطلاقة وبأسلوب يحاكي الأسلوب البشري بلغات متعددة دون الحاجة إلى تدريب مخصص لمهمة بعينها، مما جعله إنجازاً حقيقياً. أما بالنسبة للترجمة تحديداً، فقد شكلت هذه الطلاقة نفسها خطراً حقيقياً: كان بإمكان GPT-3 إنتاج جملة تبدو واثقة ومتقنة الصياغة في اللغة الهدف لكنها تظل خاطئة، دون أن يظهر في المخرجات أي مؤشر ينبه بحدوث خطأ.
أُطلق GPT-4 في March 2023، وبدأت اختبارات النماذج الخاصة بموقع MachineTranslation.com مع هذا الجيل تقريباً. كان التحسن حقيقياً لكنه لم يكن متساوياً. عند اختبار العبارة الإنجليزية المبهمة "That's sick" باللغة اليابانية، كان GPT-4.1-nano هو النموذج الوحيد من بين ستة نماذج خضعت للاختبار الذي اختزل المعنى المزدوج المقصود في العبارة إلى تفسير واحد، بينما حافظت النماذج الخمسة الأخرى على الغموض الذي قصدته العبارة الأصلية. وكانت التعبيرات الاصطلاحية نقطة ضعف أكبر: فعند اختبار التعبير الاصطلاحي الإسباني "llevarse el gato al agua" على خمسة إصدارات من GPT في وقت واحد، أنتج النموذجان الأصغر GPT-4o-mini وGPT-4.1-nano الترجمة الحرفية الخاطئة نفسها، متجاهلين المعنى الاصطلاحي تماماً.
وظهر النمط نفسه في مواضع أخرى؛ فالمصطلح الألماني "ich verstehe nur Bahnhof"، عند اختباره على ثمانية إصدارات فرعية من GPT وClaude، تُرجم حرفياً وبشكل خاطئ بواسطة GPT-4o-mini تحديداً، في حين نجح نموذج أصغر وأحدث في الاختبار نفسه، وهو GPT-4.1-nano، في ترجمته بشكل صحيح. لم يكن جيل النموذج وحجمه متوافقين بأي شكل ثابت، وهو نمط تغطيه اختبارات إصدارات النماذج في MachineTranslation.com بمزيد من العمق.
قدمت OpenAI نموذج GPT-5 كنظام موحد يوجه الطلبات بين نموذج افتراضي سريع ونموذج استدلال أعمق بناءً على المهمة، وهو تغيير هيكلي مقارنة بتصميم النموذج المنفرد في GPT-4. وتفيد وثيقة GPT-5 System Card الخاصة بشركة OpenAI بأن المعدل العام للأخطاء الواقعية في النموذج أقل بنحو 45% مقارنة بنموذج GPT-4 وبنحو 80% مقارنة بنموذج GPT-3، وهو تحسن عام في الموثوقية يظهر تحديداً في الترجمة أيضاً. وتُظهر اختبارات MachineTranslation.com أوضح المكاسب في المجالات التي عانت فيها نماذج عصر GPT-4 أكثر من غيرها: ففي التعبير الاصطلاحي الإسباني ذاته الذي أخطأ فيه GPT-4o-mini وGPT-4.1-nano، توصل كل من GPT-5.4-mini وGPT-5.4 إلى ترجمات اصطلاحية صحيحة، حيث صاغها كل منهما بطريقة مختلفة قليلاً ولكن كلاهما استوعب المعنى الاصطلاحي ذاته.

لم تكن الفجوة بين الأجيال صعوداً مستمراً، بل تركزت بالكامل تقريباً في اللغة الاصطلاحية والمبهمة. أما في النصوص المباشرة، فإن أداء نماذج عصر GPT-4 وعصر GPT-5 يسجل نتائج متطابقة تقريباً.
| GPT-3 | GPT-4 | GPT-5 | |
|---|---|---|---|
| تاريخ الإصدار | 2020 | March 2023 | 2025، وحاليًا على GPT-5.4/5.5 |
| متاح اليوم | لا، تم إيقافه | عبر API فقط، تم إيقافه في ChatGPT | نعم، الجيل الحالي |
| التعامل مع التعبيرات الاصطلاحية | لم يختبره MachineTranslation.com (يسبق البرنامج) | غير متسق؛ أخطأ في عدة تعبيرات اصطلاحية تمامًا | تعامل بشكل صحيح مع التعبيرات الاصطلاحية ذاتها التي أخطأ فيها GPT-4 |
| نصوص الأعمال القياسية | لم يختبره MachineTranslation.com | قوي، وشبه متطابق مع النماذج اللاحقة | قوي، وشبه متطابق مع GPT-4 |
هذه النقطة الأخيرة مهمة: فاختبار منفصل لعبارة أعمال قياسية، "please confirm receipt of this document"، مترجمة إلى الألمانية، أسفر عن نتائج شبه متطابقة عبر كل النماذج المختبرة، بما في ذلك GPT-4o-mini ونماذج جيل GPT-5. وتقتصر فجوة الأجيال تحديدًا على اللغة المجازية والغامضة، وليست اختلافًا شاملاً في الجودة.
لا. عند اختبار تعبير اصطلاحي عبري عبر عائلات النماذج المختلفة، توصل كل من GPT-5.4-mini وGPT-5.4 إلى تفسيرين مختلفين وجزئيين للعبارة نفسها، ولم يكن أي منهما صحيحاً تماماً، بينما كان نموذج أقدم وغير ذي صلة أقرب إلى الصواب. فالنموذج الأحدث ليس بالضرورة هو الأكثر دقة، والنموذج الأكبر أو الأحدث إصداراً ليس تلقائياً هو الخيار الأكثر أماناً لجملة معينة.
تم إيقاف كل من GPT-3 وGPT-4 في ChatGPT؛ ولا يزال الوصول إلى GPT-4 متاحاً فقط عبر OpenAI API لعمليات التكامل الحالية. والجيل الحالي، GPT-5.4 وGPT-5.5، هو ما يعتمد عليه MachineTranslation.com اليوم، ويقدم أداءً تنافسياً مقارنة بالنماذج الحالية من المزودين الآخرين، وإن لم يكن أفضل بشكل موحد في كل زوج لغوي. ولإلقاء نظرة فاحصة على كيفية مقارنة الإصدارات الفرعية الحالية من GPT ببعضها البعض ومع نماذج مثل Claude وDeepSeek، راجع اختبار الإصدارات الفرعية وجهاً لوجه من MachineTranslation.com، والذي يتعمق أكثر مما يمكن لنظرة عامة على الأجيال تقديمه.
النتيجة الأكثر أهمية لبرنامج تعريب واسع النطاق ليست مجرد "تفوق GPT-5 على GPT-3"، بل هي أن إصدار النموذج، وليس عائلة النموذج فحسب، هو ما يحدد ما إذا كان تعبير اصطلاحي محدد أو عبارة غامضة ستُترجم بشكل صحيح، وهذا ينطبق على كل زوج لغوي، وليس فقط على الأمثلة القليلة الموضحة هنا. وتزداد أهمية ذلك في المحتوى الذي يعتمد على النبرة واللغة المجازية في المقام الأول، وخاصة النصوص التسويقية والمحتوى المُنشأ بواسطة المستخدمين، حيث يمكن لتعبير اصطلاحي واحد يُترجم حرفياً أن يغير المعنى الكامل لمنشور أو إعلان. وأي برنامج ينقل المحتوى إلى عشرات اللغات سيواجه هذا النوع من اللغة تحديداً في كل واحدة منها. تغطي سلسلة اختبارات الإصدارات الفرعية واختبارات مقارنة النماذج الكاملة من MachineTranslation.com هذا الأمر بمزيد من التفصيل. إن نهج المنصة المتمثل في تشغيل نماذج GPT الحالية جنباً إلى جنب مع أكثر من 20 نموذجاً آخر في كل ترجمة وُجد خصيصاً لأنه لا يوجد تاريخ إصدارات لأي نموذج بمفرده يمكن أن يشكل ضماناً موثوقاً بدرجة كافية.
تعامل GPT-3 مع النصوص المباشرة بشكل جيد إلى حد معقول، لكنه واجه صعوبة بالغة مع أي نصوص اصطلاحية أو غامضة. وقلص GPT-4 تلك الفجوة بشكل كبير، لكنه ظل يختزل بعض العبارات الغامضة بطبيعتها في معنى واحد بدلاً من الحفاظ على هذا الغموض. أما الإصدارات الفرعية اللاحقة من GPT-5 فقد تعاملت بنجاح مع التعبيرات الاصطلاحية التي ترجمتها نماذج عصر GPT-4 السابقة ترجمة حرفية وخاطئة.
لا. فقد وجدت اختبارات MachineTranslation.com حالات تفوق فيها إصدار فرعي أحدث وأصغر حجماً على إصدار أقدم وأكبر، كما أن الفجوة في الجودة بين الأجيال تميل إلى أن تكون مقتصرة على اللغة الاصطلاحية أو المجازية بدلاً من أن تكون تحسناً عاماً وشاملاً.
لا. لقد تم إيقاف كليهما في ChatGPT واستبدالهما بنماذج أحدث من جيل GPT-5. ولا يزال الوصول إلى GPT-4 متاحاً فقط عبر OpenAI API لعمليات التكامل الحالية، وليس كخيار موجه للمستخدمين في الوقت الحالي.
يشغل MachineTranslation.com النماذج الحالية من جيل GPT-5 (وهي GPT-5.4 وGPT-5.5، اعتماداً على باقة الاشتراك) جنباً إلى جنب مع أكثر من 20 نموذجاً آخر من نماذج الذكاء الاصطناعي في كل ترجمة، بدلاً من الاعتماد على GPT بمفرده.
تقدم نماذج جيل GPT-5 أداءً تنافسيًا، ولكنها ليست أفضل بشكل موحد من نماذج مثل Claude أو Gemini أو DeepSeek. وتتفوق نماذج مختلفة باختلاف أزواج اللغات وأنواع المحتوى، ولهذا السبب يختبرها MachineTranslation.com في مواجهة بعضها البعض مباشرةً بدلاً من اختيار نموذج بعينه كخيار افتراضي.