May 8, 2026

用于翻译的 OpenAI 模型:GPT-4.1、GPT-4.5、GPT-4o,以及未来展望

本文于2025年4月首次发表时,比较了三款当时活跃的OpenAI模型。几个月内,他们中就有两人退休了。GPT-4.5 已于 2025 年 7 月 14 日从 API 中弃用,并于 2025 年 8 月从 ChatGPT 中移除。GPT-4o 紧随其后:于 2025 年 8 月 7 日随 GPT-5 的发布,从大多数 ChatGPT 等级中退役。OpenAI 此后发布了 GPT-5、GPT-5.2(2026 年 1 月)和 GPT-5.5(2026 年 4 月)。

本文已更新,以反映当前的 OpenAI 模型格局,解释每个 GPT-4 模型在翻译方面实际提供的功能,记录当前可用的模型,并解释转向 GPT-5 对翻译工作的实际意义。

GPT-4 模型家族:各版本提供的功能

三个不同的OpenAI模型定义了GPT-4时代的翻译::

GPT-4o于2024年5月推出,是一个处理文本、语音和图像输入的多模态模型。在2024年的大部分时间里,它都是OpenAI的旗舰模型,在 MachineTranslation.com 的内部翻译基准测试中得分 94.2/100——是所有被测单个模型中的最高分之一。对于高资源的欧洲和东亚语言对,GPT-4o 生成了语境贴切、自然流畅的输出。它在翻译方面的具体局限性与所有单一模型工具相同:它只提供一个输出结果,没有质量信号,没有交叉验证,用户也无法评估结果的可信度。

GPT-4.5于2025年2月作为一个大型研究预览模型发布,OpenAI将其描述为当时在计算量方面他们“有史以来最大”的模型。它主要使用无监督学习进行训练,这提高了模式识别和创造性连贯性。在翻译方面,GPT-4.5 生成的输出具有很强的创造性和鲜明的语气特质。它的实际局限在于成本:发布时每百万输入词元 75 美元,是 GPT-4o 的 30 倍。OpenAI 自己得出结论,GPT-4.1 以低得多的成本提供了相似或更优的性能,这加速了弃用决定。

GPT-4.1 于 2025 年 4 月发布,其定位是作为 GPT-4o 的一个高性价比升级版,在指令遵循、编码和长上下文理解方面取得了重大进展。在翻译方面,GPT-4.1 相较于 GPT-4o 的关键改进在于其指令遵循能力:在处理长文档时,它能更可靠地遵循明确的翻译要求(术语限制、语域规范、格式规则)。在 Intento 的《2025 年翻译自动化状况》 中,GPT-4.1 在单代理解决方案中领先,在 11 个语言对中,有 7 个表现最佳 — 是本次评估中表现最强的单一模型。截至 2026 年 5 月,GPT-4.1 的 API 仍处于活跃使用状态。

GPT-4.5 和 GPT-4o 怎么样了

GPT-4.5 时间线:

  • 2025 年 2 月 27 日:GPT-4.5 通过 ChatGPT Plus 和 Pro 以及 OpenAI API 发布
  • 2025年4月14日:OpenAI 宣布将从 API 中弃用 GPT-4.5
  • 2025年7月14日:GPT-4.5 从 API 中完全移除
  • 2025年8月7日:随着 GPT-5 的发布,GPT-4.5 已从 ChatGPT Plus 和 Teams 中移除;Pro 用户可在“旧版模型”下继续访问

在所有 OpenAI 的商业模型中,GPT-4.5 的活跃生命周期最短,在 API 中仅存在了大约四个月。OpenAI表示,主要原因是GPT-4.1能以低得多的成本和延迟达到同等性能。

GPT-4o时间线:

  • 2024年5月:GPT-4o作为OpenAI的主要多模态模型推出
  • 2025年8月7日:随着GPT-5的发布,GPT-4o从大多数ChatGPT服务层级中退出;部分版本在API中继续提供
  • 2026年2月:GPT-4o 的 2024-05-13 和 2024-08-06 版本已从 Azure OpenAI 退役;剩余用户已自动升级至 GPT-5.1

如今,对于大多数用户而言,在使用 ChatGPT 或 OpenAI 的标准 API 时,他们收到的模型已不再是 GPT-4o。它实际上是一个旧版模型。

这对引用这些模型的内容意味着:‎任何围绕 GPT-4.5 构建的文章、工作流程或评估都需要更新。‎2024年的GPT-4o基准测试可作为有用的历史参考点,但不应被视为当前能力的比较。GPT-4.1 仍然是当前 API 工作的 GPT-4 系列相关参考模型。

2026 年的 GPT-4.1:唯一留存的 GPT-4 模型

截至 2026 年 5 月,GPT-4.1 是 GPT-4 系列中唯一拥有活跃、受维护的 API 支持的模型。与翻译相关的关键特征:

基准位置。‎在 Intento 2025 年的评估中,GPT-4.1 在单代理解决方案中领先 — 在 11 个语言对中取得了 7 项“最佳”表现。它出现在英语到阿拉伯语、英语到西班牙语、英语到法语、英语到意大利语、英语到韩语、英语到荷兰语、英语到葡萄牙语、英语到乌克兰语以及英语到中文(自动评估)的“最佳”类别中。在人工语言质量评估中,它在阿拉伯语、法语、意大利语、日语、韩语、荷兰语、葡萄牙语、乌克兰语和中文方面领先于 OpenAI 的模型。

指令遵循。‎与GPT-4o相比,GPT-4.1在指令遵循方面取得了可衡量的提升。对于有明确要求(仅使用这些术语,保持这种语域,保留此格式)的翻译任务,GPT-4.1 在长文档中能更一致地遵循这些要求。

上下文窗口。‎GPT-4.1 支持1M词元的上下文窗口,可单遍处理超长文档,无需分块。与整篇文档处理相比,分段处理的文档术语不一致率高出28%。来源:MachineTranslation.com 内部数据.

API 成本。‎GPT-4.1 比 GPT-4.5 便宜得多:$2/million input tokens and $每百万输出令牌 8 美元,使其适用于大批量翻译工作流程。

GPT-5 及未来:翻译领域的变化

GPT-5 于 2025 年 8 月 7 日发布,它是一个统一的系统,在单个模型中结合了快速响应和深度推理,并根据查询的复杂性在两者之间自动路由。在翻译方面,最具实际意义的变化是:

幻觉率大幅降低,OpenAI 的数据显示,GPT-5 的回答包含事实错误的可能性比 GPT-4o 低了约 45%(使用网络搜索,针对匿名提示)。对于翻译而言,这意味着在涉及专有名词、技术术语和专名实体的内容中,语义错误会更少。

扩展的上下文窗口,通过 API 支持 40 万 token,超过 100 万 token 的上下文窗口正在开发中。这超过了GPT-4.1本已很大的窗口,进一步减少了对长文档进行分块的需求。

改进了多语言基准测试,GPT-5在MMLU上测试了15种语言,在所有语言上都优于GPT-4o。在专门用于翻译的工作流程中,企业报告称其在处理临床和技术语境中的歧义时表现更佳。

GPT-5.2(2026年1月)在其发布说明中专门提到了翻译方面的改进:“在技术写作和翻译方面有明显改进。”GPT-5.2 Instant 被描述为专为包括翻译在内的日常知识工作任务而设计。

GPT-5.5(2026年4月)是截至本次更新时 OpenAI 最领先的模型。

具体到翻译领域,GPT-5 时代最重要的启示并非选择哪个版本,而是任何单一模型的输出,无论其能力多强,仍然会产生其自身无法检测到的错误。GPT-5 显著降低了幻觉率。它不会消除特定于模型的错误。

OpenAI 模型如何融入 MachineTranslation.com

ChatGPT(OpenAI 的模型)是 MachineTranslation.com SMART 系统中的 22 个人工智能模型之一。SMART 同时运行所有22个模型,并返回多数模型达成共识的输出。

从GPT-4到GPT-5的过渡对SMART用户意味着什么:随着OpenAI发布更强大的模型,其模型对共识的贡献也在不断提高。用户无需跟踪或手动选择 GPT 的不同版本,SMART 系统会自动将当前的 OpenAI 模型纳入其 22 个模型的共识中。

在 MachineTranslation.com 的内部基准测试中,单个顶级模型(包括得分为 94.2/100 的 GPT-4o)的表现一直被共识输出所超越,后者的得分达到了 98.5/100。单个模型与共识的差距,反映了模型特有的误差在输出前被多数否决。无论是否由GPT生成,这种差距都存在。来源:MachineTranslation.com 内部基准测试和 WMT24 通用机器翻译研究结果。

从单一引擎翻译切换到 SMART 的用户,在验证和纠正输出内容上花费的时间减少了 27%。来源:MachineTranslation.com 内部数据。

对于高风险内容(法律文件、监管文件、临床材料),人工验证会将 SMART 共识结果交由同一平台内经过认证的专业审校员进行审核,并保证 100% 的准确性。无需外部机构。

在 MachineTranslation.com 使用 ChatGPT 和其他 21 种 AI 模型进行翻译 — 免费,无需注册。

常见问题

1.GPT-4.5还可用吗?

GPT-4.5已于2025年7月14日从OpenAI API中弃用,并在GPT-5于2025年8月7日推出时从大多数ChatGPT套餐中移除。Pro 用户仍然可以在“旧版模型”下访问它。对于大多数开发者和用户来说,GPT-4.5 不再是活动模型。

2.GPT-4o 还能用吗?

随着 2025 年 8 月 GPT-5 的发布,GPT-4o 已从大多数 ChatGPT 服务层级中退役。一些 API 版本在 2026 年初之前仍然可用,但正在被 GPT-5.1 取代。对于当前的翻译工作,GPT-4.1 和 GPT-5 是相关的 OpenAI 模型。

3.‎2026年,哪款 OpenAI 模型最适合用于翻译?

在 GPT-4 系列中,GPT-4.1 在 Intento 的 2025 年评估中领先,在 11 个语言对中获得了最多的“最佳”表现。GPT-5 和 GPT-5.2 是当前的旗舰模型,具有增强的多语言能力和更低的幻觉率。对于专业翻译工作流程而言,选择哪款 OpenAI 模型,其重要性次于您是使用单一模型还是共识系统。

4.GPT-4.1 在翻译方面相较于 GPT-4o 有什么优势?

GPT-4.1 已记录在案的主要优势是其指令遵循能力,在长文档翻译中,它能更可靠地遵守明确的翻译要求(术语限制、语域规范、格式规则)。它还具有1M token的上下文窗口,并且API成本低于GPT-4o。

5.相比 GPT-4o,GPT-5 在翻译方面有何提升?

相比 GPT-4o,GPT-5 将事实性错误减少了约 45%(根据 OpenAI 自己的评估,此为启用网络搜索时的结果)。它具有更大的上下文窗口(通过 API 可达 40 万词元)、改进的多语言覆盖范围和统一的推理能力。在临床和技术翻译中,企业报告称对模糊术语的处理能力更强。

6.ChatGPT是最好的翻译AI吗?

ChatGPT(OpenAI的模型)是用于翻译的最强大的独立模型之一,GPT-4.1在Intento的2025年单代理评估中处于领先地位。但每个模型,包括OpenAI的模型,都会产生其自身无法检测的输出错误。MachineTranslation.com 的 SMART 同时运行 ChatGPT 和其他 21 个模型,并返回多数模型认同的输出结果,得分达到 98.5/100,而表现最佳的单个 OpenAI 模型得分为 94.2/100。

7.MachineTranslation.com 是否使用最新的 OpenAI 模型?

MachineTranslation.com 的 SMART 系统将 ChatGPT 作为 22 个模型之一。该平台集成了 OpenAI 的当前模型版本——作为 22 模型共识的一部分,用户可自动受益于每一代模型的改进,无需追踪哪个 GPT 版本是最新版本。‎