September 25, 2026
GPT-3, GPT-4 a GPT-5 delí päť rokov a niekoľko generácií architektúry, no užitočná otázka pre preklad neznie „ktorý z nich je najinteligentnejší“. Je konkrétnejšia: čo sa presne zmenilo v tom, ako tieto modely pracujú s časťami jazyka, ktoré sa neprekladajú doslovne – s vecami ako idiómy, dvojzmyselnosť a jazykový register? Zlepšenie nastalo na konkrétnych miestach, v konkrétnych bodoch a nešlo priamočiaro od starších k novším.
Spoločnosť OpenAI vydala GPT-3 v roku 2020, ešte predtým, než vznikol vlastný testovací program platformy MachineTranslation.com, takže nič z tohto nie je proprietárny benchmark. Ide o dobre zdokumentovanú históriu, nie o výsledok interného testu. GPT-3 bol prvým modelom svojho druhu schopným generovať plynulý, prirodzene znejúci text vo viacerých jazykoch bez špecifického tréningu pre danú úlohu, čo z neho urobilo skutočný míľnik. Konkrétne pre preklad však tá istá plynulosť priniesla reálne riziko: GPT-3 dokázal vytvoriť sebavedomú, dobre formulovanú vetu v cieľovom jazyku, ktorá však bola stále nesprávna, pričom nič na výstupe nesignalizovalo, že došlo k chybe.
GPT-4 bol uvedený na trh v marci 2023 a vlastné testovanie modelov webom MachineTranslation.com začína približne pri tejto generácii. Zlepšenie bolo skutočné, ale nerovnomerné. Pri testovaní dvojzmyselnej anglickej frázy „That's sick“ v japončine bol GPT-4.1-nano jediným zo šiestich testovaných modelov, ktorý zredukoval zámerný dvojitý význam vety na jedinú interpretáciu, zatiaľ čo ostatných päť zachovalo nejednoznačnosť, ktorú pôvodná fráza zamýšľala. Väčšou slabinou boli idiómy: pri testovaní španielskeho idiómu „llevarse el gato al agua“ na piatich verziách GPT súčasne vygenerovali menšie modely GPT-4o-mini aj GPT-4.1-nano rovnaký doslovný, nesprávny preklad a idióm úplne minuli.
Rovnaký vzorec sa ukázal aj inde. Nemecký idióm „ich verstehe nur Bahnhof“, testovaný na ôsmich podverziách GPT a Claude, preložil konkrétne model GPT-4o-mini doslovne a nesprávne, zatiaľ čo menší a novší model v rovnakom teste, GPT-4.1-nano, ho preložil správne. Generácia a veľkosť modelu si nijako konzistentne nezodpovedali, čo je vzorec, ktorému sa testovanie verzií modelov na MachineTranslation.com venuje podrobnejšie.
Spoločnosť OpenAI predstavila GPT-5 ako jednotný systém, ktorý podľa danej úlohy prepína medzi rýchlym predvoleným modelom a hlbším uvažovacím modelom, čo predstavuje štrukturálnu zmenu oproti jednomodelovému dizajnu GPT-4. Vlastný dokument OpenAI s názvom GPT-5 System Card uvádza, že celková miera faktických chýb modelu je približne o 45 % nižšia ako pri GPT-4 a o 80 % nižšia ako pri GPT-3, čo predstavuje všeobecný nárast spoľahlivosti, ktorý sa prejavuje aj konkrétne pri preklade. Testovanie platformy MachineTranslation.com vykazuje najjasnejšie zlepšenia tam, kde modely z éry GPT-4 najviac zápasili: pri tom istom španielskom idióme, v ktorom modely GPT-4o-mini a GPT-4.1-nano zlyhali, dospeli GPT-5.4-mini aj GPT-5.4 k správnym, idiomatickým prekladom – každý ho formuloval trochu inak, no oba samotný idióm pochopili.

Rozdiel medzi generáciami nebol plynulým vzostupom. Sústredil sa takmer výlučne na idiomatický a nejednoznačný jazyk. Pri priamočiarom texte dosahujú modely z éry GPT-4 a GPT-5 takmer identické výsledky.
| GPT-3 | GPT-4 | GPT-5 | |
|---|---|---|---|
| Vydané | 2020 | Marec 2023 | 2025, v súčasnosti GPT-5.4/5.5 |
| Dostupné dnes | Nie, vyradený | Iba cez API, vyradený z ChatGPT | Áno, aktuálna generácia |
| Spracovanie idiómov | Netestované portálom MachineTranslation.com (predchádza programu) | Nekonzistentné; niekoľko idiómov úplne nepochopil | Správne spracoval rovnaké idiómy, ktoré GPT-4 nezvládol |
| Štandardný obchodný text | Netestované portálom MachineTranslation.com | Veľmi dobrý, takmer identický s neskoršími modelmi | Veľmi dobrý, takmer identický s GPT-4 |
Tento posledný bod je dôležitý: samostatný test bežnej obchodnej frázy „please confirm receipt of this document“ preloženej do nemčiny priniesol takmer identické výsledky pri všetkých testovaných modeloch vrátane modelov GPT-4o-mini a generácie GPT-5. Generačný rozdiel sa týka konkrétne obrazného a nejednoznačného jazyka, nejde o plošný rozdiel v kvalite.
Nie. Pri testovaní hebrejského idiómu naprieč rodinami modelov dospeli GPT-5.4-mini a GPT-5.4 k dvom rôznym, čiastočným interpretáciám tej istej frázy, pričom ani jedna nebola úplne správna, zatiaľ čo starší, nesúvisiaci model sa dostal bližšie. Novší model automaticky neznamená presnejší a väčší či novší model nie je automaticky bezpečnejšou voľbou pre danú vetu.
GPT-3 aj GPT-4 sú v ChatGPT už vyradené; GPT-4 zostáva dostupný len prostredníctvom OpenAI API pre existujúce integrácie. Súčasná generácia, GPT-5.4 a GPT-5.5, je to, čo MachineTranslation.com dnes používa, a dosahuje konkurencieschopné výsledky v porovnaní s aktuálnymi modelmi od iných poskytovateľov, hoci nie jednotne lepšie pri každom jazykovom páre. Ak sa chcete bližšie pozrieť na to, ako sa súčasné subverzie GPT porovnávajú navzájom a s modelmi ako Claude a DeepSeek, pozrite si priame porovnávacie testovanie subverzií na MachineTranslation.com, ktoré ide hlbšie, než dokáže generačný prehľad.
Zistenie, na ktorom pri rozsiahlom lokalizačnom programe záleží najviac, nie je „GPT-5 poráža GPT-3“. Je to fakt, že verzia modelu, a nielen rodina modelov, určuje, či sa konkrétny idióm alebo nejednoznačná fráza preloží správne, a to platí pre každý jazykový pár, nielen pre tých pár uvedených tu. Najviac na tom záleží pri obsahu, ktorý sa v prvom rade opiera o tón a obrazný jazyk, najmä pri marketingových textoch a obsahu vytváranom používateľmi, kde jediný idióm preložený doslovne môže zmeniť celý význam príspevku alebo reklamy. Program prevádzajúci obsah do desiatok jazykov narazí na presne takýto typ jazyka v každom jednom z nich. Séria testov subverzií a testovanie úplného porovnania modelov na MachineTranslation.com sa tomu venujú podrobnejšie. Prístup platformy, ktorá pri každom preklade spúšťa súčasné modely GPT spolu s viac ako 20 ďalšími, existuje práve preto, že história verzií žiadneho jednotlivého modelu nie je sama osebe dostatočne spoľahlivou zárukou.
GPT-3 zvládal priamočiary text pomerne dobre, ale výrazne zápasil s čímkoľvek idiomatickým alebo nejednoznačným. GPT-4 túto medzeru výrazne zmenšil, no stále zredukoval niektoré skutočne nejednoznačné frázy na jediný význam namiesto zachovania nejednoznačnosti. Neskoršie subverzie GPT-5 správne spracovali idiómy, ktoré staršie modely z éry GPT-4 preložili doslovne a nesprávne.
Nie. Vlastné testovanie MachineTranslation.com zistilo prípady, kedy menšia, novšia subverzia prekonala väčšiu, staršiu, a kvalitatívny rozdiel medzi generáciami býva špecifický pre idiomatický alebo obrazný jazyk, než aby išlo o všeobecné, plošné zlepšenie.
Nie. Oba modely boli z ChatGPT vyradené a nahradené novšími modelmi generácie GPT-5. GPT-4 zostáva prístupný iba cez OpenAI API pre existujúce integrácie, nie ako aktuálna možnosť pre bežných používateľov.
MachineTranslation.com používa pri každom preklade súčasné modely generácie GPT-5 (GPT-5.4 a GPT-5.5, v závislosti od úrovne predplatného) spolu s viac ako 20 ďalšími modelmi AI, namiesto toho, aby sa spoliehal výlučne na GPT.
Modely generácie GPT-5 dosahujú konkurencieschopné výsledky, no nie sú plošne lepšie ako modely ako Claude, Gemini či DeepSeek. Pri rôznych jazykových pároch a typoch obsahu víťazia rôzne modely, a preto ich MachineTranslation.com testuje priamo proti sebe, namiesto toho, aby jeden z nich vybral ako predvolený.