September 25, 2026

Od GPT-3 po GPT-5: Ako sa v skutočnosti zmenila kvalita AI prekladu

GPT-3, GPT-4 a GPT-5 delí päť rokov a niekoľko generácií architektúry, no užitočná otázka pre preklad neznie „ktorý z nich je najinteligentnejší“. Je konkrétnejšia: čo sa presne zmenilo v tom, ako tieto modely pracujú s časťami jazyka, ktoré sa neprekladajú doslovne – s vecami ako idiómy, dvojzmyselnosť a jazykový register? Zlepšenie nastalo na konkrétnych miestach, v konkrétnych bodoch a nešlo priamočiaro od starších k novším.

Čo GPT-3 v skutočnosti ponúkol pre preklad

Spoločnosť OpenAI vydala GPT-3 v roku 2020, ešte predtým, než vznikol vlastný testovací program platformy MachineTranslation.com, takže nič z tohto nie je proprietárny benchmark. Ide o dobre zdokumentovanú históriu, nie o výsledok interného testu. GPT-3 bol prvým modelom svojho druhu schopným generovať plynulý, prirodzene znejúci text vo viacerých jazykoch bez špecifického tréningu pre danú úlohu, čo z neho urobilo skutočný míľnik. Konkrétne pre preklad však tá istá plynulosť priniesla reálne riziko: GPT-3 dokázal vytvoriť sebavedomú, dobre formulovanú vetu v cieľovom jazyku, ktorá však bola stále nesprávna, pričom nič na výstupe nesignalizovalo, že došlo k chybe.

Čo sa zmenilo s príchodom GPT-4

GPT-4 bol uvedený na trh v marci 2023 a vlastné testovanie modelov webom MachineTranslation.com začína približne pri tejto generácii. Zlepšenie bolo skutočné, ale nerovnomerné. Pri testovaní dvojzmyselnej anglickej frázy „That's sick“ v japončine bol GPT-4.1-nano jediným zo šiestich testovaných modelov, ktorý zredukoval zámerný dvojitý význam vety na jedinú interpretáciu, zatiaľ čo ostatných päť zachovalo nejednoznačnosť, ktorú pôvodná fráza zamýšľala. Väčšou slabinou boli idiómy: pri testovaní španielskeho idiómu „llevarse el gato al agua“ na piatich verziách GPT súčasne vygenerovali menšie modely GPT-4o-mini aj GPT-4.1-nano rovnaký doslovný, nesprávny preklad a idióm úplne minuli.

Rovnaký vzorec sa ukázal aj inde. Nemecký idióm „ich verstehe nur Bahnhof“, testovaný na ôsmich podverziách GPT a Claude, preložil konkrétne model GPT-4o-mini doslovne a nesprávne, zatiaľ čo menší a novší model v rovnakom teste, GPT-4.1-nano, ho preložil správne. Generácia a veľkosť modelu si nijako konzistentne nezodpovedali, čo je vzorec, ktorému sa testovanie verzií modelov na MachineTranslation.com venuje podrobnejšie.

Čo GPT-5 zmenil pre preklad

Spoločnosť OpenAI predstavila GPT-5 ako jednotný systém, ktorý podľa danej úlohy prepína medzi rýchlym predvoleným modelom a hlbším uvažovacím modelom, čo predstavuje štrukturálnu zmenu oproti jednomodelovému dizajnu GPT-4. Vlastný dokument OpenAI s názvom GPT-5 System Card uvádza, že celková miera faktických chýb modelu je približne o 45 % nižšia ako pri GPT-4 a o 80 % nižšia ako pri GPT-3, čo predstavuje všeobecný nárast spoľahlivosti, ktorý sa prejavuje aj konkrétne pri preklade. Testovanie platformy MachineTranslation.com vykazuje najjasnejšie zlepšenia tam, kde modely z éry GPT-4 najviac zápasili: pri tom istom španielskom idióme, v ktorom modely GPT-4o-mini a GPT-4.1-nano zlyhali, dospeli GPT-5.4-mini aj GPT-5.4 k správnym, idiomatickým prekladom – každý ho formuloval trochu inak, no oba samotný idióm pochopili.

Rozdiel medzi generáciami nebol plynulým vzostupom. Sústredil sa takmer výlučne na idiomatický a nejednoznačný jazyk. Pri priamočiarom texte dosahujú modely z éry GPT-4 a GPT-5 takmer identické výsledky.

GPT-3GPT-4GPT-5
Vydané2020Marec 20232025, v súčasnosti GPT-5.4/5.5
Dostupné dnesNie, vyradenýIba cez API, vyradený z ChatGPTÁno, aktuálna generácia
Spracovanie idiómovNetestované portálom MachineTranslation.com (predchádza programu)    Nekonzistentné; niekoľko idiómov úplne nepochopil    Správne spracoval rovnaké idiómy, ktoré GPT-4 nezvládol
Štandardný obchodný text     Netestované portálom MachineTranslation.comVeľmi dobrý, takmer identický s neskoršími modelmiVeľmi dobrý, takmer identický s GPT-4

Tento posledný bod je dôležitý: samostatný test bežnej obchodnej frázy „please confirm receipt of this document“ preloženej do nemčiny priniesol takmer identické výsledky pri všetkých testovaných modeloch vrátane modelov GPT-4o-mini a generácie GPT-5. Generačný rozdiel sa týka konkrétne obrazného a nejednoznačného jazyka, nejde o plošný rozdiel v kvalite.

Znamená novšia generácia GPT vždy lepší preklad?

Nie. Pri testovaní hebrejského idiómu naprieč rodinami modelov dospeli GPT-5.4-mini a GPT-5.4 k dvom rôznym, čiastočným interpretáciám tej istej frázy, pričom ani jedna nebola úplne správna, zatiaľ čo starší, nesúvisiaci model sa dostal bližšie. Novší model automaticky neznamená presnejší a väčší či novší model nie je automaticky bezpečnejšou voľbou pre danú vetu.

Každá generácia GPT sa v preklade v priemere zlepšila a každá generácia GPT má stále konkrétne veci, v ktorých robí chyby, zatiaľ čo starší alebo menší model ich niekedy neurobí. To nie je kritika žiadnej konkrétnej verzie. Je to dôvod, prečo nenechávame rozhodovať len jeden jediný model, vrátane GPT-5.

Kde sa dnes GPT-5 nachádza v oblasti prekladu

GPT-3 aj GPT-4 sú v ChatGPT už vyradené; GPT-4 zostáva dostupný len prostredníctvom OpenAI API pre existujúce integrácie. Súčasná generácia, GPT-5.4 a GPT-5.5, je to, čo MachineTranslation.com dnes používa, a dosahuje konkurencieschopné výsledky v porovnaní s aktuálnymi modelmi od iných poskytovateľov, hoci nie jednotne lepšie pri každom jazykovom páre. Ak sa chcete bližšie pozrieť na to, ako sa súčasné subverzie GPT porovnávajú navzájom a s modelmi ako Claude a DeepSeek, pozrite si priame porovnávacie testovanie subverzií na MachineTranslation.com, ktoré ide hlbšie, než dokáže generačný prehľad.

Čo to znamená, ak lokalizujete vo veľkom rozsahu

Zistenie, na ktorom pri rozsiahlom lokalizačnom programe záleží najviac, nie je „GPT-5 poráža GPT-3“. Je to fakt, že verzia modelu, a nielen rodina modelov, určuje, či sa konkrétny idióm alebo nejednoznačná fráza preloží správne, a to platí pre každý jazykový pár, nielen pre tých pár uvedených tu. Najviac na tom záleží pri obsahu, ktorý sa v prvom rade opiera o tón a obrazný jazyk, najmä pri marketingových textoch a obsahu vytváranom používateľmi, kde jediný idióm preložený doslovne môže zmeniť celý význam príspevku alebo reklamy. Program prevádzajúci obsah do desiatok jazykov narazí na presne takýto typ jazyka v každom jednom z nich. Séria testov subverzií a testovanie úplného porovnania modelov na MachineTranslation.com sa tomu venujú podrobnejšie. Prístup platformy, ktorá pri každom preklade spúšťa súčasné modely GPT spolu s viac ako 20 ďalšími, existuje práve preto, že história verzií žiadneho jednotlivého modelu nie je sama osebe dostatočne spoľahlivou zárukou.

Často kladené otázky

1. Aký je skutočný rozdiel medzi GPT-3, GPT-4 a GPT-5 pri preklade?

GPT-3 zvládal priamočiary text pomerne dobre, ale výrazne zápasil s čímkoľvek idiomatickým alebo nejednoznačným. GPT-4 túto medzeru výrazne zmenšil, no stále zredukoval niektoré skutočne nejednoznačné frázy na jediný význam namiesto zachovania nejednoznačnosti. Neskoršie subverzie GPT-5 správne spracovali idiómy, ktoré staršie modely z éry GPT-4 preložili doslovne a nesprávne.

2. Je GPT-5 pri preklade vždy lepší ako GPT-4?

Nie. Vlastné testovanie MachineTranslation.com zistilo prípady, kedy menšia, novšia subverzia prekonala väčšiu, staršiu, a kvalitatívny rozdiel medzi generáciami býva špecifický pre idiomatický alebo obrazný jazyk, než aby išlo o všeobecné, plošné zlepšenie.

3. Ponúka OpenAI stále GPT-3 alebo GPT-4?

Nie. Oba modely boli z ChatGPT vyradené a nahradené novšími modelmi generácie GPT-5. GPT-4 zostáva prístupný iba cez OpenAI API pre existujúce integrácie, nie ako aktuálna možnosť pre bežných používateľov.

4. Ktorú verziu GPT používa MachineTranslation.com?

MachineTranslation.com používa pri každom preklade súčasné modely generácie GPT-5 (GPT-5.4 a GPT-5.5, v závislosti od úrovne predplatného) spolu s viac ako 20 ďalšími modelmi AI, namiesto toho, aby sa spoliehal výlučne na GPT.

5. Ako si vedie GPT-5 v porovnaní s inými súčasnými AI modelmi pri preklade?

Modely generácie GPT-5 dosahujú konkurencieschopné výsledky, no nie sú plošne lepšie ako modely ako Claude, Gemini či DeepSeek. Pri rôznych jazykových pároch a typoch obsahu víťazia rôzne modely, a preto ich MachineTranslation.com testuje priamo proti sebe, namiesto toho, aby jeden z nich vybral ako predvolený.