June 10, 2026
Tahan jagada midagi, mille me sel nädalal otsustasime — mitte pärast selle valmimist, vaid sel ajal, kui me seda veel ehitame.
Muudame seda, kuidas tehisintellekti mudeleid meie kasutajatasandite vahel jaotatakse. MachineTranslation.com-i tasulised kasutajad saavad peagi ligipääsu täiustatumatele tehisintellekti mudelitele juhtivatelt pakkujatelt — OpenAI, Anthropic, Google, DeepSeek ja teistelt. Tasuta kasutajad saavad ka edaspidi võimekat ja usaldusväärset tõlget — kuid mitte samade mudelitega. See lünk on tahtlik ja ma tahan täpselt selgitada, miks me selle otsuse teeme.
Ma kirjutan selle pigem nüüd, kui põhjendus on veel värske ja otsus alles toores, kui et ootan, kuni see on avalik, ja esitlen seda lihvitud teadaandena. Aus versioon on kasulikum.
MachineTranslation.com tõlgib korraga 22 tehisintellekti mudeliga ja kasutab parima tulemuse esiletoomiseks konsensusel põhinevat lähenemist. See on alati olnud meie tegevuse tuum – mitte panustada kõike ühele mudelile, vaid võrrelda mitut ja lasta tulemustel enda eest rääkida.
Selle lähenemise ebamugav külg on see, et see teeb mudelite kvaliteedierinevused väga nähtavaks. Me näeme iga päev, et kõik mudelid ei saa kõikide tekstidega võrdselt hästi hakkama. Ja pikka aega ei lasknud me sellel tähelepanekul muuta seda, kuidas me mudeleid kasutajatele jaotasime.
Mõned nädalad tagasi tutvustas Rachelle (meie tehisintellekti juht) meile sisemist tööriista, mille olime ehitanud, et testida samaaegselt mitme GPT-mudeli tõlkekvaliteeti – sealhulgas GPT 4.1 nano, GPT 4.1 mini, GPT 5.4 mini ja teised. Sisestate sama lähteteksti ja näete iga mudeli väljundit kõrvuti.
See tööriist teeb kohe selgeks järgmise: lihtsa, lühikese ja igapäevase teksti puhul on väljundid peaaegu identsed. Te ei saa tõesti õigustada tipptasemel mudelite kvaliteediargumenti lausega „koosolek on kell 15“.
Aga kõige puhul, mis sisaldab tõelist keelelist keerukust (idioomid, valdkondlik terminoloogia, pikad dokumendid, kus kontekst peab säilima tuhandete sõnade ulatuses), tekib mudelite vahel lõhe ja see tekib viisil, mis on professionaalselt oluline.
See on see osa, millest tõlketööstus minu arvates piisavalt ausalt ei räägi. Madalama taseme mudelid ei anna tavaliselt ilmselgelt valesid tõlkeid. Nad loovad tõlkeid, mis on pealtnäha korrektsed, kuid sisaldavad peeneid vigu, mida valdkonnaekspert (jurist, meditsiinitöötaja, vanemlokaliseerimisjuht) märkaks kohe.
Tingimuslause, mis on tõlgitud vale tähendusega. Juriidiline termin, mis tähendab selles jurisdiktsioonis midagi spetsiifilist, tõlgitud selle igapäevase vastena. Stiili nihe pika dokumendi keskel, mis õõnestab terviku professionaalset usaldusväärsust.
See ebaõnnestumine on vaikne. Ja märkamatud ebaõnnestumised professionaalses tõlkes võivad kalliks maksma minna.
Me ei teinud seda otsust intuitsiooni põhjal. Me testisime mudeleid keeruka, idiomaatilise lähtetekstiga (sellist sisu, mida meie professionaalsed kasutajad tegelikult tõlkida vajavad) ja lasime lingvistidel väljundeid hinnata.
Tulemus oli selge. Täiustatud mudelid käsitlesid nüansse, registrit ja valdkonnaspetsiifilist terminoloogiat järjepidevalt paremini. Odavamad mudelid olid tavakasutuseks enam kui piisavad. Need kaks kasutusjuhtu vajavad tõepoolest erinevaid tööriistu.

Vestlus, mille see ettevõttesiseselt tekitas, ei käinud niivõrd hinnakujunduse kui aususe kohta. Kui me teame, et mudelid toimivad professionaalse sisu puhul erinevalt, ja me teame, et meie maksvad kasutajad tõlgivad suures osas professionaalset sisu, siis on neile sama mudeli andmine, mida kasutab tavalist e-kirja tõlkiv tasuta kasutaja, karuteene mõlemale.
Ofer (meie tegevjuht) sõnastas selle meie sisevestluses selgelt:
„Madalama taseme mudelid kätkevad endas keerulise või idiomaatilise teksti puhul reaalseid kvaliteediriske. Aga olulisem on see: konsensus on ainult nii hea kui selle taga olevad mudelid. Kui maksvad kasutajad saavad täiustatumaid mudeleid, ei saa nad mitte ainult paremaid üksikuid tulemusi — nad saavad ka tugevama konsensuse. Paremad mudelid, parem konsensus, usaldusväärsemad tõlked. Seda professionaalne tõlge tegelikult tähendabki.
See sõnastus jäi mulle meelde. See ei ole ainult kuluargument. See on selguse argument.
Võimekamate tehisintellekti mudelite käitamine maksab tokeni kohta märkimisväärselt rohkem. See ei ole MachineTranslation.com-i poliitika, vaid nii hinnastab iga suurem tehisintellekti pakkuja oma lipulaeva mudeleid. OpenAI, Anthropic, Google ja DeepSeek reserveerivad oma uusimad ja kõige võimekamad mudelid maksvatele klientidele, sest neid mudeleid on oluliselt kallim käitada. Meie kõige arenenuma mudeli kasutamine iga tasuta tõlke, iga tavapärase päringu ja iga „mida see silt tähendab“ tüüpi päringu puhul suurendaks oluliselt meie taristukulusid.
Mis veelgi olulisem, see tähendaks lihtsate kasutusjuhtude ristsubsideerimist selle arvutusvõimsuse eelarve arvelt, mida vajame kvaliteedi säilitamiseks professionaalidele, kes tõlgivad 10 000-sõnalisi tehnilisi dokumente. See ei ole jätkusuutlik ega mõistlik jaotus.
Sellel otsusel on ka versioon, mis on puhtalt omakasupüüdlik — küsi rohkem, anna rohkem, lihtne. See ei ole tegelikult see, mis seda ajendab.
Seda ajendab see, et oleme loonud platvormi, mis suudab tõeliselt esile tuua AI-mudelite vahelised kvaliteedierinevused. Meil on olemas sisemised tööriistad, et neid erinevusi selgelt näha. Selle nähtavuse eiramine meie kasutajatasemete kujundamisel oleks omamoodi ebaausus, teeseldes, et lõhet pole olemas, kuigi meil on tõendeid selle olemasolu kohta.
Tasuta kasutajad väärivad teadmist, mida nad saavad. Maksvad kasutajad väärivad teada, et nad saavad midagi oluliselt erinevat. Ja erinevus ei seisne ainult juurdepääsus arenenumatele mudelitele, vaid juurdepääsus tugevamale konsensusele, mis on nende mudelite põhjal loodud. See on usaldusväärsuse signaal, mida ükski tehisintellekt pakkuda ei suuda.
Me alles töötame rakendamise üksikasju välja, seega tahan olla ettevaatlik, et mitte anda liiga konkreetseid lubadusi. Aga siin on suund.
Tasuta paketi tõlked kasutavad ka edaspidi võimekaid tehisintellekti mudeleid. Enamiku igapäevaste tõlkeülesannete (lühisõnumid, tavaline lugemine, lihtne kirjavahetus) puhul saavad tasuta kasutajad täpse ja usaldusväärse tulemuse. See ei muutu.
Tasuta tase on olemas, sest usume, et keel ei tohiks olla takistuseks, ja me ei tagane sellest.
Erinevus on kõige nähtavam:
| Sisu tüüp | Miks mudeli kvaliteet on siin oluline |
|---|---|
| Juriidilised ja finantsdokumendid | Tingimuslaused, jurisdiktsioonipõhine terminoloogia, registri järjepidevus |
| Tehniline dokumentatsioon | Valdkonnaspetsiifiline sõnavara, pika dokumendi sidusus |
| Meditsiiniline ja kliiniline tekst | Täpsus, register, tundlikkus mitmetähenduslikkuse suhtes |
| Turundus- ja bränditekstid | Idioomide käsitlemine, tonaalne täpsus, kultuuriline kõlapind |
| Väikese ressursiga keelepaarid | Napp treeningandmestik tähendab suuremaid lünki mudeli kvaliteedis |
| Pikad dokumendid (5000+ sõna) | Konteksti säilitamine, järjepidevus kogu dokumendi ulatuses |
Nendes kategooriates töötavate professionaalsete kasutajate jaoks on mudeli tasemel reaalne vahe. Just neile ongi meie tasulised paketid mõeldud.
Ja kuna SMARTi konsensus põhineb nendel täiustatud mudelitel, ei saa maksvad kasutajad mitte ainult paremaid individuaalseid väljundeid, vaid ka usaldusväärsema tehisintellektil põhineva tõlke, mille loovad uusimad mudelid koostöös.
Ütlen ausalt, et kõik pole veel lahendatud.
Me alles määrame täpset mudelite jaotust — millised mudelid millisele tasemele kuuluvad ja kuidas me sellest toote sees kasutajatele selgelt teada anname. Töötame maksumüüri loogikat läbi, et tagada sujuv, mitte järsk kogemus. Ja me mõtleme hoolikalt, kuidas esitada kasutajatele teavet mudeli kvaliteedi kohta viisil, mis on tõeliselt kasulik, mitte lihtsalt turundusväide.
Lisaks on veel üks reaalne küsimus, millega me tegeleme: kuidas aidata tasuta kasutajal hetkega mõista, millal ta on jõudnud kasutusjuhuni, kus tasulisele versioonile üleminek tema tulemust märkimisväärselt parandaks? See on nii UX-i kui ka toote väljakutse ning meil pole sellele veel täielikku vastust.
Kirjutan sellest, kuidas see vastu võetakse, kui see käiku läheb. Praegu on mõttekäik selline.
Kui olete maksev kasutaja ja soovite kaasa rääkida teemal, mis on teile mudeli kvaliteedi juures kõige olulisem, siis olen siiralt huvitatud. Jätke teade MachineTranslation.com-i kontaktilehe kaudu.
Sest meie sisesed testid näitasid märkimisväärset kvaliteedierinevust mudelitasemete vahel professionaalse tasemega tõlkeülesannete puhul. Me lõime tööriista mitme tehisintellekti mudeli samaaegseks võrdlemiseks ja andmed näitasid selgelt: arenenumad mudelid saavad keeruka, idiomaatilise ja valdkonnaspetsiifilise sisuga oluliselt paremini hakkama. Taseme muutus kajastab seda tegelikkust ausalt. Maksvate kasutajate suurem eelis on see, et SMART-konsensus põhineb täiustatumatel mudelitel, mis tähendab, et usaldusväärsuse signaal ise on tugevam.
Ei. Tasuta paketi kasutajad saavad ka edaspidi kvaliteetseid ja täpseid tõlkeid igapäevaseks kasutamiseks. Muudatus seisneb selles, et maksvad kasutajad uuendatakse täiustatumatele mudelitele, mitte selles, et tasuta kasutajate taset alandatakse.
Juriidilised, finants-, meditsiinilised, tehnilised ja mahukad dokumendid — ja igasugune sisu vähem levinud keelepaarides, kus treeningandmeid on vähem. Lühikeste, lihtsate ja igapäevaste tekstide puhul on erinevus mudelitasemete vahel minimaalne. Tasuliste kasutajate suurem eelis on see, et SMART-konsensus põhineb arenenumatel mudelitel, mis tähendab, et usaldusväärsuse signaal ise on tugevam.
Me ehitame seda praegu. Postitan uuenduse, kui see välja saadetakse, sealhulgas selle kohta, milline on tootesisene kogemus ja mida näitavad esialgsed andmed.
Me käivitame samaaegselt mitut mudelit ja kasutame väljundite hindamiseks konsensusel põhinevat hindamismeetodit. Meie sisemine võrdlusvahend võimaldab meil testida kvaliteeti erinevate mudelitasemete lõikes sama lähteteksti põhjal, mis andiski aluse sellele tasemete jaotamise otsusele. Saate rohkem teada selle kohta, kuidas MachineTranslation.com.com-i konsensussüsteem töötab.