June 10, 2026

Tarjoamme maksaville käyttäjille kehittyneempiä tekoälymalleja. Tässä syy.

Haluan kertoa teille jostakin, mitä päätimme tällä viikolla – ei sen jälkeen, kun se on julkaistu, vaan kun vielä rakennamme sitä.

Muutamme tapaa, jolla tekoälymallit jaetaan eri käyttäjätasoillemme. MachineTranslation.com-sivuston maksavat käyttäjät saavat pian käyttöönsä johtavien palveluntarjoajien — OpenAI, Anthropic, Google, DeepSeek ja muut — edistyneempiä tekoälymalleja. Ilmaiskäyttäjät saavat jatkossakin pätevää ja luotettavaa käännöstä — mutta eivät samoja malleja. Tuo väli on tarkoituksellinen, ja haluan selittää tarkalleen, miksi teemme tämän päätöksen.

Kirjoitan tämän mieluummin nyt, kun perustelut ovat vielä tuoreita ja päätös on vielä hieman raaka, kuin odottaisin, kunnes se on julkaistu, ja muotoilisin sen hiotuksi tiedotteeksi. Rehellinen versio on hyödyllisempi.

Sisällysluettelo

  • Miksi olemme pohtineet tätä jonkin aikaa
  • Mikä muutti mielemme: Sisäinen testi
  • Rehellinen syy porrastukselle
  • Miltä tämä näyttää käyttäjille
  • Mitä vielä selvitämme
  • UKK

Miksi olemme miettineet tätä jo jonkin aikaa

MachineTranslation.com kääntää 22 tekoälymallilla samanaikaisesti ja käyttää konsensukseen perustuvaa lähestymistapaa parhaan tuloksen esiin tuomiseksi. Se on aina ollut tekemisemme ydin — emme panosta kaikkea yhteen malliin, vaan vertailemme useita keskenään ja annamme tulosten puhua puolestaan.

Tämän lähestymistavan epämukava puoli on se, että se tekee mallien väliset laaduerot erittäin näkyviksi. Me näemme, joka päivä, että kaikki mallit eivät käsittele kaikkea tekstiä yhtä hyvin. Ja pitkään aikaan emme antaneet tuon havainnon muuttaa sitä, miten kohdensimme malleja käyttäjille.

Kaikki mallit eivät ole samanarvoisia, ja meillä on dataa sen todistamiseksi

Muutama viikko sitten Rachelle (tekoälyjohtajamme) esitteli meille sisäisen työkalun, jonka olimme rakentaneet käännöslaadun testaamiseen useilla GPT-malleilla samanaikaisesti — mukaan lukien GPT 4.1 nano, GPT 4.1 mini, GPT 5.4 mini ja muut. Syötät saman lähdetekstin ja näet jokaisen mallin tuotoksen rinnakkain.

Työkalu tekee heti selväksi tämän: yksinkertaisilla, lyhyillä ja arkipäiväisillä teksteillä tuotokset ovat lähes identtisiä. Premium-mallien laadukkuutta ei voi aidosti perustella lauseella kokous on klo 15.

Mutta kaikessa, missä on todellista kielellistä monimutkaisuutta (idiomaattiset ilmaisut, erikoisalan terminologia, pitkät asiakirjat, joissa kontekstin on säilyttävä tuhansien sanojen yli), ero mallien välillä kasvaa, ja se kasvaa tavoilla, joilla on ammatillista merkitystä.

Missä alemman tason mallit kaikessa hiljaisuudessa jäävät vajaiksi

Tämä on se osa, josta käännösala ei mielestäni puhu riittävän rehellisesti. Alemman tason mallit eivät yleensä tuota selvästi vääriä käännöksiä. Ne tuottavat käännöksiä, jotka ovat päällisin puolin sujuvia, mutta sisältävät hienovaraisia virheitä, jotka aihealueen asiantuntija (lakimies, lääketieteen ammattilainen, kokenut lokalisointipäällikkö) huomaisi heti.

Väärässä merkityksessä käännetty ehtolause. Oikeudellinen termi, joka tarkoittaa jotain erityistä kyseisellä tuomiovalta-alueella, käännettynä sen arkikielisenä vastineena. Tyylilajin muutos pitkän asiakirjan puolivälissä, joka heikentää koko kokonaisuuden ammatillista uskottavuutta.

Epäonnistuminen on hiljainen. Ja hiljaiset epäonnistumiset ammattikääntämisessä voivat tulla kalliiksi.

Mikä muutti mielemme: Sisäinen testi

Emme tehneet tätä päätöstä intuition perusteella. Testasimme malleja monimutkaisella, idiomaattisella lähdetekstillä (juuri sellaista sisältöä, jota ammattikäyttäjämme tarvitsevat käännettäväksi) ja annoimme lingvistien arvioida tulokset.

Tulos oli selvä. Edistyneet mallit käsittelivät nyansseja, rekistereitä ja alakohtaista terminologiaa johdonmukaisesti paremmin. Halvemmat mallit olivat enemmän kuin riittäviä arkikäyttöön. Kaksi käyttötapausta aidosti vaativat erilaisia työkaluja.

Neljä mallia, sama lause, hyvin erilaiset tulokset


Tästä sisäisesti syttynyt keskustelu ei koskenut niinkään hinnoittelua, vaan enemmänkin rehellisyyttä. Jos tiedämme, että mallit suoriutuvat eri tavoin ammattilaistason sisällön kanssa, ja tiedämme, että maksavat käyttäjämme kääntävät pääasiassa ammattilaistason sisältöä, niin saman mallin antaminen heille kuin ilmaiskäyttäjälle, joka kääntää rentoa sähköpostia, on karhunpalvelus molemmille.

Rehellinen syy porrastukselle

Ofer (toimitusjohtajamme) ilmaisi asian selkeästi sisäisessä keskustelussamme:

 Alemman tason mallit sisältävät todellisia laaturiskejä monimutkaisen tai idiomaattisen tekstin kohdalla. Mutta tärkeämpi pointti on tämä: konsensus on vain niin hyvä kuin sen takana olevat mallit. Kun maksavat käyttäjät saavat kehittyneempiä malleja, he eivät saa vain parempia yksittäisiä tulosteita – he saavat vahvemman konsensuksen. Paremmat mallit, parempi konsensus, luotettavammat käännökset. Sitä ammattitason kääntäminen oikeasti tarkoittaa.

Tuo asetelma jäi mieleeni. Kyse ei ole vain kustannusargumentista. Se on selkeysargumentti.

Mitä premium-mallien käyttäminen todellisuudessa maksaa

Kyvykkäämpien tekoälymallien ajaminen maksaa merkittävästi enemmän tokenia kohti. Se ei ole MachineTranslation.comin käytäntö, vaan siten jokainen suuri tekoälyntarjoaja hinnoittelee lippulaivamallinsa. OpenAI, Anthropic, Google ja DeepSeek kaikki varaavat uusimmat ja kyvykkäimmät mallinsa maksaville asiakkaille, koska niiden käyttäminen on huomattavasti kalliimpaa. Edistyneimmän mallimme käyttäminen jokaiseen ilmaiseen käännökseen, jokaiseen arkiseen kyselyyn ja jokaiseen mitä tässä kyltissä lukee -pyyntöön kasvattaisi merkittävästi infrastruktuurikustannuksiamme.

Mikä tärkeintä, se tarkoittaisi yksinkertaisten käyttötapausten ristisubventointia sillä laskentabudjetilla, jota tarvitsemme ylläpitääksemme laatua 10 000 sanan teknisiä asiakirjoja kääntäville ammattilaisille. Se ei ole kestävä tai järkevä kohdennus.

Miksi kaikkien tasojen samanarvoisiksi teeskentely ei palvele ketään

Tästä päätöksestä on olemassa puhtaasti voitonhakuinen versio – veloita enemmän, anna enemmän, yksinkertaista. Se ei oikeastaan ole syy siihen.

Kyse on siitä, että olemme rakentaneet alustan, joka pystyy aidosti tuomaan esiin tekoälymallien välisiä laatueroja. Meillä on sisäiset työkalut, joilla näemme nuo erot selvästi. Tuon näkyvyyden huomiotta jättäminen käyttäjätasojamme suunnitellessamme olisi eräänlaista epärehellisyyttä, teeskentelyä siitä, ettei kuilua ole olemassa, vaikka meillä on todisteita sen olemassaolosta.

Ilmaiskäyttäjät ansaitsevat tietää, mitä he saavat. Maksavat käyttäjät ansaitsevat tietää saavansa jotain merkityksellisesti erilaista. Ja ero ei ole ainoastaan pääsy kehittyneempiin malleihin, vaan pääsy vahvempaan konsensukseen, joka on rakennettu näiden mallien pohjalta. Se on luotettavuussignaali, jota yksikään tekoäly ei voi tarjota.

Miltä tämä näyttää käyttäjille

Työstämme yhä toteutuksen yksityiskohtia, joten en halua luvata liikaa tarkkoja seikkoja. Mutta tässä on linjaus.

Ilmaisversio pysyy vahvana

Ilmaisversion käännöksissä käytetään jatkossakin kyvykkäitä tekoälymalleja. Useimmissa arkipäiväisissä käännöstehtävissä (lyhyet viestit, kevyt lukeminen, peruskirjeenvaihto) ilmaiskäyttäjät saavat tarkkoja ja luotettavia tuloksia. Tämä ei muutu.

Ilmainen taso on olemassa, koska uskomme, ettei kielen pitäisi olla este, emmekä ole perääntymässä siitä.

Missä maksavat käyttäjät pääsevät edelle

Ero näkyy selvimmin:

SisältötyyppiMiksi mallin laadulla on tässä merkitystä
Lakitieteelliset ja taloudelliset asiakirjatEhdolliset lausekkeet, oikeudenkäyttöaluekohtainen terminologia, rekisterin johdonmukaisuus
Tekninen dokumentaatioToimialakohtainen sanasto, pitkien asiakirjojen yhtenäisyys
Lääketieteellinen ja kliininen tekstiTarkkuus, rekisteri, herkkyys moniselitteisyydelle
Markkinointi- ja bränditekstitIdioomien käsittely, sävyn tarkkuus, kulttuurinen resonanssi
Vähäresurssiset kieliparitVähäisempi koulutusdata tarkoittaa suurempia laatueroja mallissa
Pitkät asiakirjat (yli 5 000 sanaa)Kontekstin säilyttäminen, johdonmukaisuus koko asiakirjassa

Ammattikäyttäjille, jotka työskentelevät missä tahansa näistä luokista, mallitasolla on todellista merkitystä. Maksulliset sopimuksemme on tehty juuri heitä varten.

Ja koska SMARTin konsensus rakentuu näiden kehittyneempien mallien pohjalta, maksavat käyttäjät eivät ainoastaan saa parempia yksittäisiä tuloksia — vaan he saavat luotettavampaa tekoälykäännöstä, joka on tuotettu uusimpien, yhdessä toimivien mallien avulla.

Mitä vielä selvitämme

Haluan olla rehellinen ja kertoa, että kaikkea ei ole vielä ratkaistu.

Selvitämme vielä tarkkaa mallien jakoa — mitkä mallit kuuluvat millekin tasolle ja miten viestimme siitä selkeästi käyttäjille tuotteen sisällä. Työstämme maksumuurin logiikkaa varmistaaksemme, että kokemus on saumaton eikä töksähtelevä. Ja pohdimme huolellisesti, miten esittää käyttäjille tietoa mallin laadusta tavalla, joka on aidosti hyödyllinen eikä vain markkinointiväite.

Pohdimme myös erästä todellista kysymystä: miten autamme ilmaiskäyttäjää ymmärtämään juuri sillä hetkellä, kun hän kohtaa käyttötapauksen, jossa parempaan versioon päivittäminen parantaisi merkittävästi hänen tuotostaan? Se on yhtä lailla UX-haaste kuin tuotehaastekin, eikä meillä ole vielä täyttä vastausta.

Kirjoitan siitä, miten tämä otetaan vastaan, kun se on julkaistu. Toistaiseksi ajattelemme näin.

Jos olet maksava käyttäjä ja haluat kertoa mielipiteesi siitä, mikä sinulle on tärkeintä mallin laadussa, olen aidosti kiinnostunut. Jätä viesti MachineTranslation.com-yhteystietosivun kautta.

UKK

1. Miksi MachineTranslation.com muuttaa tapaa, jolla malleja kohdennetaan?

Koska sisäinen testauksemme osoitti merkittävän laatuero mallitasojen välillä ammattitason käännöstehtävissä. Rakensimme työkalun useiden tekoälymallien samanaikaiseen vertailuun, ja data osoitti selvästi: kehittyneet mallit käsittelevät monimutkaista, idiomaattista ja toimialakohtaista sisältöä huomattavasti paremmin. Tasomuutos heijastaa sitä todellisuutta rehellisesti. Suurempi hyöty maksaville käyttäjille on, että SMART-konsensus rakentuu kehittyneemmistä malleista, mikä tarkoittaa, että luotettavuussignaali itsessään on vahvempi.

2. Huononevatko ilmaisversion käännökset, kun tämä julkaistaan?

Ei. Ilmaisversion käyttäjät saavat jatkossakin laadukkaita ja tarkkoja käännöksiä arkikäyttöön. Muutos on se, että maksavat käyttäjät päivitetään kehittyneempiin malleihin, ei se, että ilmaiskäyttäjien versiota heikennettäisiin.

3. Minkä tyyppiset käännökset hyötyvät eniten premium-tekoälymalleista?

Oikeudelliset, taloudelliset, lääketieteelliset, tekniset ja pitkät asiakirjat — sekä kaikki sisältö harvinaisemmissa kielipareissa, joissa opetusdataa on niukemmin. Lyhyiden, yksinkertaisten ja arkisten tekstien kohdalla ero mallitasojen välillä on minimaalinen. Maksaville käyttäjille suurempi etu on, että SMART-konsensus rakentuu kehittyneemmistä malleista, mikä tarkoittaa, että luotettavuussignaali itsessään on vahvempi.

4. Milloin tämä julkaistaan?

Rakennamme sitä nyt. Julkaisen päivityksen, kun se toimitetaan, mukaan lukien miltä käyttökokemus näyttää tuotteessa ja mitä alustava data osoittaa.

5. Miten MachineTranslation.com päättää, mikä tekoälymalli on paras tietylle tekstille?

Ajatamme useita malleja samanaikaisesti ja käytämme konsensukseen perustuvaa pisteytysmenetelmää tulosten arviointiin. Sisäinen vertailutyökalumme mahdollistaa laadun testaamisen eri mallitasoilla samalla lähdetekstillä, ja tähän tietoon tasoluokituspäätös perustui. Voit oppia lisää siitä, miten MachineTranslation.com.com-konsensusjärjestelmä toimii.‎