June 10, 2026
Dua të ndaj me ju diçka që vendosëm këtë javë — jo pasi të jetë publikuar, por ndërsa jemi ende duke e ndërtuar.
Po ndryshojmë mënyrën se si modelet e AI-së ndahen nëpër nivelet tona të përdoruesve. Përdoruesit me pagesë në MachineTranslation.com së shpejti do të kenë akses në modele më të avancuara të IA-së nga ofruesit kryesorë — OpenAI, Anthropic, Google, DeepSeek, dhe të tjerë. Përdoruesit falas do të vazhdojnë të marrin përkthim cilësor dhe të besueshëm — por jo të njëjtat modele. Ajo hapësirë është e qëllimshme, dhe dua të shpjegoj saktësisht pse po e marrim këtë vendim.
Më mirë ta shkruaj këtë tani, ndërsa arsyetimi është i freskët dhe vendimi është ende pak i papërpunuar, sesa të pres derisa të bëhet publike dhe ta paraqes si një njoftim të përpunuar. Versioni i sinqertë është më i dobishëm.
MachineTranslation.com përkthen me 22 modele të IA-së njëherësh dhe përdor një qasje të bazuar në konsensus për të nxjerrë në pah rezultatin më të mirë. Kjo ka qenë gjithmonë thelbi i asaj që bëjmë — të mos i vëmë të gjitha shpresat te një model i vetëm, por të krahasojmë disa modele dhe t'i lëmë rezultatet të flasin vetë.
Ana e pakëndshme e kësaj qasjeje është se i bën dallimet në cilësi mes modeleve shumë të dukshme. Ne shohim, çdo ditë, që jo të gjitha modelet e përpunojnë të gjithë tekstin njësoj mirë. Dhe për një kohë të gjatë, ne nuk e lejuam atë vëzhgim të ndryshonte mënyrën se si ua caktonim modelet përdoruesve.
Disa javë më parë, Rachelle (drejtuesja jonë e IA-së) na prezantoi një mjet të brendshëm që kishim ndërtuar për të testuar cilësinë e përkthimit në disa modele GPT njëkohësisht — duke përfshirë GPT 4.1 nano, GPT 4.1 mini, GPT 5.4 mini, dhe të tjera. Ju vendosni të njëjtin tekst burimor dhe shihni rezultatin e çdo modeli krah për krah.
Ajo që ky mjet e bën menjëherë të qartë është kjo: në tekst të thjeshtë, të shkurtër, të përditshëm, rezultatet janë pothuajse identike. Sinqerisht nuk mund të justifikoni një argument për cilësinë e modeleve premium me fjalinë takimi është në orën 3 pasdite.
Por për çdo gjë me kompleksitet të vërtetë gjuhësor (shprehje idiomatike, terminologji specifike, dokumente të gjata ku konteksti duhet të ruhet përgjatë mijëra fjalëve) hendeku midis modeleve zgjerohet, dhe zgjerohet në mënyra që kanë rëndësi profesionalisht.
Kjo është pjesa për të cilën mendoj se industria e përkthimit nuk flet mjaftueshëm sinqerisht. Modelet e nivelit më të ulët zakonisht nuk prodhojnë përkthime haptazi të gabuara. Ato prodhojnë përkthime që në pamje të parë duken në rregull, por mbartin gabime delikate që një ekspert i fushës (një avokat, një profesionist mjekësor, një menaxher i lartë lokalizimi) do t'i kapte menjëherë.
Një klauzolë kushtore e dhënë me kuptimin e gabuar. Një term ligjor që do të thotë diçka specifike në atë juridiksion, i përkthyer si ekuivalenti i tij i përditshëm. Një ndryshim stili në mes të një dokumenti të gjatë që minon besueshmërinë profesionale të të gjithë dokumentit.
Dështimi është i heshtur. Dhe dështimet e heshtura në përkthimin profesional mund të jenë të kushtueshme.
Ne nuk e morëm këtë vendim bazuar në intuitë. Ne i vumë në provë modelet me tekste burimore komplekse e idiomatike (pikërisht lloji i përmbajtjes që përdoruesve tanë profesionistë u duhet të përkthejnë) dhe kërkuam nga gjuhëtarët të vlerësonin rezultatet.
Rezultati ishte i qartë. Modelet e avancuara i trajtuan vazhdimisht më mirë nuancat, regjistrin dhe terminologjinë specifike të fushës. Modelet më të lira ishin më se të mjaftueshme për përdorim të përditshëm. Të dy rastet e përdorimit vërtet kërkojnë mjete të ndryshme.

Biseda që kjo ndezi brenda nesh ishte më pak rreth çmimeve dhe më shumë rreth ndershmërisë. Nëse e dimë që modelet performojnë ndryshe në përmbajtje të nivelit profesional, dhe e dimë që përdoruesit tanë me pagesë kryesisht përkthejnë përmbajtje të nivelit profesional, atëherë t'u japësh atyre të njëjtin model si një përdoruesi pa pagesë që po përkthen një email të thjeshtë, është një shërbim i keq për të dyja palët.
Ofer (CEO ynë) e tha troç në diskutimin tonë të brendshëm:
Modelet e nivelit më të ulët mbartin rreziqe reale për cilësinë në tekstet komplekse ose idiomatike. Por poenta më e madhe është kjo: konsensusi vlen vetëm aq sa modelet që qëndrojnë pas tij. Kur përdoruesit me pagesë marrin modele më të avancuara, ata nuk po marrin thjesht rezultate individuale më të mira — ata po marrin një konsensus më të fortë. Modele më të mira, konsensus më i mirë, përkthime më të besueshme. Kjo është ajo që do të thotë në të vërtetë përkthim i nivelit profesional.
Ai formulim më mbeti në mendje. Nuk është vetëm një argument kostoje. Është një argument qartësie.
Modelet më të afta të IA-së kushtojnë ndjeshëm më shumë për token për t'u ekzekutuar. Kjo nuk është një politikë e MachineTranslation.com, por është mënyra se si çdo ofrues i madh i AI i çmimon modelet e tij kryesore. OpenAI, Anthropic, Google dhe DeepSeek i rezervojnë modelet e tyre më të fundit dhe më të aftë për klientët me pagesë, sepse ato modele janë ndjeshëm më të shtrenjta për t'u operuar. Përdorimi i modelit tonë më të avancuar për çdo përkthim falas, çdo pyetje të rastësishme, çdo kërkesë të tipit çfarë thotë kjo tabelë, do t'i rriste ndjeshëm kostot tona të infrastrukturës.
Më e rëndësishmja, kjo do të thoshte të subvenciononim rastet e përdorimit me kompleksitet të ulët me buxhetin e fuqisë llogaritëse që na nevojitet për të ruajtur cilësinë për profesionistët që përkthejnë dokumente teknike prej 10,000 fjalësh. Kjo nuk është një shpërndarje e qëndrueshme apo e arsyeshme.
Ka një version të këtij vendimi që është thjesht mercenar — tarifo më shumë, jep më shumë, e thjeshtë. Në të vërtetë, nuk është kjo ajo që e nxit.
Ajo që e nxit është se ne kemi ndërtuar një platformë që mund të nxjerrë vërtet në pah dallimet në cilësi midis modeleve të AI. Ne kemi mjetet e brendshme për t'i parë qartë ato dallime. Të zgjedhësh të injorosh atë dukshmëri kur projektojmë nivelet e përdoruesve tanë do të ishte një lloj pandershmërie, duke pretenduar se hendeku nuk ekziston kur kemi prova se ai ekziston.
Përdoruesit falas meritojnë të dinë se çfarë po marrin. Përdoruesit me pagesë meritojnë të dinë se po marrin diçka thelbësisht ndryshe. Dhe dallimi nuk është vetëm qasja në modele më të avancuara, por qasja në një konsensus më të fortë të ndërtuar nga ato modele. Ky është sinjali i besueshmërisë që asnjë AI e vetme nuk mund ta ofrojë.
Ne jemi ende duke punuar me detajet e zbatimit, kështu që dua të jem i kujdesshëm të mos premtoj tepër për detajet specifike. Por ja ku është drejtimi.
Përkthimet e planit falas do të vazhdojnë të përdorin modele të afta të IA-së. Për shumicën e punëve të përditshme të përkthimit (mesazhe të shkurtra, lexim i rastësishëm, korrespondencë bazë), përdoruesit falas do të marrin përkthime të sakta dhe të besueshme. Kjo nuk do të ndryshojë.
Plani falas ekziston sepse ne besojmë se gjuha nuk duhet të jetë një pengesë dhe ne nuk do të tërhiqemi nga kjo.
Dallimi do të jetë më i dukshëm në:
| Lloji i përmbajtjes | Pse cilësia e modelit ka rëndësi këtu |
|---|---|
| Dokumente ligjore dhe financiare | Klauzola kushtëzuese, terminologji specifike për juridiksionin, qëndrueshmëri e regjistrit |
| Dokumentacion teknik | Fjalor specifik për fushën, koherencë në dokumente të gjata |
| Tekste mjekësore dhe klinike | Saktësi, regjistër, ndjeshmëri ndaj paqartësisë |
| Tekste marketingu dhe marke | Përdorim idiomatik, saktësi tonale, rezonancë kulturore |
| Çifte gjuhësore me burime të pakta | Të dhëna më të pakta trajnimi nënkuptojnë boshllëqe më të mëdha në cilësinë e modelit |
| Dokumente të gjata (5,000+ fjalë) | Ruajtja e kontekstit, qëndrueshmëria në të gjithë dokumentin |
Për përdoruesit profesionistë që punojnë në ndonjë nga këto kategori, niveli i modelit do të bëjë një ndryshim të vërtetë. Planet tona me pagesë janë ndërtuar pikërisht për ta.
Dhe për shkak se konsensusi i SMART-it ndërtohet nga ato modele më të avancuara, përdoruesit me pagesë nuk po marrin vetëm rezultate individuale më të mira — ata po marrin përkthim më të besueshëm nga AI, të gjeneruar nga modelet më të fundit që punojnë së bashku.
Dua të jem i sinqertë që kjo çështje nuk është zgjidhur ende plotësisht.
Ne jemi ende duke përcaktuar ndarjen e saktë të modeleve — cilat modele vendosen në cilin nivel dhe si t'ua komunikojmë këtë qartë përdoruesve brenda produktit. Po punojmë me logjikën e paywall-it për t'u siguruar që përvoja të jetë e rrjedhshme, jo penguese. Dhe po mendojmë me kujdes se si t'u paraqesim përdoruesve informacionin për cilësinë e modelit në një mënyrë që është vërtet e dobishme dhe jo thjesht një pretendim marketingu.
Gjithashtu, ka një pyetje reale që po shqyrtojmë: si ta ndihmojmë një përdorues falas të kuptojë, në atë moment, kur ka hasur në një rast përdorimi ku përmirësimi do të përmirësonte ndjeshëm rezultatin e tyre? Kjo është sa një sfidë e UX-it, aq edhe e produktit, dhe ende nuk e kemi përgjigjen e plotë.
Do të shkruaj për mënyrën se si do të pritet sapo të jetë live. Për momentin, ky është mendimi.
Nëse jeni një përdorues me pagesë dhe doni të jepni mendimin tuaj për atë që ka më shumë rëndësi për ju në cilësinë e modelit, jam sinqerisht i interesuar. Lini një mesazh nëpërmjet faqes së kontaktit të MachineTranslation.com.
Sepse testimi ynë i brendshëm tregoi një hendek të ndjeshëm cilësie midis niveleve të modeleve në detyrat e përkthimit të nivelit profesional. Ne ndërtuam një mjet për të krahasuar njëkohësisht modele të shumta të IA-së, dhe të dhënat e treguan qartë: modelet e avancuara e trajtojnë përmbajtjen komplekse, idiomatike dhe specifike për fushën ndjeshëm më mirë. Ndryshimi i kategorisë e pasqyron me sinqeritet atë realitet. Përfitimi më i madh për përdoruesit me pagesë është se konsensusi SMART ndërtohet nga modele më të avancuara, që do të thotë se vetë sinjali i besueshmërisë është më i fortë.
Jo. Përdoruesit e planit falas do të vazhdojnë të marrin përkthime cilësore dhe të sakta për raste të përdorimit të përditshëm. Ndryshimi është se përdoruesit me pagesë do të kalojnë në modele më të avancuara, dhe jo se përdoruesve falas do t'u ulet niveli.
Dokumentet ligjore, financiare, mjekësore, teknike dhe dokumentet e gjata — dhe çdo përmbajtje në çifte gjuhësore më pak të zakonshme, ku të dhënat e trajnimit janë më të pakta. Për tekst të shkurtër, të thjeshtë, të përditshëm, dallimi midis niveleve të modelit është minimal. Përfitimi më i madh për përdoruesit me pagesë është se konsensusi SMART ndërtohet nga modele më të avancuara, çka do të thotë se vetë sinjali i besueshmërisë është më i fortë.
Po e ndërtojmë tani. Do të postoj një përditësim kur të dërgohet, duke përfshirë si duket përvoja në produkt dhe çfarë tregojnë të dhënat e para.
Ne vëmë në punë modele të shumta njëkohësisht dhe përdorim një qasje vlerësimi të bazuar në konsensus për të vlerësuar rezultatet. Mjeti ynë i brendshëm i krahasimit na lejon të testojmë cilësinë nëpër nivelet e modeleve në të njëjtin tekst burimor, dhe pikërisht kjo e informoi këtë vendim për ndarjen në nivele. Ju mund të mësoni më shumë rreth mënyrës se si funksionon sistemi i konsensusit i MachineTranslation.com.com.