June 10, 2026
Хачу падзяліцца рашэннем, якое мы прынялі на гэтым тыдні — не пасля яго выпуску, а пакуль мы яшчэ над ім працуем.
Мы змяняем спосаб размеркавання мадэляў ШІ паміж узроўнямі нашых карыстальнікаў. Платныя карыстальнікі MachineTranslation.com хутка атрымаюць доступ да больш прасунутых мадэляў штучнага інтэлекту ад вядучых пастаўшчыкоў — OpenAI, Anthropic, Google, DeepSeek і іншых. Бясплатныя карыстальнікі па-ранейшаму будуць атрымліваць якасны і надзейны пераклад, але з выкарыстаннем іншых мадэляў. Гэты прабел наўмысны, і я хачу дакладна патлумачыць, чаму мы прымаем такое рашэнне.
Я б лепш напісаў гэта цяпер, пакуль развагі свежыя, а рашэнне яшчэ трохі сырое, чым чакаць, пакуль яно будзе апублікавана, і падаваць гэта як адшліфаваную аб'яву. Шчырая версія больш карысная.
MachineTranslation.com адначасова перакладае з дапамогай 22 мадэлей ШІ і выкарыстоўвае падыход, заснаваны на кансенсусе, каб паказаць найлепшы вынік. Гэта заўсёды было сутнасцю нашай працы — не ставіць усё на адну мадэль, а параўноўваць некалькі і дазваляць вынікам гаварыць самім за сябе.
Нязручны бок такога падыходу ў тым, што ён робіць розніцу ў якасці паміж мадэлямі вельмі заўважнай. Мы кожны дзень бачым, што не ўсе мадэлі аднолькава добра апрацоўваюць любы тэкст. І доўгі час мы не дазвалялі гэтаму назіранню змяніць тое, як мы размяркоўвалі мадэлі паміж карыстальнікамі.
Некалькі тыдняў таму Рэйчэл (наша кіраўніца па ШІ) прадэманстравала нам унутраны інструмент, які мы стварылі для адначасовага тэсціравання якасці перакладу на некалькіх мадэлях GPT, у тым ліку GPT 4.1 nano, GPT 4.1 mini, GPT 5.4 mini і іншых. Вы ўводзіце адзін і той жа зыходны тэкст і бачыце вынікі кожнай мадэлі побач.
Гэты інструмент адразу ж дае зразумець: на простых, кароткіх, паўсядзённых тэкстах вынікі амаль ідэнтычныя. Вы сапраўды не можаце прывесці важкі аргумент на карысць прэміум-мадэляў на прыкладзе фразы «сустрэча а 15-й гадзіне».
Але на чымсьці з сапраўднай лінгвістычнай складанасцю (ідэаматычныя выразы, галіновая тэрміналогія, доўгія дакументы, дзе кантэкст павінен захоўвацца на працягу тысяч слоў) розніца паміж мадэлямі становіцца відавочнай, і яна выяўляецца ў прафесійна значных аспектах.
Гэта тое, пра што, на маю думку, індустрыя перакладаў не гаворыць дастаткова шчыра. Мадэлі ніжэйшага ўзроўню звычайна не ствараюць відавочна няправільных перакладаў. Яны ствараюць пераклады, якія на першы погляд выглядаюць нармальна, але ўтрымліваюць тонкія памылкі, якія профільны спецыяліст (юрыст, медыцынскі работнік, старшы менеджар па лакалізацыі) заўважыць адразу.
Умоўны сказ, перададзены з няправільным сэнсам. Юрыдычны тэрмін, які азначае нешта канкрэтнае ў гэтай юрысдыкцыі, перакладзены як яго бытавы эквівалент. Стылістычны збой на сярэдзіне доўгага дакумента, які падрывае прафесійны давер да ўсяго тэксту.
Збой — ціхі. І невідавочныя памылкі ў прафесійным перакладзе могуць дорага каштаваць.
Мы прынялі гэтае рашэнне не на аснове інтуіцыі. Мы пратэсціравалі мадэлі на складаным, ідыяматычным зыходным тэксце (змесце таго тыпу, пераклад якога сапраўды патрэбны нашым прафесійным карыстальнікам), і папрасілі лінгвістаў ацаніць вынікі.
Вынік быў відавочны. Удасканаленыя мадэлі стабільна лепш спраўляліся з нюансамі, рэгістрам і галіновай тэрміналогіяй. Таннейшыя мадэлі былі больш чым дастатковымі для звычайнага выкарыстання. Два выпадкі выкарыстання сапраўды патрабуюць розных інструментаў.

Размова, якую гэта выклікала ўнутры кампаніі, тычылася не столькі цэнаўтварэння, колькі сумленнасці. Калі мы ведаем, што мадэлі працуюць па-рознаму з прафесійным кантэнтам, і мы ведаем, што нашы платныя карыстальнікі пераважна перакладаюць прафесійны кантэнт, тады прадастаўленне ім той жа мадэлі, што і бясплатнаму карыстальніку, які перакладае звычайны электронны ліст, — гэта дрэнна і для тых, і для другіх.
Офер (наш генеральны дырэктар) ясна выказаўся падчас нашай унутранай дыскусіі:
«Мадэлі ніжэйшага ўзроўню нясуць рэальныя рызыкі для якасці пры працы са складанымі або ідыяматычнымі тэкстамі. Але галоўная думка ў наступным: кансенсус настолькі ж добры, як і мадэлі, што стаяць за ім. Калі платныя карыстальнікі атрымліваюць больш прасунутыя мадэлі, яны атрымліваюць не проста лепшыя асобныя вынікі — яны атрымліваюць мацнейшы кансэнсус. Лепшыя мадэлі, лепшы кансенсус, больш надзейныя пераклады. Вось што насамрэч азначае прафесійны пераклад.
Гэтая фармулёўка мне запомнілася. Справа не толькі ў кошце. Гэта аргумент на карысць яснасці.
Эксплуатацыя больш магутных мадэлей ШІ каштуе значна даражэй у разліку на токен. Гэта не палітыка MachineTranslation.com, а тое, як кожны буйны пастаўшчык ШІ ўстанаўлівае цэны на свае флагманскія мадэлі. OpenAI, Anthropic, Google і DeepSeek рэзервуюць свае найноўшыя, самыя магутныя мадэлі для платных кліентаў, таму што гэтыя мадэлі значна даражэйшыя ў эксплуатацыі. Выкарыстанне нашай самай перадавой мадэлі для кожнага бясплатнага перакладу, кожнага выпадковага запыту і кожнага запыту кшталту «што напісана на гэтай шыльдзе» значна павялічыла б нашы выдаткі на інфраструктуру.
Што яшчэ больш важна, гэта азначала б перакрыжаванае субсідзіраванне простых выпадкаў выкарыстання за кошт вылічальнага бюджэту, неабходнага для падтрымання якасці для прафесіяналаў, якія перакладаюць тэхнічныя дакументы аб'ёмам 10 000 слоў. Гэта не ўстойлівае і не разумнае размеркаванне.
Ёсць версія гэтага рашэння, якая з'яўляецца чыста карыслівай — браць больш, даваць больш, усё проста. Насамрэч, справа не ў гэтым.
Рухае гэтым тое, што мы стварылі платформу, якая можа па-сапраўднаму выявіць розніцу ў якасці паміж мадэлямі ШІ. У нас ёсць унутраны інструментарый, каб выразна бачыць гэтыя адрозненні. Ігнараваць гэтую бачнасць пры распрацоўцы нашых узроўняў карыстальнікаў было б свайго роду несумленнасцю — рабіць выгляд, што разрыву не існуе, калі мы маем доказы, што ён ёсць.
Бясплатныя карыстальнікі заслугоўваюць ведаць, што яны атрымліваюць. Платныя карыстальнікі заслугоўваюць ведаць, што яны атрымліваюць нешта істотна іншае. І розніца не толькі ў доступе да больш дасканалых мадэляў, але і ў доступе да мацнейшага кансенсусу, пабудаванага на аснове гэтых мадэляў. Гэта той сігнал надзейнасці, які не можа забяспечыць ніводны ШІ.
Мы ўсё яшчэ прапрацоўваем дэталі рэалізацыі, таму я хачу быць асцярожным і не даваць занадта канкрэтных абяцанняў. Але вось напрамак.
Пераклады ў бясплатным плане і надалей будуць выкарыстоўваць магутныя мадэлі ШІ. Для большасці штодзённых задач па перакладзе (кароткія паведамленні, паўсядзённае чытанне, простае ліставанне) бясплатныя карыстальнікі атрымаюць дакладны, надзейны вынік. Гэта не зменіцца.
Бясплатны ўзровень існуе, таму што мы лічым, што мова не павінна быць перашкодай, і мы не адмаўляемся ад гэтага.
Розніца будзе найбольш прыкметнай у:
| Тып змесціва | Чаму тут важная якасць мадэлі |
|---|---|
| Юрыдычныя і фінансавыя дакументы | Умоўныя палажэнні, тэрміналогія канкрэтнай юрысдыкцыі, захаванне стылю |
| Тэхнічная дакументацыя | Спецыфічная лексіка, захаванне цэласнасці ў вялікіх дакументах |
| Медыцынскія і клінічныя тэксты | Дакладнасць, стыль, адчувальнасць да неадназначнасці |
| Маркетынгавыя і брэндавыя тэксты | Выкарыстанне ідыём, танальная дакладнасць, культурны рэзананс |
| Моўныя пары з невялікай колькасцю рэсурсаў | Меншы аб'ём навучальных даных азначае большыя разрывы ў якасці мадэлі |
| Вялікія дакументы (5000+ слоў) | Захаванне кантэксту, аднастайнасць ва ўсім дакуменце |
Для прафесійных карыстальнікаў, якія працуюць у любой з гэтых катэгорый, узровень мадэлі будзе мець рэальнае значэнне. Менавіта для іх і створаны нашы платныя планы.
І паколькі кансенсус SMART будуецца на аснове гэтых больш дасканалых мадэляў, платныя карыстальнікі атрымліваюць не проста лепшыя асобныя вынікі — яны атрымліваюць больш надзейны машынны пераклад, створаны найноўшымі мадэлямі, якія працуюць разам.
Хачу быць шчырым: гэтае пытанне яшчэ не вырашана да канца.
Мы ўсё яшчэ вызначаем дакладнае размеркаванне мадэляў — якія мадэлі будуць на якім узроўні, і як мы будзем дакладна паведамляць пра гэта карыстальнікам у прадукце. Мы прапрацоўваем логіку платнага доступу, каб карыстальніцкі досвед быў плаўным, а не раздражняльным. І мы старанна разважаем, як падаць карыстальнікам інфармацыю пра якасць мадэлі так, каб яна была сапраўды карыснай, а не проста маркетынгавай заявай.
Таксама перад намі стаіць рэальнае пытанне: як дапамагчы карыстальніку бясплатнай версіі зразумець у момант выкарыстання, калі ён сутыкнуўся са сцэнарыем, дзе абнаўленне значна палепшыць яго вынік? Гэта ў роўнай ступені выклік для UX і для прадукту, і ў нас яшчэ няма поўнага адказу.
Я напішу пра тое, як гэта будзе ўспрынята, пасля запуску. Пакуль што думкі такія.
Калі вы платны карыстальнік і хочаце выказаць сваё меркаванне наконт таго, што для вас найбольш важна ў якасці мадэлі, мне сапраўды цікава. Пакіньце паведамленне праз кантактную старонку MachineTranslation.com.
Таму што наша ўнутранае тэсціраванне паказала значную розніцу ў якасці паміж узроўнямі мадэлей пры выкананні задач прафесійнага перакладу. Мы стварылі інструмент для адначасовага параўнання некалькіх мадэляў штучнага інтэлекту, і даныя выразна паказалі: прасунутыя мадэлі значна лепш спраўляюцца са складаным, ідыяматычным і вузкаспецыялізаваным кантэнтам. Змена ўзроўню сумленна адлюстроўвае тую рэальнасць. Большая перавага для платных карыстальнікаў заключаецца ў тым, што кансенсус SMART грунтуецца на больш дасканалых мадэлях, а гэта значыць, што сам сігнал надзейнасці мацнейшы.
Не. Карыстальнікі бясплатнага плана па-ранейшаму будуць атрымліваць якасныя і дакладныя пераклады для штодзённага выкарыстання. Змена ў тым, што платныя карыстальнікі атрымаюць абнаўленне да больш прасунутых мадэляў, а не ў тым, што бясплатныя карыстальнікі будуць паніжаны.
Юрыдычныя, фінансавыя, медыцынскія, тэхнічныя і аб'ёмныя дакументы — а таксама любое змесціва ў менш распаўсюджаных моўных парах, дзе менш навучальных даных. Для кароткіх, простых, паўсядзённых тэкстаў розніца паміж узроўнямі мадэлі мінімальная. Большая перавага для платных карыстальнікаў заключаецца ў тым, што кансенсус SMART пабудаваны на больш дасканалых мадэлях, а гэта азначае, што і сам сігнал надзейнасці мацнейшы.
Мы распрацоўваем гэта зараз. Я апублікую абнаўленне, калі яно будзе адпраўлена, у тым ліку пра тое, як гэта выглядае ў прадукце і што паказваюць першыя даныя.
Мы запускаем некалькі мадэлей адначасова і выкарыстоўваем кансенсусны падыход да ацэнкі вынікаў. Наш унутраны інструмент параўнання дазваляе нам правяраць якасць мадэлей розных узроўняў на адным і тым жа зыходным тэксце, што і легла ў аснову рашэння аб такім падзеле. Вы можаце даведацца больш пра тое, як працуе кансенсусная сістэма MachineTranslation.com.com.