June 10, 2026
Saya ingin berkongsi sesuatu yang kami putuskan minggu ini — bukan selepas ia dilancarkan, tetapi semasa kami masih membangunkannya.
Kami sedang mengubah cara model AI diperuntukkan merentasi peringkat pengguna kami. Pengguna berbayar di MachineTranslation.com akan segera mendapat akses kepada model AI yang lebih canggih daripada penyedia terkemuka — OpenAI, Anthropic, Google, DeepSeek, dan lain-lain. Pengguna percuma akan terus mendapat terjemahan yang cekap dan boleh dipercayai — tetapi bukan model yang sama. Jurang itu disengajakan, dan saya ingin menjelaskan dengan tepat mengapa kami membuat keputusan ini.
Saya lebih suka menulis ini sekarang, sementara alasannya masih segar dan keputusan itu masih sedikit mentah, daripada menunggu sehingga ia dilancarkan dan membingkainya sebagai pengumuman yang rapi. Versi yang jujur lebih berguna.
MachineTranslation.com menterjemah dengan 22 model AI sekaligus dan menggunakan pendekatan berasaskan konsensus untuk menghasilkan output terbaik. Itu sentiasa menjadi teras kepada apa yang kami lakukan — bukan mempertaruhkan segalanya pada satu model, tetapi membandingkan merentasi beberapa model dan membiarkan hasilnya berbicara sendiri.
Sisi yang tidak menyenangkan dari pendekatan itu ialah ia menjadikan perbezaan kualiti antara model sangat ketara. Kita melihat, setiap hari, bahawa tidak semua model mengendalikan semua teks dengan sama baik. Dan untuk masa yang lama, kami tidak membiarkan pemerhatian itu mengubah cara kami memperuntukkan model kepada pengguna.
Beberapa minggu yang lalu, Rachelle (ketua AI kami) membimbing kami melalui alat dalaman yang kami bina untuk menguji kualiti terjemahan merentasi pelbagai model GPT secara serentak — termasuk GPT 4.1 nano, GPT 4.1 mini, GPT 5.4 mini, dan lain-lain. Anda memasukkan teks sumber yang sama, dan anda melihat output setiap model bersebelahan.
Apa yang alat itu jelaskan dengan serta-merta ialah: pada teks yang ringkas, pendek, dan harian, outputnya hampir sama. Anda benar-benar tidak boleh mewajarkan hujah kualiti untuk model premium pada mesyuarat pada jam 3 petang.
Tetapi pada apa-apa sahaja yang mempunyai kerumitan linguistik sebenar (frasa idiomatik, terminologi domain, dokumen panjang di mana konteks perlu dibawa merentasi ribuan perkataan) jurang antara model terbuka, dan ia terbuka dalam cara yang penting secara profesional.
Ini adalah bahagian yang saya rasa industri terjemahan tidak bincangkan dengan cukup jujur. Model peringkat rendah biasanya tidak menghasilkan terjemahan yang jelas salah. Ia menghasilkan terjemahan yang kelihatan baik pada permukaan tetapi mengandungi kesilapan halus yang akan segera dikesan oleh pakar bidang (seorang peguam, profesional perubatan, pengurus penyetempatan kanan).
Klausa bersyarat yang diterjemahkan dengan makna yang salah. Istilah undang-undang yang mempunyai maksud khusus dalam bidang kuasa tersebut, diterjemahkan sebagai padanan sehari-harinya. Pergeseran daftar di pertengahan dokumen panjang yang merosakkan kredibiliti profesional keseluruhan dokumen itu.
Kegagalan itu senyap. Dan kegagalan senyap dalam penterjemahan profesional boleh menjadi mahal.
Kami tidak membuat keputusan ini berdasarkan gerak hati. Kami menjalankan model terhadap teks sumber yang kompleks dan idiomatik (jenis kandungan yang sebenarnya perlu diterjemahkan oleh pengguna profesional kami) dan kami meminta ahli bahasa menilai hasilnya.
Hasilnya jelas. Model-model termaju menangani nuansa, ragam bahasa, dan istilah khusus domain secara konsisten lebih baik. Model-model yang lebih murah lebih daripada mencukupi untuk kegunaan santai. Kedua-dua kes penggunaan itu benar-benar memerlukan alatan yang berbeza.

Perbualan yang tercetus secara dalaman ini kurang mengenai harga dan lebih mengenai kejujuran. Jika kita tahu model-model ini berprestasi secara berbeza pada kandungan gred profesional, dan kita tahu pengguna berbayar kita kebanyakannya menterjemah kandungan gred profesional, maka memberikan mereka model yang sama dengan pengguna percuma yang menterjemah e-mel santai adalah merugikan kedua-duanya.
Ofer (CEO kami) menyatakannya dengan jelas dalam perbincangan dalaman kami:
Model peringkat rendah membawa risiko kualiti sebenar pada teks yang kompleks atau beridiom. Namun, poin yang lebih besar ialah ini: konsensus hanya sebagus model-model di belakangnya. Apabila pengguna berbayar mendapat model yang lebih canggih, mereka bukan sahaja mendapat output individu yang lebih baik — mereka mendapat konsensus yang lebih kukuh. Model yang lebih baik, konsensus yang lebih baik, terjemahan yang lebih boleh dipercayai. Itulah maksud sebenar terjemahan bertaraf profesional.
Kerangka pemikiran itu kekal dalam ingatan saya. Bukan hanya hujah kos. Ini adalah hujah kejelasan.
Model AI yang lebih berkemampuan menelan kos yang jauh lebih tinggi setiap token untuk dijalankan. Itu bukan polisi MachineTranslation.com, ia adalah cara setiap penyedia AI utama menetapkan harga model utama mereka. OpenAI, Anthropic, Google, dan DeepSeek semuanya menyimpan model terkini mereka yang paling berkemampuan untuk pelanggan berbayar kerana model-model tersebut jauh lebih mahal untuk dioperasikan. Menjalankan model kami yang paling canggih merentasi setiap terjemahan percuma, setiap pertanyaan santai, setiap permintaan 'apa yang tertulis pada papan tanda ini', akan meningkatkan dengan ketara kos infrastruktur kami.
Lebih penting lagi, ia bermakna menyubsidi silang kes penggunaan berkerumitan rendah dengan bajet pengkomputeran yang kami perlukan untuk mengekalkan kualiti untuk profesional yang menterjemah dokumen teknikal 10,000 perkataan. Itu bukan peruntukan yang mampan atau masuk akal.
Ada versi keputusan ini yang semata-mata bersifat tamak — caj lebih, beri lebih, mudah. Itu sebenarnya bukan puncanya.
Puncanya ialah kami telah membina sebuah platform yang benar-benar boleh menonjolkan perbezaan kualiti antara model AI. Kami mempunyai alat dalaman untuk melihat perbezaan tersebut dengan jelas. Memilih untuk mengabaikan keterlihatan itu apabila kita mereka bentuk peringkat pengguna kita akan menjadi sejenis ketidakjujuran, berpura-pura jurang itu tidak wujud apabila kita mempunyai bukti ia wujud.
Pengguna percuma berhak tahu apa yang mereka dapat. Pengguna berbayar berhak tahu bahawa mereka mendapat sesuatu yang berbeza secara bermakna. Dan perbezaannya bukan sahaja akses kepada model yang lebih canggih, ia adalah akses kepada konsensus yang lebih kukuh yang dibina daripada model-model tersebut. Itulah isyarat kebolehpercayaan yang tiada satu pun AI boleh berikan.
Kami masih menyelesaikan butiran pelaksanaan, jadi saya ingin berhati-hati agar tidak terlalu menjanjikan perkara yang spesifik. Tetapi ini arahnya.
Terjemahan pelan percuma akan terus menggunakan model AI yang berkebolehan. Untuk kebanyakan tugas terjemahan harian (mesej ringkas, bacaan santai, surat-menyurat asas), pengguna percuma akan mendapat hasil yang tepat dan boleh dipercayai. Itu tidak akan berubah.
Peringkat percuma wujud kerana kami percaya bahasa tidak seharusnya menjadi penghalang, dan kami tidak akan menarik balik kenyataan itu.
Perbezaan akan paling ketara pada:
| Jenis kandungan | Mengapa kualiti model penting di sini |
|---|---|
| Dokumen undang-undang dan kewangan | Klausa bersyarat, terminologi khusus bidang kuasa, konsistensi daftar |
| Dokumentasi teknikal | Perbendaharaan kata khusus domain, koheren dokumen panjang |
| Teks perubatan dan klinikal | Ketepatan, daftar, sensitiviti terhadap kekaburan |
| Salinan pemasaran dan jenama | Pengendalian idiomatik, ketepatan nada, resonansi budaya |
| Pasangan bahasa sumber rendah | Data latihan yang lebih nipis bermakna jurang kualiti model yang lebih besar |
| Dokumen bentuk panjang (5,000+ perkataan) | Pengekalan konteks, konsistensi merentasi keseluruhan dokumen |
Bagi pengguna profesional yang bekerja dalam mana-mana kategori ini, peringkat model akan membuat perbezaan yang nyata. Itulah sebenarnya untuk siapa pelan berbayar kami dibina.
Dan kerana konsensus SMART dibina daripada model-model yang lebih canggih itu, pengguna berbayar bukan sahaja mendapat output individu yang lebih baik — mereka mendapat terjemahan AI yang lebih dipercayai, yang dihasilkan oleh model-model terkini yang bekerjasama.
Saya ingin jujur bahawa ini belum semuanya diselesaikan.
Kami masih menentukan peruntukan model yang tepat — model mana yang berada di peringkat mana, dan bagaimana kami menyampaikan perkara itu dengan jelas kepada pengguna di dalam produk. Kami sedang mengusahakan logik paywall untuk memastikan pengalaman itu lancar, tidak mengganggu. Dan kami sedang berfikir dengan teliti tentang bagaimana untuk menyampaikan maklumat kualiti model kepada pengguna dengan cara yang benar-benar berguna dan bukannya sekadar tuntutan pemasaran.
Terdapat juga soalan sebenar yang sedang kami fikirkan: bagaimana kami membantu pengguna percuma memahami, pada masa itu, apabila mereka menghadapi kes penggunaan di mana peningkatan taraf akan meningkatkan hasil mereka dengan ketara? Itu adalah cabaran UX sama seperti cabaran produk, dan kami belum ada jawapan penuh lagi.
Saya akan menulis tentang bagaimana ini berlaku sebaik sahaja ia dilancarkan. Buat masa ini, inilah yang difikirkan.
Jika anda pengguna berbayar dan anda ingin menyuarakan pendapat tentang apa yang paling penting bagi anda dalam kualiti model, saya amat berminat. Hantar mesej melalui halaman hubungan MachineTranslation.com.
Kerana ujian dalaman kami menunjukkan jurang kualiti yang signifikan antara peringkat model dalam tugas terjemahan gred profesional. Kami membina alat untuk membandingkan pelbagai model AI secara serentak, dan data menunjukkan dengan jelas: model canggih mengendalikan kandungan yang kompleks, idiomatik, dan khusus domain dengan lebih baik. Perubahan peringkat mencerminkan realiti itu secara jujur. Manfaat yang lebih besar bagi pengguna berbayar ialah konsensus SMART dibina daripada model yang lebih canggih, yang bermaksud isyarat kebolehpercayaan itu sendiri lebih kuat.
Tidak. Pengguna pelan percuma akan terus mendapat terjemahan yang berkebolehan dan tepat untuk kegunaan harian. Perubahannya ialah pengguna berbayar akan dinaik taraf kepada model yang lebih canggih, bukanlah pengguna percuma akan diturunkan taraf.
Dokumen undang-undang, kewangan, perubatan, teknikal, dan bentuk panjang — dan sebarang kandungan dalam pasangan bahasa yang kurang lazim di mana data latihan lebih nipis. Untuk teks yang pendek, ringkas, dan harian, perbezaan antara peringkat model adalah minimum. Manfaat yang lebih besar untuk pengguna berbayar ialah bahawa konsensus SMART dibina daripada model yang lebih canggih, yang bermaksud isyarat kebolehpercayaan itu sendiri adalah lebih kuat.
Kami sedang membangunkannya sekarang. Saya akan menyiarkan kemas kini apabila ia dihantar, termasuk bagaimana pengalaman itu kelihatan dalam produk dan apa yang ditunjukkan oleh data awal.
Kami menjalankan pelbagai model secara serentak dan menggunakan pendekatan pemarkahan berasaskan konsensus untuk menilai output. Alat perbandingan dalaman kami membolehkan kami menguji kualiti merentasi peringkat model pada teks sumber yang sama, itulah yang mendasari keputusan pembahagian peringkat ini. Anda boleh mengetahui lebih lanjut tentang bagaimana sistem konsensus MachineTranslation.com.com berfungsi.