Translation memory (TM) — avval tarjima qilingan manba segmenti va uning maqsad tildagi ekvivalentini juftlik sifatida saqlaydigan ma’lumotlar bazasi. Computer-Assisted Translation vositasi yangi hujjatdagi gap yoki iborani bazadan qidirib, to‘liq yoki o‘xshash mosliklarni tarjimonga taklif qiladi. TM avtomatik tarjima modeli emas; uning asosiy vazifasi inson tasdiqlagan tarjimalarni qayta ishlatish va terminologik izchillikni oshirishdir.
Segment va moslik
Hujjat odatda gap, sarlavha yoki ro‘yxat elementi kabi segmentlarga bo‘linadi. Exact match manba segmenti bazadagi yozuv bilan bir xil ekanini bildiradi. Fuzzy match kichik farq — raqam, so‘z yoki tinish belgisi — mavjudligini ko‘rsatadi va foizli yaqinlik bilan beriladi. Context match qo‘shni segment yoki hujjat joylashuvini ham hisobga oladi.
Yuqori foiz tarjima to‘g‘ri degani emas. “File” so‘zi menyuda buyruq, boshqa kontekstda fayl ma’nosida bo‘lishi mumkin. Tarjimon target segmentni grammatika, domain va yangi manba o‘zgarishiga mos tekshiradi. Eski xato ham TM orqali takrorlanishi mumkin, shu sabab tasdiqlash va sifat darajasi metadata’da saqlanadi.
Tuzilma va format
TM yozuvida source text, target text, til juftligi, yaratilgan vaqt, muallif, loyiha va tasdiq holati bo‘lishi mumkin. Segment ID va context key takroriy, lekin turli ma’nodagi satrlarni ajratadi. Placeholder, HTML tag va format markerlar matndan alohida himoyalanadi; targetda ularning yo‘qolishi dastur xatosiga sabab bo‘lishi mumkin.
TMX turli tarjima vositalari orasida translation memory almashish uchun XML asosidagi standart formatdir. XLIFF esa tarjima qilinadigan content va workflow metadata’ni almashishga mo‘ljallangan. Mahsulotlar standartni turlicha kengaytirishi mumkin, shuning uchun importdan keyin til kodi, inline tag va segment chegaralari sinovdan o‘tkaziladi.
Terminologiya bilan aloqasi
Termbase tasdiqlangan termin, ta’rif, so‘z turkumi va ruxsat etilmagan variantlarni saqlaydi. Translation memory esa butun segment juftligini saqlaydi. Masalan, “Service Worker” atamasining o‘zbekcha yozilishi termbase’da, u qatnashgan avvalgi gaplar TM’da turadi. Quality checker target segmentda majburiy termin ishlatilganini tekshirishi mumkin.
Machine translation TM’da moslik topilmaganda taklif berishi mumkin. Bu ikki manbaning confidence va kelib chiqishi interfeysda aniq ajratiladi. Inson tahriridan o‘tgan machine output yangi TM yozuviga aylanishi mumkin, lekin raw natijani avtomatik tasdiqlangan korpusga qo‘shish xatoni ko‘paytiradi.
Sifat va boshqaruv
Deduplication bir manba uchun qarama-qarshi targetlarni ko‘rsatadi, ammo ularni ko‘r-ko‘rona birlashtirish mumkin emas. Loyiha, mijoz va versiya bo‘yicha alohida TM kontekstni saqlaydi. Eskirgan brend yoki UI atamasi deprecated belgisi bilan chetlashtiriladi. Periodik review eng ko‘p qayta ishlatiladigan segmentlardan boshlanadi.
TM tijorat hujjati, shaxsiy ma’lumot yoki hali e’lon qilinmagan mahsulot matnini saqlashi mumkin. Kirish loyiha bo‘yicha cheklanadi, eksport audit qilinadi va cloud CAT xizmatiga yuborish shartnomada baholanadi. Tarjimon nomi kabi metadata retention talabiga mos boshqariladi.
Dastur lokalizatsiyasidagi integratsiya
Source segmentga faqat ko‘rinadigan matn emas, stable key va developer context ham biriktiriladi. “Open” fe’lmi yoki sifatmi degan izoh tarjimonning to‘g‘ri variant tanlashiga yordam beradi. Screenshot reference UI’dagi joy va uzunlik cheklovini ko‘rsatadi. String concatenation gap bo‘laklarini kontekstsiz qoldiradi va boshqa tilda so‘z tartibini buzadi; placeholderli butun jumla afzal.
Yangilangan source satr fuzzy match sifatida ko‘rinadi, tarjimon aynan qaysi token o‘zgarganini ko‘radi. Faqat tinish belgisi o‘zgargan bo‘lsa ham target avtomatik nashr qilinmaydi, chunki ma’no yoki UI talabi yangilangan bo‘lishi mumkin. Build pipeline missing translation va buzilgan placeholderni release’dan oldin aniqlaydi.
Bog‘liq tushunchalar
Computer-Assisted Translation, TMX, XLIFF, Termbase, Localization, Machine translation, Fuzzy matching