Bosh sahifa Wiki Confusion matrix

Confusion matrix

Confusion matrix — haqiqiy va bashorat qilingan sinflar kombinatsiyasi bo‘yicha namunalar sonini jadval ko‘rinishida ko‘rsatuvchi vosita. Tushuncha dataset tayyorlash, model o‘qitish, inference yoki baholash bosqichlaridan biriga tegishli bo‘lishi mumkin. Uni aniq qo‘llash uchun qiymatning ma’nosi, birligi, vaqt nuqtasi va target bilan aloqasi hujjatlashtiriladi.

Tuzilishi

Confusion matrixning asosiy mexanizmi: binary holatda TP, TN, FP va FN; multi-class holatda qator va ustunlar classlar bo‘lib, diagonal to‘g‘ri bashoratlarni ifodalaydi. Jarayon input schema, tensor shape, class tartibi va missing-value siyosatiga bog‘liq. Shu shartlardan biri training va serving o‘rtasida farq qilsa, kod ishlashda davom etsa ham natija semantik jihatdan noto‘g‘ri bo‘lishi mumkin.

Confusion matrix bilan ishlash sodda baseline va tekshiriladigan data splitdan boshlanadi. Har transformatsiya, threshold yoki hyperparameter alohida ablation orqali baholanadi. Random seed, dataset snapshoti, feature kodi va dependency versiyasi saqlanishi tajribani takrorlash va regression sababini aniqlash imkonini beradi.

Joriy etish

Confusion matrix klassifikatsiya error analysisi, qaysi sinflar aralashishini aniqlash va metric hisoblashda qo‘llanadi. Production ma’lumoti laboratoriya datasetidan hajm, shovqin, kechikish va taqsimot bo‘yicha farq qiladi. Shuning uchun bo‘sh qiymat, yangi kategoriya, ekstremal son, takroriy yozuv va out-of-domain namuna uchun aniq qayta ishlash qoidasi bo‘ladi.

Confusion matrix pipeline’ga qo‘shilganda owner, yangilanish chastotasi va downstream iste’molchilar qayd etiladi. Yangi variant avval offline holdoutda, so‘ng kichik trafikdagi canary sinovda tekshiriladi. Eski artefakt, transformatsiya va schema rollback uchun saqlanadi. Sensitive ma’lumot ishlatilsa access, retention va log sanitization alohida belgilanadi.

Sifat nazorati

Confusion matrixni baholashda normalized va raw count, per-class support, vaqt va subgroup bo‘yicha matritsa kuzatiladi. Birgina o‘rtacha metric kam uchraydigan, ammo muhim xatolarni yashirishi mumkin. Shu sabab natija class, vaqt, region, til, input uzunligi va boshqa muhim subgroup bo‘yicha ajratiladi. Confidence interval va sample soni metric bilan birga ko‘rsatiladi.

Taqqoslash bir xil train-validation-test ajratilishi, preprocessing va compute budjetida bajariladi. Confusion matrix bo‘yicha offline yutuq haqiqiy biznes natijasini kafolatlamaydi; end-to-end test va monitoring data drift, xato darajasi, latency hamda resurs sarfini kuzatadi. Belgilangan chegara buzilganda yangilanish to‘xtatiladi yoki rollback qilinadi.

Muammoli holatlar

Confusion matrix bilan bog‘liq asosiy xavflar: o‘qlarni almashtirish, class imbalance’ni yashirish, kichik count va ko‘p classda o‘qish qiyinligi. Ularni kamaytirish uchun schema validation, leakage auditi, regression test, data lineage va inson ko‘rigi birgalikda qo‘llanadi. Label yoki feedback inson tomonidan berilsa, rubric va annotator kelishuvi saqlanadi; avtomatik yaratilsa, uning confidence’i va kelib chiqishi yoziladi.

Confusion matrixdan olingan natija sababiy bog‘lanish yoki mutlaq haqiqat deb avtomatik talqin qilinmaydi. Model training taqsimoti va objective doirasida ishlaydi. Yuqori xavfli qarorda threshold, abstention, dalilga qaytish hamda inson tasdig‘i mavjud bo‘ladi. Mo‘ljallangan foydalanish va ma’lum cheklovlar release hujjatida ko‘rsatiladi.

Versiyalash

Confusion matrixga tegishli dataset fingerprinti, kod, model va konfiguratsiya bitta release identifikatori bilan bog‘lanadi. Yangilanishdan oldin va keyin bir xil regression to‘plami ishlatiladi. Natija yomonlashsa, faqat model weighti emas, unga mos feature pipeline, schema va runtime ham avvalgi versiyaga qaytariladi. Bu kuzatilgan farq manbasini ajratish va tajribani boshqa muhitda qayta bajarishga yordam beradi.

Bog‘liq tushunchalar

True positive, False negative, Precision, Recall, Classification, Error analysis