Bosh sahifa Wiki Structured data

Structured data

Structured data — oldindan belgilangan schema, field va type’lar asosida tashkil etilgan ma’lumot. Relational jadval, typed API xabari va qat’iy ustunli CSV bunga misol bo‘la oladi. Tuzilma har yozuvning qaysi qismi nimani anglatishini machine-readable tarzda belgilaydi, shu sabab qidirish, validatsiya, birlashtirish va tahlil qilish osonlashadi.

Schema xususiyatlari

Schema field nomi, data type, nullability, constraint va munosabatlarni ifodalaydi. order_id integer yoki UUID, created_at timezone’li timestamp, amount esa decimal va currency bilan bog‘liq bo‘lishi mumkin. Faqat field nomi semantikani to‘liq bermaydi; birlik, timezone va biznes ma’nosi data dictionary’da yoziladi.

Closed schema noma’lum fieldni rad etadi, open schema kengayishga ruxsat beradi. Qat’iylik xatoni erta topadi, lekin evolyutsiyani boshqarish talab etadi. Schema-on-write data kirishda moslashtiradi; schema-on-read query vaqtida talqin qiladi. Ikkinchisi xom data lake’da moslashuvchan, ammo sifat muammosini consumerlarga surishi mumkin.

Semi-structured va unstructured data

JSON va XML ko‘pincha semi-structured deb ataladi: har hujjat field va nestingga ega, lekin barcha yozuv bir xil schema’ga majbur bo‘lmasligi mumkin. Schema validation qo‘llansa ular qat’iy structured almashuvga aylanishi mumkin. Matn, audio va tasvir unstructured deyiladi, ammo ular filename, vaqt, til va label kabi structured metadata bilan birga saqlanadi.

Chegara absolyut emas. Email body matn, headerlari structured. PDF ko‘rinish buyruqlariga ega, lekin undagi jadvalning mantiqiy row-column tuzilishi aniq bo‘lmasligi mumkin. OCR va Document AI unstructured ko‘rinishdan structured field chiqaradi, natija confidence bilan baholanadi.

Saqlash va so‘rov

Relational database structured data uchun table, key, index va SQL beradi. Constraint referential integrityni saqlaydi. Columnar warehouse analytic aggregationni, row-oriented database transactional accessni optimallashtiradi. Document database nested strukturani tabiiy saqlaydi, ammo field variantlari va index strategiyasi nazorat qilinmasa schema drift yuz beradi.

Index tez qidiruv beradi, lekin write va storage xarajati bor. Query pattern asosida tanlanadi. Partition katta datasetni vaqt yoki tenant bo‘yicha ajratadi. Primary key entity’ni barqaror aniqlaydi; mutable ism yoki emailni key qilish migration va duplicate muammosini keltiradi.

Sifat va almashuv

Structured bo‘lish data to‘g‘ri degani emas. Type mos bo‘lsa ham tug‘ilgan sana kelajakda yoki summa noto‘g‘ri valyutada bo‘lishi mumkin. Completeness, uniqueness, validity, consistency va timeliness alohida o‘lchanadi. Constraint, profiling va reconciliation birgalikda ishlaydi.

Data exchange’da schema registry versiyalarni saqlaydi. Optional field qo‘shish ko‘pincha mos, type yoki ma’noni almashtirish breaking change. Producer va consumer contract testdan o‘tadi. Null, field yo‘qligi va default qiymat semanticsi ochiq belgilanadi.

Vebdagi structured data

Qidiruv tizimlari uchun HTML sahifaga JSON-LD, Microdata yoki RDFa orqali entity haqidagi structured metadata qo‘shilishi mumkin. Masalan, maqola muallifi, sanasi va sarlavhasi machine-readable beriladi. Metadata sahifadagi real ko‘rinadigan contentga mos bo‘lishi kerak; yolg‘on rating yoki yashirin ma’lumot qidiruv siyosatini buzadi.

Schema.org vocabulary keng tarqalgan, ammo markup rich result chiqishini kafolatlamaydi. Validator syntaxni tekshiradi, qidiruv konsoli esa indexing muammosini ko‘rsatadi. JSON-LD scripti ham untrusted qiymatlar bilan xavfsiz serialize qilinadi; raw string concatenation script context injectionga sabab bo‘lishi mumkin.

Bog‘liq tushunchalar

Schema, Relational database, Semi-structured data, JSON-LD, Data model, Data quality, Metadata