Strukturerad data passar snyggt in i rader och kolumner. Namn, datum, belopp och kategorier. Varje fält har en definierad typ. Varje post följer samma format. Strukturen definieras i förväg av ett schema. Relationsdatabaser lagrar strukturerad data. Kalkylblad lagrar den. CSV-filer lagrar den. Styvheten är poängen. Eftersom strukturen är förutsägbar är frågorna snabba och resultaten konsekventa. Du kan koppla samman tabeller, aggregera värden och filtrera rader med förtroende för att informationen kommer att bete sig som förväntat.
Strukturerad data dominerar traditionella affärssystem. Transaktioner, lager, kundregister och ekonomiböcker är alla strukturerade. Schemat framtvingar konsekvens. Ett datumfält får inte innehålla text. Ett numeriskt fält får inte innehålla en sträng. Den tillämpningen upptäcker fel tidigt. Det gör också informationen lätt att analysera. SQL byggdes för strukturerad data. Business Intelligence-verktyg förutsätter det. Maskininlärningsmodeller föredrar det ofta. Begränsningen är flexibilitet. Strukturerad data kräver att man känner till schemat innan man lagrar informationen. Om informationen ändrar form måste man ändra schemat. Den migreringen är störande. Semistrukturerad och ostrukturerad data undviker det problemet genom att skjuta upp strukturen till frågetid. Men de byter flexibilitet mot komplexitet. Strukturerad data är enklare att arbeta med och svårare att ändra. De flesta organisationer använder den. Redovisningssystemet, CRM, ERP. De lagrar alla strukturerad data. Det är inte spännande. Det är grunden.
Strukturerade dataegenskaper
- Schemadefinierad — struktur känd i förväg
- Tabellform — rader och kolumner
- Typad — varje fält har en datatyp
- Frågbar — SQL och liknande språk
- Konsekvent — samma format för varje post
Strukturerad data är förutsägbar. Det är den förutsägbarheten som gör den användbar och den som gör den stel.
Comments
No comments yet. Be the first to share a thought.
Leave a comment