Sammenligningsmetode og kodekontrakt
Status: forskningsforankret og delvis kjørbar v2-kontrakt, 15. september 2026. Pilotens begreper, relasjoner, omtaler, påstander og append-only reviewbeslutninger følger nå kontrakten; flere analysefasetter og uavhengig dobbeltkoding gjenstår før skala.
Konklusjon
Atlaset skal ikke redusere læreplanhistorie til ordtelling eller én akse fra «innhold» til «ferdigheter». Den sentrale analyseenheten er ett eksakt kildeutsagn eller et avgrenset kildespenn, koblet til et begrep gjennom flere uavhengige dimensjoner. Hver sammenligning må vise hvilken myndighet, utgave, faglig del, skoleform og elevgruppe den faktisk gjelder.
Dette følger den viktigste felles lærdommen fra norsk og internasjonal læreplanforskning: læreplan, tilgjengelige læremidler, undervisning, vurdering og læringsutbytte er forskjellige slags belegg.
Det vi tar i bruk
1. Ulike evidensplan
TIMSS skiller mellom tilsiktet, gjennomført og oppnådd læreplan. Atlaset bruker seks eksplisitte plan:
intended: lov, overordnet del og fagplan;mediating_resource: lærebok, lesebok, lærerveiledning og annet tilgjengelig materiale;implemented_reported: lærer eller elev rapporterer praksis;implemented_observed: praksis er observert;assessed: prøve eller eksamen undersøker innholdet;attained: elevresultater.
Læreplandokumentene i dagens pilot er intended; de ni lærebøkene er mediating_resource. En lærebok kan vise en tilgjengelig undervisningsmulighet, men beviser ikke at boka eller emnet ble brukt. Se TIMSS 1995s tekniske rapport og TIMSS 2019s datamodell.
2. En flerdimensjonal kildepåstand
Hver påstand koder disse aksene separat:
| Akse | Eksempler |
|---|---|
| Omtalegrad | eksakt eksplisitt; indirekte eksplisitt; ikke eksplisitt i kontrollert spenn; ikke undersøkt |
| Semantisk forhold | eksakt begrep; snevrere tilfelle; bredere ramme; overlapp; analytikertolkning |
| Tyngde | hovedfokus; delfokus; kort omtale; bare tilgjengelig mulighet |
| Normativ kraft | påkrevd; anbefalt; tillatt; forbudt; ikke angitt |
| Utvalgsform | navngitt element; kategori med åpent utvalg; valgsett; eksempel; ikke relevant; uklart |
| Måltype | substansielt innhold; faglig/prosedural kunnskap; generell kompetanse; aktivitet/metode; verdi/holdning; vurdering |
| Handling | identifisere; huske; gjenfortelle; forklare; sammenligne; tolke; vurdere kilder; vurdere; utforske; reflektere; lese; skape; diskutere; delta |
Dermed kan LK20 samtidig kreve nasjonalromantikken og la konkrete forfattere og verk være åpne, mens M74 kan anbefale en åpen kategori. Normativ kraft og utvalgsform er egne akser fordi «anbefalt» og «åpent utvalg» kan være sant samtidig. OECDs kartleggingsmetode støtter eksplisitt, lavinferent koding og skiller hovedmål, delmål, tilgjengelig mulighet og ikke målrettet; vi splitter aksene ytterligere for å unngå at styrke, eksplisitthet og valgfrihet blandes. Se OECDs tekniske rapport.
3. Sammenlignbar populasjon
En påstand må arve normaliserte koordinater for jurisdiksjon, myndighet, dokumentlag, fag og historisk fagforløper, skoleform, program/linje, trinn, typisk alder, obligatorisk/valgfri status, målform, lokalt nivå og en separat ISCED-kobling. Visningsnavnet fra kilden beholdes.
Dette gjør det mulig å sammenligne landsfolkeskole 1922 med dagens planer uten å late som de gjelder samme elevpopulasjon. Europarådets Observatory on History Teaching in Europe bruker tilsvarende felter for kurs, alder/trinn, timer, obligatorisk status, eksamen, organisering og ressurser. Se sammenligningsrapporten og teknisk vedlegg.
3a. Kildespenn, spørsmålsforpliktelser og fire statusakser
Et sammensatt læreplandokument må kunne ha kjørbare curriculum_scopes for innledning, felles mål, kursmål, vurdering og vedlegg uten at hvert spenn blir et nytt fag eller kurs. Hvert spenn avgrenses av eksakte tekstselektorer og bindes til normalisert teksthash, siderekke, analytisk rolle, kildebelagte elevprofiler og berørte OCR-gap. En påstand bindes til ett spenn og et faktisk delsett av profilene; komponenten avledes gjennom profilen. Systemet lager aldri alle kombinasjoner av en løs komponentliste og en løs profilliste.
Et lagret spørsmål fastsetter et evidenspredikat og hvilke analytiske roller som skal undersøkes. Den kildespesifikke nevneren er en eksplisitt mengde spenn × elevprofil-forpliktelser med relevans applicable, inapplicable eller undetermined. Spørsmålsrevisjonen binder målbegrep, oppløste aliaser og grafutvidelse, predikat, roller, spennrevisjoner, profiler og kildegrunnlaget for relevans. Hvis ett av disse endres, beholdes den gamle reviewbeslutningen i loggen, men den dekker ikke automatisk den nye revisjonen.
Fire forhold vises separat:
- tilgjengelighet: om manifestasjonen er innhentet og kan undersøkes;
- relevans: om akkurat dette spennet og denne elevprofilen hører til spørsmålet;
- vurderingsgrad: om alle gjeldende forpliktelser er ukontrollert, delvis eller fullstendig kontrollert;
- funn: positivt belegg, avgrenset nullfunn eller intet etablert funn.
Positivt belegg er eksistensielt og kan finnes i en ellers delvis kontrollert kilde. Et avgrenset nullfunn er konjunktivt: samtlige relevante forpliktelser må ha en gjeldende, reviewet kontroll mot det fryste evidenspredikatet; uavklart relevans eller et berørt OCR-gap stanser et komplett nullfunn; et motstridende positivt belegg utløser ny vurdering. Manglende påstander er aldri i seg selv et nullfunn.
R94-historiekilden er første prøvetilfelle. Kildens skille ved 1850 styrer bare de kronologiske kursdelene: et mål som slutter før 1850 tilhører den eldre siden, og et som starter etter 1850 den nyere. Et mål som berører eller spenner over 1850 er uavklart fordi kilden ikke angir hvilken side grenseåret tilhører. Innledning og felles mål skal fortsatt undersøkes for alle fire modellerte elevprofiler. Privatister og det komprimerte voksenløpet finnes i teksten, men er ikke representert av disse fire profilene og kan ikke arves inn i dem.
En felles påstand beholdes som ett belegg og én offentlig opptelling selv om den projiseres til flere kildebelagte profiler. Den gamle samlede cellestatusen beholdes foreløpig som kompatibilitetsvisning for eldre kilder; den erstatter ikke de fire aksene. Se ADR 0008.
4. Faglige analysefasetter
For historie og samfunnsfag brukes valgfrie, flerverdige fasetter for romlig skala; kildebestemt periodisering; politisk, sosialt, økonomisk, kulturelt, religiøst, teknologisk og miljømessig felt; substansiell kontra prosedural kunnskap; betydning, belegg/kildekritikk, kontinuitet/endring, årsak/virkning, perspektiv og etisk vurdering; fortid–nåtid–framtid; aktører, mangfold og flerperspektiv; nasjonal, komparativ eller sammenfiltret/transnasjonal ramme; og demokrati som kunnskap, praksis eller handling.
For norsk brukes fasetter for muntlig, lesing, skriving, språk, litteratur, kultur og medier; forfatter, verk, verksgruppe, sjanger og periode; helt verk, utdrag eller ukjent omfang; original, oversettelse eller bearbeidelse; og navngitt kanon kontra påkrevd periode/sjanger med åpent verkvalg.
Navngitte enheter publiseres som to koblede nivåer: en felles evidence group bevarer den styrende setningen/listen én gang, mens hvert navn eller hver tittel får egen stabil omtale-ID og TextQuoteSelector. Kontekstrolle, normativ kraft, utvalgsform og omfang er uavhengige koordinater. Derfor kan L60 samtidig kreve ett klassikerverk, bare tillate de navngitte titlene som eksempler, og avgrense Peer Gynt-eksemplet til tre akter. Betingelser som «to av fem» og indre alternativer som «Asbjørnsen eller Moe» beholdes eksplisitt.
Når to eller flere kildesetninger styrer samme liste, får omtalen et sammensatt anker: navneforekomsten, hovedvilkåret og supplerende modaltekst forankres hver for seg. Sammensetningen hasher de stabile undersitatene, mens endret OCR ellers på siden registreres som ekstraksjonsdrift. Den utløser derfor ikke falsk omkoding av et uendret spenn.
Nuller krever et eget inventory record med definert kilde, fag, segment, sidetall og entitetstyper. assessed betyr komplett bare innen denne grensen; partial og not_assessed er ukjent, aldri null. Inventory records bruker samme append-only reviewmekanisme som påstander og omtaler. scope_basis skiller en faktisk kontrollert page_range, eksakte section_spans og en komplett samling eksplisitt deklarerte evidence_groups. Sistnevnte kan aldri framstilles som komplett for alle egennavn mellom første og siste side. Seksjonsspenn kan bare brukes for innholdet mellom sine offentlige start- og sluttankre. Sidemengdeankeret omfatter bare sidene eller spennene som faktisk bærer den deklarerte kontrollen; medlemsrevisjonene binder den aksepterte totalen. Kompletthetsvisningen krever i tillegg at alle bundne medlemmer fortsatt har en akseptert reviewbeslutning. Et senere avvist medlem kan dermed ikke forsvinne og redusere en tilsynelatende «komplett» total.
Kildeskader kan registreres som strukturerte source_quality_checks. Hver kontroll angir berørte sider, problemet, om det fortsatt er uavklart eller bare løst for det erklærte spørsmålet, og de konkrete kildebeleggene som gjorde avgrensningen mulig. «Løst for erklært spørsmål» betyr ikke at en skadet tekst er rekonstruert. M74-inventaret bruker dette for en avskåret bokmålsspalte på s. 103–104: en komplett, offisiell nynorskutgave fra samme år gir støtte til den redaksjonelle vurderingen om at passasjen ikke tilfører navn eller titler. Den er ikke bevis for ordrett ekvivalens og erstatter ikke den manglende bokmålsteksten.
L60-piloten demonstrerer begge former. Det smale inventaret binder ti navngitte listekontekster (53 identiteter / 170 omtaler). Det bredere inventaret er en side-for-side-kontroll av hele norskfaget på trykte sider 59–97 (95 identiteter / 221 omtaler), inkludert bibliografier og bibliotekressurser. Komplett betyr her bare de deklarerte typene person, verk, verksgruppe og verksamling. Organisasjoner, land, språk, hendelser, generiske kategorier og krysshenvisninger til andre læreplandokumenter er uttrykkelig utenfor denne opptellingen. Foreslåtte bokemner er heller ikke verk før en konkret utgivelse er identifisert. Disse klassene kan senere få egne inventarer uten å endre den historiske beslutningen.
1890-utkastet viser hvorfor hele sider ikke alltid er en ærlig kompletthetsgrense. De formelle morsmålsdelene står nederst på s. 4, øverst på s. 5 og øverst på s. 8; de samme sidene inneholder kristendom, historie og andre fag. section_spans binder derfor inventaret til tre eksakte start- og sluttsitater. Byggeren hasher hele teksten mellom grensene, filtrerer eventuelle omtaler etter deres tekstposisjon og viser grensene offentlig. Et navn i en naboseksjon på samme side kan dermed verken telles inn eller undergrave et seksjonsavgrenset nullfunn. Spennene, side–skann-kartet og medlemsmengden inngår i inventory-revisjonen.
Begge 1890-morsmålsseksjonene er kontrollert uten funn av navngitte personer, verk eller ressurser. «Vore mest fremragende Forfattere», vers, sanger, bok og grammatisk lærebok er åpne kategorier. Dette er ikke et nullfunn for hele publikasjonen: begrunnelsen fra s. 12 navngir flere pedagogiske og religiøse autoriteter. Analysen holder dessuten Bygdemaal, Folkemaalet, Skriftsproget og Bogmaal som historiske kildetermer, uten automatisk å oversette dem til dagens bokmål/nynorsk-inndeling.
De to formelle historieseksjonene bruker samme seksjonsavgrensning: småskolen fra historieoverskriften til siste regel om første gangs gjenfortelling på s. 5, og storskolen fra historieoverskriften til regelen om ordrett læreboklæring på s. 8. Også her er identitetsresultatet null, men generiske innholdskategorier og metoder kodes positivt. «Fædrelandets Historie», verdenshistoriske folk og begivenheter, historiske sanger og lærebok er ikke navn eller titler. «Bibelhistorien» og «Kirkehistorien» er faglige referanserammer i setningen, ikke identifiserte bøker. Småskolens nedtonede historiske sammenheng skilles fra årsaksforståelse; storskolens sammenhengende fortellinger gjør heller ikke automatisk stoffet kausalt. Forbud mot utenatlæring og første gangs elevgjenfortelling kodes som eksplisitte forbud, ikke som fravær av innhold.
N22 viser hvorfor trykte sidetall og digitale skannsekvenser må lagres som to ulike koordinater. Nasjonalbibliotekets manifest legger blanke baksider mellom flere tekstsider og merker den faktiske, visuelt kontrollerte s. 13 uten sidetall, mens en blank skann bærer manifestetiketten 13. Et valgfritt page_sequence_map binder derfor hvert trykte sidetall til nøyaktig én skann og angir om koblingen kommer fra manifestet eller direkte kontroll av sidetallet i primærskannet. Kartet inngår i inventory-revisjonen og sideankeret. En endring i kartet krever ny vurdering; blanke surrogatsider kan ikke gi et falskt komplett nullfunn.
Den komplette kontrollen av norskfaget på s. 12–21 fant ingen navngitte personer, verk, samlinger eller leseressurser. Dette nullfunnet holdes atskilt fra fire positive utvalgs- og metodepåstander på s. 18–19: tillatt individuelt valg av opplesningsstykke fra en annen bok i 5.–7. skoleår, obligatorisk oppmerksomhet på opphavsperson, anbefalt kjennskap til større opphavsverk og anbefalt supplerende høytlesing. Vilkårene om hjemmeforberedelse, lærerens egnethetskontroll, gjennomførbarhet og elevnivå er egne tekstankre. Dermed blir «fritt valg» verken til ubegrenset elevautonomi, et krav om å lese hele boka eller en navngitt kanon.
N39 viser et annet grensetilfelle. En komplett kontroll av norskfaget på trykte sider 48–66 fant 29 omtaler av 22 identiteter, men ingen navngitt litterær forfatter eller skjønnlitterær tittel foreskrevet for elevene. Navnene på s. 49–51 er forskere, studier og måleinstrumenter som begrunner planens lesefarts-, stil- og rettskrivingskrav. Departementskatalogen på s. 55 er en ressurs for bibliotek- og litteraturvalg. Omtalerollen methodological-reference skiller disse fra literary-selection, mens resource-provision skiller katalogen fra faktisk bokbestand og elevlesning. Forkortede og etternavnsbaserte forskeridentiteter beholdes uavklart; året 1939 lagres som source-reference-year, uttrykkelig ikke som levetid eller aktivitet. Korte, tvetydige titler er sideankret, men har tomme literal_search_aliases, så vanlig omtale av lesefart eller morsmålsopplæring ikke blir til falske verktreff.
N39s positive påstander viser dessuten hvorfor modalitet må forankres på flere nivåer. Lesebokkravene på s. 53 inneholder indre «skal»-punkter under den ytre formuleringen «En bør derfor stille følgende krav». Atlaset koder den indre regelen, men inkluderer den ytre anbefalingen i samme sammensatte anker og i påstandsteksten. Henvisning til opphavsverk betyr ikke lesing av hele verket; henvisning til tilleggslitteratur betyr ikke at videre lesing er obligatorisk; krav om klassisk barnelitteratur gjelder skolens tilbud, ikke dokumentert bestand. Stillelesing, utenatlæring og dramatisering er egne metodebegreper, og det anbefalte dramatiseringseksemplet holdes separat fra det generelle kravet om å utnytte lekemomentet.
M74 demonstrerer dessuten hvorfor identitetsinventar og innholdspåstander må holdes atskilt. Den redaksjonelle sidekontrollen av norskspennet s. 96–115 fant ingen navngitte personer eller verk; vurderingen av den skadde passasjen støttes av den offisielle nynorskparallellen uten å hevde ordrett ekvivalens. Samtidig anbefaler planen at kjente norske diktere blir representert, at elevene leser hele verk og minst 800 sider i 7.–9. trinn. Den siste føringen er lagret som en valgfri, strukturert quantitative_requirement med terskel, enhet, trinnspenn og omtrentlig sidemålsandel. Den er en målbar fasett, ikke en ny kategorisk kodeakse, og arver aldri sterkere normativ kraft enn sitatet.
Autoritetskontroll skiller biografiske levetidsdata fra svakere tidsbelegg. En Wikidata- eller biografikobling kan gi et kildebelagt livsspenn. En person som bare er identifisert gjennom en bibliotekskatalog får i stedet et eksplisitt publication-attested-active-vindu; det må aldri vises eller tolkes som fødsels- og dødsår. Tilsvarende er et serieintervall bare et catalogue-attested-series-window. Uavklarte kortformer, som L60s «Roosevelt», beholdes som egen kandidatidentitet uten automatisk fulltekstkobling.
Ordrette læreboktreff bruker et eget literal_search_aliases-felt når en identitet har korte eller tvetydige navn. Tom liste betyr at en kontekstløs fulltekstmatch er for risikabel. «Gift», «Fant», «Arne» og den uavklarte «Odin»-identiteten blir derfor ikke automatisk koblet til enhver forekomst av de vanlige ordene i historiebøker.
Bertrams firelandsstudie begrunner skillet mellom substansiell og prosedural kunnskap, rom, kronologi, bredde/dybde og progresjon (Bertram 2016). Ongstads norske L1-historie viser hvorfor fagenes komponenter og selve læreplansjangeren må behandles som historiske variabler; like ord kan skifte funksjon og mening (Ongstad).
5. Interoperabilitet uten å overbygge
- SKOS for foretrukne og alternative navn, bredere/snevrere/relaterte begreper og kartleggingsstyrke;
- PeriodO for kildespesifikke perioder med egne grenser og referanser;
- Web Annotation for robuste kildeutdrag og selektorer;
- PROV-O for kjeden fra anskaffelse via OCR og normalisering til redaksjonell vurdering;
- 1EdTech CASE som framtidig eksport av offisielle kompetanseutsagn og hierarki;
- IFLA LRM for å skille verk, uttrykk/oversettelse, utgave og konkret NB-eksemplar.
Piloten trenger ikke RDF, OWL eller CIDOC CRM. Den trenger stabile ID-er, eksplisitte typer og mulighet for senere eksport.
Endring over tid
Endring modelleres som etterprøvbare hendelser mellom dokumentversjoner: tilføyd, fjernet, omformulert, flyttet mellom læreplanlag, påkrevd til åpent utvalg (eller motsatt), innhold omrammet som metode/kompetanse/verdi, og begrep splittet, slått sammen eller omdøpt. Nyttige summer er spesifikasjonsgrad, utvalgsåpenhet, substansiell/prosedural balanse, vurderingsstyring og progresjon. Alle må ha synlig nevner og klikkbare kilder. Sidetall og treffhyppighet er ikke synonymer for dybde eller viktighet.
Norsk EVA2020 understreker både re-kontekstualiseringen fra politikk via programmatisk læreplan til lokal praksis, og at kunnskap–kompetanse ikke er en enkel motsetning. Se EVA2020s sluttrapport.
Kilde- og gapmatriser
Et lagret spørsmål skal vise alle kjente kildemanifestasjoner, ikke bare treff. Eldre kilder uten en kjørbar forventningsnevner får foreløpig én projisert dokumentstatus: positivt belegg, avgrenset nullfunn, blandet, delvis, ikke vurdert, utilgjengelig eller ikke relevant. For migrerte kilder er de fire uavhengige aksene over autoritative. Ikke relevant kan følge av fag eller av tid—1890-planen er for eksempel eldre enn første verdenskrig og skal ikke framstilles som om den utelot en framtidig hendelse.
Den projiserte dokumentstatusen er en overskrift, ikke en fullstendighetspåstand. Under den bevares vurderte fag-, segment-, trinn- og programpopulasjoner. En positiv rad for sjuende trinn gjør ikke forberedelsesfaget positivt; et funn i én M74-plan dekker ikke den alternative integrerte planen; tre like formuleringer for ulike LK20-løp forblir tre populasjonsforekomster, ikke tre dokumenter. Matrisen kan først kalles komplett for forventede spenn når hver forventet spenn×profil-forpliktelse er disponert eksplisitt under den gjeldende spørsmålsrevisjonen. Delte søkespenn er heller ikke uavhengige observasjoner.
Kodekvalitet og maskinell hjelp
Før masseanalyse skal vi:
- publisere en versjonert kodebok med positive, negative og tvetydige eksempler;
- dobbeltkode et stratifisert utvalg på tvers av perioder, fag, dokumentlag og OCR-kvalitet;
- bruke Cohens kappa for den nåværende tokoderpiloten, Krippendorffs alfa når flere kodere eller et større flerkoderdesign tas i bruk, og vektet kappa for ordnet tyngde; bevare begge koder og dokumentere forlik;
- markere kategorier under avtalt terskel—helst 0,80—som utforskende;
- bevare originalspråk og historisk ortografi, og ved internasjonal sammenligning lagre originalterm, bokstavelig glosse, funksjonell oversettelse, kartleggingsforhold og faglig kontrollør.
Den første blinde Astra-piloten avdekket et mangelfullt instrument: aksepterte aliaser og nok kontekst til å lese styringskraft manglet. I den forbedrede v2- piloten ble alle 31 påstander kodet på nytt. Utvalgsform (κ 0,9482), måltype (κ 0,8970) og eksakt samsvar for elevhandlinger (0,9355) nådde terskelen 0,80. Omtalestatus (κ 0,5090), begrepsforhold (κ 0,6469), vektet tyngde (κ 0,7947) og styringskraft (κ 0,4402) behandles som utforskende fram til forlik og en menneskelig replikasjon. Begge råkodingene og alle uenigheter er bevart i data/reliability/; ingen offentlig påstand ble automatisk overskrevet.
Deterministisk søk, fuzzy søk, emnemodeller og embeddings kan foreslå kandidater. De kan ikke opprette offentlige dekningspåstander. IEA anbefaler flere framoversettelser, tospråklig kontroll og forlik framfor å stole på ren tilbakeoversettelse (IEAs verifikasjonsmetode).
Godkjenningstester før skala
- «Karl XII» alene kan gi et persontreff, men aldri automatisk en eksplisitt påstand om den store nordiske krig.
- «Sveriges stormaktstid» kan være bredere/overlappende ramme, ikke eksakt omtale av krigen.
- Ibsen i en historieseksjon blir ikke påkrevd norsklesning.
- Påkrevd litterær periode og åpent verkvalg kan vises samtidig.
- Grafstier skaper aldri dekning uten et eget sitat.
- Sammenligninger mellom ulike skoleformer viser et populasjonsvarsel.
- Ny OCR overskriver ikke tidligere belegg i stillhet.
- Maskintreff forblir kandidater til de er vurdert.
- Et framtidig bokeksempel kan modellere TOC, kapittel, side, oppgave, helt verk/utdrag og utgave, men forblir
mediating_resource.
Bevisst utsatt
En universell historieontologi, automatisk begrepssammenslåing, rangering av historisk betydning, full RDF-infrastruktur og maskinelt «dekningsdyp» utsettes. Ambisjonen nå er et presist og reviderbart påstandslag som tåler flere hundre dokumenter uten senere semantisk migrasjon.