Gå til indhold
Krydsordhjælp

Hvor kommer svarene fra? Sådan er Krydsordhjælp bygget

· Krydsordhjælp-redaktionen

De fleste krydsordssider er bygget på samme måde: brugere sender svar ind, og siden samler dem. Det giver mange svar — og ingen mulighed for at vide, hvem der har kontrolleret hvad. Vi har gjort det modsatte. Her er, hvordan hvert eneste svar på Krydsordhjælp bliver til, og hvad metoden ikke kan.

Trin 1: Opgaverne kommer fra jer

Vi har ikke fundet på opgaverne. Listen over opgaver — fugl, plante, græsk ø, statsleder og alle de andre — er de ord, danskere faktisk skriver i en søgemaskine sammen med ordet «krydsord». Det er altså jeres spørgsmål, der afgør, hvad siden indeholder. En opgave, ingen slår op, har vi ikke en side til.

Trin 2: Svarene kommer fra to åbne kilder

DanNet er det danske wordnet: en stor, struktureret ordbog over danske ord og deres indbyrdes forhold, udarbejdet af Det Danske Sprog- og Litteraturselskab og Center for Sprogteknologi ved Københavns Universitet. Den ved, at måge er en fugl, at ske er et redskab, og at ile betyder det samme som skynde sig. Det er herfra, de almindelige ord kommer: synonymer, overbegreber, underbegreber.

Wikidata er den åbne vidensbase bag Wikipedia. Den ved, at Rhodos er en græsk ø, at Donau er en flod, og at Freja er en nordisk gudinde. Det er herfra, navnene kommer: arter, steder, personer, guder, himmellegemer.

Hvert svar på siden er knyttet til det sted i DanNet eller Wikidata, det kommer fra. Det er ikke en formalitet — det er det, der gør, at vi kan svare, når nogen spørger «hvorfor står det dér?».

Trin 3: Kontrollen

Et ord i en database er ikke nødvendigvis et ord, man kan skrive i et krydsord. Derfor kontrolleres hvert svar mod Stavekontroldens danske ordliste — den, der ligger bag stavekontrollen i mange programmer. Ord, der ikke findes der eller i Wikidata, udgiver vi ikke.

Og så tæller vi bogstaver. Det lyder trivielt, men det er det ikke, når sproget har Æ, Ø og Å: afhængigt af, hvordan en tekst er gemt, kan Å fylde ét eller to tegn. Vi tæller i rigtige bogstaver, så HÅR er tre felter og ØRN er tre felter. Hver gang siden bygges, kontrolleres det, at tallet ved svaret passer til ordets faktiske længde.

Trin 4: Rækkefølgen

Når du slår en opgave op, er svarene delt op efter antal bogstaver, og inden for hver længde står de mest almindelige ord først. «Almindelig» måles i et stort korpus af dansk tekst: hvor tit ordet forekommer. Det er det nærmeste, vi kan komme «det sandsynlige svar» uden at snyde.

For vi har ingen statistik over, hvor tit et ord har været brugt i krydsord. Den findes ikke som åbne data, og vi vil ikke finde på den. Derfor står der på hver side, hvad listen er sorteret efter, og derfor vil du aldrig se et tal hos os, der påstår, at «dette svar bruges i 23 ud af 100 krydsord».

Trin 5: Betydningerne

Ved de fleste ord står der nu også, hvad ordet betyder. Betydningerne kommer fra de samme to kilder: DanNets definitioner og Wikidatas korte beskrivelser. Nogle af DanNets definitioner er forkortet med «…» i den udgave, DanNet stiller frit til rådighed. Dem viser vi, som de er. At skrive resten selv ville være at gætte, og det er netop det, siden ikke gør.

Hvad metoden ikke kan

Det er fair at sige højt:

To sider af samme ord

En sidste ting, der er særlig for dansk: i et dansk krydsord er ledetråd og svar det samme ordforråd. Ost er en ledetråd («find en ost») og et svar (på «mejeriprodukt»). Derfor har hvert ord hos os én side med to sider: øverst det, ordet kan være svar på — nederst de opgaver, ordet selv er svar på. Det er ikke pynt; det er sådan, man finder vej fra det ord, man har, til det ord, man mangler.

Licenser

DanNet bruges under CC BY-SA 4.0, Wikidata under CC0 1.0, Stavekontrolden under MPL 1.1, og ordfrekvenserne under CC BY-SA 4.0. Den fulde liste med henvisninger står på kilder og licenser. Vores egne tekster og artikler er skrevet af redaktionen og er ikke betalt af nogen — læs mere om siden.

Flere artikler