Tala på desse sidene kjem frå Bergen sine offentlege møteprotokollar — dei same PDF-ane du finn i kommunen sin eigen innsynsportal. Ei protokoll vert henta, og teksten som skildrar handsaminga av kvar sak vert lese av ein KI-modell.
Uttrekket har éin jobb: finne røystingane i teksten og strukturere dei — kven som fremja kva, kva som vart vedteke eller falt, og korleis partia fordelte seg. Det tolkar ikkje kva vedtaket betyr, og det skriv ingenting som ikkje alt står i protokollen. Finn det ingen voteringstekst i ei sak, vert det heller ingen votering vist for henne her.
Kvar partistemme har ei kjelde. Eksplisitt tyder at protokollen sjølv oppgir talet (t.d. 7 SP, 6 AP …). Utleidd frå namn tyder at protokollen berre listar namngjevne representantar, og at partitalet er talt opp frå den lista — eit ekstra steg som kan bomme om eit namn er stava feil eller ikkje kjent att.
Ei tredje kjelde finst: følgjer av totalen — protokollen skreiv ikkje talet. Nokre protokollar nemner eit lite parti i oppteljinga utan å skrive talet, av di partiet har éin representant («12 røyster(4H, V, 4 Frp, Inp)»). Talet 1 er då det einaste som får rekneskapen til å gå opp, men det står ikkje i protokollen — og vi merkjer det som utleidd i staden for å la det gå for eit tal kjelda oppgav. Går ikkje residualen opp, fører vi partiet ikkje opp i det heile, og røystinga står som uklar.
Kvar votering har òg eit presisjonsnivå, sett etter kor mykje protokollen faktisk oppgir:
Dette er ikkje ei fullstendig liste over feilkjelder, men dei vi kjenner til og kan seie noko konkret om:
uttrekk.modell lagrar kva som faktisk produserte
kvar rad ("agent:…" mot eit API-backend-namn som "anthropic"), slik at
dei to aldri vert forveksla — talet over er talt derfrå, ikkje skrive
inn her.
Så langt dekkjer datasettet for Bergen 680 av 3570 registrerte sak(er) med eit fullført uttrekk. Sist henta frå kommunen: 2026-08-16. Sist uttrekt: 2026-08-17.