Nøyaktighet og evaluering
Hvordan GeoPard måler nøyaktigheten til AI-assistenten og validerer genererte planer.
Vi måler den agronomiske treffsikkerheten til assistenten mot en versjonert benchmark. Vi publiserer poengsummen for hver kategori, også områdene som fortsatt er under forbedring.
Benchmarken
503 agronomispørsmål på ekspertnivå, i CCA-stil.
Fem kategorier: jord og vann, vekststyring, næringsstyring, plantevern og integrert plantevern (IPM), spesialfelt i presisjonslandbruk.
Versjonert og kjørt på nytt ved hver lansering. Nåværende versjon: v2, juli 2026.
Nåværende resultater
Spesialfelt i presisjonslandbruk
100%
Jord og vann
95.8%
Vekststyring
93.8%
Næringsstyring
92.9%
Plantevern og integrert plantevern (IPM)
77.5%
Hvorfor spørsmålssettet er privat
Offentlige benchmarkspørsmål lekker inn i treningsdataene til AI. Når det skjer, slutter poengsummene å måle faktisk evne. Spørsmålssettet holdes privat, slik at framtidige poeng fortsatt betyr noe. Vi publiserer metoden, alle kategoripoeng og eksempelspørsmål på forespørsel.
Validering utover benchmarken
Benchmarkpoeng måler kunnskap. Hver genererte plan blir testkjørt og validert før den lages. Sjekkene omfatter næringsbalanse og uttakskoeffisienter opp mot rådgivingsanbefalinger. De omfatter kritiske grenseverdier i jordprøver og oppbyggingsprinsipper fra laboratoriet ditt. De omfatter også grenser for spredningsmengde, avstand til vann og regler i kunnskapsbasen. Hvis en sjekk feiler, blir det ikke laget noe kart.
Din rolle
Assistenten støtter faglig skjønn. Den erstatter ikke en sertifisert lokal agronom. Du går gjennom og godkjenner hver tildelingsplan. Kontroller anbefalingene mot vekstplanen din, jordprøvene, produktetikettene og lokale forskrifter.
Relatert
Sist oppdatert
Var dette nyttig?