For the complete documentation index, see llms.txt. This page is also available as Markdown.

Dokładność i ocena

Jak GeoPard mierzy dokładność Asystenta AI i weryfikuje wygenerowane plany.

Mierzymy dokładność agronomiczną asystenta na wersjonowanym benchmarku. Publikujemy wynik dla każdej kategorii, także w obszarach, które jeszcze dopracowujemy.

Benchmark

  • 503 eksperckie pytania agronomiczne, w stylu CCA.

  • Pięć kategorii: gleba i woda, zarządzanie uprawą, zarządzanie składnikami pokarmowymi, ochrona przed szkodnikami i IPM, specjalizacja w rolnictwie precyzyjnym.

  • Wersjonowany i ponownie uruchamiany przy nowych wydaniach. Aktualna wersja: v2, lipiec 2026.

Aktualne wyniki

Kategoria
Wynik

Specjalizacja w rolnictwie precyzyjnym

100%

Gleba i woda

95.8%

Zarządzanie uprawą

93.8%

Zarządzanie składnikami pokarmowymi

92.9%

Ochrona przed szkodnikami i IPM

77.5%

Dlaczego zestaw pytań jest prywatny

Publiczne pytania z benchmarku przedostają się do danych treningowych AI. Gdy tak się stanie, wyniki przestają mierzyć rzeczywiste możliwości. Zestaw pytań pozostaje prywatny, aby przyszłe wyniki nadal miały wartość. Na życzenie publikujemy metodykę, wszystkie wyniki kategorii oraz przykładowe pytania.

Walidacja poza benchmarkiem

Wyniki benchmarku mierzą wiedzę. Każdy wygenerowany plan jest przed utworzeniem sprawdzany w trybie próbnego uruchomienia. Kontrole obejmują bilans składników pokarmowych i współczynniki wynoszenia względem zaleceń doradczych. Obejmują też poziomy krytyczne z badań gleby i zasady budowania zasobności z Twojego laboratorium. Sprawdzają również limity dawek aplikacji, odległości buforowe i reguły bazy wiedzy. Jeśli któryś test nie przejdzie, mapa nie jest generowana.

Twoja rola

Asystent wspiera profesjonalny osąd. Nie zastępuje certyfikowanego lokalnego agronoma. Każde zalecenie sprawdzasz i zatwierdzasz Ty. Weryfikuj rekomendacje względem planu upraw, badań gleby, etykiet produktów i lokalnych przepisów.

Powiązane

Ostatnia aktualizacja

Czy to było pomocne?