Woodpass AI Evals 🤖
Telemetria modeli językowych i wektorowych. Pomiary pewności decyzyjnej (Confidence Score).
Model: GPT-4o-Mini (Vision)
Średni Czas Ekstrakcji
420ms
Optymalna wydajność API
Confidence Score
99.8%
Wskaźnik pewności odczytu z CMR
Wskaźnik Halucynacji
0.01%
Nadzorowane przez system strażników (Guardrails)
Matryca Testów Regresyjnych (Ostatnie 24h)
1450 dok.
1600 dok.
1300 dok.
1800 dok.
1500 dok.
1900 dok.
1700 dok.
1850 dok.
1400 dok.
1950 dok.
1650 dok.
1800 dok.