Back to evaluations
Public evaluation
bnpl_risk_score_eval
Evaluates type enforcement and classification precision for buy-now-pay-later application reviews.
Evaluation type
task based
Challenge
BNPL Credit Fraud Anomaly Detection with Pydantic AI and Fiddler AI
Difficulty
Intermediate
Rigor
Unspecified
Evaluation overview
How the linked challenge is judged: tasks, benchmarks, and criteria count.
Tasks
1
Benchmarks
0
Criteria
0
Task templates
Inputs and expected outputs.
Task 1
bnpl_risk_score_eval
Validates structured risk classification output for BNPL applicant telemetry.
Input format
JSON payload containing checkout session telemetry
Output format
Validated Pydantic model output containing risk_tier, risk_score, and key_factors