{
  "evidence": {
    "runId": "2ae6700b-221b-4223-969c-282e572fe35d",
    "evaluatedAt": "2026-09-27T07:56:27.401Z",
    "packageVersion": "0.7.0",
    "recipeFingerprint": "cf942449ed8153c6445d9bf776146328e9d17bffef15889a4280357e0e83d640",
    "datasetFingerprint": "031777ea53dce248c241becf86e6f49573d0a10e64965812f8e3d8e9147a2072",
    "split": "held-out",
    "mode": "live",
    "policy": {
      "minConfidence": 0.8,
      "selectedOn": {
        "runId": "728aeac7-f7f1-496c-a18a-1e331da6039e",
        "datasetFingerprint": "4f296b4799c00845333673a8d9dcf6ac8fd2a5a226efbb9f9a6e676e3ce165ee",
        "recipeFingerprint": "cf942449ed8153c6445d9bf776146328e9d17bffef15889a4280357e0e83d640",
        "model": "jev-1.13.0",
        "split": "development"
      }
    },
    "provenance": [
      {
        "method": "author-synthetic",
        "source": "AI-authored synthetic boundary cases for jev-recipes; labels have not had independent human review.",
        "cases": 40
      }
    ]
  },
  "recipe": "contact-opt-out",
  "model": "jev-1.13.0",
  "models": [
    "jev-1.13.0"
  ],
  "cases": 40,
  "completed": 40,
  "failed": 0,
  "correct": 39,
  "wrong": 1,
  "ready": 33,
  "review": 7,
  "accuracy": 0.975,
  "completedAccuracy": 0.975,
  "accuracyInterval95": [
    0.8712,
    0.9956
  ],
  "readyAccuracy": 1,
  "readyAccuracyInterval95": [
    0.8957,
    1
  ],
  "reviewRate": 0.175,
  "contestedAccuracy": 0.8,
  "adversarialAccuracy": 1,
  "calibration": [
    {
      "confidence": "0-0.5",
      "cases": 2,
      "accuracy": 1
    },
    {
      "confidence": "0.5-0.6",
      "cases": 0,
      "accuracy": null
    },
    {
      "confidence": "0.6-0.7",
      "cases": 2,
      "accuracy": 0.5
    },
    {
      "confidence": "0.7-0.8",
      "cases": 1,
      "accuracy": 1
    },
    {
      "confidence": "0.8-0.9",
      "cases": 1,
      "accuracy": 1
    },
    {
      "confidence": "0.9-1",
      "cases": 34,
      "accuracy": 1
    }
  ],
  "thresholdEvaluation": "frozen-policy",
  "thresholds": [],
  "suggestedMinConfidence": null,
  "latencyMs": {
    "p50": 118.89,
    "p95": 154.6,
    "totalCaseTime": 4918.64
  },
  "usage": {
    "requests": 40,
    "input_tokens": 24799,
    "output_tokens": 2174,
    "unknownResponses": 0,
    "failedRequests": 0,
    "models": [
      "jev-1.13.0"
    ]
  },
  "cost": {
    "model": "jev-1.13.0",
    "inputPerMillion": 0.042,
    "outputPerMillion": 0,
    "currency": "USD",
    "date": "2026-09-27",
    "source": "https://docs.typesafe.ai/models",
    "estimated": 0.00104156
  },
  "confusion": {
    "{\"verdict\":\"all_contact\"}": {
      "total": 10,
      "correct": 10,
      "misses": {}
    },
    "{\"verdict\":\"campaign\"}": {
      "total": 10,
      "correct": 10,
      "misses": {}
    },
    "{\"verdict\":\"channel\"}": {
      "total": 10,
      "correct": 10,
      "misses": {}
    },
    "{\"verdict\":\"none\"}": {
      "total": 5,
      "correct": 5,
      "misses": {}
    },
    "{\"verdict\":\"unclear\"}": {
      "total": 5,
      "correct": 4,
      "misses": {
        "{\"verdict\":\"campaign\"}": 1
      }
    }
  },
  "failures": [
    {
      "id": "featured-18-3",
      "expected": {
        "verdict": "unclear"
      },
      "actual": {
        "verdict": "campaign"
      },
      "confidence": 0.62,
      "contested": true
    }
  ],
  "acceptance": {
    "minConfidence": 0.8,
    "minimumHeldOutReadyCases": 20,
    "minimumReadyAccuracy": 0.95,
    "maximumProviderFailures": 0,
    "met": true,
    "label": "Measured on these synthetic cases"
  }
}
