{
  "schemaVersion": 1,
  "generatedAt": "2026-08-12T23:37:46.765Z",
  "generationKey": "bc8c653cbe3ab2d0c3a1e746ea85175dd5c9c37d68b6c9d4a865c8e4903f9152",
  "metadataPayloadSha256": "05824a2bcb18829d54c6e1eb17d34b1c90a59dbe67a8f26e7949d69b959742c4",
  "diagram": {
    "id": "crucible-evaluation-and-quality-control-d72bba9d",
    "title": "Crucible — evaluation and quality control",
    "description": "Concept-anchored evaluation pins configuration lineage, measures the real Lens pipeline, and promotes reviewed corrections only as draft goldens.",
    "status": "current",
    "canonicalAppearanceKey": "tsx:src/app/(docs)/docs/concepts/system-diagrams/page.tsx:CRUCIBLE_CHART#1"
  },
  "aliases": [],
  "concepts": [
    "System diagrams",
    "Crucible — evaluation and quality control",
    "Golden set — concept-anchored",
    "Metrics — three measurable layers",
    "Crucible"
  ],
  "keywords": [
    "judgments · run_metrics",
    "drift.kb alert",
    "golden_items · golden_assertions",
    "golden_citations · golden_concepts",
    "eval_runs · eval_results",
    "deduped eval.gate.failed alerts",
    "drift_snapshots + alerts",
    "graded relevance 0–3",
    "feedback row not input",
    "answer payload →",
    "Lens pipeline",
    "each item × sample",
    "retrieval IR",
    "abstention + CRAG",
    "append-only queue",
    "validate · one TX",
    "reviewed correction",
    "named metric thresholds",
    "rollout gate",
    "BU × topic gap matrix",
    "orphan rate · doc churn",
    "Warrant curation",
    "significant regression",
    "thumbs · ratings · corrections",
    "params applied + effective snapshot",
    "catalog rows → forced-draft goldens",
    "pin goldenSetHash · resolveEvalConfig",
    "recall@k · nDCG@10 · MRR",
    "faithfulness · relevancy · ctx · noise",
    "truthfulness · risk–coverage · AURC",
    "append feedback + create draft golden",
    "paired bootstrap BCa + permutation",
    "two-gate: CI ∌ 0 AND p &lt",
    "latest-run accuracy overlay",
    "steward review · re-certify",
    "draft requires separate activation",
    "re-author goldens · qrels",
    "eval_configs",
    "eval_feedback",
    "eval_acceptance_gates"
  ],
  "mermaid": {
    "type": "flowchart",
    "direction": "TD",
    "sourceSha256": "d72bba9d401008417665c3bb60732d8ef46aca2af6ed1fc5e40a3505fec4ed35"
  },
  "provenance": [
    {
      "appearanceKey": "md:docs/architecture/system-diagrams.md#8",
      "surface": "markdown",
      "sourcePath": "docs/architecture/system-diagrams.md",
      "line": 526,
      "heading": "7 · Crucible — evaluation and quality control"
    },
    {
      "appearanceKey": "tsx:src/app/(docs)/docs/concepts/system-diagrams/page.tsx:CRUCIBLE_CHART#1",
      "surface": "route",
      "sourcePath": "src/app/(docs)/docs/concepts/system-diagrams/page.tsx",
      "line": 362,
      "route": "/docs/concepts/system-diagrams",
      "symbol": "CRUCIBLE_CHART",
      "caption": "Concept-anchored evaluation pins configuration lineage, measures the real Lens pipeline, and promotes reviewed corrections only as draft goldens."
    }
  ],
  "embeddedMetadata": [
    {
      "sourcePath": "docs/architecture/system-diagrams.md",
      "heading": "7 · Crucible — evaluation and quality control"
    },
    {
      "sourcePath": "src/app/(docs)/docs/concepts/system-diagrams/page.tsx",
      "caption": "Concept-anchored evaluation pins configuration lineage, measures the real Lens pipeline, and promotes reviewed corrections only as draft goldens."
    }
  ],
  "generation": {
    "application": {
      "name": "eli-ai",
      "version": "0.1.0"
    },
    "environment": {
      "node": "v26.3.1",
      "yarn": "4.17.1",
      "platform": "linux",
      "architecture": "x64",
      "containerImage": "playwright:v1.62.1-noble@sha256:c091b21d9fae78c76e85cd4356431e9b018402f172a214fc7d7a5e9a7e29d8ac+node:26.3.1-bookworm-slim@sha256:209558c3e5e40e8adff68959d3c2ba7cd73723e716d89196878a0c362fa1e109"
    },
    "packages": {
      "mermaid": "11.16.0",
      "mermaidCli": "11.16.0",
      "playwright": "1.62.1",
      "playwrightCore": "1.62.1",
      "puppeteer": "25.6.0",
      "puppeteerCore": "25.6.0"
    },
    "renderer": {
      "mermaidConfigSha256": "68c10966fe84406ee626034d58bfabd555df9f65f691204b7c46db24038da101",
      "themeCssSha256": "c80287a78d80ad63d27bd5ca348b2ef9a7e2f44da289e436be6484ea28a1b033",
      "browser": {
        "name": "chromium",
        "revision": "1234",
        "version": "151.0.7922.34",
        "executableSha256": "0b20b130e7edd9dd51873be867761295fe0cfad490c2b9a64f95bd3cfc08fa71"
      },
      "font": {
        "family": "Eli Diagram Inter Variable",
        "fileSha256": "3100e775e8616cd2611beecfa23a4263d7037586789b43f035236a2e6fbd4c62",
        "licenseSha256": "3b0a5fca3d17942cde889069889dedbbbd075e9b599968c82a95f4d944e9b345"
      }
    },
    "adapterVersions": {
      "diagramGenerator": "2",
      "drawioFlowchart": "1",
      "drawioSequence": "1",
      "drawioState": "1",
      "drawioGantt": "1"
    }
  },
  "artifacts": {
    "mmd": "/diagrams/crucible-evaluation-and-quality-control-d72bba9d/crucible-evaluation-and-quality-control-d72bba9d.mmd",
    "svg": "/diagrams/crucible-evaluation-and-quality-control-d72bba9d/crucible-evaluation-and-quality-control-d72bba9d.svg",
    "png": "/diagrams/crucible-evaluation-and-quality-control-d72bba9d/crucible-evaluation-and-quality-control-d72bba9d.png",
    "drawio": "/diagrams/crucible-evaluation-and-quality-control-d72bba9d/crucible-evaluation-and-quality-control-d72bba9d.drawio",
    "json": "/diagrams/crucible-evaluation-and-quality-control-d72bba9d/crucible-evaluation-and-quality-control-d72bba9d.json"
  },
  "artifactSha256": {
    "mmd": "e1395bd0815ec8420ab9b8c2d8f640175b3f16b938a511f752956d737e89a2d3",
    "svg": "27eb70528c2dc1c9dbf4fdba2abfc3dbaa5112a31d0ee68a5973382f15b35e5a",
    "png": "6035e566b62d767984d75d01ff36911e9e947bb2f9d0fbc5af65614011df7f63",
    "drawio": "1e0f16d614f0d23a82dbfdcfcd6d08f93d39f6238bd34665def752c2ca87d923"
  }
}
