Repository object · research-note
Independent Em0034 Review Receipt
Accepted research note in the public catalog.
- Media type
application/json- Object ID
em:research-note:sha256:7526f1929330c0f2ecd06d2f20c0864c239235c075d08ed99920c858980d91c7- Content digest
f35f8c093778ad1cdeafc57746575f1a82d12fe6e6fbf0d1d4a546e3c5296e1e
Also filed under
Source content
{
"format": "epistemedia-independent-dossier-review-v1",
"task_id": "EM-0034",
"repository": "https://github.com/yoheinakajima/epistemedia",
"reviewer": {
"id": "codex-independent-em0034-reviewer",
"independent": true,
"authored_candidate": false,
"fresh_clone": true,
"model_family": "OpenAI GPT-5"
},
"decision": "pass",
"complete": true,
"started_at": "2026-08-28T15:57:21Z",
"completed_at": "2026-08-28T15:59:23Z",
"reviewed": {
"base": "ead2b5887da233dde4e790f0c6c0aea15e59f074",
"head": "1c5a8318b2bb770c38a07a96f731531ba1c53a32",
"tree": "b7356ab1578e8a1eea76cb14e36d7a15b0e00d48",
"dossier": {
"bytes": 224792,
"path": "research/how-we-know/gpt-4-bar-exam-percentile/candidate-dossier.json",
"sha256": "32c4457b3823237b2f988a26d51b2f6222af8060e662993524aff1c1a5d79e5d",
"dossier_id": "em:dossier:sha256:babe89ba3bda594a8d9f2db86a5a2987f284437a069b940d19b6928856d936d1"
},
"source_graph_sha256": "2bb896ded74d63469ec4e3947d75adfd6ac9a9c5dee6fe0db7ef9251760da38e"
},
"accepted_bindings": [
{
"bytes": 210543,
"path": "research/how-we-know/gpt-4-bar-exam-percentile/candidate-packet.json",
"sha256": "07dec44bc2cf893b19ba6307e34aef60b6127b5e881e319ff4132c8e69972d1a"
},
{
"bytes": 92747,
"path": "research/how-we-know/gpt-4-bar-exam-percentile/independent-review-receipt.json",
"sha256": "0606e98ed7ff98f1d0e69509db5edcd8dce774c62c48981bd5aec8f23a95ad20"
},
{
"bytes": 64382,
"path": "research/how-we-know/gpt-4-bar-exam-percentile/source-records.json",
"sha256": "385bbc193be495597ef0fe2a675220ca443297e673b32947c8d8ffcd1a6366da"
},
{
"bytes": 62565,
"path": "research/how-we-know/gpt-4-bar-exam-percentile/artifact-inventory.json",
"sha256": "f9e45045831a15fcb40c7f542c73651e5dc63ba081b145d00260bee91192c25b"
},
{
"bytes": 51950,
"path": "research/how-we-know/gpt-4-bar-exam-percentile/git-blob-search-manifest.json",
"sha256": "708657f61bc759f3a5b439affde1a677177859b50a8bc960012b81dcebcdb122"
}
],
"coverage": {
"assertion_keys": [
"assertion-claim-february-sensitive",
"assertion-claim-july-sensitive",
"assertion-claim-launch-comparison-unspecified",
"assertion-claim-launch-score-label",
"assertion-claim-martinez-first-time",
"assertion-claim-martinez-passers-conflict",
"assertion-claim-no-lawyer-rank",
"assertion-claim-score-discrepancy",
"assertion-derive-illinois-feb-2018-298",
"assertion-derive-illinois-feb-2019-298",
"assertion-derive-illinois-jul-2018-298",
"assertion-derive-martinez-first-time-essay",
"assertion-derive-martinez-first-time-mbe",
"assertion-derive-martinez-first-time-ube",
"assertion-derive-martinez-parameters",
"assertion-derive-martinez-passers-essay",
"assertion-derive-martinez-passers-mbe",
"assertion-derive-martinez-passers-ube",
"assertion-encyclopedia-evaluation",
"assertion-reviewed-source-register",
"assertion-skeptical-evaluation"
],
"calculation_ids": [
"derive-illinois-feb-2018-298",
"derive-illinois-feb-2019-298",
"derive-illinois-jul-2018-298",
"derive-martinez-first-time-essay",
"derive-martinez-first-time-mbe",
"derive-martinez-first-time-ube",
"derive-martinez-parameters",
"derive-martinez-passers-essay",
"derive-martinez-passers-mbe",
"derive-martinez-passers-ube"
],
"edition_keys": [
"edition-em0032-calculation-register",
"edition-illinois-feb-2018",
"edition-illinois-feb-2019",
"edition-illinois-jul-2018",
"edition-katz-figshare-25018513-v1",
"edition-katz-git-commit-90997f7-tree-810bd4a",
"edition-katz-rsta-2024",
"edition-katz-ssrn-4389233",
"edition-martinez-2024-vor",
"edition-martinez-osf-analysis-new",
"edition-martinez-osf-c8ygu",
"edition-ncbe-first-repeat-2022",
"edition-ncbe-mbe-2022",
"edition-ncbe-snapshot-2022",
"edition-ncbe-ube-2022",
"edition-ncbe-ube-scores-2026-08-27",
"edition-ny-passrates-2022",
"edition-openai-2303-08774v1",
"edition-openai-2303-08774v6",
"edition-reshetar-testing-column-spring-2022"
],
"lineage_edge_ids": [
"edge-author-social-collaboration",
"edge-benchmark-illinois-charts",
"edge-citation-katz-to-martinez",
"edge-comparison-class-first-time-passers",
"edge-data-reported-score-reuse",
"edge-derivation-comparison-inputs",
"edge-material-shared-exam-items",
"edge-method-single-free-response-run",
"edge-model-historical-snapshots",
"edge-score-component-composite"
],
"lineage_keys": [
"lineage-evaluation-synthesis",
"lineage-illinois-comparison-root",
"lineage-martinez-analysis-root",
"lineage-model-performance-root",
"lineage-ncbe-comparison-root",
"lineage-new-york-pass-rate-root",
"lineage-reviewed-source-register"
],
"proposition_keys": [
"claim-february-sensitive",
"claim-july-sensitive",
"claim-launch-comparison-unspecified",
"claim-launch-score-label",
"claim-martinez-first-time",
"claim-martinez-passers-conflict",
"claim-no-lawyer-rank",
"claim-score-discrepancy",
"derive-illinois-feb-2018-298",
"derive-illinois-feb-2019-298",
"derive-illinois-jul-2018-298",
"derive-martinez-first-time-essay",
"derive-martinez-first-time-mbe",
"derive-martinez-first-time-ube",
"derive-martinez-parameters",
"derive-martinez-passers-essay",
"derive-martinez-passers-mbe",
"derive-martinez-passers-ube",
"prop-encyclopedia-evaluation",
"prop-reviewed-source-register",
"prop-skeptical-evaluation"
],
"relation_keys": [
"edge-author-social-collaboration",
"edge-benchmark-illinois-charts",
"edge-citation-katz-to-martinez",
"edge-comparison-class-first-time-passers--1",
"edge-comparison-class-first-time-passers--2",
"edge-data-reported-score-reuse",
"edge-derivation-comparison-inputs--1",
"edge-derivation-comparison-inputs--2",
"edge-material-shared-exam-items",
"edge-method-single-free-response-run",
"edge-model-historical-snapshots",
"edge-score-component-composite",
"relation-assertion-claim-february-sensitive",
"relation-assertion-claim-july-sensitive",
"relation-assertion-claim-launch-comparison-unspecified",
"relation-assertion-claim-launch-score-label",
"relation-assertion-claim-martinez-first-time",
"relation-assertion-claim-martinez-passers-conflict",
"relation-assertion-claim-no-lawyer-rank",
"relation-assertion-claim-score-discrepancy",
"relation-assertion-derive-illinois-feb-2018-298",
"relation-assertion-derive-illinois-feb-2019-298",
"relation-assertion-derive-illinois-jul-2018-298",
"relation-assertion-derive-martinez-first-time-essay",
"relation-assertion-derive-martinez-first-time-mbe",
"relation-assertion-derive-martinez-first-time-ube",
"relation-assertion-derive-martinez-parameters",
"relation-assertion-derive-martinez-passers-essay",
"relation-assertion-derive-martinez-passers-mbe",
"relation-assertion-derive-martinez-passers-ube",
"relation-assertion-encyclopedia-evaluation",
"relation-assertion-reviewed-source-register",
"relation-assertion-skeptical-evaluation"
],
"source_work_keys": [
"work-em0032-calculation-register",
"work-illinois-percentile-charts",
"work-katz-gpt4-bar",
"work-martinez-reanalysis",
"work-ncbe-2022-statistics",
"work-ncbe-ube",
"work-ny-2022-passrates",
"work-openai-gpt4-report",
"work-reshetar-testing-column-february-july"
],
"span_keys": [
"span-calculation-derive-illinois-feb-2018-298",
"span-calculation-derive-illinois-feb-2019-298",
"span-calculation-derive-illinois-jul-2018-298",
"span-calculation-derive-martinez-first-time-essay",
"span-calculation-derive-martinez-first-time-mbe",
"span-calculation-derive-martinez-first-time-ube",
"span-calculation-derive-martinez-parameters",
"span-calculation-derive-martinez-passers-essay",
"span-calculation-derive-martinez-passers-mbe",
"span-calculation-derive-martinez-passers-ube",
"span-illinois-feb-2018-anchors",
"span-illinois-feb-2019-anchors",
"span-illinois-jul-2018-anchors",
"span-katz-vor-abstract-score",
"span-katz-vor-components",
"span-katz-vor-materials",
"span-katz-vor-percentile-boundary",
"span-katz-vor-range",
"span-katz-vor-score-discrepancy",
"span-martinez-abstract-ranks",
"span-martinez-discussion-48",
"span-martinez-mean-assumption",
"span-martinez-model-assumptions",
"span-martinez-results-45",
"span-martinez-score-validation",
"span-martinez-script-comment-conflict",
"span-martinez-script-july-mbe-distribution",
"span-martinez-script-thresholds",
"span-martinez-script-ube-sd",
"span-martinez-table-45",
"span-ncbe-jurisdiction-status",
"span-ncbe-mbe-2022-counts",
"span-ncbe-ny-cutoff-2022",
"span-ncbe-snapshot-composition",
"span-ncbe-snapshot-typo",
"span-ncbe-ube-weights",
"span-ny-first-timers-2022",
"span-openai-v1-abstract-top-ten",
"span-openai-v1-collaborators",
"span-openai-v1-free-response-run",
"span-openai-v1-scoring",
"span-openai-v1-snapshots",
"span-openai-v1-table-score",
"span-openai-v6-table-score",
"span-reshetar-first-time-mean"
]
},
"commands": [
{
"argv": [
"python",
"research/how-we-know/gpt-4-bar-exam-percentile/build_candidate.py",
"--check"
],
"exit_code": 0,
"stdout_sha256": "e3b0c44298fc1c149afbf4c8996fb92427ae41e4649b934ca495991b7852b855"
},
{
"argv": [
"python",
"research/how-we-know/gpt-4-bar-exam-percentile/verify_candidate.py",
"--self-test"
],
"exit_code": 0,
"stdout_sha256": "42e3a9b3c109f75a761a1a829a904af0224da51d69b51221c68a9cb30108becc"
},
{
"argv": [
"python",
"-m",
"pytest",
"-q",
"research/how-we-know/gpt-4-bar-exam-percentile/test_candidate.py"
],
"exit_code": 0,
"stdout_sha256": "585ba42829657b9e2d56f8614be6c3365a8405474eed008559511ab50f2ffcfb"
},
{
"argv": [
"ruff",
"check",
"research/how-we-know/gpt-4-bar-exam-percentile/build_candidate.py",
"research/how-we-know/gpt-4-bar-exam-percentile/verify_candidate.py",
"research/how-we-know/gpt-4-bar-exam-percentile/test_candidate.py"
],
"exit_code": 0,
"stdout_sha256": "82b3e6a6c090a57601d22943bd23fca9218d1031dbe5a7b754092f9a156b4f18"
},
{
"argv": [
"git",
"diff",
"--check",
"ead2b5887da233dde4e790f0c6c0aea15e59f074..1c5a8318b2bb770c38a07a96f731531ba1c53a32"
],
"exit_code": 0,
"stdout_sha256": "e3b0c44298fc1c149afbf4c8996fb92427ae41e4649b934ca495991b7852b855"
},
{
"argv": [
"make",
"check",
"PYTHON=/private/tmp/em0034-independent-review.v8smBm/repo/.venv/bin/python"
],
"exit_code": 0,
"stdout_sha256": "9e45d714ee36459e11298f1864b94534c65fa5eacea8f3d74bba13362638be4a"
}
],
"limitations": [
"This review verifies the bounded historical candidate and does not establish current model behavior, general legal competence, practicing-lawyer quality, or a current product ranking.",
"The launch comparison distribution, original top-ten-percent chart, national UBE distribution, and proprietary inputs remain unresolved and receive no invented value or evidentiary credit.",
"The Martinez re-analysis remains model- and assumption-dependent, including its retained 45/48 internal discrepancy and its separate comparison populations.",
"This receipt does not admit, feature, publish, deploy, or describe Case 003 as live."
],
"findings": [
"Accepted EM-0032 artifacts and receipts are byte-identical to accepted commit 700a822f38d00d13cc0661fd577bdb7e6e5b34dd.",
"All ten accepted derivations close through exact structured calculation spans, parent spans, and resolved input-cell identities.",
"All ten accepted typed dependence-edge groups retain exact evidence and every mapped structural endpoint.",
"The 297/298 and 45/48 discrepancies, comparison-class boundaries, historical-model boundary, and lawyer-comparator limitation remain visible.",
"Encyclopedia and skeptical evaluations use one unchanged source graph with materially different reasons and reader upshots.",
"Exact-head CI run 33187448187 and job 98904022930 completed successfully with no review threads."
],
"git_state": {
"fresh_clone": true,
"pre_review_clean": true,
"post_review_clean": true,
"unchanged_during_review": true,
"pre_review_head": "1c5a8318b2bb770c38a07a96f731531ba1c53a32",
"post_review_head": "1c5a8318b2bb770c38a07a96f731531ba1c53a32",
"receipt_path": "research/how-we-know/gpt-4-bar-exam-percentile/independent-em0034-review-receipt.json"
}
}
Build receipt
Reproduce this projection
- Catalog
em:catalog:sha256:9bfc972213cba2cde167386103dc2c011ee74639fb7f0794c54120fbbdef1a5d- Frontier
em:frontier:sha256:f33be3eae4c75232d56750ef9a1aa79d96274ece3417d65a75c1391bf61a81bf- Accepted commit
f92846570180dfa4511263f8ba98ecd18f7772c9- Epistemic policy
commons-balanced-v0.1- Disclosure policy
public-noninterference-v0.1- Compiler
epistemedia/0.2.0