diff --git a/reports/benchmark_reproducibility.json b/reports/benchmark_reproducibility.json index 149c57b..fafd25d 100644 --- a/reports/benchmark_reproducibility.json +++ b/reports/benchmark_reproducibility.json @@ -3,7 +3,7 @@ "ok": true, "generated_at": "2026-06-16", "skill_dir": ".", - "commit": "a5bdd57ea1005419464b6b84d7674fccee923e5a", + "commit": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", "git_status": { "available": true, "dirty": false, @@ -17,8 +17,8 @@ "methodology_complete": true, "required_artifact_count": 25, "missing_artifact_count": 0, - "evidence_bundle_sha256": "e3146f35d98391ddc8fbfad3eb08c8ce03ca6c3c055b507cd0e2c756430ff41b", - "source_contract_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d", + "evidence_bundle_sha256": "44a39ad8cf67fc298645856ba18644b083c014d9c9250ec29a8df0cf7b5ab1b5", + "source_contract_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895", "archive_sha256": "5802e5f522558cf77666ae59390a28845cf3affd22fa1267b6629891ddeba76b", "output_case_count": 5, "failure_disclosure_count": 3, @@ -54,7 +54,7 @@ }, "release_lock": { "ready": true, - "commit": "a5bdd57ea1005419464b6b84d7674fccee923e5a", + "commit": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", "status_scope": "generation-time status before this report is written", "reason": "clean generation-time HEAD" }, @@ -64,7 +64,7 @@ "existing_count": 25, "missing_count": 0, "missing_paths": [], - "sha256": "e3146f35d98391ddc8fbfad3eb08c8ce03ca6c3c055b507cd0e2c756430ff41b" + "sha256": "44a39ad8cf67fc298645856ba18644b083c014d9c9250ec29a8df0cf7b5ab1b5" }, "methodology": { "path": "reports/benchmark_methodology.md", @@ -173,7 +173,7 @@ "path": "reports/security_trust_report.json", "exists": true, "bytes": 126302, - "sha256": "63e09a0238696ea3e85fec120f710c493092617451850628cd5cc99bb60dbbb3" + "sha256": "8d944c67b09286d14fc81fd7151e06387e6dc3e4d7bcf414d07185b05a174ec6" }, { "label": "python_compatibility", @@ -221,8 +221,8 @@ "label": "world_class_evidence_ledger", "path": "reports/world_class_evidence_ledger.json", "exists": true, - "bytes": 22028, - "sha256": "43da0b8f6283e1fac4f4a3acefec6d716bfc53c2bd24f1c0f2bd9c5ea2677eb4" + "bytes": 22288, + "sha256": "75569fdccc5b26ea72b847b4e4d963f9719cd23259991c7e17d6e53e65af56c3" }, { "label": "world_class_evidence_intake", @@ -249,8 +249,8 @@ "label": "world_class_operator_runbook", "path": "reports/world_class_operator_runbook.json", "exists": true, - "bytes": 24639, - "sha256": "5cc9b1e636da2c2c27f0588f7b9fabf46d5ff7f3e375d140486e30d51671dd20" + "bytes": 24899, + "sha256": "af89218e3dfc2d1bfd8d7455e078463363ac7c3af017622db6701b8d975c69ec" }, { "label": "world_class_operator_runbook_markdown", diff --git a/reports/benchmark_reproducibility.md b/reports/benchmark_reproducibility.md index 19467c3..b35a277 100644 --- a/reports/benchmark_reproducibility.md +++ b/reports/benchmark_reproducibility.md @@ -1,9 +1,9 @@ # Benchmark Reproducibility Generated at: `2026-06-16` -Commit: `a5bdd57ea1005419464b6b84d7674fccee923e5a` +Commit: `4f3d9af19f2eb5be2564f5ef88272e1e82c17096` Working tree dirty at generation: `false` -Evidence bundle SHA256: `e3146f35d98391ddc8fbfad3eb08c8ce03ca6c3c055b507cd0e2c756430ff41b` +Evidence bundle SHA256: `44a39ad8cf67fc298645856ba18644b083c014d9c9250ec29a8df0cf7b5ab1b5` ## Summary @@ -12,7 +12,7 @@ Evidence bundle SHA256: `e3146f35d98391ddc8fbfad3eb08c8ce03ca6c3c055b507cd0e2c75 - methodology complete: `true` - required artifacts: `25` - missing artifacts: `0` -- source contract sha256: `95b883a7258f` +- source contract sha256: `a19c34849f99` - archive sha256: `5802e5f52255` - output cases: `5` - disclosed failure cases: `3` @@ -50,7 +50,7 @@ This report proves local benchmark reproducibility only. It keeps external provi - algorithm: `sha256(path,label,exists,artifact_sha256)` - artifacts: `25` / `25` -- sha256: `e3146f35d98391ddc8fbfad3eb08c8ce03ca6c3c055b507cd0e2c756430ff41b` +- sha256: `44a39ad8cf67fc298645856ba18644b083c014d9c9250ec29a8df0cf7b5ab1b5` ## Methodology Sections @@ -77,18 +77,18 @@ This report proves local benchmark reproducibility only. It keeps external provi | review_adjudication | `reports/output_review_adjudication.json` | present | `bb8c72a9291e` | | trigger_scorecard | `reports/route_scorecard.json` | present | `c164e83e36d0` | | runtime_conformance | `reports/conformance_matrix.json` | present | `97f9ba949c23` | -| trust_report | `reports/security_trust_report.json` | present | `63e09a023869` | +| trust_report | `reports/security_trust_report.json` | present | `8d944c67b092` | | python_compatibility | `reports/python_compatibility.json` | present | `fca6eb5f6f0e` | | registry_audit | `reports/registry_audit.json` | present | `e75a341d15e4` | | package_verification | `reports/package_verification.json` | present | `a27941fdb865` | | install_simulation | `reports/install_simulation.json` | present | `e29ae26bc97c` | | skill_os2_audit | `reports/skill_os2_audit.json` | present | `4f64f1cd6c78` | | world_class_evidence_plan | `reports/world_class_evidence_plan.json` | present | `130161495dc4` | -| world_class_evidence_ledger | `reports/world_class_evidence_ledger.json` | present | `43da0b8f6283` | +| world_class_evidence_ledger | `reports/world_class_evidence_ledger.json` | present | `75569fdccc5b` | | world_class_evidence_intake | `reports/world_class_evidence_intake.json` | present | `7f502f722ff1` | | world_class_evidence_preflight | `reports/world_class_evidence_preflight.json` | present | `d50e4ed44a45` | | world_class_submission_review | `reports/world_class_submission_review.json` | present | `6aaf868374ba` | -| world_class_operator_runbook | `reports/world_class_operator_runbook.json` | present | `5cc9b1e636da` | +| world_class_operator_runbook | `reports/world_class_operator_runbook.json` | present | `af89218e3dfc` | | world_class_operator_runbook_markdown | `reports/world_class_operator_runbook.md` | present | `e9b66ef084e6` | | world_class_operator_runbook_html | `reports/world_class_operator_runbook.html` | present | `9a7be02a6990` | | world_class_claim_guard | `reports/world_class_claim_guard.json` | present | `704aba252d55` | diff --git a/reports/evidence_consistency.json b/reports/evidence_consistency.json index 9434628..7502ab0 100644 --- a/reports/evidence_consistency.json +++ b/reports/evidence_consistency.json @@ -189,12 +189,12 @@ "status": "pass", "expected": { "status": "pass", - "detail": "initial load 990/1000; deferred 489692/120000; top deferred scripts 429594; resource governance governed; quality density 131.3", + "detail": "initial load 990/1000; deferred 489964/120000; top deferred scripts 429866; resource governance governed; quality density 131.3", "evidence": "reports/context_budget.json" }, "actual": { "status": "pass", - "detail": "initial load 990/1000; deferred 489692/120000; top deferred scripts 429594; resource governance governed; quality density 131.3", + "detail": "initial load 990/1000; deferred 489964/120000; top deferred scripts 429866; resource governance governed; quality density 131.3", "evidence": "reports/context_budget.json" }, "paths": [ @@ -248,8 +248,8 @@ "key": "overview-benchmark-commit", "label": "overview embeds the benchmark commit", "status": "pass", - "expected": "a5bdd57ea1005419464b6b84d7674fccee923e5a", - "actual": "a5bdd57ea1005419464b6b84d7674fccee923e5a", + "expected": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", + "actual": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", "paths": [ "reports/benchmark_reproducibility.json", "reports/skill-overview.json" @@ -264,7 +264,7 @@ "release_lock_ready": true, "required_artifact_count": 25, "missing_artifact_count": 0, - "source_contract_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d", + "source_contract_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895", "archive_sha256": "5802e5f522558cf77666ae59390a28845cf3affd22fa1267b6629891ddeba76b", "world_class_ledger_pending_count": 4, "world_class_source_check_count": 13, @@ -277,7 +277,7 @@ "release_lock_ready": true, "required_artifact_count": 25, "missing_artifact_count": 0, - "source_contract_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d", + "source_contract_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895", "archive_sha256": "5802e5f522558cf77666ae59390a28845cf3affd22fa1267b6629891ddeba76b", "world_class_ledger_pending_count": 4, "world_class_source_check_count": 13, @@ -394,8 +394,8 @@ "key": "interpretation-benchmark-commit", "label": "interpretation embeds the benchmark commit", "status": "pass", - "expected": "a5bdd57ea1005419464b6b84d7674fccee923e5a", - "actual": "a5bdd57ea1005419464b6b84d7674fccee923e5a", + "expected": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", + "actual": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", "paths": [ "reports/benchmark_reproducibility.json", "reports/skill-interpretation.json" @@ -410,7 +410,7 @@ "release_lock_ready": true, "required_artifact_count": 25, "missing_artifact_count": 0, - "source_contract_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d", + "source_contract_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895", "archive_sha256": "5802e5f522558cf77666ae59390a28845cf3affd22fa1267b6629891ddeba76b", "world_class_ledger_pending_count": 4, "world_class_source_check_count": 13, @@ -423,7 +423,7 @@ "release_lock_ready": true, "required_artifact_count": 25, "missing_artifact_count": 0, - "source_contract_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d", + "source_contract_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895", "archive_sha256": "5802e5f522558cf77666ae59390a28845cf3affd22fa1267b6629891ddeba76b", "world_class_ledger_pending_count": 4, "world_class_source_check_count": 13, diff --git a/reports/review-studio.html b/reports/review-studio.html index c12e9e5..23502f9 100644 --- a/reports/review-studio.html +++ b/reports/review-studio.html @@ -740,12 +740,12 @@

核心指标

-
Skill IR2.0.0

5 targets in platform-neutral contract

Compiler5/5

target contracts compiled from Skill IR

Output Delta100.0

5 cases; 1 file-backed

Exec Runs10

command 10; model 0; recorded 0

Blind A/B5

review pairs hide baseline vs with-skill labels

Review Kit0/5

pending 5; answer key hidden

Review A/B0/5

adjudication decisions; pending 5

Public Claimblocked

4 blockers; local reproducible true

Blueprint21/21

2.0 coverage; extensions partial 0, planned 0; evidence pending 4

Runtime5/5

target conformance pass rate

Perm Probe4/4

0 native; 4 installer-enforced

Trust0

135 scripts scanned; secrets found

Py Compat0

211 files scanned for Python 3.11

Arch Debt0

696 largest lines; 0 watchlist; 68 CLI handlers; 18 in entrypoint

Atlas5

12 scanned skills; route collisions

Driftlow

1 metadata events; 0 missed triggers

Daily Ops5

proposal-review; approval 0; release lock true

Weekly Queue5

curator-review; ready 1; top score 88

Waivers0

0 gates covered; human risk decisions

Intake4/4

0 valid submissions; 0 invalid

Claim Guard0

180 public surfaces scanned

Notes0/0

0 open blocker annotations

Registry1.1.0

5 targets; MIT license

Archivepass

658 zip entries; package verification

Installpass

4 adapters; 12 permissions enforced; 0 permission failures

Upgrademinor

declared minor; 0 breaking changes

+
Skill IR2.0.0

5 targets in platform-neutral contract

Compiler5/5

target contracts compiled from Skill IR

Output Delta100.0

5 cases; 1 file-backed

Exec Runs10

command 10; model 0; recorded 0

Blind A/B5

review pairs hide baseline vs with-skill labels

Review Kit0/5

pending 5; answer key hidden

Review A/B0/5

adjudication decisions; pending 5

Public Claimblocked

4 blockers; local reproducible true

Blueprint21/21

2.0 coverage; extensions partial 0, planned 0; evidence pending 4

Runtime5/5

target conformance pass rate

Perm Probe4/4

0 native; 4 installer-enforced

Trust0

135 scripts scanned; secrets found

Py Compat0

211 files scanned for Python 3.11

Arch Debt0

700 largest lines; 0 watchlist; 68 CLI handlers; 18 in entrypoint

Atlas5

12 scanned skills; route collisions

Driftlow

1 metadata events; 0 missed triggers

Daily Ops5

proposal-review; approval 0; release lock true

Weekly Queue5

curator-review; ready 1; top score 88

Waivers0

0 gates covered; human risk decisions

Intake4/4

0 valid submissions; 0 invalid

Claim Guard0

180 public surfaces scanned

Notes0/0

0 open blocker annotations

Registry1.1.0

5 targets; MIT license

Archivepass

658 zip entries; package verification

Installpass

4 adapters; 12 permissions enforced; 0 permission failures

Upgrademinor

declared minor; 0 breaking changes

审查闸门

-
通过

意图画布

intent confidence 100/100; Intent is clear enough to package the first routeable version.

reports/intent-confidence.json 证据
通过

触发实验

13 trigger cases; 0 misroutes; 0 ambiguous

reports/route_scorecard.json 证据
关注

输出实验

5/5 cases; with-skill 100.0; baseline 0.0; file-backed 1; near-neighbor 1; blind A/B 5; exec 10; command 10; model 0; recorded 0; reviewed 0/5; review pending 5

reports/output_quality_scorecard.json 证据
通过

上下文

initial load 990/1000; deferred 489692/120000; top deferred scripts 429594; resource governance governed; quality density 131.3

reports/context_budget.json 证据
通过

运行矩阵

5 / 5 targets pass

reports/conformance_matrix.json 证据
通过

信任报告

0 secrets; 135 scripts; 3 network-capable scripts; 0 help smoke failures

reports/security_trust_report.json 证据
通过

Python 兼容

Python 3.11; 211 files; 0 compatibility issues; 0 syntax; 0 f-string 3.11 hazards

reports/python_compatibility.json 证据
通过

架构维护

208 Python files; 0 hotspots; 0 watchlist files; 0 blockers; largest 696 lines; 68 CLI handlers; 18 in entrypoint

reports/architecture_maintainability.json 证据
通过

权限批准

3/3 permissions approved; gaps 0; required file_write, network, subprocess

reports/security_trust_report.json + security/permission_policy.json 证据
通过

权限探针

4/4 targets probed; native 0; metadata fallback 4; installer 4; residual risks 4

reports/runtime_permission_probes.json 证据
通过

组合治理

12 skills, 1 actionable; 0 actionable route collisions; 0 actionable owner gaps; 0 actionable stale; 0 actionable drift; 24 scoped non-actionable issues

reports/skill_atlas.json 证据
通过

运营回路

1 metadata events; adoption 0; missed 0; bad-output 0; risk low; daily proposals 5; daily decision proposal-review; daily release lock true; weekly queue 5 unique; weekly ready 1; weekly top 88; weekly release lock true

reports/adoption_drift_report.json + reports/skillops/daily + reports/skillops/weekly 证据
关注

人工批准

0 active waivers; 1 warning gates still need reviewer decision

reports/review_waivers.json 证据
关注

世界证据

4 pending world-class evidence entries; 1 human pending; 3 external pending; source checks 6/13 pass; 7 blocked; overclaim guard true

reports/world_class_evidence_ledger.json 证据
通过

注册审计

yao-meta-skill 1.1.0; 6/6 compatibility entries pass; install pass with 4 adapters; installer permissions 12 enforced / 0 failures

reports/registry_audit.json + reports/install_simulation.json 证据
通过

发布路线

0 promote; 3 keep current; 0 blocked; upgrade minor declared / minor recommended

reports/promotion_decisions.json + reports/upgrade_check.json + docs/migration-v2.md 证据
+
通过

意图画布

intent confidence 100/100; Intent is clear enough to package the first routeable version.

reports/intent-confidence.json 证据
通过

触发实验

13 trigger cases; 0 misroutes; 0 ambiguous

reports/route_scorecard.json 证据
关注

输出实验

5/5 cases; with-skill 100.0; baseline 0.0; file-backed 1; near-neighbor 1; blind A/B 5; exec 10; command 10; model 0; recorded 0; reviewed 0/5; review pending 5

reports/output_quality_scorecard.json 证据
通过

上下文

initial load 990/1000; deferred 489964/120000; top deferred scripts 429866; resource governance governed; quality density 131.3

reports/context_budget.json 证据
通过

运行矩阵

5 / 5 targets pass

reports/conformance_matrix.json 证据
通过

信任报告

0 secrets; 135 scripts; 3 network-capable scripts; 0 help smoke failures

reports/security_trust_report.json 证据
通过

Python 兼容

Python 3.11; 211 files; 0 compatibility issues; 0 syntax; 0 f-string 3.11 hazards

reports/python_compatibility.json 证据
通过

架构维护

208 Python files; 0 hotspots; 0 watchlist files; 0 blockers; largest 700 lines; 68 CLI handlers; 18 in entrypoint

reports/architecture_maintainability.json 证据
通过

权限批准

3/3 permissions approved; gaps 0; required file_write, network, subprocess

reports/security_trust_report.json + security/permission_policy.json 证据
通过

权限探针

4/4 targets probed; native 0; metadata fallback 4; installer 4; residual risks 4

reports/runtime_permission_probes.json 证据
通过

组合治理

12 skills, 1 actionable; 0 actionable route collisions; 0 actionable owner gaps; 0 actionable stale; 0 actionable drift; 24 scoped non-actionable issues

reports/skill_atlas.json 证据
通过

运营回路

1 metadata events; adoption 0; missed 0; bad-output 0; risk low; daily proposals 5; daily decision proposal-review; daily release lock true; weekly queue 5 unique; weekly ready 1; weekly top 88; weekly release lock true

reports/adoption_drift_report.json + reports/skillops/daily + reports/skillops/weekly 证据
关注

人工批准

0 active waivers; 1 warning gates still need reviewer decision

reports/review_waivers.json 证据
关注

世界证据

4 pending world-class evidence entries; 1 human pending; 3 external pending; source checks 6/13 pass; 7 blocked; overclaim guard true

reports/world_class_evidence_ledger.json 证据
通过

注册审计

yao-meta-skill 1.1.0; 6/6 compatibility entries pass; install pass with 4 adapters; installer permissions 12 enforced / 0 failures

reports/registry_audit.json + reports/install_simulation.json 证据
通过

发布路线

0 promote; 3 keep current; 0 blocked; upgrade minor declared / minor recommended

@@ -812,12 +812,12 @@
-

上下文

initial load 990/1000; deferred 489692/120000; top deferred scripts 429594; resource governance governed; quality density 131.3

+

上下文

initial load 990/1000; deferred 489964/120000; top deferred scripts 429866; resource governance governed; quality density 131.3

编译证据

Review reports/compiled_targets.md before packaging to inspect target adapter modes, generated files, preserved semantics, warnings, and unsupported features.

-

信任报告

Secret
0
脚本数
135
网络脚本
3
Help 失败
0
包体哈希
95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d
+

信任报告

Secret
0
脚本数
135
网络脚本
3
Help 失败
0
包体哈希
a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895

安全边界

高风险 secret、远程 inline execution、缺失依赖策略或无法解释的脚本接口应阻断 governed release。

diff --git a/reports/review-studio.json b/reports/review-studio.json index 842e2fd..2fb52cc 100644 --- a/reports/review-studio.json +++ b/reports/review-studio.json @@ -44,7 +44,7 @@ "key": "context-budget", "label": "上下文", "status": "pass", - "detail": "initial load 990/1000; deferred 489692/120000; top deferred scripts 429594; resource governance governed; quality density 131.3", + "detail": "initial load 990/1000; deferred 489964/120000; top deferred scripts 429866; resource governance governed; quality density 131.3", "evidence": "reports/context_budget.json", "link": "context_budget.md" }, @@ -76,7 +76,7 @@ "key": "architecture-maintainability", "label": "架构维护", "status": "pass", - "detail": "208 Python files; 0 hotspots; 0 watchlist files; 0 blockers; largest 696 lines; 68 CLI handlers; 18 in entrypoint", + "detail": "208 Python files; 0 hotspots; 0 watchlist files; 0 blockers; largest 700 lines; 68 CLI handlers; 18 in entrypoint", "evidence": "reports/architecture_maintainability.json", "link": "architecture_maintainability.md" }, @@ -1972,8 +1972,8 @@ "methodology_complete": true, "required_artifact_count": 25, "missing_artifact_count": 0, - "evidence_bundle_sha256": "e3146f35d98391ddc8fbfad3eb08c8ce03ca6c3c055b507cd0e2c756430ff41b", - "source_contract_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d", + "evidence_bundle_sha256": "44a39ad8cf67fc298645856ba18644b083c014d9c9250ec29a8df0cf7b5ab1b5", + "source_contract_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895", "archive_sha256": "5802e5f522558cf77666ae59390a28845cf3affd22fa1267b6629891ddeba76b", "output_case_count": 5, "failure_disclosure_count": 3, @@ -1996,7 +1996,7 @@ "working_tree_dirty": false, "changed_file_count": 0 }, - "commit": "a5bdd57ea1005419464b6b84d7674fccee923e5a", + "commit": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", "missing_artifacts": [], "limitations": [ "The git commit and dirty flag are generation-time context; the evidence bundle hash is the durable artifact anchor inside a committed report.", @@ -2101,7 +2101,7 @@ "interactive_script_count": 0, "package_hash_scope": "source-contract-without-generated-reports", "package_hash_file_count": 226, - "package_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d" + "package_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895" }, "skill_atlas": { "skill_count": 12, @@ -2723,6 +2723,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -2842,6 +2844,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -2951,6 +2955,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -3053,6 +3059,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -5651,7 +5659,7 @@ "ok": true, "generated_at": "2026-06-16", "skill_dir": ".", - "commit": "a5bdd57ea1005419464b6b84d7674fccee923e5a", + "commit": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", "git_status": { "available": true, "dirty": false, @@ -5665,8 +5673,8 @@ "methodology_complete": true, "required_artifact_count": 25, "missing_artifact_count": 0, - "evidence_bundle_sha256": "e3146f35d98391ddc8fbfad3eb08c8ce03ca6c3c055b507cd0e2c756430ff41b", - "source_contract_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d", + "evidence_bundle_sha256": "44a39ad8cf67fc298645856ba18644b083c014d9c9250ec29a8df0cf7b5ab1b5", + "source_contract_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895", "archive_sha256": "5802e5f522558cf77666ae59390a28845cf3affd22fa1267b6629891ddeba76b", "output_case_count": 5, "failure_disclosure_count": 3, @@ -5702,7 +5710,7 @@ }, "release_lock": { "ready": true, - "commit": "a5bdd57ea1005419464b6b84d7674fccee923e5a", + "commit": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", "status_scope": "generation-time status before this report is written", "reason": "clean generation-time HEAD" }, @@ -5712,7 +5720,7 @@ "existing_count": 25, "missing_count": 0, "missing_paths": [], - "sha256": "e3146f35d98391ddc8fbfad3eb08c8ce03ca6c3c055b507cd0e2c756430ff41b" + "sha256": "44a39ad8cf67fc298645856ba18644b083c014d9c9250ec29a8df0cf7b5ab1b5" }, "methodology": { "path": "reports/benchmark_methodology.md", @@ -5821,7 +5829,7 @@ "path": "reports/security_trust_report.json", "exists": true, "bytes": 126302, - "sha256": "63e09a0238696ea3e85fec120f710c493092617451850628cd5cc99bb60dbbb3" + "sha256": "8d944c67b09286d14fc81fd7151e06387e6dc3e4d7bcf414d07185b05a174ec6" }, { "label": "python_compatibility", @@ -5869,8 +5877,8 @@ "label": "world_class_evidence_ledger", "path": "reports/world_class_evidence_ledger.json", "exists": true, - "bytes": 22028, - "sha256": "43da0b8f6283e1fac4f4a3acefec6d716bfc53c2bd24f1c0f2bd9c5ea2677eb4" + "bytes": 22288, + "sha256": "75569fdccc5b26ea72b847b4e4d963f9719cd23259991c7e17d6e53e65af56c3" }, { "label": "world_class_evidence_intake", @@ -5897,8 +5905,8 @@ "label": "world_class_operator_runbook", "path": "reports/world_class_operator_runbook.json", "exists": true, - "bytes": 24639, - "sha256": "5cc9b1e636da2c2c27f0588f7b9fabf46d5ff7f3e375d140486e30d51671dd20" + "bytes": 24899, + "sha256": "af89218e3dfc2d1bfd8d7455e078463363ac7c3af017622db6701b8d975c69ec" }, { "label": "world_class_operator_runbook_markdown", @@ -12096,7 +12104,7 @@ "interactive_script_count": 0, "package_hash_scope": "source-contract-without-generated-reports", "package_hash_file_count": 226, - "package_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d" + "package_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895" }, "failures": [], "warnings": [], @@ -16607,13 +16615,20 @@ "warn_line_threshold": 900, "watch_line_threshold": 720, "block_line_threshold": 1500, - "largest_file_lines": 696, + "largest_file_lines": 700, "watchlist_count": 0, "hotspot_count": 0, "blocker_count": 0, "decision": "pass" }, "largest_files": [ + { + "path": "scripts/world_class_evidence_contract.py", + "lines": 700, + "kind": "internal-module", + "severity": "pass", + "recommendation": "Watch this file before adding new responsibilities; extract a helper module when one concern dominates." + }, { "path": "tests/verify_yao_cli.py", "lines": 696, @@ -16621,13 +16636,6 @@ "severity": "pass", "recommendation": "Break broad integration assertions into focused verifier helpers when the next behavior change lands." }, - { - "path": "scripts/world_class_evidence_contract.py", - "lines": 687, - "kind": "internal-module", - "severity": "pass", - "recommendation": "Watch this file before adding new responsibilities; extract a helper module when one concern dominates." - }, { "path": "scripts/render_review_viewer.py", "lines": 685, @@ -16635,6 +16643,13 @@ "severity": "pass", "recommendation": "Split viewer data assembly from HTML section rendering." }, + { + "path": "tests/verify_world_class_evidence_intake.py", + "lines": 669, + "kind": "test", + "severity": "pass", + "recommendation": "Break broad integration assertions into focused verifier helpers when the next behavior change lands." + }, { "path": "scripts/skill_report_model.py", "lines": 665, @@ -16642,13 +16657,6 @@ "severity": "pass", "recommendation": "Watch this file before adding new responsibilities; extract a helper module when one concern dominates." }, - { - "path": "tests/verify_world_class_evidence_intake.py", - "lines": 663, - "kind": "test", - "severity": "pass", - "recommendation": "Break broad integration assertions into focused verifier helpers when the next behavior change lands." - }, { "path": "scripts/render_skill_os2_coverage.py", "lines": 649, @@ -16715,15 +16723,15 @@ "context_budget_tier": "production", "context_budget_limit": 1000, "skill_body_tokens": 797, - "other_text_tokens": 1056256, + "other_text_tokens": 1057945, "estimated_initial_load_tokens": 990, - "estimated_total_text_tokens": 1057053, - "deferred_resource_tokens": 489692, + "estimated_total_text_tokens": 1058742, + "deferred_resource_tokens": 489964, "deferred_resource_warn_threshold": 120000, "deferred_resource_dirs": [ { "path": "scripts", - "estimated_tokens": 429594, + "estimated_tokens": 429866, "file_count": 135 }, { @@ -16745,7 +16753,7 @@ "large_deferred_resource_dirs": [ { "path": "scripts", - "estimated_tokens": 429594, + "estimated_tokens": 429866, "file_count": 135 } ], @@ -16768,7 +16776,7 @@ ], "missing": [], "path": "scripts", - "estimated_tokens": 429594, + "estimated_tokens": 429866, "file_count": 135, "rationale": "Script resources are deterministic deferred tools, not initial-load prompt context." } @@ -20288,6 +20296,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -20407,6 +20417,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -20516,6 +20528,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -20618,6 +20632,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -22485,6 +22501,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -22618,6 +22636,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -22740,6 +22760,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -22856,6 +22878,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { diff --git a/reports/review-viewer.json b/reports/review-viewer.json index a462ef0..36368d5 100644 --- a/reports/review-viewer.json +++ b/reports/review-viewer.json @@ -1001,8 +1001,8 @@ "methodology_complete": true, "required_artifact_count": 25, "missing_artifact_count": 0, - "evidence_bundle_sha256": "e3146f35d98391ddc8fbfad3eb08c8ce03ca6c3c055b507cd0e2c756430ff41b", - "source_contract_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d", + "evidence_bundle_sha256": "44a39ad8cf67fc298645856ba18644b083c014d9c9250ec29a8df0cf7b5ab1b5", + "source_contract_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895", "archive_sha256": "5802e5f522558cf77666ae59390a28845cf3affd22fa1267b6629891ddeba76b", "output_case_count": 5, "failure_disclosure_count": 3, @@ -1025,7 +1025,7 @@ "working_tree_dirty": false, "changed_file_count": 0 }, - "commit": "a5bdd57ea1005419464b6b84d7674fccee923e5a", + "commit": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", "missing_artifacts": [], "limitations": [ "The git commit and dirty flag are generation-time context; the evidence bundle hash is the durable artifact anchor inside a committed report.", @@ -1130,7 +1130,7 @@ "interactive_script_count": 0, "package_hash_scope": "source-contract-without-generated-reports", "package_hash_file_count": 226, - "package_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d" + "package_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895" }, "skill_atlas": { "skill_count": 12, @@ -1752,6 +1752,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -1871,6 +1873,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -1980,6 +1984,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -2082,6 +2088,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { diff --git a/reports/skill-interpretation.json b/reports/skill-interpretation.json index 1014694..cfb9431 100644 --- a/reports/skill-interpretation.json +++ b/reports/skill-interpretation.json @@ -1005,8 +1005,8 @@ "methodology_complete": true, "required_artifact_count": 25, "missing_artifact_count": 0, - "evidence_bundle_sha256": "e3146f35d98391ddc8fbfad3eb08c8ce03ca6c3c055b507cd0e2c756430ff41b", - "source_contract_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d", + "evidence_bundle_sha256": "44a39ad8cf67fc298645856ba18644b083c014d9c9250ec29a8df0cf7b5ab1b5", + "source_contract_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895", "archive_sha256": "5802e5f522558cf77666ae59390a28845cf3affd22fa1267b6629891ddeba76b", "output_case_count": 5, "failure_disclosure_count": 3, @@ -1029,7 +1029,7 @@ "working_tree_dirty": false, "changed_file_count": 0 }, - "commit": "a5bdd57ea1005419464b6b84d7674fccee923e5a", + "commit": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", "missing_artifacts": [], "limitations": [ "The git commit and dirty flag are generation-time context; the evidence bundle hash is the durable artifact anchor inside a committed report.", @@ -1134,7 +1134,7 @@ "interactive_script_count": 0, "package_hash_scope": "source-contract-without-generated-reports", "package_hash_file_count": 226, - "package_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d" + "package_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895" }, "skill_atlas": { "skill_count": 12, @@ -1756,6 +1756,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -1875,6 +1877,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -1984,6 +1988,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -2086,6 +2092,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { diff --git a/reports/skill-overview.json b/reports/skill-overview.json index e9cb9d7..073efcd 100644 --- a/reports/skill-overview.json +++ b/reports/skill-overview.json @@ -1000,8 +1000,8 @@ "methodology_complete": true, "required_artifact_count": 25, "missing_artifact_count": 0, - "evidence_bundle_sha256": "e3146f35d98391ddc8fbfad3eb08c8ce03ca6c3c055b507cd0e2c756430ff41b", - "source_contract_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d", + "evidence_bundle_sha256": "44a39ad8cf67fc298645856ba18644b083c014d9c9250ec29a8df0cf7b5ab1b5", + "source_contract_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895", "archive_sha256": "5802e5f522558cf77666ae59390a28845cf3affd22fa1267b6629891ddeba76b", "output_case_count": 5, "failure_disclosure_count": 3, @@ -1024,7 +1024,7 @@ "working_tree_dirty": false, "changed_file_count": 0 }, - "commit": "a5bdd57ea1005419464b6b84d7674fccee923e5a", + "commit": "4f3d9af19f2eb5be2564f5ef88272e1e82c17096", "missing_artifacts": [], "limitations": [ "The git commit and dirty flag are generation-time context; the evidence bundle hash is the durable artifact anchor inside a committed report.", @@ -1129,7 +1129,7 @@ "interactive_script_count": 0, "package_hash_scope": "source-contract-without-generated-reports", "package_hash_file_count": 226, - "package_sha256": "95b883a7258f8b201a7f94b47a35fa3f665ac65160def6d41764f20e2cdb5e4d" + "package_sha256": "a19c34849f99fe3f9166f7ba13c54d9ca709e1cec205ad3a1e82e8f1eb30d895" }, "skill_atlas": { "skill_count": 12, @@ -1751,6 +1751,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -1870,6 +1872,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -1979,6 +1983,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": { @@ -2081,6 +2087,8 @@ "attested_real_evidence": false, "privacy_contract_satisfied": false, "ledger_reviewer_approved": false, + "ledger_reviewer": "", + "ledger_reviewed_at": "", "ledger_counts_as_completion": false }, "anti_overclaim": {