{"kind":"awits-rdgap-topology","generatedAt":"2026-09-03T17:05:06.199Z","readOnly":true,"mutations":false,"catalog":{"graph":{"id":"029bc274-17fc-42fa-9055-a42dc197bb26","name":"AWITS Candidate-Necessity R&D Map v2.4","schema":"intrikata-stack.rdgap-capability-manifest/v1","catalogId":"singularity-class-takeoff-rdgap-2026-08-01","modelVersion":"rdgap-v2.14-calendar-adaptive-arxiv-named-tunnel-2026-08-03","sourceManifestRdGapModelVersion":"rdgap-v2.11-residual-resolution-arxiv-shadow-2026-08-02","sourceCapabilityProjectionSha256":"1b7bbd2c48e37d3a80365a47572678f7c945845db3f95b7fba61f3715029398f","readOnly":true,"parentGapCount":9,"capabilityCount":37,"pathwayCount":4,"nodeCount":50,"edgeCount":73},"claim":"candidate-research-workstreams-not-completed-frontier-capabilities","statement":"All 37 items are represented as candidate research workstreams. Representation is not implementation, completion, direct readiness, a frontier-capability claim, or proof that takeoff will occur.","implementationStatus":"not-asserted","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"parents":[{"gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","rank":1,"title":"Test-time compute & reasoning generalization","capabilityCount":4,"capabilityIds":["rd-capability:test-time-compute-reasoning-generalization:01","rd-capability:test-time-compute-reasoning-generalization:02","rd-capability:test-time-compute-reasoning-generalization:03","rd-capability:test-time-compute-reasoning-generalization:04"]},{"gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","rank":2,"title":"Reliable long-horizon agency & tool use","capabilityCount":4,"capabilityIds":["rd-capability:reliable-long-horizon-agency-tool-use:01","rd-capability:reliable-long-horizon-agency-tool-use:02","rd-capability:reliable-long-horizon-agency-tool-use:03","rd-capability:reliable-long-horizon-agency-tool-use:04"]},{"gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","rank":3,"title":"Compute, energy & training infrastructure","capabilityCount":5,"capabilityIds":["rd-capability:compute-energy-training-infrastructure:01","rd-capability:compute-energy-training-infrastructure:02","rd-capability:compute-energy-training-infrastructure:03","rd-capability:compute-energy-training-infrastructure:04","rd-capability:compute-energy-training-infrastructure:05"]},{"gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","rank":4,"title":"Automated / recursive R&D loops","capabilityCount":4,"capabilityIds":["rd-capability:automated-recursive-rd-loops:01","rd-capability:automated-recursive-rd-loops:02","rd-capability:automated-recursive-rd-loops:03","rd-capability:automated-recursive-rd-loops:04"]},{"gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","rank":5,"title":"Training-data supply & synthetic-data validity","capabilityCount":4,"capabilityIds":["rd-capability:training-data-supply-synthetic-validity:01","rd-capability:training-data-supply-synthetic-validity:02","rd-capability:training-data-supply-synthetic-validity:03","rd-capability:training-data-supply-synthetic-validity:04"]},{"gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","rank":6,"title":"Continual learning & sample-efficient adaptation","capabilityCount":4,"capabilityIds":["rd-capability:continual-learning-sample-efficient-adaptation:01","rd-capability:continual-learning-sample-efficient-adaptation:02","rd-capability:continual-learning-sample-efficient-adaptation:03","rd-capability:continual-learning-sample-efficient-adaptation:04"]},{"gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","rank":7,"title":"Automated scientific discovery & formal reasoning","capabilityCount":4,"capabilityIds":["rd-capability:automated-scientific-discovery-formal-reasoning:01","rd-capability:automated-scientific-discovery-formal-reasoning:02","rd-capability:automated-scientific-discovery-formal-reasoning:03","rd-capability:automated-scientific-discovery-formal-reasoning:04"]},{"gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","rank":8,"title":"Grounded world models & multimodal planning","capabilityCount":4,"capabilityIds":["rd-capability:grounded-world-models-multimodal-planning:01","rd-capability:grounded-world-models-multimodal-planning:02","rd-capability:grounded-world-models-multimodal-planning:03","rd-capability:grounded-world-models-multimodal-planning:04"]},{"gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","rank":9,"title":"Safe multi-agent & economy-scale coordination","capabilityCount":4,"capabilityIds":["rd-capability:safe-multi-agent-economy-scale-coordination:01","rd-capability:safe-multi-agent-economy-scale-coordination:02","rd-capability:safe-multi-agent-economy-scale-coordination:03","rd-capability:safe-multi-agent-economy-scale-coordination:04"]}],"capabilities":[{"id":"rd-capability:test-time-compute-reasoning-generalization:01","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":1,"workstream":"Inference-compute scaling laws with held-out, uncontaminated tasks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-inference-cost-burden 43000000 output-tokens-at-27pct-frontiermath","computed":{"name":"frontiermath-output-tokens-at-27pct","value":43000000,"unit":"output-tokens"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:test-time-compute-reasoning-generalization:02","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":2,"workstream":"Transfer of verifiable-reward training to non-verifiable domains","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: transfer of gains from verifiable domains","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:test-time-compute-reasoning-generalization:03","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":3,"workstream":"Process supervision and search over reasoning traces at frontier scale","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: held-out uncontaminated tasks","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:test-time-compute-reasoning-generalization:04","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":4,"workstream":"Cost-aware reasoning: accuracy per token, not accuracy at any price","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-inference-cost-burden 43000000 output-tokens-at-27pct-frontiermath","computed":{"name":"token-reduction-vs-5m-later-snapshot","value":8.6,"unit":"times-token-reduction-at-fixed-accuracy"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:01","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":1,"workstream":"Long-horizon planning, memory, and recovery under tool failure","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to metr-time-horizons 185.91 minutes","computed":{"name":"metr-80pct-horizon","value":185.91,"unit":"minutes"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:02","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":2,"workstream":"Computer-use, browser, and IDE agents with verifiable success rates","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to metr-time-horizons 185.91 minutes","computed":{"name":"osworld-best-agent-success","value":12.24,"unit":"percent-success-rate-best-agent-osworld"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:03","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":3,"workstream":"Safe tool APIs, sandboxing, and permission hierarchies","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: recovery from failure","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:04","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":4,"workstream":"Multi-step evaluation suites with anti-overfit holdouts","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to metr-time-horizons 185.91 minutes","computed":{"name":"metr-80pct-vs-16hr-reliability-bound","value":0.19365625,"unit":"fraction-of-metr-16hr-exclusion-bound"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:01","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":1,"workstream":"Power delivery and cooling for multi-GW AI campuses","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: grid and interconnect headroom","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:02","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":2,"workstream":"Next-generation accelerators, HBM, and optical interconnect","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 5 times-per-year-training-compute-growth","computed":{"name":"training-compute-growth-in-published-ci","value":1,"unit":"boolean-in-ci-band"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:03","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":3,"workstream":"Training-system fault tolerance, utilization, and data pipelines","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: inference capacity tracked against demand","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:04","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":4,"workstream":"Algorithmic efficiency that multiplies effective compute","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 5 times-per-year-training-compute-growth","computed":{"name":"pretraining-software-efficiency","value":3,"unit":"times-per-year-pretraining-compute-efficiency"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:05","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":5,"workstream":"Hardware-software co-design within the compute-energy class","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: accelerator supply chain","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:01","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":1,"workstream":"AutoML and architecture search that improves frontier training recipes","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:02","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":2,"workstream":"AI co-scientists for experiment design, code generation, and result critique","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:03","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":3,"workstream":"Closed-loop training-data generation with quality filters","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:04","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":4,"workstream":"Metrics for R&D productivity lift rather than loss curves alone","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:01","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":1,"workstream":"Synthetic-data filters that remain valid across successive training generations","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: successive-generation held-out performance","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:02","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":2,"workstream":"Resolution of model-collapse versus accumulate-don't-replace results","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: model-collapse","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:03","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":3,"workstream":"Licensing, acquisition, and multimodal corpus expansion beyond public text","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: interactive / multimodal data quality","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:04","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":4,"workstream":"More capability per training token","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 3 times-per-year-pretraining-compute-efficiency","computed":{"name":"capability-per-pretraining-compute-efficiency","value":3,"unit":"times-per-year-pretraining-compute-efficiency"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:01","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":1,"workstream":"Stable continual and lifelong learning at foundation-model scale","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: non-stationary task suites","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:02","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":2,"workstream":"Efficient fine-tuning and modular adapters with transfer guarantees","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: sample-efficient adaptation cost","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:03","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":3,"workstream":"Memory architectures that retain skills under non-stationary tasks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 30 times-per-year-context-window-growth","computed":{"name":"context-window-growth-in-published-ci","value":1,"unit":"boolean-in-ci-band"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:04","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":4,"workstream":"Data-efficient post-training from sparse human feedback","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: catastrophic-forgetting","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:01","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":1,"workstream":"Autoformalization and theorem proving at research scale","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:02","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":2,"workstream":"Closed-loop wet-lab, materials, and drug-discovery agents","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:03","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":3,"workstream":"Verified synthesis of novel algorithms and training methods","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:04","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":4,"workstream":"Cross-domain knowledge graphs that propose testable experiments","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:01","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":1,"workstream":"Unified multimodal world models spanning vision, language, action, and physics priors","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to osworld-benchmark 12.24 percent-success-rate-best-agent-osworld","computed":{"name":"osworld-human-minus-agent-gap","value":60.12,"unit":"percentage-points"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:02","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":2,"workstream":"Sim-to-real and digital-twin planning loops","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: physical / non-digital environment","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:03","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":3,"workstream":"Causal and counterfactual evaluation of plans","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: held-out causal and counterfactual","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:04","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":4,"workstream":"Embodied and robotics transfer benchmarks with public suites","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: physical / non-digital environment generalization","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:01","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":1,"workstream":"Game-theoretic protocol design for agent societies","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:02","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":2,"workstream":"Collusion, deception, and cascade-failure benchmarks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:03","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":3,"workstream":"Economic simulation environments with scarce resources","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:04","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":4,"workstream":"Identity, reputation, and permission systems for agent networks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}}],"frontierCapabilityValidation":{"claim":"candidate-research-workstreams-not-completed-frontier-capabilities","statement":"All 37 items are represented as candidate research workstreams. Representation is not implementation, completion, direct readiness, a frontier-capability claim, or proof that takeoff will occur.","catalogId":"singularity-class-takeoff-rdgap-2026-08-01","sourceManifestRdGapModelVersion":"rdgap-v2.11-residual-resolution-arxiv-shadow-2026-08-02","capabilityCount":37,"parentGapCount":9,"allFrontierClaimsWithheld":true,"allImplementationNotAsserted":true,"allWorkstreamReadinessUnmeasured":true,"parentInstrumentsPartialCount":6,"parentInstrumentsUnmeasuredCount":0,"parentInstrumentsStructurallyUnmeasurableCount":3,"workstreams":[{"capabilityId":"rd-capability:test-time-compute-reasoning-generalization:01","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","ordinalWithinParent":1,"workstream":"Inference-compute scaling laws with held-out, uncontaminated tasks","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:test-time-compute-reasoning-generalization:02","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","ordinalWithinParent":2,"workstream":"Transfer of verifiable-reward training to non-verifiable domains","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:test-time-compute-reasoning-generalization:03","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","ordinalWithinParent":3,"workstream":"Process supervision and search over reasoning traces at frontier scale","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:test-time-compute-reasoning-generalization:04","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","ordinalWithinParent":4,"workstream":"Cost-aware reasoning: accuracy per token, not accuracy at any price","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:reliable-long-horizon-agency-tool-use:01","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","ordinalWithinParent":1,"workstream":"Long-horizon planning, memory, and recovery under tool failure","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:reliable-long-horizon-agency-tool-use:02","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","ordinalWithinParent":2,"workstream":"Computer-use, browser, and IDE agents with verifiable success rates","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:reliable-long-horizon-agency-tool-use:03","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","ordinalWithinParent":3,"workstream":"Safe tool APIs, sandboxing, and permission hierarchies","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:reliable-long-horizon-agency-tool-use:04","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","ordinalWithinParent":4,"workstream":"Multi-step evaluation suites with anti-overfit holdouts","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:compute-energy-training-infrastructure:01","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","ordinalWithinParent":1,"workstream":"Power delivery and cooling for multi-GW AI campuses","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:compute-energy-training-infrastructure:02","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","ordinalWithinParent":2,"workstream":"Next-generation accelerators, HBM, and optical interconnect","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:compute-energy-training-infrastructure:03","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","ordinalWithinParent":3,"workstream":"Training-system fault tolerance, utilization, and data pipelines","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:compute-energy-training-infrastructure:04","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","ordinalWithinParent":4,"workstream":"Algorithmic efficiency that multiplies effective compute","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:compute-energy-training-infrastructure:05","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","ordinalWithinParent":5,"workstream":"Hardware-software co-design within the compute-energy class","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:automated-recursive-rd-loops:01","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","ordinalWithinParent":1,"workstream":"AutoML and architecture search that improves frontier training recipes","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false},{"capabilityId":"rd-capability:automated-recursive-rd-loops:02","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","ordinalWithinParent":2,"workstream":"AI co-scientists for experiment design, code generation, and result critique","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false},{"capabilityId":"rd-capability:automated-recursive-rd-loops:03","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","ordinalWithinParent":3,"workstream":"Closed-loop training-data generation with quality filters","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false},{"capabilityId":"rd-capability:automated-recursive-rd-loops:04","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","ordinalWithinParent":4,"workstream":"Metrics for R&D productivity lift rather than loss curves alone","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false},{"capabilityId":"rd-capability:training-data-supply-synthetic-validity:01","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","ordinalWithinParent":1,"workstream":"Synthetic-data filters that remain valid across successive training generations","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:training-data-supply-synthetic-validity:02","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","ordinalWithinParent":2,"workstream":"Resolution of model-collapse versus accumulate-don't-replace results","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:training-data-supply-synthetic-validity:03","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","ordinalWithinParent":3,"workstream":"Licensing, acquisition, and multimodal corpus expansion beyond public text","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:training-data-supply-synthetic-validity:04","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","ordinalWithinParent":4,"workstream":"More capability per training token","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:continual-learning-sample-efficient-adaptation:01","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","ordinalWithinParent":1,"workstream":"Stable continual and lifelong learning at foundation-model scale","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:continual-learning-sample-efficient-adaptation:02","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","ordinalWithinParent":2,"workstream":"Efficient fine-tuning and modular adapters with transfer guarantees","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:continual-learning-sample-efficient-adaptation:03","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","ordinalWithinParent":3,"workstream":"Memory architectures that retain skills under non-stationary tasks","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:continual-learning-sample-efficient-adaptation:04","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","ordinalWithinParent":4,"workstream":"Data-efficient post-training from sparse human feedback","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:automated-scientific-discovery-formal-reasoning:01","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","ordinalWithinParent":1,"workstream":"Autoformalization and theorem proving at research scale","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false},{"capabilityId":"rd-capability:automated-scientific-discovery-formal-reasoning:02","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","ordinalWithinParent":2,"workstream":"Closed-loop wet-lab, materials, and drug-discovery agents","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false},{"capabilityId":"rd-capability:automated-scientific-discovery-formal-reasoning:03","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","ordinalWithinParent":3,"workstream":"Verified synthesis of novel algorithms and training methods","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false},{"capabilityId":"rd-capability:automated-scientific-discovery-formal-reasoning:04","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","ordinalWithinParent":4,"workstream":"Cross-domain knowledge graphs that propose testable experiments","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false},{"capabilityId":"rd-capability:grounded-world-models-multimodal-planning:01","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","ordinalWithinParent":1,"workstream":"Unified multimodal world models spanning vision, language, action, and physics priors","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:grounded-world-models-multimodal-planning:02","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","ordinalWithinParent":2,"workstream":"Sim-to-real and digital-twin planning loops","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:grounded-world-models-multimodal-planning:03","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","ordinalWithinParent":3,"workstream":"Causal and counterfactual evaluation of plans","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:grounded-world-models-multimodal-planning:04","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","ordinalWithinParent":4,"workstream":"Embodied and robotics transfer benchmarks with public suites","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentHasPartialInstrument":true},{"capabilityId":"rd-capability:safe-multi-agent-economy-scale-coordination:01","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","ordinalWithinParent":1,"workstream":"Game-theoretic protocol design for agent societies","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false},{"capabilityId":"rd-capability:safe-multi-agent-economy-scale-coordination:02","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","ordinalWithinParent":2,"workstream":"Collusion, deception, and cascade-failure benchmarks","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false},{"capabilityId":"rd-capability:safe-multi-agent-economy-scale-coordination:03","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","ordinalWithinParent":3,"workstream":"Economic simulation environments with scarce resources","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false},{"capabilityId":"rd-capability:safe-multi-agent-economy-scale-coordination:04","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","ordinalWithinParent":4,"workstream":"Identity, reputation, and permission systems for agent networks","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","workstreamDirectReadinessStatus":"unmeasured","workstreamDirectReadinessNecessityWeight":0,"parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentHasPartialInstrument":false}]},"capabilityImplementationReport":{"claim":"workstream-probes-implemented-not-frontier-capabilities","catalogClaim":"candidate-research-workstreams-not-completed-frontier-capabilities","capabilityCount":37,"implementedCount":37,"probesPassed":37,"probesFailed":[],"byClass":{"decidable":8,"semi-decidable":17,"tarski-residual":12},"byKind":{"snapshot-bound":10,"uncovered-named":15,"tarski-named":12},"allProbesPassed":true,"allFrontierClaimsWithheld":true,"allWorkstreamReadinessUnmeasured":true,"specIdParity":true,"workstreams":[{"id":"rd-capability:test-time-compute-reasoning-generalization:01","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":1,"workstream":"Inference-compute scaling laws with held-out, uncontaminated tasks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-inference-cost-burden 43000000 output-tokens-at-27pct-frontiermath","computed":{"name":"frontiermath-output-tokens-at-27pct","value":43000000,"unit":"output-tokens"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:test-time-compute-reasoning-generalization:02","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":2,"workstream":"Transfer of verifiable-reward training to non-verifiable domains","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: transfer of gains from verifiable domains","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:test-time-compute-reasoning-generalization:03","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":3,"workstream":"Process supervision and search over reasoning traces at frontier scale","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: held-out uncontaminated tasks","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:test-time-compute-reasoning-generalization:04","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":4,"workstream":"Cost-aware reasoning: accuracy per token, not accuracy at any price","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-inference-cost-burden 43000000 output-tokens-at-27pct-frontiermath","computed":{"name":"token-reduction-vs-5m-later-snapshot","value":8.6,"unit":"times-token-reduction-at-fixed-accuracy"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:01","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":1,"workstream":"Long-horizon planning, memory, and recovery under tool failure","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to metr-time-horizons 185.91 minutes","computed":{"name":"metr-80pct-horizon","value":185.91,"unit":"minutes"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:02","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":2,"workstream":"Computer-use, browser, and IDE agents with verifiable success rates","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to metr-time-horizons 185.91 minutes","computed":{"name":"osworld-best-agent-success","value":12.24,"unit":"percent-success-rate-best-agent-osworld"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:03","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":3,"workstream":"Safe tool APIs, sandboxing, and permission hierarchies","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: recovery from failure","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:04","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":4,"workstream":"Multi-step evaluation suites with anti-overfit holdouts","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to metr-time-horizons 185.91 minutes","computed":{"name":"metr-80pct-vs-16hr-reliability-bound","value":0.19365625,"unit":"fraction-of-metr-16hr-exclusion-bound"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:01","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":1,"workstream":"Power delivery and cooling for multi-GW AI campuses","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: grid and interconnect headroom","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:02","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":2,"workstream":"Next-generation accelerators, HBM, and optical interconnect","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 5 times-per-year-training-compute-growth","computed":{"name":"training-compute-growth-in-published-ci","value":1,"unit":"boolean-in-ci-band"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:03","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":3,"workstream":"Training-system fault tolerance, utilization, and data pipelines","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: inference capacity tracked against demand","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:04","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":4,"workstream":"Algorithmic efficiency that multiplies effective compute","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 5 times-per-year-training-compute-growth","computed":{"name":"pretraining-software-efficiency","value":3,"unit":"times-per-year-pretraining-compute-efficiency"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:05","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":5,"workstream":"Hardware-software co-design within the compute-energy class","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: accelerator supply chain","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:01","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":1,"workstream":"AutoML and architecture search that improves frontier training recipes","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:02","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":2,"workstream":"AI co-scientists for experiment design, code generation, and result critique","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:03","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":3,"workstream":"Closed-loop training-data generation with quality filters","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:04","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":4,"workstream":"Metrics for R&D productivity lift rather than loss curves alone","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:01","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":1,"workstream":"Synthetic-data filters that remain valid across successive training generations","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: successive-generation held-out performance","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:02","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":2,"workstream":"Resolution of model-collapse versus accumulate-don't-replace results","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: model-collapse","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:03","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":3,"workstream":"Licensing, acquisition, and multimodal corpus expansion beyond public text","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: interactive / multimodal data quality","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:04","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":4,"workstream":"More capability per training token","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 3 times-per-year-pretraining-compute-efficiency","computed":{"name":"capability-per-pretraining-compute-efficiency","value":3,"unit":"times-per-year-pretraining-compute-efficiency"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:01","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":1,"workstream":"Stable continual and lifelong learning at foundation-model scale","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: non-stationary task suites","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:02","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":2,"workstream":"Efficient fine-tuning and modular adapters with transfer guarantees","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: sample-efficient adaptation cost","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:03","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":3,"workstream":"Memory architectures that retain skills under non-stationary tasks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 30 times-per-year-context-window-growth","computed":{"name":"context-window-growth-in-published-ci","value":1,"unit":"boolean-in-ci-band"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:04","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":4,"workstream":"Data-efficient post-training from sparse human feedback","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: catastrophic-forgetting","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:01","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":1,"workstream":"Autoformalization and theorem proving at research scale","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:02","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":2,"workstream":"Closed-loop wet-lab, materials, and drug-discovery agents","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:03","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":3,"workstream":"Verified synthesis of novel algorithms and training methods","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:04","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":4,"workstream":"Cross-domain knowledge graphs that propose testable experiments","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:01","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":1,"workstream":"Unified multimodal world models spanning vision, language, action, and physics priors","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to osworld-benchmark 12.24 percent-success-rate-best-agent-osworld","computed":{"name":"osworld-human-minus-agent-gap","value":60.12,"unit":"percentage-points"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:02","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":2,"workstream":"Sim-to-real and digital-twin planning loops","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: physical / non-digital environment","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:03","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":3,"workstream":"Causal and counterfactual evaluation of plans","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: held-out causal and counterfactual","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:04","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":4,"workstream":"Embodied and robotics transfer benchmarks with public suites","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: physical / non-digital environment generalization","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:01","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":1,"workstream":"Game-theoretic protocol design for agent societies","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:02","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":2,"workstream":"Collusion, deception, and cascade-failure benchmarks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:03","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":3,"workstream":"Economic simulation environments with scarce resources","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:04","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":4,"workstream":"Identity, reputation, and permission systems for agent networks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}}]},"parentEdges":[{"source":"test-time-compute-reasoning-generalization","target":"rd-capability:test-time-compute-reasoning-generalization:01","relation":"contains-candidate-workstream"},{"source":"test-time-compute-reasoning-generalization","target":"rd-capability:test-time-compute-reasoning-generalization:02","relation":"contains-candidate-workstream"},{"source":"test-time-compute-reasoning-generalization","target":"rd-capability:test-time-compute-reasoning-generalization:03","relation":"contains-candidate-workstream"},{"source":"test-time-compute-reasoning-generalization","target":"rd-capability:test-time-compute-reasoning-generalization:04","relation":"contains-candidate-workstream"},{"source":"reliable-long-horizon-agency-tool-use","target":"rd-capability:reliable-long-horizon-agency-tool-use:01","relation":"contains-candidate-workstream"},{"source":"reliable-long-horizon-agency-tool-use","target":"rd-capability:reliable-long-horizon-agency-tool-use:02","relation":"contains-candidate-workstream"},{"source":"reliable-long-horizon-agency-tool-use","target":"rd-capability:reliable-long-horizon-agency-tool-use:03","relation":"contains-candidate-workstream"},{"source":"reliable-long-horizon-agency-tool-use","target":"rd-capability:reliable-long-horizon-agency-tool-use:04","relation":"contains-candidate-workstream"},{"source":"compute-energy-training-infrastructure","target":"rd-capability:compute-energy-training-infrastructure:01","relation":"contains-candidate-workstream"},{"source":"compute-energy-training-infrastructure","target":"rd-capability:compute-energy-training-infrastructure:02","relation":"contains-candidate-workstream"},{"source":"compute-energy-training-infrastructure","target":"rd-capability:compute-energy-training-infrastructure:03","relation":"contains-candidate-workstream"},{"source":"compute-energy-training-infrastructure","target":"rd-capability:compute-energy-training-infrastructure:04","relation":"contains-candidate-workstream"},{"source":"compute-energy-training-infrastructure","target":"rd-capability:compute-energy-training-infrastructure:05","relation":"contains-candidate-workstream"},{"source":"automated-recursive-rd-loops","target":"rd-capability:automated-recursive-rd-loops:01","relation":"contains-candidate-workstream"},{"source":"automated-recursive-rd-loops","target":"rd-capability:automated-recursive-rd-loops:02","relation":"contains-candidate-workstream"},{"source":"automated-recursive-rd-loops","target":"rd-capability:automated-recursive-rd-loops:03","relation":"contains-candidate-workstream"},{"source":"automated-recursive-rd-loops","target":"rd-capability:automated-recursive-rd-loops:04","relation":"contains-candidate-workstream"},{"source":"training-data-supply-synthetic-validity","target":"rd-capability:training-data-supply-synthetic-validity:01","relation":"contains-candidate-workstream"},{"source":"training-data-supply-synthetic-validity","target":"rd-capability:training-data-supply-synthetic-validity:02","relation":"contains-candidate-workstream"},{"source":"training-data-supply-synthetic-validity","target":"rd-capability:training-data-supply-synthetic-validity:03","relation":"contains-candidate-workstream"},{"source":"training-data-supply-synthetic-validity","target":"rd-capability:training-data-supply-synthetic-validity:04","relation":"contains-candidate-workstream"},{"source":"continual-learning-sample-efficient-adaptation","target":"rd-capability:continual-learning-sample-efficient-adaptation:01","relation":"contains-candidate-workstream"},{"source":"continual-learning-sample-efficient-adaptation","target":"rd-capability:continual-learning-sample-efficient-adaptation:02","relation":"contains-candidate-workstream"},{"source":"continual-learning-sample-efficient-adaptation","target":"rd-capability:continual-learning-sample-efficient-adaptation:03","relation":"contains-candidate-workstream"},{"source":"continual-learning-sample-efficient-adaptation","target":"rd-capability:continual-learning-sample-efficient-adaptation:04","relation":"contains-candidate-workstream"},{"source":"automated-scientific-discovery-formal-reasoning","target":"rd-capability:automated-scientific-discovery-formal-reasoning:01","relation":"contains-candidate-workstream"},{"source":"automated-scientific-discovery-formal-reasoning","target":"rd-capability:automated-scientific-discovery-formal-reasoning:02","relation":"contains-candidate-workstream"},{"source":"automated-scientific-discovery-formal-reasoning","target":"rd-capability:automated-scientific-discovery-formal-reasoning:03","relation":"contains-candidate-workstream"},{"source":"automated-scientific-discovery-formal-reasoning","target":"rd-capability:automated-scientific-discovery-formal-reasoning:04","relation":"contains-candidate-workstream"},{"source":"grounded-world-models-multimodal-planning","target":"rd-capability:grounded-world-models-multimodal-planning:01","relation":"contains-candidate-workstream"},{"source":"grounded-world-models-multimodal-planning","target":"rd-capability:grounded-world-models-multimodal-planning:02","relation":"contains-candidate-workstream"},{"source":"grounded-world-models-multimodal-planning","target":"rd-capability:grounded-world-models-multimodal-planning:03","relation":"contains-candidate-workstream"},{"source":"grounded-world-models-multimodal-planning","target":"rd-capability:grounded-world-models-multimodal-planning:04","relation":"contains-candidate-workstream"},{"source":"safe-multi-agent-economy-scale-coordination","target":"rd-capability:safe-multi-agent-economy-scale-coordination:01","relation":"contains-candidate-workstream"},{"source":"safe-multi-agent-economy-scale-coordination","target":"rd-capability:safe-multi-agent-economy-scale-coordination:02","relation":"contains-candidate-workstream"},{"source":"safe-multi-agent-economy-scale-coordination","target":"rd-capability:safe-multi-agent-economy-scale-coordination:03","relation":"contains-candidate-workstream"},{"source":"safe-multi-agent-economy-scale-coordination","target":"rd-capability:safe-multi-agent-economy-scale-coordination:04","relation":"contains-candidate-workstream"}],"pathwayRelations":[{"source":"recursive-software-rd","target":"test-time-compute-reasoning-generalization","relation":"pathway-necessity","pathwayId":"recursive-software-rd","pathwayLabel":"Recursive software R&D","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","level":"required"},{"source":"recursive-software-rd","target":"reliable-long-horizon-agency-tool-use","relation":"pathway-necessity","pathwayId":"recursive-software-rd","pathwayLabel":"Recursive software R&D","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","level":"required"},{"source":"recursive-software-rd","target":"compute-energy-training-infrastructure","relation":"pathway-necessity","pathwayId":"recursive-software-rd","pathwayLabel":"Recursive software R&D","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","level":"likely-required"},{"source":"recursive-software-rd","target":"automated-recursive-rd-loops","relation":"pathway-necessity","pathwayId":"recursive-software-rd","pathwayLabel":"Recursive software R&D","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","level":"required"},{"source":"recursive-software-rd","target":"training-data-supply-synthetic-validity","relation":"pathway-necessity","pathwayId":"recursive-software-rd","pathwayLabel":"Recursive software R&D","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","level":"likely-required"},{"source":"recursive-software-rd","target":"continual-learning-sample-efficient-adaptation","relation":"pathway-necessity","pathwayId":"recursive-software-rd","pathwayLabel":"Recursive software R&D","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","level":"enabling"},{"source":"recursive-software-rd","target":"automated-scientific-discovery-formal-reasoning","relation":"pathway-necessity","pathwayId":"recursive-software-rd","pathwayLabel":"Recursive software R&D","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","level":"not-required"},{"source":"recursive-software-rd","target":"grounded-world-models-multimodal-planning","relation":"pathway-necessity","pathwayId":"recursive-software-rd","pathwayLabel":"Recursive software R&D","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","level":"not-required"},{"source":"recursive-software-rd","target":"safe-multi-agent-economy-scale-coordination","relation":"pathway-necessity","pathwayId":"recursive-software-rd","pathwayLabel":"Recursive software R&D","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","level":"not-required"},{"source":"scale-and-scaffold","target":"test-time-compute-reasoning-generalization","relation":"pathway-necessity","pathwayId":"scale-and-scaffold","pathwayLabel":"Scale + scaffold compounding","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","level":"required"},{"source":"scale-and-scaffold","target":"reliable-long-horizon-agency-tool-use","relation":"pathway-necessity","pathwayId":"scale-and-scaffold","pathwayLabel":"Scale + scaffold compounding","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","level":"likely-required"},{"source":"scale-and-scaffold","target":"compute-energy-training-infrastructure","relation":"pathway-necessity","pathwayId":"scale-and-scaffold","pathwayLabel":"Scale + scaffold compounding","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","level":"required"},{"source":"scale-and-scaffold","target":"automated-recursive-rd-loops","relation":"pathway-necessity","pathwayId":"scale-and-scaffold","pathwayLabel":"Scale + scaffold compounding","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","level":"enabling"},{"source":"scale-and-scaffold","target":"training-data-supply-synthetic-validity","relation":"pathway-necessity","pathwayId":"scale-and-scaffold","pathwayLabel":"Scale + scaffold compounding","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","level":"likely-required"},{"source":"scale-and-scaffold","target":"continual-learning-sample-efficient-adaptation","relation":"pathway-necessity","pathwayId":"scale-and-scaffold","pathwayLabel":"Scale + scaffold compounding","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","level":"enabling"},{"source":"scale-and-scaffold","target":"automated-scientific-discovery-formal-reasoning","relation":"pathway-necessity","pathwayId":"scale-and-scaffold","pathwayLabel":"Scale + scaffold compounding","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","level":"not-required"},{"source":"scale-and-scaffold","target":"grounded-world-models-multimodal-planning","relation":"pathway-necessity","pathwayId":"scale-and-scaffold","pathwayLabel":"Scale + scaffold compounding","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","level":"enabling"},{"source":"scale-and-scaffold","target":"safe-multi-agent-economy-scale-coordination","relation":"pathway-necessity","pathwayId":"scale-and-scaffold","pathwayLabel":"Scale + scaffold compounding","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","level":"not-required"},{"source":"automated-science-hardware","target":"test-time-compute-reasoning-generalization","relation":"pathway-necessity","pathwayId":"automated-science-hardware","pathwayLabel":"Automated science + hardware","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","level":"required"},{"source":"automated-science-hardware","target":"reliable-long-horizon-agency-tool-use","relation":"pathway-necessity","pathwayId":"automated-science-hardware","pathwayLabel":"Automated science + hardware","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","level":"required"},{"source":"automated-science-hardware","target":"compute-energy-training-infrastructure","relation":"pathway-necessity","pathwayId":"automated-science-hardware","pathwayLabel":"Automated science + hardware","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","level":"likely-required"},{"source":"automated-science-hardware","target":"automated-recursive-rd-loops","relation":"pathway-necessity","pathwayId":"automated-science-hardware","pathwayLabel":"Automated science + hardware","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","level":"likely-required"},{"source":"automated-science-hardware","target":"training-data-supply-synthetic-validity","relation":"pathway-necessity","pathwayId":"automated-science-hardware","pathwayLabel":"Automated science + hardware","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","level":"likely-required"},{"source":"automated-science-hardware","target":"continual-learning-sample-efficient-adaptation","relation":"pathway-necessity","pathwayId":"automated-science-hardware","pathwayLabel":"Automated science + hardware","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","level":"enabling"},{"source":"automated-science-hardware","target":"automated-scientific-discovery-formal-reasoning","relation":"pathway-necessity","pathwayId":"automated-science-hardware","pathwayLabel":"Automated science + hardware","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","level":"required"},{"source":"automated-science-hardware","target":"grounded-world-models-multimodal-planning","relation":"pathway-necessity","pathwayId":"automated-science-hardware","pathwayLabel":"Automated science + hardware","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","level":"likely-required"},{"source":"automated-science-hardware","target":"safe-multi-agent-economy-scale-coordination","relation":"pathway-necessity","pathwayId":"automated-science-hardware","pathwayLabel":"Automated science + hardware","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","level":"not-required"},{"source":"distributed-agent-economy","target":"test-time-compute-reasoning-generalization","relation":"pathway-necessity","pathwayId":"distributed-agent-economy","pathwayLabel":"Distributed agent economy","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","level":"required"},{"source":"distributed-agent-economy","target":"reliable-long-horizon-agency-tool-use","relation":"pathway-necessity","pathwayId":"distributed-agent-economy","pathwayLabel":"Distributed agent economy","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","level":"required"},{"source":"distributed-agent-economy","target":"compute-energy-training-infrastructure","relation":"pathway-necessity","pathwayId":"distributed-agent-economy","pathwayLabel":"Distributed agent economy","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","level":"likely-required"},{"source":"distributed-agent-economy","target":"automated-recursive-rd-loops","relation":"pathway-necessity","pathwayId":"distributed-agent-economy","pathwayLabel":"Distributed agent economy","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","level":"likely-required"},{"source":"distributed-agent-economy","target":"training-data-supply-synthetic-validity","relation":"pathway-necessity","pathwayId":"distributed-agent-economy","pathwayLabel":"Distributed agent economy","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","level":"enabling"},{"source":"distributed-agent-economy","target":"continual-learning-sample-efficient-adaptation","relation":"pathway-necessity","pathwayId":"distributed-agent-economy","pathwayLabel":"Distributed agent economy","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","level":"likely-required"},{"source":"distributed-agent-economy","target":"automated-scientific-discovery-formal-reasoning","relation":"pathway-necessity","pathwayId":"distributed-agent-economy","pathwayLabel":"Distributed agent economy","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","level":"not-required"},{"source":"distributed-agent-economy","target":"grounded-world-models-multimodal-planning","relation":"pathway-necessity","pathwayId":"distributed-agent-economy","pathwayLabel":"Distributed agent economy","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","level":"not-required"},{"source":"distributed-agent-economy","target":"safe-multi-agent-economy-scale-coordination","relation":"pathway-necessity","pathwayId":"distributed-agent-economy","pathwayLabel":"Distributed agent economy","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","level":"required"}]},"residualRdAgenda":[{"id":"residual-rd:recursive-rd-loop-gain","residualIds":["T-LAB-OPAQUE","T-FIXEDPOINT-PLATEAU"],"residualClass":"structurally-unmeasurable","relatedGapIds":["recursive-rd"],"title":"AI-attributable recursive R&D loop-gain ledger","whyPublicProxiesFail":"Labs do not publish AI-attributable research throughput, human labor fractions, or next-cycle productivity lifts across ≥3 iterations. Public paper counts and market prices do not identify the loop operator.","instrumentThatWouldClose":"Prospective multi-iteration ledger: AI-attributable research gain, human input, compute cost, replication status, and measured next-cycle throughput — with independent audit.","residualRdWorkstreams":["Standardize AI-attributable contribution tags on research artifacts (papers, PRs, experiment logs)","Multi-lab pilot loop-gain registry with held-out replication windows","Separate human-labor and compute denominators so gain is not confounded with spend","Fixed-point vs plateau tests: diminishing returns detectors on successive AI-assisted cycles"],"neverPromoteVia":"arXiv theme heat, HF download velocity, or equity residual scores","status":"open-by-construction"},{"id":"residual-rd:scientific-automation-registry","residualIds":["T-LAB-OPAQUE"],"residualClass":"awaiting-new-sensor","relatedGapIds":["scientific-automation"],"title":"Prospective AI-originated science registry","whyPublicProxiesFail":"No public registry tracks AI-originated hypotheses through independent replication and deployment with cycle-time metrics.","instrumentThatWouldClose":"Open prospective registry of AI-originated hypotheses with independent replications, deployment status, cycle time, and contribution to later AI capability.","residualRdWorkstreams":["Design minimal viable registry schema (hypothesis, origin model, human co-author fraction, replication)","Pilot on ML-algorithm and materials domains with independent labs as replicators","Link registry outcomes to later training-data and capability reports without self-citation inflation","Publish negative results and non-replications as first-class rows"],"neverPromoteVia":"news mentions of 'AI discovers X' without replication fields","status":"awaiting-new-sensor"},{"id":"residual-rd:multi-agent-economy-scale","residualIds":["T-UNKNOWN-UNKNOWNS"],"residualClass":"structurally-unmeasurable","relatedGapIds":["multi-agent"],"title":"Economic-scale multi-agent failure taxonomy","whyPublicProxiesFail":"Agent economies at the benchmark's scale do not yet exist as a public measurable population; small multi-agent demos do not establish distinct multi-agent failure classes.","instrumentThatWouldClose":"Economic-scale agent populations with measured throughput, coordination cost, correlated-failure rate, and single-agent baselines over sustained operation.","residualRdWorkstreams":["Define population/scale thresholds where multi-agent dynamics are not reducible to single-agent reliability","Correlated-failure and cascade instrumentation for multi-agent markets and tool ecosystems","Single-agent baseline batteries run in parallel with multi-agent treatments","Open logging standards for agent-to-agent protocols (without claiming a live economy exists)"],"neverPromoteVia":"toy multi-agent benchmarks or chat-swarm demos","status":"open-by-construction"},{"id":"residual-rd:alignment-control-lab-evals","residualIds":["T-LAB-OPAQUE"],"residualClass":"lab-opaque-gate","relatedGapIds":["alignment-control"],"title":"Held-out control evaluations with lab transparency","whyPublicProxiesFail":"Decisive control evals, deploy-decline decisions, and internal red-team rates are lab-internal. Public safety cards are selective.","instrumentThatWouldClose":"Held-out control evaluations and red-team incident rates that transfer across successive frontier generations, with disclosed deploy/decline decisions.","residualRdWorkstreams":["Standardize public subsets of control evals that labs can release without full stack disclosure","Cross-generation transfer protocols for control measures under capability jumps","Independent third-party red-team windows with pre-registered scoring","Publish decline-to-deploy events as structured residuals rather than PR narratives"],"neverPromoteVia":"safety marketing copy or unfalsifiable 'we declined' anecdotes without protocol","status":"open-by-construction"},{"id":"residual-rd:definitional-singularity","residualIds":["T-DEFINITIONAL","T-COUNTERFACTUAL-NECESSITY"],"residualClass":"tarski-definitional","relatedGapIds":[],"title":"Definitional / counterfactual necessity boundary","whyPublicProxiesFail":"No finite public proxy set decides what 'singularity' means or which R&D is strictly necessary under all definitions.","instrumentThatWouldClose":"None inside this formal system — residual is open by Tarski bounds. Operational response is multi-pathway conditional maps, not a single definition.","residualRdWorkstreams":["Keep pathway matrices explicit (required / likely / enabling / not-required)","Refuse single-definition ranking promotions","Publish exclusions with residual IDs so omissions stay visible","Separate occurrence forecasting from conditional necessity maps"],"neverPromoteVia":"redefining singularity to match available instruments","status":"open-by-construction"},{"id":"residual-rd:evidence-archive-depth","residualIds":["NR-C-90","NR-SKILL","NR-R","NR-EVENT","NR-4","R-EVAL-TAPE","R-ARXIV-ARCHIVE","R-HF-DIFFUSION"],"residualClass":"evidence-archive","relatedGapIds":[],"title":"AWITS evidence-archive residual spiral","whyPublicProxiesFail":"These residuals are about elapsed calendar depth, skill over persistence, seasonal baselines, and held-out event validation — not missing code paths.","instrumentThatWouldClose":"Healthy scheduled collections until 90d coverage is in-band, skill > persistence where claimed, arXiv/HF archive depth gates pass, and event allowlists are held-out validated — without lowering thr=70.","residualRdWorkstreams":["Continue healthy scheduled collection without fabricating ForecastIssue rows","Report 7/30/90d calibration by model version without retrospective retunes","Accumulate HF matched-download ≥7d UTC and arXiv seasonal baselines","Keep thr=70 and forecast skill withheld until gates pass"],"neverPromoteVia":"hand-authored thr=70 outcomes or weight-on research/discourse channels","status":"accumulating-evidence"}],"residualResolution":{"claim":"partial-residual-closure-not-totality","statement":"Decidable residual *code* surfaces are closed; semi-decidable residuals accumulate arXiv/archive evidence; Tarski residuals remain open by construction. Claiming 'all residuals resolved' is forbidden.","generatedAt":"2026-09-03T17:05:06.199Z","totalityClaimForbidden":true,"tarskiOpenCount":4,"semiAccumulatingCount":2,"decidableClosedCount":10,"rows":[{"id":"residual-rd:recursive-rd-loop-gain","title":"AI-attributable recursive R&D loop-gain ledger","bucket":"tarski-open-by-construction","residualIds":["T-LAB-OPAQUE","T-FIXEDPOINT-PLATEAU"],"relatedGapIds":["recursive-rd"],"status":"open-by-construction","codeComplete":false,"arxivEvidence":{"agendaId":"residual-rd:recursive-rd-loop-gain","residualIds":["T-LAB-OPAQUE","T-FIXEDPOINT-PLATEAU"],"matchedThemeIds":[],"themeHits":0,"matchedInflectionClasses":[],"inflectionHits":0,"arxivWindowDays":null,"totalRecent":null,"scoringStatus":null,"evidenceRole":"shadow-literature-pressure-not-readiness","note":"No matched arXiv theme/inflection pressure in current window (or pulse withheld)."},"whyNotFullyResolved":"Open by Tarski / lab-opacity construction. arXiv pressure cannot close this residual."},{"id":"residual-rd:scientific-automation-registry","title":"Prospective AI-originated science registry","bucket":"semi-accumulating","residualIds":["T-LAB-OPAQUE"],"relatedGapIds":["scientific-automation"],"status":"awaiting-new-sensor","codeComplete":false,"arxivEvidence":{"agendaId":"residual-rd:scientific-automation-registry","residualIds":["T-LAB-OPAQUE"],"matchedThemeIds":[],"themeHits":0,"matchedInflectionClasses":[],"inflectionHits":0,"arxivWindowDays":null,"totalRecent":null,"scoringStatus":null,"evidenceRole":"shadow-literature-pressure-not-readiness","note":"No matched arXiv theme/inflection pressure in current window (or pulse withheld)."},"whyNotFullyResolved":"Semi-decidable: requires elapsed archive depth, new public sensors, or held-out validation — not a single code patch."},{"id":"residual-rd:multi-agent-economy-scale","title":"Economic-scale multi-agent failure taxonomy","bucket":"tarski-open-by-construction","residualIds":["T-UNKNOWN-UNKNOWNS"],"relatedGapIds":["multi-agent"],"status":"open-by-construction","codeComplete":false,"arxivEvidence":{"agendaId":"residual-rd:multi-agent-economy-scale","residualIds":["T-UNKNOWN-UNKNOWNS"],"matchedThemeIds":[],"themeHits":0,"matchedInflectionClasses":[],"inflectionHits":0,"arxivWindowDays":null,"totalRecent":null,"scoringStatus":null,"evidenceRole":"shadow-literature-pressure-not-readiness","note":"No matched arXiv theme/inflection pressure in current window (or pulse withheld)."},"whyNotFullyResolved":"Open by Tarski / lab-opacity construction. arXiv pressure cannot close this residual."},{"id":"residual-rd:alignment-control-lab-evals","title":"Held-out control evaluations with lab transparency","bucket":"tarski-open-by-construction","residualIds":["T-LAB-OPAQUE"],"relatedGapIds":["alignment-control"],"status":"open-by-construction","codeComplete":false,"arxivEvidence":{"agendaId":"residual-rd:alignment-control-lab-evals","residualIds":["T-LAB-OPAQUE"],"matchedThemeIds":[],"themeHits":0,"matchedInflectionClasses":[],"inflectionHits":0,"arxivWindowDays":null,"totalRecent":null,"scoringStatus":null,"evidenceRole":"shadow-literature-pressure-not-readiness","note":"No matched arXiv theme/inflection pressure in current window (or pulse withheld)."},"whyNotFullyResolved":"Open by Tarski / lab-opacity construction. arXiv pressure cannot close this residual."},{"id":"residual-rd:definitional-singularity","title":"Definitional / counterfactual necessity boundary","bucket":"tarski-open-by-construction","residualIds":["T-DEFINITIONAL","T-COUNTERFACTUAL-NECESSITY"],"relatedGapIds":[],"status":"open-by-construction","codeComplete":false,"arxivEvidence":{"agendaId":"residual-rd:definitional-singularity","residualIds":["T-DEFINITIONAL","T-COUNTERFACTUAL-NECESSITY"],"matchedThemeIds":[],"themeHits":0,"matchedInflectionClasses":[],"inflectionHits":0,"arxivWindowDays":null,"totalRecent":null,"scoringStatus":null,"evidenceRole":"shadow-literature-pressure-not-readiness","note":"No matched arXiv theme/inflection pressure in current window (or pulse withheld)."},"whyNotFullyResolved":"Open by Tarski / lab-opacity construction. arXiv pressure cannot close this residual."},{"id":"residual-rd:evidence-archive-depth","title":"AWITS evidence-archive residual spiral","bucket":"semi-accumulating","residualIds":["NR-C-90","NR-SKILL","NR-R","NR-EVENT","NR-4","R-EVAL-TAPE","R-ARXIV-ARCHIVE","R-HF-DIFFUSION"],"relatedGapIds":[],"status":"accumulating-evidence","codeComplete":false,"arxivEvidence":{"agendaId":"residual-rd:evidence-archive-depth","residualIds":["NR-C-90","NR-SKILL","NR-R","NR-EVENT","NR-4","R-EVAL-TAPE","R-ARXIV-ARCHIVE","R-HF-DIFFUSION"],"matchedThemeIds":[],"themeHits":0,"matchedInflectionClasses":[],"inflectionHits":0,"arxivWindowDays":null,"totalRecent":null,"scoringStatus":null,"evidenceRole":"shadow-literature-pressure-not-readiness","note":"No matched arXiv theme/inflection pressure in current window (or pulse withheld)."},"whyNotFullyResolved":"Semi-decidable: requires elapsed archive depth, new public sensors, or held-out validation — not a single code patch."},{"id":"code-closure:export-residual-rd-agenda-on-analysis","title":"Code residual closed: export-residual-rd-agenda-on-analysis","bucket":"decidable-closed","residualIds":[],"relatedGapIds":[],"status":"code-closed-this-cycle","codeComplete":true,"arxivEvidence":null,"whyNotFullyResolved":"Instrumentation/export surface only — does not close Tarski or science residuals."},{"id":"code-closure:export-residual-resolution-report-with-arxiv-shadow-evidence","title":"Code residual closed: export-residual-resolution-report-with-arxiv-shadow-evidence","bucket":"decidable-closed","residualIds":[],"relatedGapIds":[],"status":"code-closed-this-cycle","codeComplete":true,"arxivEvidence":null,"whyNotFullyResolved":"Instrumentation/export surface only — does not close Tarski or science residuals."},{"id":"code-closure:export-residual-resolution-on-rdgap-topology-api","title":"Code residual closed: export-residual-resolution-on-rdgap-topology-api","bucket":"decidable-closed","residualIds":[],"relatedGapIds":[],"status":"code-closed-this-cycle","codeComplete":true,"arxivEvidence":null,"whyNotFullyResolved":"Instrumentation/export surface only — does not close Tarski or science residuals."},{"id":"code-closure:ui-residual-rd-agenda-section","title":"Code residual closed: ui-residual-rd-agenda-section","bucket":"decidable-closed","residualIds":[],"relatedGapIds":[],"status":"code-closed-this-cycle","codeComplete":true,"arxivEvidence":null,"whyNotFullyResolved":"Instrumentation/export surface only — does not close Tarski or science residuals."},{"id":"code-closure:graph-push-residual-resolution-snapshot","title":"Code residual closed: graph-push-residual-resolution-snapshot","bucket":"decidable-closed","residualIds":[],"relatedGapIds":[],"status":"code-closed-this-cycle","codeComplete":true,"arxivEvidence":null,"whyNotFullyResolved":"Instrumentation/export surface only — does not close Tarski or science residuals."},{"id":"code-closure:tarski-totality-claim-forbidden-guard","title":"Code residual closed: tarski-totality-claim-forbidden-guard","bucket":"decidable-closed","residualIds":[],"relatedGapIds":[],"status":"code-closed-this-cycle","codeComplete":true,"arxivEvidence":null,"whyNotFullyResolved":"Instrumentation/export surface only — does not close Tarski or science residuals."},{"id":"code-closure:all-public-now-initiation-instruments-partial","title":"Code residual closed: all-public-now-initiation-instruments-partial","bucket":"decidable-closed","residualIds":[],"relatedGapIds":[],"status":"code-closed-this-cycle","codeComplete":true,"arxivEvidence":null,"whyNotFullyResolved":"Instrumentation/export surface only — does not close Tarski or science residuals."},{"id":"code-closure:interpretability-gate-partial-instrument","title":"Code residual closed: interpretability-gate-partial-instrument","bucket":"decidable-closed","residualIds":[],"relatedGapIds":[],"status":"code-closed-this-cycle","codeComplete":true,"arxivEvidence":null,"whyNotFullyResolved":"Instrumentation/export surface only — does not close Tarski or science residuals."},{"id":"code-closure:eval-measurement-gate-partial-instrument","title":"Code residual closed: eval-measurement-gate-partial-instrument","bucket":"decidable-closed","residualIds":[],"relatedGapIds":[],"status":"code-closed-this-cycle","codeComplete":true,"arxivEvidence":null,"whyNotFullyResolved":"Instrumentation/export surface only — does not close Tarski or science residuals."},{"id":"code-closure:workstream-parent-instrument-inheritance-surface","title":"Code residual closed: workstream-parent-instrument-inheritance-surface","bucket":"decidable-closed","residualIds":[],"relatedGapIds":[],"status":"code-closed-this-cycle","codeComplete":true,"arxivEvidence":null,"whyNotFullyResolved":"Instrumentation/export surface only — does not close Tarski or science residuals."}],"arxivPulseSummary":{"totalRecent":null,"windowDays":null,"scoringStatus":null,"themeHitTotal":0,"inflectionCount":null,"asOf":null},"instrumentCoverage":{"initiationPartial":6,"initiationStructural":3,"initiationUnmeasured":0,"gatesPartial":["eval-measurement","interpretability"],"gatesUnmeasuredOrOpaque":["alignment-control"]},"codeCompletedThisCycle":["export-residual-rd-agenda-on-analysis","export-residual-resolution-report-with-arxiv-shadow-evidence","export-residual-resolution-on-rdgap-topology-api","ui-residual-rd-agenda-section","graph-push-residual-resolution-snapshot","tarski-totality-claim-forbidden-guard","all-public-now-initiation-instruments-partial","interpretability-gate-partial-instrument","eval-measurement-gate-partial-instrument","workstream-parent-instrument-inheritance-surface"]},"capabilityImplementationReport":{"claim":"workstream-probes-implemented-not-frontier-capabilities","catalogClaim":"candidate-research-workstreams-not-completed-frontier-capabilities","capabilityCount":37,"implementedCount":37,"probesPassed":37,"probesFailed":[],"byClass":{"decidable":8,"semi-decidable":17,"tarski-residual":12},"byKind":{"snapshot-bound":10,"uncovered-named":15,"tarski-named":12},"allProbesPassed":true,"allFrontierClaimsWithheld":true,"allWorkstreamReadinessUnmeasured":true,"specIdParity":true,"workstreams":[{"id":"rd-capability:test-time-compute-reasoning-generalization:01","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":1,"workstream":"Inference-compute scaling laws with held-out, uncontaminated tasks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-inference-cost-burden 43000000 output-tokens-at-27pct-frontiermath","computed":{"name":"frontiermath-output-tokens-at-27pct","value":43000000,"unit":"output-tokens"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:test-time-compute-reasoning-generalization:02","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":2,"workstream":"Transfer of verifiable-reward training to non-verifiable domains","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: transfer of gains from verifiable domains","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:test-time-compute-reasoning-generalization:03","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":3,"workstream":"Process supervision and search over reasoning traces at frontier scale","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: held-out uncontaminated tasks","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:test-time-compute-reasoning-generalization:04","gapId":"reasoning-scaling","parentGapId":"test-time-compute-reasoning-generalization","parentGapRank":1,"ordinalWithinParent":4,"workstream":"Cost-aware reasoning: accuracy per token, not accuracy at any price","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-02-16","parentInstrumentSourceIds":["epoch-inference-cost-burden","epoch-ai-trends"],"parentInstrumentMetric":"output tokens required to reach ~27% accuracy on FrontierMath (verifiable math domain) under published reasoning-effort settings — lower is better for a fixed accuracy target","parentInstrumentValue":43000000,"parentInstrumentUnit":"output-tokens-at-27pct-frontiermath","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-inference-cost-burden 43000000 output-tokens-at-27pct-frontiermath","computed":{"name":"token-reduction-vs-5m-later-snapshot","value":8.6,"unit":"times-token-reduction-at-fixed-accuracy"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:01","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":1,"workstream":"Long-horizon planning, memory, and recovery under tool failure","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to metr-time-horizons 185.91 minutes","computed":{"name":"metr-80pct-horizon","value":185.91,"unit":"minutes"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:02","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":2,"workstream":"Computer-use, browser, and IDE agents with verifiable success rates","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to metr-time-horizons 185.91 minutes","computed":{"name":"osworld-best-agent-success","value":12.24,"unit":"percent-success-rate-best-agent-osworld"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:03","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":3,"workstream":"Safe tool APIs, sandboxing, and permission hierarchies","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: recovery from failure","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:reliable-long-horizon-agency-tool-use:04","gapId":"agency-tools","parentGapId":"reliable-long-horizon-agency-tool-use","parentGapRank":2,"ordinalWithinParent":4,"workstream":"Multi-step evaluation suites with anti-overfit holdouts","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-05-08","parentInstrumentSourceIds":["metr-time-horizons"],"parentInstrumentMetric":"80% time horizon -- task duration, on a human-expert-completion-time scale, at which the agent succeeds about 80% of the time","parentInstrumentValue":185.91,"parentInstrumentUnit":"minutes","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to metr-time-horizons 185.91 minutes","computed":{"name":"metr-80pct-vs-16hr-reliability-bound","value":0.19365625,"unit":"fraction-of-metr-16hr-exclusion-bound"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:01","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":1,"workstream":"Power delivery and cooling for multi-GW AI campuses","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: grid and interconnect headroom","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:02","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":2,"workstream":"Next-generation accelerators, HBM, and optical interconnect","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 5 times-per-year-training-compute-growth","computed":{"name":"training-compute-growth-in-published-ci","value":1,"unit":"boolean-in-ci-band"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:03","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":3,"workstream":"Training-system fault tolerance, utilization, and data pipelines","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: inference capacity tracked against demand","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:04","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":4,"workstream":"Algorithmic efficiency that multiplies effective compute","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 5 times-per-year-training-compute-growth","computed":{"name":"pretraining-software-efficiency","value":3,"unit":"times-per-year-pretraining-compute-efficiency"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:compute-energy-training-infrastructure:05","gapId":"compute-energy","parentGapId":"compute-energy-training-infrastructure","parentGapRank":3,"ordinalWithinParent":5,"workstream":"Hardware-software co-design within the compute-energy class","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"frontier language-model training-compute growth rate (top-tier models, Epoch AI Trends) — multiples of training FLOP/year","parentInstrumentValue":5,"parentInstrumentUnit":"times-per-year-training-compute-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: accelerator supply chain","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:01","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":1,"workstream":"AutoML and architecture search that improves frontier training recipes","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:02","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":2,"workstream":"AI co-scientists for experiment design, code generation, and result critique","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:03","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":3,"workstream":"Closed-loop training-data generation with quality filters","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-recursive-rd-loops:04","gapId":"recursive-rd","parentGapId":"automated-recursive-rd-loops","parentGapRank":4,"ordinalWithinParent":4,"workstream":"Metrics for R&D productivity lift rather than loss curves alone","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"lab-opaque","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:01","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":1,"workstream":"Synthetic-data filters that remain valid across successive training generations","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: successive-generation held-out performance","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:02","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":2,"workstream":"Resolution of model-collapse versus accumulate-don't-replace results","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: model-collapse","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:03","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":3,"workstream":"Licensing, acquisition, and multimodal corpus expansion beyond public text","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: interactive / multimodal data quality","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:training-data-supply-synthetic-validity:04","gapId":"data-substrate","parentGapId":"training-data-supply-synthetic-validity","parentGapRank":5,"ordinalWithinParent":4,"workstream":"More capability per training token","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-partial","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"pre-training software/algorithmic efficiency improvement rate — factor by which the same model performance can be achieved with less pre-training compute per year","parentInstrumentValue":3,"parentInstrumentUnit":"times-per-year-pretraining-compute-efficiency","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 3 times-per-year-pretraining-compute-efficiency","computed":{"name":"capability-per-pretraining-compute-efficiency","value":3,"unit":"times-per-year-pretraining-compute-efficiency"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:01","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":1,"workstream":"Stable continual and lifelong learning at foundation-model scale","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: non-stationary task suites","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:02","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":2,"workstream":"Efficient fine-tuning and modular adapters with transfer guarantees","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: sample-efficient adaptation cost","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:03","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":3,"workstream":"Memory architectures that retain skills under non-stationary tasks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to epoch-ai-trends 30 times-per-year-context-window-growth","computed":{"name":"context-window-growth-in-published-ci","value":1,"unit":"boolean-in-ci-band"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:continual-learning-sample-efficient-adaptation:04","gapId":"continual-learning","parentGapId":"continual-learning-sample-efficient-adaptation","parentGapRank":6,"ordinalWithinParent":4,"workstream":"Data-efficient post-training from sparse human feedback","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2026-08-02","parentInstrumentSourceIds":["epoch-ai-trends"],"parentInstrumentMetric":"LLM context-window growth rate (public frontier models) — multiples of context length per year since 2023","parentInstrumentValue":30,"parentInstrumentUnit":"times-per-year-context-window-growth","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: catastrophic-forgetting","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:01","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":1,"workstream":"Autoformalization and theorem proving at research scale","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:02","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":2,"workstream":"Closed-loop wet-lab, materials, and drug-discovery agents","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:03","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":3,"workstream":"Verified synthesis of novel algorithms and training methods","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:automated-scientific-discovery-formal-reasoning:04","gapId":"scientific-automation","parentGapId":"automated-scientific-discovery-formal-reasoning","parentGapRank":7,"ordinalWithinParent":4,"workstream":"Cross-domain knowledge graphs that propose testable experiments","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"needs-new-sensor","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-LAB-OPAQUE; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:01","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":1,"workstream":"Unified multimodal world models spanning vision, language, action, and physics priors","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"decidable","kind":"snapshot-bound","probeOk":true,"evidence":"bound to osworld-benchmark 12.24 percent-success-rate-best-agent-osworld","computed":{"name":"osworld-human-minus-agent-gap","value":60.12,"unit":"percentage-points"},"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:02","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":2,"workstream":"Sim-to-real and digital-twin planning loops","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: physical / non-digital environment","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:03","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":3,"workstream":"Causal and counterfactual evaluation of plans","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: held-out causal and counterfactual","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:grounded-world-models-multimodal-planning:04","gapId":"world-models","parentGapId":"grounded-world-models-multimodal-planning","parentGapRank":8,"ordinalWithinParent":4,"workstream":"Embodied and robotics transfer benchmarks with public suites","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"partially-measured","parentInstrumentability":"public-now","parentInstrumentAsOf":"2024-05-30","parentInstrumentSourceIds":["osworld-benchmark"],"parentInstrumentMetric":"best reported multimodal agent success rate on OSWorld open-ended computer tasks (execution-based evaluation) — lower agent rate vs human is the gap signal","parentInstrumentValue":12.24,"parentInstrumentUnit":"percent-success-rate-best-agent-osworld","parentHasPartialInstrument":true,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"semi-decidable","kind":"uncovered-named","probeOk":true,"evidence":"uncovered aspect named: physical / non-digital environment generalization","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:01","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":1,"workstream":"Game-theoretic protocol design for agent societies","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:02","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":2,"workstream":"Collusion, deception, and cascade-failure benchmarks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:03","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":3,"workstream":"Economic simulation environments with scarce resources","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}},{"id":"rd-capability:safe-multi-agent-economy-scale-coordination:04","gapId":"multi-agent","parentGapId":"safe-multi-agent-economy-scale-coordination","parentGapRank":9,"ordinalWithinParent":4,"workstream":"Identity, reputation, and permission systems for agent networks","classification":"candidate-research-workstream","implementationStatus":"not-asserted","completionClaim":"not-claimed","frontierCapabilityClaim":"not-claimed","directReadinessStatus":"unmeasured","directReadinessValue":null,"directReadinessNecessityWeight":0,"attentionNecessityWeight":0,"claimScope":"research-workstream-representation-not-frontier-capability-implementation","topologyDirectReadinessStatus":"not-measured-at-workstream-level","sourceField":"likely_rd","evidenceInheritance":"parent-gap","demotionInheritance":"parent-gap","observabilityInheritance":"parent-gap","parentInstrumentCoverageStatus":"structurally-unmeasurable-from-public-proxies","parentInstrumentability":"not-yet-observable","parentInstrumentAsOf":null,"parentInstrumentSourceIds":[],"parentInstrumentMetric":null,"parentInstrumentValue":null,"parentInstrumentUnit":null,"parentHasPartialInstrument":false,"inheritanceNote":"parent-instrument-telemetry-only-not-workstream-readiness","runtime":{"implemented":true,"claim":"workstream-probes-implemented-not-frontier-capabilities","implClass":"tarski-residual","kind":"tarski-named","probeOk":true,"evidence":"named residual T-UNKNOWN-UNKNOWNS; no fabricated measurement","computed":null,"frontierCapabilityClaim":"not-claimed","workstreamReadiness":"unmeasured"}}]},"note":"Research-workstream representation + residual R&D agenda + public-proxy probes for all 37 workstreams. Does not claim implementation of completed frontier capabilities, direct readiness, universal necessity, or singularity occurrence. Tarski residuals remain open; claim=partial-residual-closure-not-totality."}