{ "bench_version": 1, "track": "dynamics", "model": "custom_matched_refinement_rnn", "metric_direction": "lower is better", "n_seeds": 8, "baseline": { "best_cfg": { "lr": 0.003, "step": 0.25 }, "sweep": [ { "cfg": { "lr": 0.001, "step": 0.25 }, "mean": 0.00020656592459999956 }, { "cfg": { "lr": 0.001, "step": 0.5 }, "mean": 0.00035531837966118474 }, { "cfg": { "lr": 0.001, "step": 1.0 }, "mean": 0.0009092524851439521 }, { "cfg": { "lr": 0.001, "step": 2.0 }, "mean": 0.008616556180641055 }, { "cfg": { "lr": 0.003, "step": 0.25 }, "mean": 0.00010479371485416777 }, { "cfg": { "lr": 0.003, "step": 0.5 }, "mean": 0.0001718404637358617 }, { "cfg": { "lr": 0.003, "step": 1.0 }, "mean": 0.0007685718519496731 }, { "cfg": { "lr": 0.003, "step": 2.0 }, "mean": 0.010642364271916449 }, { "cfg": { "lr": 0.01, "step": 0.25 }, "mean": 0.00014638340144301765 }, { "cfg": { "lr": 0.01, "step": 0.5 }, "mean": 0.0006321593828033656 }, { "cfg": { "lr": 0.01, "step": 1.0 }, "mean": 0.0017989037442021072 }, { "cfg": { "lr": 0.01, "step": 2.0 }, "mean": 0.035143551183864474 } ], "full": { "mean": 0.00010781512173707597, "std": 2.4695774008571815e-05, "per_seed": [ 6.690840382361785e-05, 0.00013107550330460072, 0.0001228735054610297, 9.831744682742283e-05, 0.0001292095403186977, 0.00013566877169068903, 0.00010378748993389308, 7.468031253665686e-05 ], "n": 8 } }, "idea": { "mean": 0.00011978308180005115, "std": 0.00014333295352723913, "per_seed": [ 4.686686224886216e-05, 9.109569509746507e-05, 0.00011464366252766922, 8.399749276577495e-06, 7.34728091629222e-05, 6.693405157420784e-05, 0.000491157581564039, 6.569424294866621e-05 ], "n": 8, "cfg": { "lr": 0.003, "step": 0.25 }, "sweep": [ { "cfg": { "lr": 0.003, "step": 0.25 }, "mean": 0.00011978308180005115, "per_seed": [ 4.686686224886216e-05, 9.109569509746507e-05, 0.00011464366252766922, 8.399749276577495e-06, 7.34728091629222e-05, 6.693405157420784e-05, 0.000491157581564039, 6.569424294866621e-05 ] }, { "cfg": { "lr": 0.003, "step": 0.5 }, "mean": 0.00017802219872464775, "per_seed": [ 5.6299137213500217e-05, 0.0002794665051624179, 9.379914990859106e-05, 0.0001387570664519444, 0.0003630504652392119, 0.00018886031466536224, 0.00017176337132696062, 0.00013218157982919365 ] } ] }, "comparison": { "delta_mean": 1.196796006297518e-05, "idea_wins": 7, "n_pairs": 8, "per_seed_diffs": [ -2.0041541574755684e-05, -3.997980820713565e-05, -8.229842933360487e-06, -8.991769755084533e-05, -5.573673115577549e-05, -6.873472011648118e-05, 0.0003873700916301459, -8.986069587990642e-06 ], "p_value": 1.0, "mde": 0.0001291404226093749, "mde_rel_pct": 119.77950822548252, "verdict": "no significant win", "system_worked": false }, "mechanism_signature": { "track_choice": "dynamics matches stability/control structure", "idea_sweep": [ { "cfg": { "lr": 0.003, "step": 0.25 }, "mean": 0.00011978308180005115, "per_seed": [ 4.686686224886216e-05, 9.109569509746507e-05, 0.00011464366252766922, 8.399749276577495e-06, 7.34728091629222e-05, 6.693405157420784e-05, 0.000491157581564039, 6.569424294866621e-05 ] }, { "cfg": { "lr": 0.003, "step": 0.5 }, "mean": 0.00017802219872464775, "per_seed": [ 5.6299137213500217e-05, 0.0002794665051624179, 9.379914990859106e-05, 0.0001387570664519444, 0.0003630504652392119, 0.00018886031466536224, 0.00017176337132696062, 0.00013218157982919365 ] } ], "mechanism_signature": { "prediction": "convex-gradient refinement should have non-amplifying local response", "idea_observed_mean_output_sensitivity": 0.21240035444498062, "baseline_observed_mean_output_sensitivity": 0.2104792781174183, "idea_observed_max_output_sensitivity": 0.2549852430820465, "baseline_observed_max_output_sensitivity": 0.25559741258621216, "idea_mean_firm_gap_proxy": 2.065331489120581e-05, "baseline_mean_firm_gap_proxy": 2.03489205432561e-05, "confirmed": false } }, "baseline_union_grid": [ { "lr": 0.001, "step": 0.25 }, { "lr": 0.001, "step": 0.5 }, { "lr": 0.001, "step": 1.0 }, { "lr": 0.001, "step": 2.0 }, { "lr": 0.003, "step": 0.25 }, { "lr": 0.003, "step": 0.5 }, { "lr": 0.003, "step": 1.0 }, { "lr": 0.003, "step": 2.0 }, { "lr": 0.01, "step": 0.25 }, { "lr": 0.01, "step": 0.5 }, { "lr": 0.01, "step": 1.0 }, { "lr": 0.01, "step": 2.0 } ], "protocol_notes": { "epochs": 12, "batch": 64, "n_train": 400, "n_test": 200, "paired_seeds": [ 0, 1, 2, 3, 4, 5, 6, 7 ], "baseline_sweep_seeds": [ 0, 1, 2, 3 ] } }