{ "bench_version": 1, "track": "dynamics", "model": "rnn_small", "metric_direction": "lower is better", "n_seeds": 8, "baseline": { "best_cfg": { "lr": 0.006, "gamma": 1.0 }, "sweep": [ { "cfg": { "lr": 0.001, "gamma": 0.4 }, "mean": 0.001971690042410046 }, { "cfg": { "lr": 0.001, "gamma": 1.0 }, "mean": 0.0013888165121898055 }, { "cfg": { "lr": 0.003, "gamma": 0.4 }, "mean": 0.0010129157599294558 }, { "cfg": { "lr": 0.003, "gamma": 1.0 }, "mean": 0.0007739054271951318 }, { "cfg": { "lr": 0.006, "gamma": 0.4 }, "mean": 0.0005326326572685502 }, { "cfg": { "lr": 0.006, "gamma": 1.0 }, "mean": 0.0004311748270993121 } ], "full": { "mean": 0.0004004990041721612, "std": 7.354865862466145e-05, "per_seed": [ 0.00032163842115551233, 0.0005050268373452127, 0.0003722184046637267, 0.0005258156452327967, 0.00031021691393107176, 0.00036279112100601196, 0.00040758162504062057, 0.0003987030650023371 ], "n": 8 } }, "idea": { "mean": 0.0005187966198718641, "std": 6.731488481596035e-05, "per_seed": [ 0.0004997514770366251, 0.0006125298095867038, 0.0005725970841012895, 0.000530327029991895, 0.00038920878432691097, 0.0005293103749863803, 0.0005672792322002351, 0.00044936916674487293 ], "n": 8 }, "comparison": { "delta_mean": 0.00011829761569970287, "idea_wins": 0, "n_pairs": 8, "per_seed_diffs": [ 0.00017811305588111281, 0.00010750297224149108, 0.00020037867943756282, 4.511384759098291e-06, 7.899187039583921e-05, 0.00016651925398036838, 0.00015969760715961456, 5.066610174253583e-05 ], "p_value": 0.0081, "mde": 5.78763280347936e-05, "mde_rel_pct": 14.451054167893634, "verdict": "idea worse (significant)", "system_worked": false }, "mechanism_signature": { "prediction": "trained fast/slow modal decay rates agree within 20%", "predicted_rates": [ 3.908752053976059, 0.3747453838586807 ], "observed_rates": [ 0.0, 0.0 ], "relative_errors": [ 1.0, 1.0 ], "confirmed": false }, "idea_sweep": [ { "cfg": { "lr": 0.001 }, "mean": 0.001689480894128792, "per_seed": [ 0.0016606806311756372, 0.0017868814757093787, 0.0018675795290619135, 0.0017374568851664662, 0.0013423769269138575, 0.0014587605837732553, 0.001253080670721829, 0.0024090304505079985 ] }, { "cfg": { "lr": 0.003 }, "mean": 0.0008820996736176312, "per_seed": [ 0.00092177907936275, 0.0009301036479882896, 0.0009488135110586882, 0.0009710948215797544, 0.0007397678564302623, 0.0008799024508334696, 0.0008156044641509652, 0.0008497315575368702 ] }, { "cfg": { "lr": 0.006 }, "mean": 0.0005187966198718641, "per_seed": [ 0.0004997514770366251, 0.0006125298095867038, 0.0005725970841012895, 0.000530327029991895, 0.00038920878432691097, 0.0005293103749863803, 0.0005672792322002351, 0.00044936916674487293 ] } ], "protocol_note": "Matched dynamics task; baseline and idea share 64-dimensional dissipative recurrent state, input/output, optimizer, epochs, batch, and all learning-rate values. Only one versus two relaxation bands and explicit exchange differ." }