{ "bench_version": 1, "track": "dynamics", "model": "rnn_small", "metric_direction": "lower is better", "n_seeds": 8, "baseline": { "best_cfg": { "lr": 0.01, "weight_decay": 0.0001 }, "sweep": [ { "cfg": { "lr": 0.001, "weight_decay": 0.0 }, "mean": 0.004103701037820429 }, { "cfg": { "lr": 0.001, "weight_decay": 0.0001 }, "mean": 0.0041049906285479665 }, { "cfg": { "lr": 0.003, "weight_decay": 0.0 }, "mean": 0.0033861721749417484 }, { "cfg": { "lr": 0.003, "weight_decay": 0.0001 }, "mean": 0.0033592699037399143 }, { "cfg": { "lr": 0.01, "weight_decay": 0.0 }, "mean": 0.0014241317112464458 }, { "cfg": { "lr": 0.01, "weight_decay": 0.0001 }, "mean": 0.0014055168576305732 } ], "full": { "mean": 0.0013874754731659777, "std": 0.0003779629342121644, "per_seed": [ 0.0008414968033321202, 0.0018421959830448031, 0.0010265976889058948, 0.0019117769552394748, 0.0010145766427740455, 0.0013230722397565842, 0.0016772722592577338, 0.0014628152130171657 ], "n": 8 } }, "idea": { "mean": 0.0014499883909593336, "std": 0.0006258243181704281, "per_seed": [ 0.00110855873208493, 0.0011564278975129128, 0.0009631213033571839, 0.002061811974272132, 0.0009511980460956693, 0.0017834099708124995, 0.0008573447703383863, 0.0027180344332009554 ], "n": 8 }, "comparison": { "delta_mean": 6.251291779335588e-05, "idea_wins": 4, "n_pairs": 8, "per_seed_diffs": [ 0.00026706192875280976, -0.0006857680855318904, -6.347638554871082e-05, 0.00015003501903265715, -6.33785966783762e-05, 0.00046033773105591536, -0.0008199274889193475, 0.0012552192201837897 ], "p_value": 0.82325, "mde": 0.000547451419528248, "mde_rel_pct": 39.45665563940089, "verdict": "no significant win", "system_worked": false }, "mechanism_signature": { "prediction": "cycle-stabilizing intervention lowers local recurrent hidden-state gain", "baseline_hidden_gain": 0.5601232647895813, "idea_hidden_gain": 0.5631288886070251, "relative_gain_change": 0.005366004150734417, "confirmed": false, "measurement": "finite 1e-3 hidden perturbation through trained GRU final-step transition" }, "idea_sweep": [ { "cfg": { "lr": 0.001, "weight_decay": 0.0001, "lambda": 0.02 }, "result": { "mean": 0.0048043747956398875, "std": 0.0015046526831977705, "per_seed": [ 0.007243611849844456, 0.0027444041334092617, 0.004059470724314451, 0.003256669035181403, 0.004964617546647787, 0.005492699332535267, 0.003940005321055651, 0.006733520422130823 ], "n": 8 } }, { "cfg": { "lr": 0.003, "weight_decay": 0.0001, "lambda": 0.02 }, "result": { "mean": 0.0029061136301606894, "std": 0.0006765360005780435, "per_seed": [ 0.0028327745385468006, 0.0025881670881062746, 0.0032603004947304726, 0.004262231756001711, 0.002710104687139392, 0.003395120846107602, 0.0021831300109624863, 0.002017079619690776 ], "n": 8 } }, { "cfg": { "lr": 0.01, "weight_decay": 0.0001, "lambda": 0.02 }, "result": { "mean": 0.0014499883909593336, "std": 0.0006258243181704281, "per_seed": [ 0.00110855873208493, 0.0011564278975129128, 0.0009631213033571839, 0.002061811974272132, 0.0009511980460956693, 0.0017834099708124995, 0.0008573447703383863, 0.0027180344332009554 ], "n": 8 } } ], "protocol_notes": { "epochs": 12, "n_train": 400, "n_test": 400, "baseline_grid": [ { "lr": 0.001, "weight_decay": 0.0 }, { "lr": 0.001, "weight_decay": 0.0001 }, { "lr": 0.003, "weight_decay": 0.0 }, { "lr": 0.003, "weight_decay": 0.0001 }, { "lr": 0.01, "weight_decay": 0.0 }, { "lr": 0.01, "weight_decay": 0.0001 } ], "idea_grid": [ { "lr": 0.001, "weight_decay": 0.0001, "lambda": 0.02 }, { "lr": 0.003, "weight_decay": 0.0001, "lambda": 0.02 }, { "lr": 0.01, "weight_decay": 0.0001, "lambda": 0.02 } ] } }