{ "bench_version": 1, "track": "dynamics", "model": "rnn_small", "metric_direction": "lower is better", "n_seeds": 8, "baseline": { "best_cfg": { "lr": 0.01, "epochs": 8, "tau": 0.05, "horizon": 4 }, "full": { "mean": 0.0029927210562163964, "std": 0.0009221810424349031, "per_seed": [ 0.003302625846117735, 0.0018407043535262346, 0.002554400824010372, 0.0041609639301896095, 0.00346640357747674, 0.002362125087529421, 0.0018692960729822516, 0.0043852487578988075 ], "n": 8 }, "sweep": { "best_cfg": { "lr": 0.01, "epochs": 8, "tau": 0.05, "horizon": 4 }, "sweep": [ { "cfg": { "lr": 0.001, "epochs": 8, "tau": 0.05, "horizon": 4 }, "mean": 0.0069296700530685484 }, { "cfg": { "lr": 0.001, "epochs": 8, "tau": 0.05, "horizon": 8 }, "mean": 0.009733024751767516 }, { "cfg": { "lr": 0.001, "epochs": 8, "tau": 0.08, "horizon": 4 }, "mean": 0.0069296700530685484 }, { "cfg": { "lr": 0.001, "epochs": 8, "tau": 0.08, "horizon": 8 }, "mean": 0.009733024751767516 }, { "cfg": { "lr": 0.001, "epochs": 8, "tau": 0.15, "horizon": 4 }, "mean": 0.0069296700530685484 }, { "cfg": { "lr": 0.001, "epochs": 8, "tau": 0.15, "horizon": 8 }, "mean": 0.009733024751767516 }, { "cfg": { "lr": 0.003, "epochs": 8, "tau": 0.05, "horizon": 4 }, "mean": 0.005332525062840432 }, { "cfg": { "lr": 0.003, "epochs": 8, "tau": 0.05, "horizon": 8 }, "mean": 0.007113165338523686 }, { "cfg": { "lr": 0.003, "epochs": 8, "tau": 0.08, "horizon": 4 }, "mean": 0.005332525062840432 }, { "cfg": { "lr": 0.003, "epochs": 8, "tau": 0.08, "horizon": 8 }, "mean": 0.007113165338523686 }, { "cfg": { "lr": 0.003, "epochs": 8, "tau": 0.15, "horizon": 4 }, "mean": 0.005332525062840432 }, { "cfg": { "lr": 0.003, "epochs": 8, "tau": 0.15, "horizon": 8 }, "mean": 0.007113165338523686 }, { "cfg": { "lr": 0.01, "epochs": 8, "tau": 0.05, "horizon": 4 }, "mean": 0.002964673738460988 }, { "cfg": { "lr": 0.01, "epochs": 8, "tau": 0.05, "horizon": 8 }, "mean": 0.0035731843090616167 }, { "cfg": { "lr": 0.01, "epochs": 8, "tau": 0.08, "horizon": 4 }, "mean": 0.002964673738460988 }, { "cfg": { "lr": 0.01, "epochs": 8, "tau": 0.08, "horizon": 8 }, "mean": 0.0035731843090616167 }, { "cfg": { "lr": 0.01, "epochs": 8, "tau": 0.15, "horizon": 4 }, "mean": 0.002964673738460988 }, { "cfg": { "lr": 0.01, "epochs": 8, "tau": 0.15, "horizon": 8 }, "mean": 0.0035731843090616167 } ], "full": { "mean": 0.0029927210562163964, "std": 0.0009221810424349031, "per_seed": [ 0.003302625846117735, 0.0018407043535262346, 0.002554400824010372, 0.0041609639301896095, 0.00346640357747674, 0.002362125087529421, 0.0018692960729822516, 0.0043852487578988075 ], "n": 8 } } }, "idea": { "mean": 0.0029927210562163964, "std": 0.0009221810424349031, "per_seed": [ 0.003302625846117735, 0.0018407043535262346, 0.002554400824010372, 0.0041609639301896095, 0.00346640357747674, 0.002362125087529421, 0.0018692960729822516, 0.0043852487578988075 ], "n": 8 }, "comparison": { "delta_mean": 0.0, "idea_wins": 0, "n_pairs": 8, "per_seed_diffs": [ 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0 ], "p_value": 1.0, "mde": 0.0, "mde_rel_pct": 0.0, "verdict": "no measurable effect", "system_worked": false }, "idea_sweep": [ [ { "lr": 0.01, "epochs": 8, "tau": 0.05, "horizon": 4 }, { "mean": 0.0029927210562163964, "std": 0.0009221810424349031, "per_seed": [ 0.003302625846117735, 0.0018407043535262346, 0.002554400824010372, 0.0041609639301896095, 0.00346640357747674, 0.002362125087529421, 0.0018692960729822516, 0.0043852487578988075 ], "n": 8 } ], [ { "lr": 0.001, "epochs": 8, "tau": 0.05, "horizon": 4 }, { "mean": 0.009247816720744595, "std": 0.0046769102156664615, "per_seed": [ 0.004128649365156889, 0.0065189506858587265, 0.0036286672111600637, 0.013442412950098515, 0.006088127847760916, 0.009851381182670593, 0.017597200348973274, 0.012727144174277782 ], "n": 8 } ], [ { "lr": 0.01, "epochs": 8, "tau": 0.05, "horizon": 4 }, { "mean": 0.0029927210562163964, "std": 0.0009221810424349031, "per_seed": [ 0.003302625846117735, 0.0018407043535262346, 0.002554400824010372, 0.0041609639301896095, 0.00346640357747674, 0.002362125087529421, 0.0018692960729822516, 0.0043852487578988075 ], "n": 8 } ], [ { "lr": 0.01, "epochs": 8, "tau": 0.05, "horizon": 4 }, { "mean": 0.0029927210562163964, "std": 0.0009221810424349031, "per_seed": [ 0.003302625846117735, 0.0018407043535262346, 0.002554400824010372, 0.0041609639301896095, 0.00346640357747674, 0.002362125087529421, 0.0018692960729822516, 0.0043852487578988075 ], "n": 8 } ], [ { "lr": 0.01, "epochs": 8, "tau": 0.15, "horizon": 4 }, { "mean": 0.0029927210562163964, "std": 0.0009221810424349031, "per_seed": [ 0.003302625846117735, 0.0018407043535262346, 0.002554400824010372, 0.0041609639301896095, 0.00346640357747674, 0.002362125087529421, 0.0018692960729822516, 0.0043852487578988075 ], "n": 8 } ] ], "mechanism_signature": { "trained_model": "GRUCell Jacobian and learned scalar head measured on test-time batches", "predicted": "non-eigenvector transitions should activate rollout; eigen-like transitions should skip", "observed_mean_residual": 0.39864883571863174, "observed_activation_rate": 1.0, "observed_lambda_mean": 0.7705069109797478, "confirmed": true } }