{ "bench_version": 1, "track": "dynamics", "model": "rnn_small", "metric_direction": "lower is better", "n_seeds": 8, "baseline": { "best_cfg": { "lr": 0.01 }, "sweep": [ { "cfg": { "lr": 0.001 }, "mean": 0.004298779065720737 }, { "cfg": { "lr": 0.003 }, "mean": 0.0034615940821822733 }, { "cfg": { "lr": 0.01 }, "mean": 0.0014865802077110857 } ], "full": { "mean": 0.0014198302378645167, "std": 0.00039839114901047844, "per_seed": [ 0.0009327387670055032, 0.0018641706556081772, 0.0010785290505737066, 0.0020708823576569557, 0.0009260809747502208, 0.0014055331703275442, 0.0016443432541564107, 0.001436363672837615 ], "n": 8 } }, "idea": { "mean": 0.0019242097914684564, "std": 0.0006243480083057443, "per_seed": [ 0.0027711838483810425, 0.0015842666616663337, 0.0012298799119889736, 0.0026156860403716564, 0.001083912211470306, 0.002030868548899889, 0.002578162821009755, 0.0014997182879596949 ], "n": 8 }, "comparison": { "delta_mean": 0.0005043795536039397, "idea_wins": 1, "n_pairs": 8, "per_seed_diffs": [ 0.0018384450813755393, -0.0002799039939418435, 0.000151350861415267, 0.0005448036827147007, 0.00015783123672008514, 0.0006253353785723448, 0.0009338195668533444, 6.335461512207985e-05 ], "p_value": 0.05675, "mde": 0.0005505516465549087, "mde_rel_pct": 38.77587840240402, "verdict": "no significant win", "system_worked": false }, "mechanism_signature": { "prediction": "Jackson filtering suppresses the trained model output by p(2*gap-1) around its fixed point", "signature": { "gap_hat": 0.25, "K": 7, "sK": 1.75, "predicted_fejer_gain": 0.173583984375, "predicted_jackson_gain": 0.168701171875, "observed_filtered_over_raw_norm": 0.7509765625, "prediction_error_abs": 0.582275390625, "confirmed": false }, "idea_sweep": [ { "cfg": { "lr": 0.001 }, "result": { "mean": 0.013434823020361364, "std": 0.007597705589429824, "per_seed": [ 0.00517980195581913, 0.016346164047718048, 0.007690576370805502, 0.011888416483998299, 0.003950032871216536, 0.015627766028046608, 0.018083054572343826, 0.028712771832942963 ], "n": 8 } }, { "cfg": { "lr": 0.003 }, "result": { "mean": 0.005034002184402198, "std": 0.0020313352507723005, "per_seed": [ 0.004691103473305702, 0.00431825453415513, 0.003526391228660941, 0.01027995441108942, 0.004567801486700773, 0.0038863292429596186, 0.0040084864012897015, 0.0049936966970562935 ], "n": 8 } }, { "cfg": { "lr": 0.01 }, "result": { "mean": 0.0019242097914684564, "std": 0.0006243480083057443, "per_seed": [ 0.0027711838483810425, 0.0015842666616663337, 0.0012298799119889736, 0.0026156860403716564, 0.001083912211470306, 0.002030868548899889, 0.002578162821009755, 0.0014997182879596949 ], "n": 8 } } ], "math_checks": { "3": { "fejer_p1_error": 0.0, "jackson_p1_error": 0.0, "jackson_degree": 2, "nonnegative": true }, "7": { "fejer_p1_error": 0.0, "jackson_p1_error": 0.0, "jackson_degree": 6, "nonnegative": true }, "15": { "fejer_p1_error": 0.0, "jackson_p1_error": 0.0, "jackson_degree": 14, "nonnegative": true }, "iterate_identity_error": 3.7547848202023757e-17 }, "protocol": { "epochs": 12, "n_train": 400, "n_test": 200, "gap": 0.25, "K": 7, "matched_architecture": true, "lr_union": [ { "lr": 0.001 }, { "lr": 0.003 }, { "lr": 0.01 } ] } } }