{ "bench_version": 1, "track": "vision", "model": "cnn_small", "metric_direction": "lower is better", "n_seeds": 8, "baseline": { "best_cfg": { "lr": 0.001, "epochs": 8, "epsilon": 0.25, "lam": 0.01 }, "sweep": [ { "cfg": { "lr": 0.001, "epochs": 8, "epsilon": 0.25, "lam": 0.01 }, "mean": 0.7974999696016312 }, { "cfg": { "lr": 0.003, "epochs": 8, "epsilon": 0.25, "lam": 0.01 }, "mean": 0.8012499809265137 }, { "cfg": { "lr": 0.006, "epochs": 8, "epsilon": 0.25, "lam": 0.01 }, "mean": 0.8087499737739563 } ], "full": { "mean": 0.794999971985817, "std": 0.020916503869207948, "per_seed": [ 0.7799999713897705, 0.7999999523162842, 0.824999988079071, 0.7849999666213989, 0.8299999833106995, 0.7649999856948853, 0.7899999618530273, 0.7849999666213989 ], "n": 8 } }, "idea": { "mean": 0.7981249764561653, "std": 0.037411342897785256, "per_seed": [ 0.7799999713897705, 0.8549999594688416, 0.8549999594688416, 0.7549999952316284, 0.8100000023841858, 0.7549999952316284, 0.7749999761581421, 0.7999999523162842 ], "n": 8 }, "comparison": { "delta_mean": 0.003125004470348358, "idea_wins": 4, "n_pairs": 8, "per_seed_diffs": [ 0.0, 0.05500000715255737, 0.029999971389770508, -0.029999971389770508, -0.019999980926513672, -0.009999990463256836, -0.014999985694885254, 0.014999985694885254 ], "p_value": 0.8129, "mde": 0.02385367502560343, "mde_rel_pct": 3.0004623731016924, "verdict": "no measurable effect", "system_worked": false }, "mechanism_signature": { "predicted_pou_error~0": 1.1920928955078125e-07, "observed_pooled_energy": 0.08952471613883972, "observed_ridge_projected_energy": 0.07936406880617142, "prediction_projected_le_raw": true, "confirmed": true, "idea_sweep": [ { "cfg": { "lr": 0.001, "epochs": 8, "epsilon": 0.25, "lam": 0.01 }, "res": { "mean": 0.844374991953373, "std": 0.02256068428063704, "per_seed": [ 0.8100000023841858, 0.8650000095367432, 0.875, 0.8650000095367432, 0.8149999976158142, 0.8299999833106995, 0.8499999642372131, 0.8449999690055847 ], "n": 8 } }, { "cfg": { "lr": 0.003, "epochs": 8, "epsilon": 0.35, "lam": 0.01 }, "res": { "mean": 0.7981249764561653, "std": 0.037411342897785256, "per_seed": [ 0.7799999713897705, 0.8549999594688416, 0.8549999594688416, 0.7549999952316284, 0.8100000023841858, 0.7549999952316284, 0.7749999761581421, 0.7999999523162842 ], "n": 8 } }, { "cfg": { "lr": 0.006, "epochs": 8, "epsilon": 0.25, "lam": 0.01 }, "res": { "mean": 0.8024999797344208, "std": 0.04782781963257417, "per_seed": [ 0.7799999713897705, 0.8999999761581421, 0.8100000023841858, 0.7149999737739563, 0.8100000023841858, 0.8199999928474426, 0.7949999570846558, 0.7899999618530273 ], "n": 8 } } ], "structural_match": "vision CNN spatial directional pooling; same task and trained systems" } }