{ "bench_version": 1, "track": "spd_covariance_classification", "model": "mlp_tiny", "metric_direction": "lower is better", "n_seeds": 8, "baseline": { "best_cfg": { "lr": 0.001, "epochs": 18 }, "sweep": [ { "cfg": { "lr": 0.001, "epochs": 18 }, "mean": 0.004999999888241291 }, { "cfg": { "lr": 0.003, "epochs": 18 }, "mean": 0.006249999860301614 }, { "cfg": { "lr": 0.01, "epochs": 18 }, "mean": 0.007499999832361937 } ], "full": { "mean": 0.005624999874271452, "std": 0.0029973946350734574, "per_seed": [ 0.004999999888241291, 0.009999999776482582, 0.004999999888241291, 0.0, 0.009999999776482582, 0.004999999888241291, 0.004999999888241291, 0.004999999888241291 ], "n": 8 } }, "idea": { "mean": 0.25124998565297574, "std": 0.32049520383799557, "per_seed": [ 0.004999999888241291, 0.004999999888241291, 0.6649999618530273, 0.004999999888241291, 0.0, 0.6649999618530273, 0.6649999618530273, 0.0 ], "n": 8 }, "comparison": { "delta_mean": 0.24562498577870429, "idea_wins": 3, "n_pairs": 8, "per_seed_diffs": [ 0.0, -0.004999999888241291, 0.659999961964786, 0.004999999888241291, -0.009999999776482582, 0.659999961964786, 0.659999961964786, -0.004999999888241291 ], "p_value": 0.2308, "mde": 0.28693631664685193, "mde_rel_pct": 5101.090187740063, "verdict": "no significant win", "system_worked": false }, "mechanism_signature": { "prediction": "factor-generated prototypes remain SPD and logits finite after NN training", "predicted_min_eigenvalue_bound": 0.0, "observed_min_prototype_eigenvalue": 0.42081671953201294, "observed_finite_logit_fraction": 1.0, "confirmed": true, "idea_settings_tried": [ { "lr": 0.001, "epochs": 18 }, { "lr": 0.003, "epochs": 18 }, { "lr": 0.01, "epochs": 18 } ] }, "idea_selected_cfg": { "lr": 0.003, "epochs": 18 } }