{ "bench_version": 1, "track": "complex_array_channel", "model": "mlp_tiny", "metric_direction": "lower is better", "n_seeds": 8, "baseline": { "best_cfg": { "lr": 0.01, "k": 2 }, "sweep": [ { "cfg": { "lr": 0.001, "k": 2 }, "mean": 0.007402819930575788 }, { "cfg": { "lr": 0.003, "k": 2 }, "mean": 0.0065840884344652295 }, { "cfg": { "lr": 0.01, "k": 2 }, "mean": 0.006486733560450375 } ], "full": { "mean": 0.006718522927258164, "std": 0.0007129592821712252, "per_seed": [ 0.006483251228928566, 0.00544784078374505, 0.007208648603409529, 0.006807193625718355, 0.007167691830545664, 0.007836345583200455, 0.005902399308979511, 0.006894812453538179 ], "n": 8 } }, "idea": { "mean": 0.007619430776685476, "std": 0.0008275326682381549, "per_seed": [ 0.0074270921759307384, 0.006459011230617762, 0.008539552800357342, 0.007304489612579346, 0.007882530800998211, 0.00901730451732874, 0.006567466538399458, 0.007757998537272215 ], "n": 8 }, "comparison": { "delta_mean": 0.0009009078494273126, "idea_wins": 0, "n_pairs": 8, "per_seed_diffs": [ 0.0009438409470021725, 0.0010111704468727112, 0.001330904196947813, 0.0004972959868609905, 0.0007148389704525471, 0.0011809589341282845, 0.0006650672294199467, 0.0008631860837340355 ], "p_value": 0.0081, "mde": 0.0002304888187870338, "mde_rel_pct": 3.43064720151363, "verdict": "idea worse (significant)", "system_worked": false }, "mechanism_signature": { "prediction": "Taylor steering error scales quadratically in offset", "delta": 0.001, "predicted_error_order": 2.0, "observed_error_over_delta_squared": 34.418742870911956, "trained_model_output_rms": 0.011084591038525105, "confirmed": true }, "idea_sweep": [ { "cfg": { "lr": 0.001, "k": 2 }, "mean": 0.007869121560361236, "std": 0.0008392636492011609, "per_seed": [ 0.007451348938047886, 0.006571656093001366, 0.008513221517205238, 0.007863671518862247, 0.008256588131189346, 0.009301764890551567, 0.006832886021584272, 0.008161835372447968 ], "n": 8 }, { "cfg": { "lr": 0.003, "k": 2 }, "mean": 0.007681989867705852, "std": 0.0008145156626225875, "per_seed": [ 0.00713324686512351, 0.006568302866071463, 0.008564387448132038, 0.0075448122806847095, 0.008067510090768337, 0.0090027442201972, 0.0066692763939499855, 0.00790563877671957 ], "n": 8 }, { "cfg": { "lr": 0.01, "k": 2 }, "mean": 0.007619430776685476, "std": 0.0008275326682381549, "per_seed": [ 0.0074270921759307384, 0.006459011230617762, 0.008539552800357342, 0.007304489612579346, 0.007882530800998211, 0.00901730451732874, 0.006567466538399458, 0.007757998537272215 ], "n": 8 } ], "custom_track": { "name": "complex_array_channel", "file": "array_track.py", "domain": "array-valued complex low-rank tensors" } }