{ "bench_version": 1, "track": "cubic_equilibrium_a_estimation (custom, in-folder; structural match: z = root(z^3 + a(x)*z - u) is exactly the idea's claimed equilibrium class)", "model": "mlp_32x32_tanh (idea: AParamNet 4->32->32->1 + softplus + ImplicitCubic Newton-20; baseline: DirectMLP 5->32->32->1, sees x and u)", "metric_direction": "lower is better", "n_seeds": 8, "epochs": 300, "grid_parity": { "grid": [ 0.003, 0.01, 0.03 ], "baseline_means": { "0.003": 0.0026160763518419117, "0.01": 0.0005651257015415467, "0.03": 0.0004695942006947007 }, "idea_means": { "0.003": 0.00024374518761760555, "0.01": 0.00022121649271866772, "0.03": 0.0002691956779017346 }, "search_space_parity": true }, "baseline": { "best_cfg": { "lr": 0.03, "epochs": 300 }, "sweep": [ { "cfg": { "lr": 0.003 }, "mean": 0.0026160763518419117 }, { "cfg": { "lr": 0.01 }, "mean": 0.0005651257015415467 }, { "cfg": { "lr": 0.03 }, "mean": 0.0004695942006947007 } ], "full": { "mean": 0.0004695942006947007, "std": 0.00013169171442929794, "per_seed": [ 0.000339631165843457, 0.000445100711658597, 0.00030270591378211975, 0.0007381809409707785, 0.0004293923848308623, 0.0006018560379743576, 0.00047620252007618546, 0.0004236839304212481 ], "n": 8 } }, "idea": { "mean": 0.00022121649271866772, "std": 2.5303392934561233e-05, "per_seed": [ 0.00020260778546798974, 0.00018607612582854927, 0.00022137281484901905, 0.0002577590639702976, 0.00023610987409483641, 0.0002327339316252619, 0.0001864753576228395, 0.0002465969882905483 ], "n": 8 }, "comparison": { "delta_mean": -0.000248377707976033, "idea_wins": 8, "n_pairs": 8, "per_seed_diffs": [ -0.00013702338037546724, -0.0002590245858300477, -8.13330989331007e-05, -0.0004804218770004809, -0.00019328251073602587, -0.0003691221063490957, -0.00028972716245334595, -0.00017708694213069975 ], "p_value": 0.0081, "mde": 0.00010886910199832132, "mde_rel_pct": 23.183655555640232, "verdict": "idea better (significant)", "system_worked": true }, "mechanism_signature": { "confirmed": true, "gradient_flows": true, "ift_backward": "dz/da = -z/J, dz/du = 1/J, J = 3z^2 + a_hat > 0 (a_hat = softplus(net(x))+0.05)", "self_check_all_seeds_ok": true, "self_check": [ { "seed": 0, "lr": 0.003, "grad_norm_first": 0.05369017, "grad_norm_last": 0.00011467, "output_delta": 0.13677967, "relative_delta": 0.264168, "network_matters": true }, { "seed": 0, "lr": 0.01, "grad_norm_first": 0.05369017, "grad_norm_last": 2.584e-05, "output_delta": 0.140783, "relative_delta": 0.272181, "network_matters": true }, { "seed": 0, "lr": 0.03, "grad_norm_first": 0.05369017, "grad_norm_last": 0.00126087, "output_delta": 0.14829852, "relative_delta": 0.28838, "network_matters": true }, { "seed": 1, "lr": 0.003, "grad_norm_first": 0.06303131, "grad_norm_last": 0.00011149, "output_delta": 0.14938839, "relative_delta": 0.282632, "network_matters": true }, { "seed": 1, "lr": 0.01, "grad_norm_first": 0.06303131, "grad_norm_last": 3.273e-05, "output_delta": 0.14870496, "relative_delta": 0.28067, "network_matters": true }, { "seed": 1, "lr": 0.03, "grad_norm_first": 0.06303131, "grad_norm_last": 2.077e-05, "output_delta": 0.15761301, "relative_delta": 0.297171, "network_matters": true }, { "seed": 2, "lr": 0.003, "grad_norm_first": 0.0651998, "grad_norm_last": 8.441e-05, "output_delta": 0.13411286, "relative_delta": 0.243048, "network_matters": true }, { "seed": 2, "lr": 0.01, "grad_norm_first": 0.0651998, "grad_norm_last": 3.367e-05, "output_delta": 0.13443458, "relative_delta": 0.243553, "network_matters": true }, { "seed": 2, "lr": 0.03, "grad_norm_first": 0.0651998, "grad_norm_last": 0.00014135, "output_delta": 0.13707605, "relative_delta": 0.248529, "network_matters": true }, { "seed": 3, "lr": 0.003, "grad_norm_first": 0.0478717, "grad_norm_last": 7.282e-05, "output_delta": 0.1600959, "relative_delta": 0.303371, "network_matters": true }, { "seed": 3, "lr": 0.01, "grad_norm_first": 0.0478717, "grad_norm_last": 2.8e-05, "output_delta": 0.16947965, "relative_delta": 0.321804, "network_matters": true }, { "seed": 3, "lr": 0.03, "grad_norm_first": 0.0478717, "grad_norm_last": 2.299e-05, "output_delta": 0.18700044, "relative_delta": 0.355268, "network_matters": true }, { "seed": 4, "lr": 0.003, "grad_norm_first": 0.06093026, "grad_norm_last": 0.00016984, "output_delta": 0.11551933, "relative_delta": 0.215875, "network_matters": true }, { "seed": 4, "lr": 0.01, "grad_norm_first": 0.06093026, "grad_norm_last": 3.269e-05, "output_delta": 0.11578429, "relative_delta": 0.216497, "network_matters": true }, { "seed": 4, "lr": 0.03, "grad_norm_first": 0.06093026, "grad_norm_last": 0.00775644, "output_delta": 0.12103881, "relative_delta": 0.229614, "network_matters": true }, { "seed": 5, "lr": 0.003, "grad_norm_first": 0.05086348, "grad_norm_last": 8.827e-05, "output_delta": 0.16617334, "relative_delta": 0.31593, "network_matters": true }, { "seed": 5, "lr": 0.01, "grad_norm_first": 0.05086348, "grad_norm_last": 3.019e-05, "output_delta": 0.17603016, "relative_delta": 0.334429, "network_matters": true }, { "seed": 5, "lr": 0.03, "grad_norm_first": 0.05086348, "grad_norm_last": 6.138e-05, "output_delta": 0.19581376, "relative_delta": 0.371749, "network_matters": true }, { "seed": 6, "lr": 0.003, "grad_norm_first": 0.07261282, "grad_norm_last": 0.00018103, "output_delta": 0.10209998, "relative_delta": 0.18625, "network_matters": true }, { "seed": 6, "lr": 0.01, "grad_norm_first": 0.07261282, "grad_norm_last": 5.02e-05, "output_delta": 0.09522294, "relative_delta": 0.174033, "network_matters": true }, { "seed": 6, "lr": 0.03, "grad_norm_first": 0.07261282, "grad_norm_last": 0.00015125, "output_delta": 0.08097388, "relative_delta": 0.147978, "network_matters": true }, { "seed": 7, "lr": 0.003, "grad_norm_first": 0.05419751, "grad_norm_last": 0.00010262, "output_delta": 0.15303306, "relative_delta": 0.288804, "network_matters": true }, { "seed": 7, "lr": 0.01, "grad_norm_first": 0.05419751, "grad_norm_last": 2.27e-05, "output_delta": 0.16315053, "relative_delta": 0.307862, "network_matters": true }, { "seed": 7, "lr": 0.03, "grad_norm_first": 0.05419751, "grad_norm_last": 0.0030526, "output_delta": 0.17037962, "relative_delta": 0.316831, "network_matters": true } ], "a_hat_mse_mean": 0.004151654953602701, "note": "network output a_hat enters F(z;a_hat,u)=z^3+a_hat*z-u nonlinearly; breaking network weights changes outputs on every seed (RULE 0.1 self-check)" }, "limitations": "Synthetic track generated exactly from the idea's equation class (z = root(z^3+a(x)z-u), a hidden, x noisy sigma=0.15, z noiseless). The advantage is the physics inductive bias: idea learns only a(x); baseline must learn z(x,u) directly with the same budget and grid. No observation noise on z; single architecture family; CPU full-batch Adam." }