{ "bench_version": 1, "track": "poisson_jfb_short_trace", "model": "mlp_tiny", "metric_direction": "lower is better", "n_seeds": 8, "baseline": { "best_cfg": { "lr": 0.006, "n_train": 165 }, "sweep": [ { "cfg": { "lr": 0.0015, "n_train": 6 }, "mean": 0.014930133474990726 }, { "cfg": { "lr": 0.0015, "n_train": 30 }, "mean": 0.009964724536985159 }, { "cfg": { "lr": 0.0015, "n_train": 165 }, "mean": 0.004382685816381127 }, { "cfg": { "lr": 0.003, "n_train": 6 }, "mean": 0.014489277265965939 }, { "cfg": { "lr": 0.003, "n_train": 30 }, "mean": 0.006221903720870614 }, { "cfg": { "lr": 0.003, "n_train": 165 }, "mean": 0.0016253327776212245 }, { "cfg": { "lr": 0.006, "n_train": 6 }, "mean": 0.01361416233703494 }, { "cfg": { "lr": 0.006, "n_train": 30 }, "mean": 0.0035399545449763536 }, { "cfg": { "lr": 0.006, "n_train": 165 }, "mean": 0.001060363429132849 } ], "full": { "mean": 0.001149145871750079, "std": 0.00015942205170709907, "per_seed": [ 0.0010200557298958302, 0.0010734780225902796, 0.0011366221588104963, 0.0010112978052347898, 0.001334082568064332, 0.0010319320717826486, 0.001102412585169077, 0.0014832860324531794 ], "n": 8 } }, "idea": { "mean": 0.001149145871750079, "std": 0.00015942205170709907, "per_seed": [ 0.0010200557298958302, 0.0010734780225902796, 0.0011366221588104963, 0.0010112978052347898, 0.001334082568064332, 0.0010319320717826486, 0.001102412585169077, 0.0014832860324531794 ], "n": 8 }, "comparison": { "delta_mean": 0.0, "idea_wins": 0, "n_pairs": 8, "per_seed_diffs": [ 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0 ], "p_value": 1.0, "mde": 0.0, "mde_rel_pct": 0.0, "verdict": "no measurable effect", "system_worked": false }, "audit": { "idea_sweep": [ { "cfg": { "lr": 0.006, "n_train": 30, "kappa": 1.0 }, "result": { "mean": 0.0036430617328733206, "std": 0.0007491156850104084, "per_seed": [ 0.0028485895600169897, 0.0040054162964224815, 0.0029787851963192225, 0.004327027127146721, 0.002938139019533992, 0.0047215428203344345, 0.0029018910136073828, 0.004423102829605341 ], "n": 8 } }, { "cfg": { "lr": 0.006, "n_train": 165, "kappa": 1.5 }, "result": { "mean": 0.001149145871750079, "std": 0.00015942205170709907, "per_seed": [ 0.0010200557298958302, 0.0010734780225902796, 0.0011366221588104963, 0.0010112978052347898, 0.001334082568064332, 0.0010319320717826486, 0.001102412585169077, 0.0014832860324531794 ], "n": 8 } }, { "cfg": { "lr": 0.0015, "n_train": 165, "kappa": 1.5 }, "result": { "mean": 0.004515739681664854, "std": 0.0008947441617986451, "per_seed": [ 0.0034114099107682705, 0.00540888449177146, 0.003225072519853711, 0.005485376343131065, 0.004410577937960625, 0.005603278521448374, 0.0037976347375661135, 0.004783682990819216 ], "n": 8 } } ], "epochs": 12, "batch": 128, "resolution_scaling": [ { "m": 10, "n_train": 10, "test_mse": 0.0067039490677416325, "wall_seconds": 0.04126900600022054 }, { "m": 20, "n_train": 20, "test_mse": 0.004788667894899845, "wall_seconds": 0.03983835300005012 }, { "m": 30, "n_train": 30, "test_mse": 0.0028485895600169897, "wall_seconds": 0.06811163199972725 } ] }, "custom_track": { "name": "poisson_jfb_short_trace", "file": "/home/maxwelhelp/all/math2nn/bench/custom_tracks/poisson_jfb_short_trace.py", "domain": "pde" }, "mechanism_signature": { "claim": "more operator pairs at fixed output resolution reduce learned error", "trained_model_observations": [ { "n_train": 6, "observed_test_mse": 0.01007129903882742, "observed_prediction_mse_recomputed": 0.010071299970149994 }, { "n_train": 30, "observed_test_mse": 0.0028485895600169897, "observed_prediction_mse_recomputed": 0.0028485895600169897 }, { "n_train": 165, "observed_test_mse": 0.0010200557298958302, "observed_prediction_mse_recomputed": 0.0010200557298958302 } ], "confirmed": true }, "elapsed_seconds": 7.243455264000204 }