Energy-Gradient Neural Flow / bench_report.json

Mechanism confirmed, baseline not beaten

Raw ⬇ ZIP
  1{
  2  "bench_version": 1,
  3  "track": "dynamics",
  4  "model": "rnn_small",
  5  "metric_direction": "lower is better",
  6  "n_seeds": 8,
  7  "baseline": {
  8    "best_cfg": {
  9      "lr": 0.002
 10    },
 11    "sweep": [
 12      {
 13        "cfg": {
 14          "lr": 0.001
 15        },
 16        "mean": 0.00028059784381184727
 17      },
 18      {
 19        "cfg": {
 20          "lr": 0.002
 21        },
 22        "mean": 0.0001786892862583045
 23      },
 24      {
 25        "cfg": {
 26          "lr": 0.003
 27        },
 28        "mean": 0.00018342551447858568
 29      }
 30    ],
 31    "full": {
 32      "mean": 0.000164712047080684,
 33      "std": 4.489169459326852e-05,
 34      "per_seed": [
 35        0.00020323635544627905,
 36        0.00021873260266147554,
 37        0.00013271479110699147,
 38        0.0001600733958184719,
 39        0.0001428304531145841,
 40        0.00023414976021740586,
 41        0.00011625964543782175,
 42        0.00010969937284244224
 43      ],
 44      "n": 8
 45    }
 46  },
 47  "idea": {
 48    "mean": 0.000707463565049693,
 49    "std": 5.862115619486818e-05,
 50    "per_seed": [
 51      0.000648840912617743,
 52      0.0008204824407584965,
 53      0.0006285406416282058,
 54      0.0007532027084380388,
 55      0.0007002238417044282,
 56      0.0007392585976049304,
 57      0.0007051959400996566,
 58      0.0006639634375460446
 59    ],
 60    "n": 8
 61  },
 62  "comparison": {
 63    "delta_mean": 0.000542751517969009,
 64    "idea_wins": 0,
 65    "n_pairs": 8,
 66    "per_seed_diffs": [
 67      0.00044560455717146397,
 68      0.000601749838097021,
 69      0.0004958258505212143,
 70      0.0005931293126195669,
 71      0.0005573933885898441,
 72      0.0005051088373875245,
 73      0.0005889362946618348,
 74      0.0005542640647036023
 75    ],
 76    "p_value": 0.0081,
 77    "mde": 4.639948748729596e-05,
 78    "mde_rel_pct": 28.17006303404585,
 79    "verdict": "idea worse (significant)",
 80    "system_worked": false
 81  },
 82  "mechanism_signature": {
 83    "idea_sweep": [
 84      {
 85        "cfg": {
 86          "lr": 0.001
 87        },
 88        "mean": 0.0013710275816265494
 89      },
 90      {
 91        "cfg": {
 92          "lr": 0.002
 93        },
 94        "mean": 0.0008818475471343845
 95      },
 96      {
 97        "cfg": {
 98          "lr": 0.003
 99        },
100        "mean": 0.000712766675860621
101      }
102    ],
103    "predicted": "energy should not increase under sufficiently small Euler steps",
104    "observed_energy_nonincreasing_fraction": 1.0,
105    "observed_energy_first_last": [
106      -2.293245553970337,
107      -3.0686049461364746
108    ],
109    "observed_grad_norm_first_last": [
110      1.0507688522338867,
111      0.8547213077545166
112    ],
113    "predicted_boundary_eta_L": 2.0,
114    "observed_local_energy_boundary": "not estimated (learned Hessian unavailable in budget)",
115    "confirmed": true
116  },
117  "protocol_notes": {
118    "track_choice": "dynamics matches stability/control/Lyapunov structure",
119    "shared_lr_union": [
120      0.001,
121      0.002,
122      0.003
123    ],
124    "epochs": 18,
125    "batch": 128,
126    "baseline_architecture": "matched VectorCell recurrent scaffold (vector field)",
127    "idea_architecture": "matched recurrent hidden width with scalar energy gradient"
128  }
129}