Correction-aware tree optimizer / results.json

Mechanism confirmed, baseline not beaten

Raw ⬇ ZIP
  1{
  2  "seed": 17,
  3  "targets": [
  4    -2.0,
  5    1.0,
  6    2.5,
  7    -1.0
  8  ],
  9  "math_checks": {
 10    "conservation_abs_errors": [
 11      0.0,
 12      0.0,
 13      0.0,
 14      0.0
 15    ],
 16    "correction_norms": [
 17      0.046097722286464436,
 18      0.0921954445729289,
 19      0.1843908891458578,
 20      0.36878177829171555
 21    ],
 22    "rho_ratio_observed": [
 23      1.0,
 24      2.0000000000000004,
 25      4.000000000000001,
 26      8.000000000000002
 27    ],
 28    "rho_ratio_predicted": [
 29      1.0,
 30      2.0,
 31      4.0,
 32      8.0
 33    ],
 34    "stale_error_linear_fit_slope": 0.9219544457292886,
 35    "stale_error_linear_fit_intercept": 2.7755575615628914e-17,
 36    "max_conservation_error": 0.0
 37  },
 38  "rho_sweep": [
 39    {
 40      "rho": 0.0,
 41      "corrected_final_loss": 3.9205502526670415,
 42      "stale_final_loss": 3.9205502526670415,
 43      "corrected_final_residual": 1.0206337574912303,
 44      "stale_final_residual": 1.0206337574912303,
 45      "corrected_loss_40": 3.9205502803976886,
 46      "stale_loss_40": 3.9205502803976886
 47    },
 48    {
 49      "rho": 0.05,
 50      "corrected_final_loss": 6.0424290031749575,
 51      "stale_final_loss": 6.041404061543362,
 52      "corrected_final_residual": 0.015133895607937117,
 53      "stale_final_residual": 0.015536552789812306,
 54      "corrected_loss_40": 5.083437650416722,
 55      "stale_loss_40": 5.0943326942464635
 56    },
 57    {
 58      "rho": 0.1,
 59      "corrected_final_loss": 6.093205857662167,
 60      "stale_final_loss": 6.093139750756857,
 61      "corrected_final_residual": 0.00016398618010693273,
 62      "stale_final_residual": 0.000182878900479688,
 63      "corrected_loss_40": 5.755701384817989,
 64      "stale_loss_40": 5.760598797515422
 65    },
 66    {
 67      "rho": 0.2,
 68      "corrected_final_loss": 6.093749989122748,
 69      "stale_final_loss": 6.093749997447158,
 70      "corrected_final_residual": 3.2284687059763312e-09,
 71      "stale_final_residual": 7.649478976543017e-10,
 72      "corrected_loss_40": 6.103479757304299,
 73      "stale_loss_40": 6.09493254808615
 74    },
 75    {
 76      "rho": 0.4,
 77      "corrected_final_loss": 6.093749973052604,
 78      "stale_final_loss": 6.093749968972797,
 79      "corrected_final_residual": 8.636614203652117e-09,
 80      "stale_final_residual": 9.297245093531612e-09,
 81      "corrected_loss_40": 6.071758202959532,
 82      "stale_loss_40": 6.07665494478726
 83    }
 84  ],
 85  "mini_experiment": {
 86    "tree_correction": {
 87      "final_loss": 6.093749989122748,
 88      "final_residual": 3.2284687059763312e-09,
 89      "bytes": 7680
 90    },
 91    "fedavg": {
 92      "final_loss": 6.09375,
 93      "final_residual": 0.0,
 94      "bytes": 10240
 95    },
 96    "stale_tree_rho_0.2": {
 97      "final_loss": 6.093749997447158,
 98      "final_residual": 7.649478976543017e-10,
 99      "bytes": 7680
100    }
101  },
102  "interpretation": "Checks test algebraic correction conservation and rho scaling; optimization comparison is a small scalar quadratic proxy, not a neural-network benchmark."
103}