appvoid commited on
Commit
e5f1698
·
verified ·
1 Parent(s): 32c7d02

Update TensorBoard training metrics

Browse files
benchmark_cache/shard_scheduler.json CHANGED
@@ -22,8 +22,8 @@
22
  "tokens_per_second": 1062967.6168812835,
23
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
24
  "estimated_pages_for_buffer": 1,
25
- "required_token_positions_per_second": 75690.40128822743,
26
- "required_pages_per_second_upper_estimate": 0.006560652148095334
27
  },
28
  {
29
  "source": "rewrite6",
@@ -36,8 +36,8 @@
36
  "tokens_per_second": 1206672.263377472,
37
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
38
  "estimated_pages_for_buffer": 1,
39
- "required_token_positions_per_second": 9461.300161028428,
40
- "required_pages_per_second_upper_estimate": 0.003774254093277656
41
  },
42
  {
43
  "source": "openmath",
@@ -50,8 +50,8 @@
50
  "tokens_per_second": 410042.7581134458,
51
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
52
  "estimated_pages_for_buffer": 1,
53
- "required_token_positions_per_second": 18922.600322056856,
54
- "required_pages_per_second_upper_estimate": 0.004377410558116449
55
  },
56
  {
57
  "source": "ultra_qa",
@@ -64,8 +64,8 @@
64
  "tokens_per_second": 2163486.5624068812,
65
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
66
  "estimated_pages_for_buffer": 1,
67
- "required_token_positions_per_second": 28383.900483085286,
68
- "required_pages_per_second_upper_estimate": 0.0017284306206031119
69
  },
70
  {
71
  "source": "ultra_style",
@@ -78,8 +78,8 @@
78
  "tokens_per_second": 1546694.2737633225,
79
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
80
  "estimated_pages_for_buffer": 1,
81
- "required_token_positions_per_second": 28383.900483085286,
82
- "required_pages_per_second_upper_estimate": 0.002185071230853253
83
  },
84
  {
85
  "source": "cortex",
@@ -92,8 +92,8 @@
92
  "tokens_per_second": 1015177.8395898147,
93
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
94
  "estimated_pages_for_buffer": 22,
95
- "required_token_positions_per_second": 28383.900483085286,
96
- "required_pages_per_second_upper_estimate": 0.352433049195839
97
  }
98
  ],
99
  "gpu_measurement": "Selected forward/backward estimate; replaced by live successful update timings.",
@@ -158,33 +158,27 @@
158
  "prefetch_batches": 62,
159
  "prefetch_capacity_limit": 512,
160
  "batch_memory_estimate_bytes": 688946,
161
- "producer_batch_seconds": 0.135052527679818,
162
- "producer_p95_seconds": 0.4274683130061021,
163
- "gpu_update_seconds": 0.9740733137250172,
164
- "producer_batches_per_second": 7.404526351189783,
165
- "gpu_batches_per_second": 1.026616770944925,
166
- "producer_headroom": 7.212551519467642,
167
  "sustainable": true,
168
- "buffer_seconds": 60.39254545095106,
169
  "buffer_drain_seconds": null,
170
  "shard_target_mib": 16,
171
  "upload_pages_per_commit": 83,
172
  "max_pending_pages": 4096,
173
- "generation_bytes_per_second": 455548.3253677066,
174
- "upload_bytes_per_second": 5081509.076277593,
175
  "upload_sustainable": true,
176
  "logical_page_rows": 4096,
177
  "logical_cortex_page_rows": 128,
178
- "estimated_full_shards_per_hour": 97.7500660016384,
179
  "selection_policy": "Smallest shard within 90% of measured local peak, enlarged to amortize 30 seconds of measured page production; bounded to 256 MiB."
180
  },
181
  "upload_measurements": [
182
- {
183
- "seconds": 1.1078665649984032,
184
- "bytes": 9761910,
185
- "pages": 33,
186
- "shards": 3
187
- },
188
  {
189
  "seconds": 0.90664235100121,
190
  "bytes": 2695308,
@@ -562,6 +556,12 @@
562
  "bytes": 5868008,
563
  "pages": 28,
564
  "shards": 2
 
 
 
 
 
 
565
  }
566
  ],
567
  "cache_key": {
 
22
  "tokens_per_second": 1062967.6168812835,
23
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
24
  "estimated_pages_for_buffer": 1,
25
+ "required_token_positions_per_second": 75162.62603138451,
26
+ "required_pages_per_second_upper_estimate": 0.0065149059264663495
27
  },
28
  {
29
  "source": "rewrite6",
 
36
  "tokens_per_second": 1206672.263377472,
37
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
38
  "estimated_pages_for_buffer": 1,
39
+ "required_token_positions_per_second": 9395.328253923064,
40
+ "required_pages_per_second_upper_estimate": 0.0037479369131654156
41
  },
42
  {
43
  "source": "openmath",
 
50
  "tokens_per_second": 410042.7581134458,
51
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
52
  "estimated_pages_for_buffer": 1,
53
+ "required_token_positions_per_second": 18790.656507846128,
54
+ "required_pages_per_second_upper_estimate": 0.0043468876788306165
55
  },
56
  {
57
  "source": "ultra_qa",
 
64
  "tokens_per_second": 2163486.5624068812,
65
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
66
  "estimated_pages_for_buffer": 1,
67
+ "required_token_positions_per_second": 28185.984761769192,
68
+ "required_pages_per_second_upper_estimate": 0.001716378591558501
69
  },
70
  {
71
  "source": "ultra_style",
 
78
  "tokens_per_second": 1546694.2737633225,
79
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
80
  "estimated_pages_for_buffer": 1,
81
+ "required_token_positions_per_second": 28185.984761769192,
82
+ "required_pages_per_second_upper_estimate": 0.0021698351307605584
83
  },
84
  {
85
  "source": "cortex",
 
92
  "tokens_per_second": 1015177.8395898147,
93
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
94
  "estimated_pages_for_buffer": 22,
95
+ "required_token_positions_per_second": 28185.984761769192,
96
+ "required_pages_per_second_upper_estimate": 0.34997559831840264
97
  }
98
  ],
99
  "gpu_measurement": "Selected forward/backward estimate; replaced by live successful update timings.",
 
158
  "prefetch_batches": 62,
159
  "prefetch_capacity_limit": 512,
160
  "batch_memory_estimate_bytes": 688946,
161
+ "producer_batch_seconds": 0.1280048998668235,
162
+ "producer_p95_seconds": 0.4314359210038674,
163
+ "gpu_update_seconds": 0.9809130400688039,
164
+ "producer_batches_per_second": 7.812200947310623,
165
+ "gpu_batches_per_second": 1.0194583608857493,
166
+ "producer_headroom": 7.663089780854852,
167
  "sustainable": true,
168
+ "buffer_seconds": 60.81660848426584,
169
  "buffer_drain_seconds": null,
170
  "shard_target_mib": 16,
171
  "upload_pages_per_commit": 83,
172
  "max_pending_pages": 4096,
173
+ "generation_bytes_per_second": 456524.683563734,
174
+ "upload_bytes_per_second": 5056368.789854124,
175
  "upload_sustainable": true,
176
  "logical_page_rows": 4096,
177
  "logical_cortex_page_rows": 128,
178
+ "estimated_full_shards_per_hour": 97.95956974205032,
179
  "selection_policy": "Smallest shard within 90% of measured local peak, enlarged to amortize 30 seconds of measured page production; bounded to 256 MiB."
180
  },
181
  "upload_measurements": [
 
 
 
 
 
 
182
  {
183
  "seconds": 0.90664235100121,
184
  "bytes": 2695308,
 
556
  "bytes": 5868008,
557
  "pages": 28,
558
  "shards": 2
559
+ },
560
+ {
561
+ "seconds": 1.1827127520009526,
562
+ "bytes": 8081279,
563
+ "pages": 39,
564
+ "shards": 3
565
  }
566
  ],
567
  "cache_key": {
metrics/void-byte-v1/1790390190216476996-4d8dc439/train.jsonl CHANGED
@@ -423,3 +423,4 @@
423
  {"step": 42300, "loss": 0.637635163962841, "lr": 0.0003, "grad_norm": 0.12041313327317661, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6189763884, "tokens_per_second": 149208.78923071647, "data_wait_s": 1.2611999409273267e-05, "gpu_peak_gb": 85.43514251708984}
424
  {"step": 42400, "loss": 0.6545305550098419, "lr": 0.0003, "grad_norm": 0.13580467009364228, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6204361023, "tokens_per_second": 148229.16309410866, "data_wait_s": 9.611998393666e-06, "gpu_peak_gb": 85.43514251708984}
425
  {"step": 42500, "loss": 0.656319335103035, "lr": 0.0003, "grad_norm": 0.12998391651455932, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6218832513, "tokens_per_second": 146968.63280764062, "data_wait_s": 8.816998160909861e-06, "gpu_peak_gb": 85.43514251708984}
 
 
423
  {"step": 42300, "loss": 0.637635163962841, "lr": 0.0003, "grad_norm": 0.12041313327317661, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6189763884, "tokens_per_second": 149208.78923071647, "data_wait_s": 1.2611999409273267e-05, "gpu_peak_gb": 85.43514251708984}
424
  {"step": 42400, "loss": 0.6545305550098419, "lr": 0.0003, "grad_norm": 0.13580467009364228, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6204361023, "tokens_per_second": 148229.16309410866, "data_wait_s": 9.611998393666e-06, "gpu_peak_gb": 85.43514251708984}
425
  {"step": 42500, "loss": 0.656319335103035, "lr": 0.0003, "grad_norm": 0.12998391651455932, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6218832513, "tokens_per_second": 146968.63280764062, "data_wait_s": 8.816998160909861e-06, "gpu_peak_gb": 85.43514251708984}
426
+ {"step": 42600, "loss": 0.8620640188455582, "lr": 0.0003, "grad_norm": 0.18959466881201842, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6233543216, "tokens_per_second": 149109.715148061, "data_wait_s": 9.228002454619855e-06, "gpu_peak_gb": 85.43514251708984}
runs/void-byte-v1/events.out.tfevents.1790390190.c8125a87-1345-4bfd-b42f-0e32ed8b7bb7-6w295.451.0.1790390190216476996-4d8dc439 CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:6f26803759d1ca0c8068f662c3bd59a3a54c4faa1b3f3c5e5540ed461338f4d5
3
- size 900805
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d39d178bed1c01cc0f3d6dac5ea9bdbc4af4a7baefcadaa994237ba99fe3b86c
3
+ size 902923