appvoid commited on
Commit
32c7d02
·
verified ·
1 Parent(s): 95fdb97

Update TensorBoard training metrics

Browse files
benchmark_cache/shard_scheduler.json CHANGED
@@ -22,8 +22,8 @@
22
  "tokens_per_second": 1062967.6168812835,
23
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
24
  "estimated_pages_for_buffer": 1,
25
- "required_token_positions_per_second": 75692.27071928447,
26
- "required_pages_per_second_upper_estimate": 0.006560814185641329
27
  },
28
  {
29
  "source": "rewrite6",
@@ -36,8 +36,8 @@
36
  "tokens_per_second": 1206672.263377472,
37
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
38
  "estimated_pages_for_buffer": 1,
39
- "required_token_positions_per_second": 9461.533839910559,
40
- "required_pages_per_second_upper_estimate": 0.0037743473112775484
41
  },
42
  {
43
  "source": "openmath",
@@ -50,8 +50,8 @@
50
  "tokens_per_second": 410042.7581134458,
51
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
52
  "estimated_pages_for_buffer": 1,
53
- "required_token_positions_per_second": 18923.067679821117,
54
- "required_pages_per_second_upper_estimate": 0.004377518673109995
55
  },
56
  {
57
  "source": "ultra_qa",
@@ -64,8 +64,8 @@
64
  "tokens_per_second": 2163486.5624068812,
65
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
66
  "estimated_pages_for_buffer": 1,
67
- "required_token_positions_per_second": 28384.601519731677,
68
- "required_pages_per_second_upper_estimate": 0.001728473310056822
69
  },
70
  {
71
  "source": "ultra_style",
@@ -78,8 +78,8 @@
78
  "tokens_per_second": 1546694.2737633225,
79
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
80
  "estimated_pages_for_buffer": 1,
81
- "required_token_positions_per_second": 28384.601519731677,
82
- "required_pages_per_second_upper_estimate": 0.0021851251985948858
83
  },
84
  {
85
  "source": "cortex",
@@ -92,8 +92,8 @@
92
  "tokens_per_second": 1015177.8395898147,
93
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
94
  "estimated_pages_for_buffer": 22,
95
- "required_token_positions_per_second": 28384.601519731677,
96
- "required_pages_per_second_upper_estimate": 0.35244175372476844
97
  }
98
  ],
99
  "gpu_measurement": "Selected forward/backward estimate; replaced by live successful update timings.",
@@ -158,33 +158,27 @@
158
  "prefetch_batches": 62,
159
  "prefetch_capacity_limit": 512,
160
  "batch_memory_estimate_bytes": 688946,
161
- "producer_batch_seconds": 0.12610325951567347,
162
- "producer_p95_seconds": 0.42072688299958827,
163
- "gpu_update_seconds": 0.9740492562765193,
164
- "producer_batches_per_second": 7.93000913569335,
165
- "gpu_batches_per_second": 1.026642126726406,
166
- "producer_headroom": 7.724219500888111,
167
  "sustainable": true,
168
- "buffer_seconds": 60.391053889144196,
169
  "buffer_drain_seconds": null,
170
  "shard_target_mib": 16,
171
- "upload_pages_per_commit": 84,
172
  "max_pending_pages": 4096,
173
- "generation_bytes_per_second": 455207.49298486306,
174
- "upload_bytes_per_second": 5054314.976417552,
175
  "upload_sustainable": true,
176
  "logical_page_rows": 4096,
177
  "logical_cortex_page_rows": 128,
178
- "estimated_full_shards_per_hour": 97.67693130645198,
179
  "selection_policy": "Smallest shard within 90% of measured local peak, enlarged to amortize 30 seconds of measured page production; bounded to 256 MiB."
180
  },
181
  "upload_measurements": [
182
- {
183
- "seconds": 1.9086563699966064,
184
- "bytes": 7678172,
185
- "pages": 33,
186
- "shards": 3
187
- },
188
  {
189
  "seconds": 1.1078665649984032,
190
  "bytes": 9761910,
@@ -562,6 +556,12 @@
562
  "bytes": 5440269,
563
  "pages": 33,
564
  "shards": 2
 
 
 
 
 
 
565
  }
566
  ],
567
  "cache_key": {
 
22
  "tokens_per_second": 1062967.6168812835,
23
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
24
  "estimated_pages_for_buffer": 1,
25
+ "required_token_positions_per_second": 75690.40128822743,
26
+ "required_pages_per_second_upper_estimate": 0.006560652148095334
27
  },
28
  {
29
  "source": "rewrite6",
 
36
  "tokens_per_second": 1206672.263377472,
37
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
38
  "estimated_pages_for_buffer": 1,
39
+ "required_token_positions_per_second": 9461.300161028428,
40
+ "required_pages_per_second_upper_estimate": 0.003774254093277656
41
  },
42
  {
43
  "source": "openmath",
 
50
  "tokens_per_second": 410042.7581134458,
51
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
52
  "estimated_pages_for_buffer": 1,
53
+ "required_token_positions_per_second": 18922.600322056856,
54
+ "required_pages_per_second_upper_estimate": 0.004377410558116449
55
  },
56
  {
57
  "source": "ultra_qa",
 
64
  "tokens_per_second": 2163486.5624068812,
65
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
66
  "estimated_pages_for_buffer": 1,
67
+ "required_token_positions_per_second": 28383.900483085286,
68
+ "required_pages_per_second_upper_estimate": 0.0017284306206031119
69
  },
70
  {
71
  "source": "ultra_style",
 
78
  "tokens_per_second": 1546694.2737633225,
79
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
80
  "estimated_pages_for_buffer": 1,
81
+ "required_token_positions_per_second": 28383.900483085286,
82
+ "required_pages_per_second_upper_estimate": 0.002185071230853253
83
  },
84
  {
85
  "source": "cortex",
 
92
  "tokens_per_second": 1015177.8395898147,
93
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
94
  "estimated_pages_for_buffer": 22,
95
+ "required_token_positions_per_second": 28383.900483085286,
96
+ "required_pages_per_second_upper_estimate": 0.352433049195839
97
  }
98
  ],
99
  "gpu_measurement": "Selected forward/backward estimate; replaced by live successful update timings.",
 
158
  "prefetch_batches": 62,
159
  "prefetch_capacity_limit": 512,
160
  "batch_memory_estimate_bytes": 688946,
161
+ "producer_batch_seconds": 0.135052527679818,
162
+ "producer_p95_seconds": 0.4274683130061021,
163
+ "gpu_update_seconds": 0.9740733137250172,
164
+ "producer_batches_per_second": 7.404526351189783,
165
+ "gpu_batches_per_second": 1.026616770944925,
166
+ "producer_headroom": 7.212551519467642,
167
  "sustainable": true,
168
+ "buffer_seconds": 60.39254545095106,
169
  "buffer_drain_seconds": null,
170
  "shard_target_mib": 16,
171
+ "upload_pages_per_commit": 83,
172
  "max_pending_pages": 4096,
173
+ "generation_bytes_per_second": 455548.3253677066,
174
+ "upload_bytes_per_second": 5081509.076277593,
175
  "upload_sustainable": true,
176
  "logical_page_rows": 4096,
177
  "logical_cortex_page_rows": 128,
178
+ "estimated_full_shards_per_hour": 97.7500660016384,
179
  "selection_policy": "Smallest shard within 90% of measured local peak, enlarged to amortize 30 seconds of measured page production; bounded to 256 MiB."
180
  },
181
  "upload_measurements": [
 
 
 
 
 
 
182
  {
183
  "seconds": 1.1078665649984032,
184
  "bytes": 9761910,
 
556
  "bytes": 5440269,
557
  "pages": 33,
558
  "shards": 2
559
+ },
560
+ {
561
+ "seconds": 1.1098419440022553,
562
+ "bytes": 5868008,
563
+ "pages": 28,
564
+ "shards": 2
565
  }
566
  ],
567
  "cache_key": {
metrics/void-byte-v1/1790390190216476996-4d8dc439/train.jsonl CHANGED
@@ -422,3 +422,4 @@
422
  {"step": 42200, "loss": 0.6159834675490856, "lr": 0.0003, "grad_norm": 0.12582849847270944, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6175109717, "tokens_per_second": 147744.1308115539, "data_wait_s": 1.2521995813585818e-05, "gpu_peak_gb": 85.43514251708984}
423
  {"step": 42300, "loss": 0.637635163962841, "lr": 0.0003, "grad_norm": 0.12041313327317661, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6189763884, "tokens_per_second": 149208.78923071647, "data_wait_s": 1.2611999409273267e-05, "gpu_peak_gb": 85.43514251708984}
424
  {"step": 42400, "loss": 0.6545305550098419, "lr": 0.0003, "grad_norm": 0.13580467009364228, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6204361023, "tokens_per_second": 148229.16309410866, "data_wait_s": 9.611998393666e-06, "gpu_peak_gb": 85.43514251708984}
 
 
422
  {"step": 42200, "loss": 0.6159834675490856, "lr": 0.0003, "grad_norm": 0.12582849847270944, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6175109717, "tokens_per_second": 147744.1308115539, "data_wait_s": 1.2521995813585818e-05, "gpu_peak_gb": 85.43514251708984}
423
  {"step": 42300, "loss": 0.637635163962841, "lr": 0.0003, "grad_norm": 0.12041313327317661, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6189763884, "tokens_per_second": 149208.78923071647, "data_wait_s": 1.2611999409273267e-05, "gpu_peak_gb": 85.43514251708984}
424
  {"step": 42400, "loss": 0.6545305550098419, "lr": 0.0003, "grad_norm": 0.13580467009364228, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6204361023, "tokens_per_second": 148229.16309410866, "data_wait_s": 9.611998393666e-06, "gpu_peak_gb": 85.43514251708984}
425
+ {"step": 42500, "loss": 0.656319335103035, "lr": 0.0003, "grad_norm": 0.12998391651455932, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 6218832513, "tokens_per_second": 146968.63280764062, "data_wait_s": 8.816998160909861e-06, "gpu_peak_gb": 85.43514251708984}
runs/void-byte-v1/events.out.tfevents.1790390190.c8125a87-1345-4bfd-b42f-0e32ed8b7bb7-6w295.451.0.1790390190216476996-4d8dc439 CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:a92e9c96bd6b1b273b2227c7b9a0a29ccc78c5f9f90fb829a09a24a2c0362ab4
3
- size 898687
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:6f26803759d1ca0c8068f662c3bd59a3a54c4faa1b3f3c5e5540ed461338f4d5
3
+ size 900805