appvoid commited on
Commit
65e9045
·
verified ·
1 Parent(s): 3832e37

Update TensorBoard training metrics

Browse files
benchmark_cache/shard_scheduler.json CHANGED
@@ -22,8 +22,8 @@
22
  "tokens_per_second": 1062967.6168812835,
23
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
24
  "estimated_pages_for_buffer": 1,
25
- "required_token_positions_per_second": 76228.00974719698,
26
- "required_pages_per_second_upper_estimate": 0.006607250686762633
27
  },
28
  {
29
  "source": "rewrite6",
@@ -36,8 +36,8 @@
36
  "tokens_per_second": 1206672.263377472,
37
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
38
  "estimated_pages_for_buffer": 1,
39
- "required_token_positions_per_second": 9528.501218399622,
40
- "required_pages_per_second_upper_estimate": 0.00380106159980837
41
  },
42
  {
43
  "source": "openmath",
@@ -50,8 +50,8 @@
50
  "tokens_per_second": 410042.7581134458,
51
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
52
  "estimated_pages_for_buffer": 1,
53
- "required_token_positions_per_second": 19057.002436799245,
54
- "required_pages_per_second_upper_estimate": 0.004408502121965669
55
  },
56
  {
57
  "source": "ultra_qa",
@@ -64,8 +64,8 @@
64
  "tokens_per_second": 2163486.5624068812,
65
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
66
  "estimated_pages_for_buffer": 1,
67
- "required_token_positions_per_second": 28585.503655198867,
68
- "required_pages_per_second_upper_estimate": 0.0017407071960547304
69
  },
70
  {
71
  "source": "ultra_style",
@@ -78,8 +78,8 @@
78
  "tokens_per_second": 1546694.2737633225,
79
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
80
  "estimated_pages_for_buffer": 1,
81
- "required_token_positions_per_second": 28585.503655198867,
82
- "required_pages_per_second_upper_estimate": 0.002200591201115855
83
  },
84
  {
85
  "source": "cortex",
@@ -92,8 +92,8 @@
92
  "tokens_per_second": 1015177.8395898147,
93
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
94
  "estimated_pages_for_buffer": 22,
95
- "required_token_positions_per_second": 28585.503655198867,
96
- "required_pages_per_second_upper_estimate": 0.35493628587107623
97
  }
98
  ],
99
  "gpu_measurement": "Selected forward/backward estimate; replaced by live successful update timings.",
@@ -155,42 +155,30 @@
155
  "shard_benchmark_scope": "Local packing/read measurements; upload capacity measured only on real data commits. Targets larger than available pages are sample-limited.",
156
  "estimated_fresh_generation_batch_seconds": 0.1434574083060457,
157
  "selected": {
158
- "prefetch_batches": 63,
159
  "prefetch_capacity_limit": 512,
160
  "batch_memory_estimate_bytes": 690670,
161
- "producer_batch_seconds": 0.11422511410142988,
162
- "producer_p95_seconds": 0.3618045629991684,
163
- "gpu_update_seconds": 0.9672035285259575,
164
- "producer_batches_per_second": 8.754642163123757,
165
- "gpu_batches_per_second": 1.033908552343709,
166
- "producer_headroom": 8.467520791155419,
167
  "sustainable": true,
168
- "buffer_seconds": 60.93382229713532,
169
  "buffer_drain_seconds": null,
170
  "shard_target_mib": 16,
171
- "upload_pages_per_commit": 85,
172
  "max_pending_pages": 4096,
173
- "generation_bytes_per_second": 354783.7727048669,
174
- "upload_bytes_per_second": 5691532.768220302,
175
  "upload_sustainable": true,
176
  "logical_page_rows": 4096,
177
  "logical_cortex_page_rows": 128,
178
- "estimated_full_shards_per_hour": 76.12833867892746,
179
  "selection_policy": "Smallest shard within 90% of measured local peak, enlarged to amortize 30 seconds of measured page production; bounded to 256 MiB."
180
  },
181
  "upload_measurements": [
182
- {
183
- "seconds": 1.11581381400174,
184
- "bytes": 5950902,
185
- "pages": 37,
186
- "shards": 2
187
- },
188
- {
189
- "seconds": 0.9459429260023171,
190
- "bytes": 2335478,
191
- "pages": 29,
192
- "shards": 2
193
- },
194
  {
195
  "seconds": 1.2669872590049636,
196
  "bytes": 5719604,
@@ -562,6 +550,18 @@
562
  "bytes": 1021880,
563
  "pages": 32,
564
  "shards": 1
 
 
 
 
 
 
 
 
 
 
 
 
565
  }
566
  ],
567
  "cache_key": {
 
22
  "tokens_per_second": 1062967.6168812835,
23
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
24
  "estimated_pages_for_buffer": 1,
25
+ "required_token_positions_per_second": 74976.1524460553,
26
+ "required_pages_per_second_upper_estimate": 0.006498742868702995
27
  },
28
  {
29
  "source": "rewrite6",
 
36
  "tokens_per_second": 1206672.263377472,
37
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
38
  "estimated_pages_for_buffer": 1,
39
+ "required_token_positions_per_second": 9372.019055756913,
40
+ "required_pages_per_second_upper_estimate": 0.003738638525513369
41
  },
42
  {
43
  "source": "openmath",
 
50
  "tokens_per_second": 410042.7581134458,
51
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
52
  "estimated_pages_for_buffer": 1,
53
+ "required_token_positions_per_second": 18744.038111513826,
54
+ "required_pages_per_second_upper_estimate": 0.004336103333294892
55
  },
56
  {
57
  "source": "ultra_qa",
 
64
  "tokens_per_second": 2163486.5624068812,
65
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
66
  "estimated_pages_for_buffer": 1,
67
+ "required_token_positions_per_second": 28116.057167270737,
68
+ "required_pages_per_second_upper_estimate": 0.0017121203679352792
69
  },
70
  {
71
  "source": "ultra_style",
 
78
  "tokens_per_second": 1546694.2737633225,
79
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
80
  "estimated_pages_for_buffer": 1,
81
+ "required_token_positions_per_second": 28116.057167270737,
82
+ "required_pages_per_second_upper_estimate": 0.0021644519109640967
83
  },
84
  {
85
  "source": "cortex",
 
92
  "tokens_per_second": 1015177.8395898147,
93
  "note": "Bounded fresh sample; full-page latency is an extrapolation.",
94
  "estimated_pages_for_buffer": 22,
95
+ "required_token_positions_per_second": 28116.057167270737,
96
+ "required_pages_per_second_upper_estimate": 0.3491073316273357
97
  }
98
  ],
99
  "gpu_measurement": "Selected forward/backward estimate; replaced by live successful update timings.",
 
155
  "shard_benchmark_scope": "Local packing/read measurements; upload capacity measured only on real data commits. Targets larger than available pages are sample-limited.",
156
  "estimated_fresh_generation_batch_seconds": 0.1434574083060457,
157
  "selected": {
158
+ "prefetch_batches": 62,
159
  "prefetch_capacity_limit": 512,
160
  "batch_memory_estimate_bytes": 690670,
161
+ "producer_batch_seconds": 0.1403276078744966,
162
+ "producer_p95_seconds": 0.40225555100187194,
163
+ "gpu_update_seconds": 0.9833526740792236,
164
+ "producer_batches_per_second": 7.126181477377994,
165
+ "gpu_batches_per_second": 1.01692915101529,
166
+ "producer_headroom": 7.007549611753482,
167
  "sustainable": true,
168
+ "buffer_seconds": 60.96786579291186,
169
  "buffer_drain_seconds": null,
170
  "shard_target_mib": 16,
171
+ "upload_pages_per_commit": 87,
172
  "max_pending_pages": 4096,
173
+ "generation_bytes_per_second": 382884.7909341969,
174
+ "upload_bytes_per_second": 5690769.518835166,
175
  "upload_sustainable": true,
176
  "logical_page_rows": 4096,
177
  "logical_cortex_page_rows": 128,
178
+ "estimated_full_shards_per_hour": 82.15816303271704,
179
  "selection_policy": "Smallest shard within 90% of measured local peak, enlarged to amortize 30 seconds of measured page production; bounded to 256 MiB."
180
  },
181
  "upload_measurements": [
 
 
 
 
 
 
 
 
 
 
 
 
182
  {
183
  "seconds": 1.2669872590049636,
184
  "bytes": 5719604,
 
550
  "bytes": 1021880,
551
  "pages": 32,
552
  "shards": 1
553
+ },
554
+ {
555
+ "seconds": 1.0568422009964706,
556
+ "bytes": 6256138,
557
+ "pages": 38,
558
+ "shards": 2
559
+ },
560
+ {
561
+ "seconds": 0.9614676109995344,
562
+ "bytes": 1727275,
563
+ "pages": 10,
564
+ "shards": 2
565
  }
566
  ],
567
  "cache_key": {
metrics/void-byte-v1/1790703713325746110-adad6d18/train.jsonl CHANGED
@@ -346,3 +346,4 @@
346
  {"step": 314800, "loss": 0.662660850211978, "lr": 0.0003, "grad_norm": 0.15615778817110823, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 46078226255, "tokens_per_second": 150534.09911022458, "data_wait_s": 1.2757998774759471e-05, "gpu_peak_gb": 85.46991729736328}
347
  {"step": 314900, "loss": 0.5819839462637901, "lr": 0.0003, "grad_norm": 0.13615964844314887, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 46092755066, "tokens_per_second": 149192.2055798279, "data_wait_s": 9.184994269162416e-06, "gpu_peak_gb": 85.46991729736328}
348
  {"step": 315000, "loss": 0.5823196284472942, "lr": 0.0003, "grad_norm": 0.1495047343906294, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 46107274235, "tokens_per_second": 148961.74686176443, "data_wait_s": 1.3094999303575605e-05, "gpu_peak_gb": 85.46991729736328}
 
 
346
  {"step": 314800, "loss": 0.662660850211978, "lr": 0.0003, "grad_norm": 0.15615778817110823, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 46078226255, "tokens_per_second": 150534.09911022458, "data_wait_s": 1.2757998774759471e-05, "gpu_peak_gb": 85.46991729736328}
347
  {"step": 314900, "loss": 0.5819839462637901, "lr": 0.0003, "grad_norm": 0.13615964844314887, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 46092755066, "tokens_per_second": 149192.2055798279, "data_wait_s": 9.184994269162416e-06, "gpu_peak_gb": 85.46991729736328}
348
  {"step": 315000, "loss": 0.5823196284472942, "lr": 0.0003, "grad_norm": 0.1495047343906294, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 46107274235, "tokens_per_second": 148961.74686176443, "data_wait_s": 1.3094999303575605e-05, "gpu_peak_gb": 85.46991729736328}
349
+ {"step": 315100, "loss": 0.5647122040390968, "lr": 0.0003, "grad_norm": 0.17350227340445543, "recovery_retries": 0, "loss_scale": 1.0, "microbatch": 86, "input_bytes_and_specials": 46121906842, "tokens_per_second": 133042.40348086104, "data_wait_s": 9.980998584069312e-06, "gpu_peak_gb": 85.46991729736328}
runs/void-byte-v1/events.out.tfevents.1790703713.3e6d470a-8cc7-4d7e-a224-51a0f9a2ce55-85btc.38629.0.1790703713325746110-adad6d18 CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:d9b00604a9dca494178d2f26dee5b472ba4370647550d72e553ca4c030de49f0
3
- size 742710
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:06279147bbb384f30bf7548c91b76bd07b1c13d19793879501714aff2bc60a85
3
+ size 744828