Control Pretraining
Nemotron 3 Nano 30B-A3B data-filtering study: unfiltered, broad and narrow filtered arms, knowledge reintroduction; every checkpoint a revision.
Viewer • Updated • 16.5M • 44Note Our filtered datasets and complete data splits from LessWrong++ and ML arXiv
geodesic-research/subversionqa-v1
Viewer • Updated • 900 • 25Note MCQA benchmark for measuring subversion-relevant knowledge
geodesic-research/synth-ml-qa
Viewer • Updated • 18.6k • 285Note MCQA benchmark for measuring general ML knowledge
geodesic-research/control-pretraining-datasets
Updated • 820Note Pretraining and midtraining datasets, including filtered data.
geodesic-research/control-pretraining-30b-baseline-base
32B • Updated • 43Note Unfiltered Model: Base model after midtraining. Has subversion knowledge.
geodesic-research/control-pretraining-30b-filtered-mini-2plus-base
32B • Updated • 55Note Broadly Filtered Model: Base model after midtraining. Has reduced subversion knowledge.
geodesic-research/control-pretraining-30b-filtered-gpt55-4plus-v2-base
32B • Updated • 51Note Narrowly Filtered arm V2, base model: broadly filtered pretraining, midtraining cut by a canary string or a GPT-5.5 judge score >= 4, every escalated document judged.
geodesic-research/control-pretraining-30b-filtered-gpt55-4plus-v2-trustedmonitor-base
32B • Updated • 14Note The Narrowly Filtered model with continual pretrainign on a data mix containing filtered documents.