My pretrained LMs on FineWeb datasets - part of my TensorFlow Model Garden LMs project
Stefan Schweter PRO
stefan-it
AI & ML interests
Flair Library π, NER & PoS Tagging, LM Pretraining (mostly encoder-only & encoder-decoder), Historical Language Models, German Language Models, Bavarian NLP π₯¨, xLSTM
Recent Activity
upvoted a paper about 3 hours ago
From Data to Device: ELMOD An Efficient German-First 2.7B Language Model for Mobile Inference upvoted a collection about 3 hours ago
ELMOD-2.7b upvoted a paper about 3 hours ago
Kimi K3: Open Frontier IntelligenceOrganizations
βοΈ Fine-Tuned Historical NER Models (hmTEAMS)
Fined-Tuned NER Models on Historical NER Datasets (HIPE-2022) with Flair and hmTEAMS as backbone LM
βοΈ Fine-Tuned Historical NER Models (hmByT5)
Fined-Tuned NER Models on Historical NER Datasets (HIPE-2022) with Flair and hmBERT as backbone LM
-
hmbyt5-preliminary/flair-hipe-2022-ajmc-de
Token Classification β’ Updated -
hmbyt5-preliminary/flair-hipe-2022-ajmc-en
Token Classification β’ Updated β’ 1 -
hmbyt5-preliminary/flair-hipe-2022-ajmc-fr
Token Classification β’ Updated -
hmbyt5-preliminary/flair-hipe-2022-newseye-de
Token Classification β’ Updated β’ 2
βοΈ Fine-Tuned Historical NER Models (hmBERT Tiny)
Fined-Tuned NER Models on Historical NER Datasets (HIPE-2022) with Flair and hmBERT Tiny as backbone LM
-
hmbert-tiny/flair-hipe-2022-ajmc-de
Token Classification β’ Updated β’ 1 -
hmbert-tiny/flair-hipe-2022-ajmc-en
Token Classification β’ Updated β’ 13 -
hmbert-tiny/flair-hipe-2022-ajmc-fr
Token Classification β’ Updated β’ 1 -
hmbert-tiny/flair-hipe-2022-newseye-de
Token Classification β’ Updated β’ 1
πΉπ· Turkish Language Models
My pretrained Language Models for Turkish
π¬πͺ Georgian NER Models
My fine-tuned NER models for Georgian
-
stefan-it/autotrain-flair-georgian-ner-xlm_r_large-bs4-e10-lr5e-06-1
Token Classification β’ Updated β’ 1 β’ 1 -
stefan-it/autotrain-flair-georgian-ner-xlm_r_large-bs4-e10-lr5e-06-2
Token Classification β’ Updated -
stefan-it/autotrain-flair-georgian-ner-xlm_r_large-bs4-e10-lr5e-06-3
Token Classification β’ Updated -
stefan-it/autotrain-flair-georgian-ner-xlm_r_large-bs4-e10-lr5e-06-4
Token Classification β’ Updated
π§Ή Fine-Tuned CleanCoNLL Models
My fine-tuned Flair NER models on CleanCoNLL dataset (with different seeds)
π Historical Multilingual Language Models
A Collection of Historical Multilingual Language Models
-
dbmdz/bert-base-historic-multilingual-cased
Fill-Mask β’ 0.1B β’ Updated β’ 2.27k β’ β’ 8 -
dbmdz/bert-base-historic-multilingual-64k-td-cased
Fill-Mask β’ 0.1B β’ Updated β’ 9 β’ 2 -
hmbyt5-preliminary/byt5-small-historic-multilingual-span20-flax
Updated β’ 6 -
hmteams/teams-base-historic-multilingual-discriminator
0.1B β’ Updated β’ 3
βοΈ Fine-Tuned Historical NER Models (hmBERT)
Fined-Tuned NER Models on Historical NER Datasets (HIPE-2022) with Flair and hmBERT as backbone LM
βοΈ Fine-Tuned Flair Models on German MobIE Dataset
Fine-Tuned Flair Models on German MobIE Dataset using π€ AutoTrain SpaceRunner
-
stefan-it/autotrain-flair-mobie-gbert_base-bs16-e10-lr5e-05-2
Token Classification β’ Updated -
stefan-it/autotrain-flair-mobie-gbert_base-bs16-e10-lr3e-05-3
Token Classification β’ Updated -
stefan-it/autotrain-flair-mobie-gbert_base-bs16-e10-lr5e-05-5
Token Classification β’ Updated -
stefan-it/autotrain-flair-mobie-gbert_base-bs16-e10-lr5e-05-3
Token Classification β’ Updated β’ 4 β’ 1
βοΈ Fine-Tuned Historical NER Models (hmBERT 64k)
Fined-Tuned NER Models on Historical NER Datasets (HIPE-2022) with Flair and hmBERT 64k as backbone LM
π± Microsoft Papers with no code/data release
Collection of Microsoft Papers with no code/data release
-
MEGA: Multilingual Evaluation of Generative AI
Paper β’ 2303.12528 β’ Published -
MEGAVERSE: Benchmarking Large Language Models Across Languages, Modalities, Models and Tasks
Paper β’ 2311.07463 β’ Published β’ 14 -
Kosmos-2.5: A Multimodal Literate Model
Paper β’ 2309.11419 β’ Published β’ 56 -
A Unified View of Masked Image Modeling
Paper β’ 2210.10615 β’ Published β’ 1
πΌ Fine-Tuned CO-Funer Models
My fine-tuned Flair models on CO-FUN NER Dataset
π§ xLSTM Language Models
My trained xLSTM LMs (under development)
π‘ FineWeb-LMs
My pretrained LMs on FineWeb datasets - part of my TensorFlow Model Garden LMs project
π Historical Multilingual Language Models
A Collection of Historical Multilingual Language Models
-
dbmdz/bert-base-historic-multilingual-cased
Fill-Mask β’ 0.1B β’ Updated β’ 2.27k β’ β’ 8 -
dbmdz/bert-base-historic-multilingual-64k-td-cased
Fill-Mask β’ 0.1B β’ Updated β’ 9 β’ 2 -
hmbyt5-preliminary/byt5-small-historic-multilingual-span20-flax
Updated β’ 6 -
hmteams/teams-base-historic-multilingual-discriminator
0.1B β’ Updated β’ 3
βοΈ Fine-Tuned Historical NER Models (hmTEAMS)
Fined-Tuned NER Models on Historical NER Datasets (HIPE-2022) with Flair and hmTEAMS as backbone LM
βοΈ Fine-Tuned Historical NER Models (hmBERT)
Fined-Tuned NER Models on Historical NER Datasets (HIPE-2022) with Flair and hmBERT as backbone LM
βοΈ Fine-Tuned Historical NER Models (hmByT5)
Fined-Tuned NER Models on Historical NER Datasets (HIPE-2022) with Flair and hmBERT as backbone LM
-
hmbyt5-preliminary/flair-hipe-2022-ajmc-de
Token Classification β’ Updated -
hmbyt5-preliminary/flair-hipe-2022-ajmc-en
Token Classification β’ Updated β’ 1 -
hmbyt5-preliminary/flair-hipe-2022-ajmc-fr
Token Classification β’ Updated -
hmbyt5-preliminary/flair-hipe-2022-newseye-de
Token Classification β’ Updated β’ 2
βοΈ Fine-Tuned Flair Models on German MobIE Dataset
Fine-Tuned Flair Models on German MobIE Dataset using π€ AutoTrain SpaceRunner
-
stefan-it/autotrain-flair-mobie-gbert_base-bs16-e10-lr5e-05-2
Token Classification β’ Updated -
stefan-it/autotrain-flair-mobie-gbert_base-bs16-e10-lr3e-05-3
Token Classification β’ Updated -
stefan-it/autotrain-flair-mobie-gbert_base-bs16-e10-lr5e-05-5
Token Classification β’ Updated -
stefan-it/autotrain-flair-mobie-gbert_base-bs16-e10-lr5e-05-3
Token Classification β’ Updated β’ 4 β’ 1
βοΈ Fine-Tuned Historical NER Models (hmBERT Tiny)
Fined-Tuned NER Models on Historical NER Datasets (HIPE-2022) with Flair and hmBERT Tiny as backbone LM
-
hmbert-tiny/flair-hipe-2022-ajmc-de
Token Classification β’ Updated β’ 1 -
hmbert-tiny/flair-hipe-2022-ajmc-en
Token Classification β’ Updated β’ 13 -
hmbert-tiny/flair-hipe-2022-ajmc-fr
Token Classification β’ Updated β’ 1 -
hmbert-tiny/flair-hipe-2022-newseye-de
Token Classification β’ Updated β’ 1
βοΈ Fine-Tuned Historical NER Models (hmBERT 64k)
Fined-Tuned NER Models on Historical NER Datasets (HIPE-2022) with Flair and hmBERT 64k as backbone LM
πΉπ· Turkish Language Models
My pretrained Language Models for Turkish
π± Microsoft Papers with no code/data release
Collection of Microsoft Papers with no code/data release
-
MEGA: Multilingual Evaluation of Generative AI
Paper β’ 2303.12528 β’ Published -
MEGAVERSE: Benchmarking Large Language Models Across Languages, Modalities, Models and Tasks
Paper β’ 2311.07463 β’ Published β’ 14 -
Kosmos-2.5: A Multimodal Literate Model
Paper β’ 2309.11419 β’ Published β’ 56 -
A Unified View of Masked Image Modeling
Paper β’ 2210.10615 β’ Published β’ 1
π¬πͺ Georgian NER Models
My fine-tuned NER models for Georgian
-
stefan-it/autotrain-flair-georgian-ner-xlm_r_large-bs4-e10-lr5e-06-1
Token Classification β’ Updated β’ 1 β’ 1 -
stefan-it/autotrain-flair-georgian-ner-xlm_r_large-bs4-e10-lr5e-06-2
Token Classification β’ Updated -
stefan-it/autotrain-flair-georgian-ner-xlm_r_large-bs4-e10-lr5e-06-3
Token Classification β’ Updated -
stefan-it/autotrain-flair-georgian-ner-xlm_r_large-bs4-e10-lr5e-06-4
Token Classification β’ Updated
πΌ Fine-Tuned CO-Funer Models
My fine-tuned Flair models on CO-FUN NER Dataset
π§Ή Fine-Tuned CleanCoNLL Models
My fine-tuned Flair NER models on CleanCoNLL dataset (with different seeds)
π§ xLSTM Language Models
My trained xLSTM LMs (under development)