Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
🤝
Open to Collab
5.2
TFLOPS
Kenneth C. Enevoldsen
KennethEnevoldsen
449
26
67
Follow
iskold's profile picture
AtheerSami's profile picture
alekswael's profile picture
75 followers
·
28 following
KennethEnevoldsen
kennethenevoldsen
kennethenevoldsen
AI & ML interests
NLP, multimodal learning, low resource NLP, Medical NLP, Cognitive Science
Recent Activity
new
activity
1 day ago
danish-foundation-models/swedish-dynaword:
Add smaller specialty corpora (akademiliv, dagens-arena, sv-covid-19, etc.) (~180M tokens)
new
activity
1 day ago
danish-foundation-models/swedish-dynaword:
Add `standsriksdagen-*` corpora (pre-1866 Swedish parliamentary records) (~300M tokens)
new
activity
1 day ago
danish-foundation-models/swedish-dynaword:
Add `fsv-*` Old Swedish corpora from Fornsvenska textbanken (~5M tokens)
View all activity
Organizations
KennethEnevoldsen
's activity
All
Models
Datasets
Spaces
Buckets
Papers
Collections
Community
Posts
Upvotes
Likes
Articles
New activity in
danish-foundation-models/swedish-dynaword
1 day ago
Add smaller specialty corpora (akademiliv, dagens-arena, sv-covid-19, etc.) (~180M tokens)
2
#46 opened 6 days ago by
KennethEnevoldsen
Add `standsriksdagen-*` corpora (pre-1866 Swedish parliamentary records) (~300M tokens)
2
#39 opened 6 days ago by
KennethEnevoldsen
Add `fsv-*` Old Swedish corpora from Fornsvenska textbanken (~5M tokens)
2
#41 opened 6 days ago by
KennethEnevoldsen
Add `laakartidningen-*` corpora from Läkartidningen medical journal (1996–2006) (~22M tokens)
2
#33 opened 6 days ago by
KennethEnevoldsen
Add `europarl-sv` — Swedish European Parliament proceedings (~33M tokens)
2
#36 opened 6 days ago by
KennethEnevoldsen
Add remaining 5 `flashback-*` subsets from Flashback forum (~3B tokens)
2
#29 opened 6 days ago by
KennethEnevoldsen
Add remaining 11 `familjeliv-*` subsets from Familjeliv forum (~500M tokens)
1
#28 opened 6 days ago by
KennethEnevoldsen
Token length figure has gotten too big
#59 opened 1 day ago by
KennethEnevoldsen
Add 36 corpora from Språkbanken Text
1
#58 opened 1 day ago by
KennethEnevoldsen
Add mosel datasets
#57 opened 1 day ago by
KennethEnevoldsen
New activity in
danish-foundation-models/norwegian-dynaword
1 day ago
Add mosel datasets
#27 opened 1 day ago by
KennethEnevoldsen
New activity in
danish-foundation-models/danish-dynaword
1 day ago
Add MOSEL datasets
#128 opened 1 day ago by
KennethEnevoldsen
New activity in
danish-foundation-models/icelandic-dynaword
3 days ago
Potential datasets
#35 opened 3 days ago by
KennethEnevoldsen
I would consider splitting igc-social-forums
#34 opened 3 days ago by
KennethEnevoldsen
Add IGC-Law (~61M tokens)
1
#3 opened 3 months ago by
V4ldeLund
create.py reproducibility concern
3
#31 opened 3 days ago by
KennethEnevoldsen
Describe the source
#33 opened 3 days ago by
KennethEnevoldsen
Size of short description
#32 opened 3 days ago by
KennethEnevoldsen
New activity in
danish-foundation-models/swedish-dynaword
4 days ago
Added 5 remaining flashback-* subsets from the Flashback internet forum
2
#50 opened 5 days ago by
KennethEnevoldsen
Added 11 remaining familjeliv-* subsets from the Familjeliv internet forum
2
#49 opened 5 days ago by
KennethEnevoldsen
Load more