Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
🔄
In a Training Loop
Michał Wiliński
MWilinski
1
4
40
Follow
alxtrtw's profile picture
Mi6paulino's profile picture
21world's profile picture
16 followers
·
27 following
https://michal-wilinski.com
inverse_hessian
JanekDev
AI & ML interests
Machine Learning, Reinforcement Learning
Recent Activity
updated
a model
6 days ago
MWilinski/qwen2.5-3b-dpo-hhrlhf
updated
a model
6 days ago
MWilinski/qwen2.5-3b-direct-hhrlhf
updated
a model
6 days ago
MWilinski/qwen2.5-3b-gail
View all activity
Organizations
MWilinski
's activity
All
Models
Datasets
Spaces
Buckets
Papers
Collections
Community
Posts
Upvotes
Likes
Articles
updated
4 models
6 days ago
MWilinski/qwen2.5-3b-dpo-hhrlhf
Updated
7 days ago
MWilinski/qwen2.5-3b-direct-hhrlhf
Updated
8 days ago
MWilinski/qwen2.5-3b-gail
Updated
Mar 27
MWilinski/Llama-3.2-1B-pared-ultrafeedback-deepseek-instruct
Updated
6 days ago
published
a model
6 days ago
MWilinski/Llama-3.2-1B-pared-ultrafeedback-deepseek-instruct
Updated
6 days ago
updated
6 models
7 days ago
MWilinski/gemma-3-4b-dpo-hhrlhf
Updated
7 days ago
MWilinski/gemma-3-4b-pared-ultrafeedback-deepseek-instruct
Updated
7 days ago
MWilinski/qwen2.5-3b-pared-ultrafeedback-deepseek-sft
Updated
7 days ago
MWilinski/qwen2.5-3b-pared-ultrafeedback-deepseek-instruct
Updated
7 days ago
MWilinski/gemma-3-4b-pared-ultrafeedback-deepseek-sft
Updated
7 days ago
MWilinski/gemma-3-4b-direct-hhrlhf
Updated
7 days ago
published
a dataset
7 days ago
MWilinski/ultrafeedback-deepseek-v3.2-irl-scored
Viewer
•
Updated
7 days ago
•
5k
•
34
published
2 models
7 days ago
MWilinski/gemma-3-4b-pared-ultrafeedback-deepseek-sft
Updated
7 days ago
MWilinski/qwen2.5-3b-pared-ultrafeedback-deepseek-sft
Updated
7 days ago
updated
2 models
7 days ago
MWilinski/gemma-3-4b-sft-ultrafeedback-deepseek
Updated
7 days ago
MWilinski/qwen2.5-3b-sft-ultrafeedback-deepseek
Updated
7 days ago
published
4 models
7 days ago
MWilinski/gemma-3-4b-pared-ultrafeedback-deepseek-instruct
Updated
7 days ago
MWilinski/qwen2.5-3b-pared-ultrafeedback-deepseek-instruct
Updated
7 days ago
MWilinski/gemma-3-4b-sft-ultrafeedback-deepseek
Updated
7 days ago
MWilinski/qwen2.5-3b-sft-ultrafeedback-deepseek
Updated
7 days ago
Load more