inclusionAI
Team
community
AI & ML interests
None defined yet.
Recent Activity
View all activity
Papers
Open-AoE: An Open Egocentric Manipulation Dataset and Toolchain for Embodied Learning
SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning
Team members 82 private
Ring
-
robbyant/lingbot-world-base-cam
Image-to-Video ⢠Updated ⢠340 -
robbyant/lingbot-world-base-act-preview
Image-to-Video ⢠Updated ⢠21 -
robbyant/lingbot-world-fast
Image-to-Video ⢠19B ⢠Updated ⢠26.4k ⢠21 -
robbyant/lingbot-world-fast-diffusers
Image-to-Video ⢠19B ⢠Updated ⢠2.69k ⢠7
The newest flagship non-reasoning model series.
Ming is the multi-modal series of any-to-any models developed by Ant Ling team.
-
inclusionAI/Ming-flash-omni-2.0
Any-to-Any ⢠104B ⢠Updated ⢠2.58k ⢠266 -
inclusionAI/Ming-omni-tts-16.8B-A3B
Text-to-Speech ⢠18B ⢠Updated ⢠1.25k ⢠54 -
inclusionAI/Ming-omni-tts-0.5B
Text-to-Speech ⢠2B ⢠Updated ⢠7.91k ⢠36 -
inclusionAI/Ming-omni-tts-tokenizer-12Hz
Audio-to-Audio ⢠0.8B ⢠Updated ⢠26 ⢠10
-
Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception
Paper ⢠2602.11858 ⢠Published ⢠61 -
inclusionAI/ZwZ-4B
Image-Text-to-Text ⢠5B ⢠Updated ⢠96 ⢠31 -
inclusionAI/ZwZ-8B
Image-Text-to-Text ⢠9B ⢠Updated ⢠225 ⢠46 -
inclusionAI/ZwZ-RL-VQA
Viewer ⢠Updated ⢠111k ⢠1.28k ⢠15
-
inclusionAI/Ling-1T
Text Generation ⢠1000B ⢠Updated ⢠2k ⢠⢠542 -
inclusionAI/Ling-flash-2.0
Text Generation ⢠103B ⢠Updated ⢠2.13k ⢠215 -
inclusionAI/Ling-mini-2.0
Text Generation ⢠16B ⢠Updated ⢠26.9k ⢠197 -
inclusionAI/Ling-mini-2.0-GGUF
16B ⢠Updated ⢠1.4k ⢠26
A collection of TwinFlow-accelerated diffusion models
GroveMoE is an open-source family of large language models developed by the AGI Center, Ant Research Institute.
-
inclusionAI/Ling-lite-1.5-2507
Text Generation ⢠17B ⢠Updated ⢠82 ⢠76 -
inclusionAI/Ling-lite-1.5-2506
Text Generation ⢠17B ⢠Updated ⢠71 ⢠52 -
inclusionAI/Ling-lite-1.5
Text Generation ⢠17B ⢠Updated ⢠35.3k ⢠57 -
inclusionAI/Ling-lite-base-1.5
Text Generation ⢠17B ⢠Updated ⢠54 ⢠33
AReaL-boba-2
Extensible Guardrails for Agentic AI via Generative Reasoning and Real-Time Classification
-
inclusionAI/SingGuard-NSFA-0.8B
Image-Text-to-Text ⢠1B ⢠Updated ⢠280 ⢠3 -
inclusionAI/SingGuard-NSFA-2B
Image-Text-to-Text ⢠3B ⢠Updated ⢠141 ⢠2 -
inclusionAI/SingGuard-NSFA-4B
Image-Text-to-Text ⢠5B ⢠Updated ⢠109 ⢠2 -
inclusionAI/SingGuard-NSFA-9B
Image-Text-to-Text ⢠9B ⢠Updated ⢠179 ⢠3
Ling-2.6 series is designed for real-world agents that require fast responses, strong execution, and high token efficiency, with several sized SKUs.
-
inclusionAI/Ring-1T
Text Generation ⢠1000B ⢠Updated ⢠234 ⢠⢠231 -
inclusionAI/Ring-1T-FP8
Text Generation ⢠1000B ⢠Updated ⢠434 ⢠19 -
inclusionAI/Ring-flash-2.0
Text Generation ⢠103B ⢠Updated ⢠105 ⢠101 -
inclusionAI/Ring-mini-2.0
Text Generation ⢠16B ⢠Updated ⢠479 ⢠184
-
LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model
Paper ⢠2604.20796 ⢠Published ⢠243 -
inclusionAI/LLaDA2.0-Uni
Any-to-Any ⢠16B ⢠Updated ⢠7.56k ⢠248 -
inclusionAI/LLaDA2.0-Uni-FP8
Any-to-Any ⢠16B ⢠Updated ⢠4.81k ⢠5 -
LLaDA2.0: Scaling Up Diffusion Language Models to 100B
Paper ⢠2512.15745 ⢠Published ⢠89
Ring is a reasoning MoE LLM provided and open-sourced by InclusionAI, derived from Ling.
The Agent Runtime for Self-Improvement
-
UI-Venus-1.5 Technical Report
Paper ⢠2602.09082 ⢠Published ⢠157 -
inclusionAI/UI-Venus-1.5-30B-A3B
Image-Text-to-Text ⢠31B ⢠Updated ⢠1.11k ⢠33 -
inclusionAI/UI-Venus-1.5-8B
Image-Text-to-Text ⢠9B ⢠Updated ⢠9.35k ⢠29 -
inclusionAI/UI-Venus-1.5-2B
Image-Text-to-Text ⢠2B ⢠Updated ⢠894 ⢠41
-
Ming-Omni: A Unified Multimodal Model for Perception and Generation
Paper ⢠2506.09344 ⢠Published ⢠31 -
inclusionAI/Ming-Lite-Omni
Any-to-Any ⢠19B ⢠Updated ⢠82 ⢠200 -
inclusionAI/Ming-Lite-Omni-1.5
Any-to-Any ⢠19B ⢠Updated ⢠239 ⢠85 -
inclusionAI/Ming-UniAudio-16B-A3B
Any-to-Any ⢠18B ⢠Updated ⢠66 ⢠80
Extensible Guardrails for Agentic AI via Generative Reasoning and Real-Time Classification
-
inclusionAI/SingGuard-NSFA-0.8B
Image-Text-to-Text ⢠1B ⢠Updated ⢠280 ⢠3 -
inclusionAI/SingGuard-NSFA-2B
Image-Text-to-Text ⢠3B ⢠Updated ⢠141 ⢠2 -
inclusionAI/SingGuard-NSFA-4B
Image-Text-to-Text ⢠5B ⢠Updated ⢠109 ⢠2 -
inclusionAI/SingGuard-NSFA-9B
Image-Text-to-Text ⢠9B ⢠Updated ⢠179 ⢠3
Ring
Ling-2.6 series is designed for real-world agents that require fast responses, strong execution, and high token efficiency, with several sized SKUs.
-
robbyant/lingbot-world-base-cam
Image-to-Video ⢠Updated ⢠340 -
robbyant/lingbot-world-base-act-preview
Image-to-Video ⢠Updated ⢠21 -
robbyant/lingbot-world-fast
Image-to-Video ⢠19B ⢠Updated ⢠26.4k ⢠21 -
robbyant/lingbot-world-fast-diffusers
Image-to-Video ⢠19B ⢠Updated ⢠2.69k ⢠7
The newest flagship non-reasoning model series.
Ming is the multi-modal series of any-to-any models developed by Ant Ling team.
-
inclusionAI/Ming-flash-omni-2.0
Any-to-Any ⢠104B ⢠Updated ⢠2.58k ⢠266 -
inclusionAI/Ming-omni-tts-16.8B-A3B
Text-to-Speech ⢠18B ⢠Updated ⢠1.25k ⢠54 -
inclusionAI/Ming-omni-tts-0.5B
Text-to-Speech ⢠2B ⢠Updated ⢠7.91k ⢠36 -
inclusionAI/Ming-omni-tts-tokenizer-12Hz
Audio-to-Audio ⢠0.8B ⢠Updated ⢠26 ⢠10
-
Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception
Paper ⢠2602.11858 ⢠Published ⢠61 -
inclusionAI/ZwZ-4B
Image-Text-to-Text ⢠5B ⢠Updated ⢠96 ⢠31 -
inclusionAI/ZwZ-8B
Image-Text-to-Text ⢠9B ⢠Updated ⢠225 ⢠46 -
inclusionAI/ZwZ-RL-VQA
Viewer ⢠Updated ⢠111k ⢠1.28k ⢠15
-
inclusionAI/Ring-1T
Text Generation ⢠1000B ⢠Updated ⢠234 ⢠⢠231 -
inclusionAI/Ring-1T-FP8
Text Generation ⢠1000B ⢠Updated ⢠434 ⢠19 -
inclusionAI/Ring-flash-2.0
Text Generation ⢠103B ⢠Updated ⢠105 ⢠101 -
inclusionAI/Ring-mini-2.0
Text Generation ⢠16B ⢠Updated ⢠479 ⢠184
-
inclusionAI/Ling-1T
Text Generation ⢠1000B ⢠Updated ⢠2k ⢠⢠542 -
inclusionAI/Ling-flash-2.0
Text Generation ⢠103B ⢠Updated ⢠2.13k ⢠215 -
inclusionAI/Ling-mini-2.0
Text Generation ⢠16B ⢠Updated ⢠26.9k ⢠197 -
inclusionAI/Ling-mini-2.0-GGUF
16B ⢠Updated ⢠1.4k ⢠26
-
LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model
Paper ⢠2604.20796 ⢠Published ⢠243 -
inclusionAI/LLaDA2.0-Uni
Any-to-Any ⢠16B ⢠Updated ⢠7.56k ⢠248 -
inclusionAI/LLaDA2.0-Uni-FP8
Any-to-Any ⢠16B ⢠Updated ⢠4.81k ⢠5 -
LLaDA2.0: Scaling Up Diffusion Language Models to 100B
Paper ⢠2512.15745 ⢠Published ⢠89
A collection of TwinFlow-accelerated diffusion models
Ring is a reasoning MoE LLM provided and open-sourced by InclusionAI, derived from Ling.
The Agent Runtime for Self-Improvement
GroveMoE is an open-source family of large language models developed by the AGI Center, Ant Research Institute.
-
UI-Venus-1.5 Technical Report
Paper ⢠2602.09082 ⢠Published ⢠157 -
inclusionAI/UI-Venus-1.5-30B-A3B
Image-Text-to-Text ⢠31B ⢠Updated ⢠1.11k ⢠33 -
inclusionAI/UI-Venus-1.5-8B
Image-Text-to-Text ⢠9B ⢠Updated ⢠9.35k ⢠29 -
inclusionAI/UI-Venus-1.5-2B
Image-Text-to-Text ⢠2B ⢠Updated ⢠894 ⢠41
-
inclusionAI/Ling-lite-1.5-2507
Text Generation ⢠17B ⢠Updated ⢠82 ⢠76 -
inclusionAI/Ling-lite-1.5-2506
Text Generation ⢠17B ⢠Updated ⢠71 ⢠52 -
inclusionAI/Ling-lite-1.5
Text Generation ⢠17B ⢠Updated ⢠35.3k ⢠57 -
inclusionAI/Ling-lite-base-1.5
Text Generation ⢠17B ⢠Updated ⢠54 ⢠33
AReaL-boba-2
-
Ming-Omni: A Unified Multimodal Model for Perception and Generation
Paper ⢠2506.09344 ⢠Published ⢠31 -
inclusionAI/Ming-Lite-Omni
Any-to-Any ⢠19B ⢠Updated ⢠82 ⢠200 -
inclusionAI/Ming-Lite-Omni-1.5
Any-to-Any ⢠19B ⢠Updated ⢠239 ⢠85 -
inclusionAI/Ming-UniAudio-16B-A3B
Any-to-Any ⢠18B ⢠Updated ⢠66 ⢠80