Sleeping
Agents
SentinelLLM Safety & Alignment Harness
๐ก
Jailbreak, bias & format guardrails for LLMs โ live demo
Jailbreak, bias & format guardrails for LLMs โ live demo
Simulate AI steering: reasoning, context, guardrails, routing
Claim-verified RAG that measurably reduces hallucination
Generate text samples from a distributed training model
Walk a diffusion model's latent space in real time
Token cost of skill-based agents vs monolithic prompts
Explore quantization error across model layers
KV cache bytes, OOM walls, PagedAttention, Pareto frontier
Watch rejection sampling accept/reject every draft token
Adaptive IRT evals, bias-audited judging, contamination