Anika Rao
anikarao03
AI & ML interests
Efficient LLM inference, KV cache optimization, quantization, speculative decoding, model pruning
Recent Activity
liked a dataset about 4 hours ago
Visionarys/kvcache liked a dataset about 4 hours ago
Anticloud/camus-10-kv-cache-quantization upvoted a paper about 4 hours ago
Flash-dLLM: IO-Aware KV Caching and Parallel Decoding for Fast, Memory-Efficient Diffusion LLMsOrganizations
None yet