Anika Rao
anikarao03
ยท
AI & ML interests
Efficient LLM inference, KV cache optimization, quantization, speculative decoding, model pruning
Recent Activity
upvoted a paper about 12 hours ago
FuseReg: Regularizing Layer Fusion Mitigates the Reconstruction-Generation Gap in Representation Autoencoders liked a dataset 1 day ago
jprivera44/kv_cache_logits_exp2 liked a model 1 day ago
position-specialist-speculative-decoding/llama2-13b-chat-poss3Organizations
None yet