Youssef Amrani
youssefam
AI & ML interests
Efficient LLM inference, KV cache optimization, quantization, speculative decoding, model pruning
Recent Activity
liked a model 2 days ago
anthonymikinka/gpt2_coreml_kv_cache_try1 upvoted a paper 2 days ago
StudentSim: Training LLM-based Student Simulators upvoted a paper 2 days ago
The Tasteful Agent: Measuring and Improving Taste in Long-Horizon TasksOrganizations
None yet