Zhi Wei Tan
zwtan-cs
AI & ML interests
Efficient LLM inference, KV cache optimization, quantization, speculative decoding, model pruning
Recent Activity
liked a model 1 day ago
yuyijiong/speculative_pipeline_decoding liked a model 1 day ago
saarvajanik/facebook-opt-6.7b-gqa-ub-16-best-for-KV-cache upvoted a paper 1 day ago
Selection-Based Structured Reasoning: Toward Efficient Multimodal Search AgentsOrganizations
None yet