-
LLM in a flash: Efficient Large Language Model Inference with Limited Memory
Paper • 2312.11514 • Published • 265 -
Magicoder: Source Code Is All You Need
Paper • 2312.02120 • Published • 83 -
Mixtral of Experts
Paper • 2401.04088 • Published • 162 -
Chain-of-Thought Reasoning Without Prompting
Paper • 2402.10200 • Published • 111
xiepengli
ginobiLi
AI & ML interests
LLM
Recent Activity
liked a model 4 days ago
XHToken/Spark-X2.5-4B liked a model 6 days ago
Qwen/Qwen3.8-Flash-Next liked a model 9 days ago
QUASAR-QAT/Qwen3.8-27B-QUASAR-NVFP4