参悟llama.cpp中的Qwen3.6-35B-A3B - 凉快李某

Wait 5 sec.

【摘要】参悟llama.cpp中的Qwen3.6-35B-A3B 懒人版:直接复制给LLM,“总结一下这篇文章讲了什么” 前言 这篇文章既是对一系列探究性实践的记录与总结,也是深入理解 MoE(Mixture of Experts)架构底层逻辑与 llama.cpp 部署机制的学习过程。 模型: Qwen3 阅读全文