AI 与机器学习 LoRA、QLoRA 与全量微调:该用哪种方法? 从显存占用、效果质量和使用场景对比 LoRA、QLoRA 和全量微调,了解哪种大模型微调方法适合你的 GPU 预算。 Brian · Jul 6, 2026 · 15 分钟阅读
AI 与机器学习 GGUF、GPTQ、AWQ、EXL2:LLM量化格式究竟如何使用内存 对比GGUF、GPTQ、AWQ和EXL2的内存使用情况,从Q4_K_M文件大小到KV缓存增长和运行时开销。 Brian · Jul 2, 2026 · 12 分钟阅读
AI 与机器学习 什么是统一内存,为什么它能让一台迷你主机运行235B模型? 统一内存让紧凑型AI主机能够加载单块24-32GB GPU都装不下的235B级模型。它是什么、为什么有效,以及为什么更大不等于更快。 Brian · Jul 2, 2026 · 11 分钟阅读