RLHF、微调、量化等技术 · 6 篇文章
INT4/INT8量化:模型瘦身实战指南
RLHF:把AI的"哲学思辨"翻译成人类语言
大模型微调实战:LoRA与QLoRA技术指南
直接偏好优化与传统RLHF的工程实践对比
合成数据在2026年模型训练中的应用
数据质量与模型能力的定量关系分析