Skip to content

面试优先顺序(通用 AI 应用开发岗位):Q1、Q3、Q4、Q5、Q6、Q7、Q8、Q10、Q13、Q18、Q19、Q20。其余题目用于进阶或特定岗位拓展;实际频率会随岗位和面试轮次变化,产品版本资讯不应当作通用必考题。

难度: ⭐⭐⭐⭐ 更新: 2026-04-15 考点: LoRA、RLHF、DPO、微调策略、训练优化、TRL v1.0

日期更新内容
2026-05-07新增 Q14 DAPO/GSPO(GRPO进化版)、Q15 信用分配问题
2026-04-15新增 Q13 TRL v1.0(75+后训练方法、chaos-adaptive设计哲学)
2026-03-05新增大模型微调与训练面试题 11 道

上一模块: 向量索引优化下一模块: 推理优化


返回目录 →

题目目录(按原文档学习顺序,⭐ = 面试高频优先题)

LoRA与PEFT

后训练与分布式训练进阶

对齐技术:RLHF与DPO

微调基础概念

训练优化

专题文章

参考资料