
公司真题库2026-07-27
【快手二面】大模型的 Function Calling 能力是怎么训练出来的?
快手二面真题:FC 能力靠工具调用轨迹 SFT 打底、可验证奖励 RL 强化;SFT 只学格式不学对错,蒸馏造数据有幻觉和同质化风险,需沙箱执行校验缓解。
91学AI·5 阅读
共 3 篇文章

快手二面真题:FC 能力靠工具调用轨迹 SFT 打底、可验证奖励 RL 强化;SFT 只学格式不学对错,蒸馏造数据有幻觉和同质化风险,需沙箱执行校验缓解。

考察对对齐两阶段分工的理解:SFT 学行为范式与格式,RLHF 注入人类偏好与价值排序;核心论点是 SFT 只能模仿正例,无法表达「哪个更好」。

考察 SFT 数据工程的实操理解:指令数据的来源与构造流程、质量要求的具体维度(准确性、多样性、一致性)、以及量级选择的依据。