Unverified50% confidenceFactExact time
Function Calling能力通过SFT阶段构造大量工具调用示例数据获得,结合RLHF优化工具选择准确性
1
Sources
50%
Confidence
Long-term
Relevance
7/21/2026
First Seen
Sources
Related Claims
Unverified指令跟随能力依赖于监督微调(SFT)阶段和RLHF阶段的偏好对齐优化73% similarUnverifiedFunction Calling的可靠性高度依赖RLHF对调用时机的精确校准,模型需在训练阶段学习何时调用工具的判断边界65% similarUnverified函数调用的可靠性高度依赖于工具描述的质量,清晰的参数说明和使用示例往往比模型本身能力更能决定工具调用成功率60% similarUnverified安全对齐通常通过监督微调(SFT)、基于人类反馈的强化学习(RLHF)等阶段实现,近期出现了直接偏好优化(DPO)等更高效方法,对齐目标概括为3H原则:有用、诚实、无害60% similarUnverified工具描述的质量直接影响模型的调用准确率60% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/581958API
curl https://kongchang.com/api/v1/knowledge/claims/581958MCP
get_claim(id=581958)