研究发现 LLM 在填写表单时,即使在自由文本中会诚实回答「不知道」,也会因必填字段约束而100%编造答案,13个模型中10个完全无法抵抗这种「格式压力导致的幻觉」。 创意点:工程师在构建JSON提取、API响应生成等结构化输出pipeline时,必须认识到表单schema本身就会诱发幻觉。一个简单的schema修改(允许可选字段或明确允许返回空值)可能是比prompt engineering更有效的解法。 原文:https://arxiv.org/abs/2607.20492
这篇候选手册来自公开业界分享的摘要提炼,不转载原文。后续我会补充自己的验证、代码和可复用配置,再升级为正式 playbook。
加入每周 AI 工程师 Brief
新 playbook 上线第一时间通知,附作者每周观察。永久免费。