研究提出 DOPA 框架,通过在分布外任务中引入 OOD 代理近似不可访问的目标域,并结合马氏距离全局多样性约束来改进演示检索,提升 LLM 的泛化鲁棒性。 创意点:工程师可借鉴「代理近似」的思路处理目标分布不可知的实际场景;RAG 系统可融入分布度量与多样性约束来优化检索策略,而非仅依赖语义相似度。 原文:https://arxiv.org/abs/2606.00014
这篇候选手册来自公开业界分享的摘要提炼,不转载原文。后续我会补充自己的验证、代码和可复用配置,再升级为正式 playbook。
加入每周 AI 工程师 Brief
新 playbook 上线第一时间通知,附作者每周观察。永久免费。