全球科技每日监测AI 与全技术每日扫描

中文读懂 AI 与全技术今天发生了什么

邮箱轻订阅 · 免费开订每日精选技术情报:中文标题 → 要点 → 详情链。主题月卡加量 · 数据 API 可对接。

AI 与全技术每日扫描

全球科技每日监测

中文读懂今天发生了什么 · 按时间更新 · 全量浏览

今日 125 条 · 论文 15 · 资讯 110 查看今日归档

免费邮箱订阅 主题月卡 数据 API →

数据源:本地 Harness 库 · 搜索「提示词」共 2 条

  • 论文公开站arXiv

    通过输出后处理实现黑盒生成式AI的统计属性对齐

    Statistical attribute alignment for black-box generative AI via output post-processing

    摘要显示,该研究针对黑盒生成式AI提出输出后处理方法,使生成输出中某属性(如性别、种族、年龄等受保护属性)的分布与用户指定目标分布对齐,适用于公平性与合成数据生成等场景。作者针对精确与近似对齐分别设计算法,最小化对生成器的期望查询次数,并证明当请求输出数m趋于无穷时算法具有最优性。在文本到图像生成与地理编码人物生成任务上的实验表明,该后处理算法可改善统计属性对齐,与基于提示词的干预形成互补。

    意义:为开发者提供不依赖模型内部结构的黑盒后处理方案,可在公平性与合成数据场景中低成本控制输出属性分布。

  • 论文公开站arXiv

    LLM何时应弃答?用于选择性风险控制的自问链

    When Should LLMs Abstain? Chain-of-Self-Questioning for Selective Risk Control

    摘要显示,论文提出仅靠提示词的 Chain-of-Self-Questioning(CoSQ)框架,让模型在明确评估回答问题所需信息后再决定是否作答。在 TruthfulQA 817 题多选题验证集上,用 11 个开源与托管模型家族测试 17 种条件:平衡选项协议下 Grounded-CoSQ(τ=0.90)将平均无条件错误作答率从思维链提示的 13.1% 降至 8.9%,相对下降 32.1%,作答准确率由 86.9% 升至 89.7%…

    意义:为开发者提供无需训练、可调阈值的拒答机制,在高风险场景中以可控覆盖率降低无依据作答风险。