- 论文公开站arXiv
可用护栏:跨ML系统认证选择性预测
Available Guardrails: Certifying Selective Prediction across ML Systems
摘要显示,该论文将选择性预测器视为安全门,要求在每个报告单元上以目标精度认证可靠性。作者用经典精确二项式反演使“可用性”可计算,并将固定组序下的报告分区选择建模为动态规划,揭示安全、粒度与覆盖流量之间的权衡。结果显示,真实信息规划者比支持平衡平均覆盖率提升0.157,而朴素估计器仅恢复0.005;跨规划/选择分割可部分弥补差距,提升0.060,方向在60个模型效应中59个复现。
意义:为需要按工具、策略标签或患者亚组认证精度的ML部署提供可计算框架,提示有限校准数据下认证可用性是核心瓶颈。
- 论文公开站arXiv
FreqSpaNet:用于物理层硬件完整性检测的SFPF频率与空间学习
FreqSpaNet: Frequency and Spatial Learning of SFPF for Physical Layer Hardware Integrity Detection
摘要显示,未经授权的硬件替换可在保留无线设备逻辑身份的同时改变其物理实现,给硬件完整性验证带来挑战。时空频极化指纹(SFPF)能捕获设备在多个频率与方向上的响应,但其频域与空域维度具有不同的结构依赖关系。为此作者提出 FreqSpaNet,一个用于开集硬件异常检测的 SFPF 表征学习网络:频率分支捕获相邻频率间的局部变化,几何感知空间分支利用角度信息建模方向关系,两者经自适应融合并结合互补预训练。实验显示其平均 AUROC 达 96.…
意义:为无线设备硬件完整性验证提供频域-空域联合表征方法,对物理层安全与设备身份认证研究有参考价值。
- 论文公开站arXiv
读取不等于使用:检索、判断与AI金融研究工作流的设计
Reading Is Not Using: Retrieval, Judgment, and the Design of AI Financial Research Workflows
摘要显示,大型语言模型在金融分析中的评估通常基于检索能力,而非检索信息对判断的影响。研究发现,在长上下文金融分析中存在“检索-整合缺口”:当无关上下文从2000增至128000个token时,风险披露对投资判断的影响降至噪声水平,尽管直接检索仍准确。该现象在多个模型家族和任务中复现,且更强大的模型仅推迟而非消除此缺口。因果记忆干预表明,压缩摘要和源文本查找共同传递披露信息,而工作流架构(如分块-总结流水线会逐出相关信息)决定传递成败。因…
意义:对AI行业而言,提示了仅靠检索评估的不足,强调工作流设计对模型实际决策的影响,为金融AI系统开发提供关键考量。
- 论文公开站arXiv
凸集图上Steiner旅行商问题的统一分支定界搜索
Unified Branch-and-Bound Search for the Steiner Traveling Salesman Problem on Graphs of Convex Sets
摘要提出了一种在凸集图(GCS)上求解Steiner旅行商问题(Steiner-TSP)的统一分支定界搜索方法,该问题要求寻找通过所需凸集的最小成本闭合轨迹,允许可选中转顶点和重复访问。通过根行走前缀的搜索,利用加性下界图成本和割分离连通流松弛来界定前缀和剩余成本。在均匀正成本假设下,最佳优先遍历在有限次扩展后终止,深度优先遍历在有限可行解存在时终止。对于用户指定的因子ε≥1,全局下界保证任一策略的解成本至多为全局最优的ε倍。在移动机械…
意义:为机器人路径规划等组合优化问题提供统一求解框架,兼顾最优性保证与计算效率,对AI决策与自动化领域有参考价值。