全球科技每日监测AI 与全技术每日扫描

中文读懂 AI 与全技术今天发生了什么

邮箱轻订阅 · 免费开订每日精选技术情报:中文标题 → 要点 → 详情链。主题月卡加量 · 数据 API 可对接。

AI 与全技术每日扫描

全球科技每日监测

中文读懂今天发生了什么 · 按时间更新 · 全量浏览

今日 125 条 · 论文 15 · 资讯 110 查看今日归档

免费邮箱订阅 主题月卡 数据 API →

数据源:本地 Harness 库 · 搜索「安全性」共 3 条

  • 论文公开站arXiv

    剖析数据稀缺机器人插入中的运动先验正则化

    Dissecting Motion-Prior Regularization for Data-Scarce Robotic Insertion

    摘要显示,该研究在仅用15次演示训练扩散策略的条件下,比较了最小加加速度、速度-曲率正则化及组合方式对机器人插入成功率的影响,每设置进行80次真实机器人试验。联合与仅最小加加速度均达70/80成功(87.5%),仅速度-曲率为69/80(86.3%),无先验为66/80(82.5%),通用平滑为67/80(83.8%)。联合正则化比无先验高5个百分点,但未优于仅最小加加速度,研究未证实协同效应或安全性提升。

    意义:为数据稀缺下的机器人扩散策略训练提供了先验正则化的实证对比,提示最小加加速度是更简单可复现的候选方案。

  • 论文公开站arXiv

    LLM助手的可验证社会推理

    Verifiable Social Reasoning for LLM Assistants

    摘要显示,针对LLM助手在社交咨询场景中难以评测的问题,研究者提出Fuse多智能体仿真框架:目标智能体带有隐藏动机,与包括用户代表的智能体互动,用户再向被评测助手咨询以推断该动机,从而天然构造可验证的真实标签。研究用2.4万条标注的人类研究验证仿真保真度,并在12个LLM上实验,发现用户中介会加剧社会推理难度、模型对用户有偏框架存在系统性敏感、模型有时需要比人类更多的细节才能做出正确预测,且更长对话不总能提升表现。作者开源Fuse及含2…

    意义:为LLM社交推理提供可验证评测基准与开源数据集,揭示用户中介与偏见框架对模型判断的系统性影响,利于助手安全性评估。

  • 论文公开站arXiv

    输入凸神经网络L_p-Lipschitz常数的参数化复杂度及Zonotopes上L_p-范数最大化

    Parameterized Complexity of $L_p$-Lipschitz Constants for Input Convex Neural Networks and $L_p$-Norm Maximization over Zonotopes

    摘要显示,该研究探讨了两层输入凸神经网络(ICNNs)计算L_p-Lipschitz常数的问题,该问题等价于在Zonotope上最大化对偶范数。对于固定的p∈(1,∞)∩Q,在d维Zonotope上最大化L_p-范数是W[1]-难的,且暴力枚举算法在指数时间假设下本质最优。通过二元性,相同难度适用于两层ReLU ICNN的L_p-Lipschitz常数计算。证明先建立L_2情形,再通过泰勒近似推广至任意固定p。该结果解决了COLT'25…

    意义:该研究明确了ICNN Lipschitz常数计算的计算复杂性边界,对神经网络的鲁棒性验证和安全性分析有重要指导意义,也为相关算法设计提供了理论依据。