全球科技每日监测AI 与全技术每日扫描

中文读懂 AI 与全技术今天发生了什么

邮箱轻订阅 · 免费开订每日精选技术情报:中文标题 → 要点 → 详情链。主题月卡加量 · 数据 API 可对接。

2026年9月28日

当日情报归档 · 时间倒序

共 64 条 · 论文 15 · 资讯 49

  • 论文公开站arXiv

    OC-GS:面向不规则转台拍摄的高斯泼溅重建

    OC-GS: Gaussian Splatting for Irregular Turntable Capture

    摘要显示,针对转台拍摄中旋转不均与丢帧导致等角度假设失效的问题,OC-GS 提出以物体为中心的高斯泼溅方法,在共享相机、旋转轴与枢轴的前提下细化每张图像的拍摄角度,联合优化图像几何与角度。在 12、8、6 个不规则视角下,前景 PSNR 分别为 21.26、19.36、15.83dB,均优于四个无位姿高斯泼溅基线;共享训练器下细化角度比固定估计提升 7.88dB,真实拍摄提升 0.70dB。

    意义:为稀疏、不规则转台拍摄提供无需精确位姿的三维重建思路,对低成本物体扫描与高斯泼溅应用有参考价值。

  • 论文公开站arXiv

    生成、跟踪、改进:基于RL微调运动生成器的感知型多技能人形机器人运动

    Generate, Track, Improve: Perceptive Multi-Skill Humanoid Locomotion with RL-Fine-Tuned Motion Generators

    摘要显示,该工作提出双层运动架构:感知式流匹配运动生成器从原始深度图规划全身轨迹,控制引导强化学习训练的感知跟踪策略执行动作。核心贡献是一种离策略强化学习微调循环,通过结构化搜索采集数据并进行优势加权回归,提升生成器在未见地形与技能组合上的一致性。摘要称地形通过成功率最高提升25个百分点,技能选择提升80个百分点;使用原始深度图无需里程计或高度图,单对策略即可驱动Unitree G1完成走、跑、站立与跳跃等动作。

    意义:为开发者提供一种样本高效的离策略微调范式,使多技能人形机器人仅凭深度图即可适应复杂地形,降低感知与部署门槛。

  • 论文公开站arXiv

    信任引导的决策Transformer

    Trust Guided Decision Transformer

    摘要显示,Decision Transformer 在长程 rollout 中因条件上下文偏离训练分布而性能下降,这种漂移可通过模型自身的下一状态预测误差观察到。作者提出 Trust Guided Decision Transformer(TGDT),先用滚动下一状态预测误差并结合 split conformal prediction 校准阈值筛选可信上下文后缀,再由冻结 critic 在可信后缀中选择最高价值动作。D4RL 导航与运动…

    意义:为离线强化学习中的长程决策提供了一种基于模型自检误差的上下文可靠性筛选思路,有助于提升 Decision Transformer 类方法的稳定性。

  • 论文公开站arXiv

    面向编程代理的紧凑文档:基准、优化器及为何无法迁移

    Compact Documentation for Coding Agents: A Benchmark, an Optimizer, and Why It Does Not Transfer

    摘要显示,研究者构建了一个往返基准,用「由描述重新生成的代码能否通过原测试」来评分代码描述质量,发现完整性而非长度决定描述保真度;并据此优化出可泛化到未见文件的描述生成提示。但跨两个模型家族、十个仓库的测试表明,在源码存在时,静态紧凑文档或检索上下文均无法帮助代理解决真实仓库问题,作者将此负面结果连同基准与优化器一并报告。

    意义:提示开发者:为编码代理生成文档未必提升真实任务表现,评估代理上下文策略需谨慎,避免无效投入。

  • 广告QUEENSHOP 2026春夏新品女装立体泡泡格纹伞摆罩衫背心0109…联盟新款物料,适合对照规格与到手价再决定是否入手。淘宝¥109 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    直接反馈对齐中的共模坍缩与恢复

    Common-Mode Collapse and Recovery in Direct Feedback Alignment

    摘要显示,直接反馈对齐(DFA)用固定随机投影回传输出误差训练隐藏层,在 tanh 隐单元与独立 sigmoid 输出下,普通 SGD 可能停滞在接近类别频率常数预测器的损失水平。作者将停滞归因于误差中的共模成分,通过精确的均值-协方差分解分离出由均值教学信号和均值突触前活动构成的秩一更新,其主成分推动 tanh 单元饱和。校准读出基线可抑制坍缩并加速学习。

    意义:揭示固定随机反馈训练不稳定的共模机制,为对齐类算法与无反向传播训练的优化设计提供改进思路。

  • 论文公开站arXiv

    新的LoRA技能应只读不写

    New LoRA Skills Should Read but Never Write

    摘要显示,该论文针对多个独立训练的LoRA适配器难以合并的问题,指出权重空间合并会相互干扰、全量重训成本高、路由方案又失去单一模型的意义。作者提出READ方法,将每个适配器重写为保持更新等价的平衡规范形式,并让新旧技能耦合单向生长:新技能可读取旧技能输入子空间但不能写入其输出子空间,每次追加仅训练耦合矩阵中新技能对应的一行,组合更新可折叠进基础权重,无推理成本与路由。

    意义:为多任务LoRA合并提供免路由、零推理开销的持续学习方案,对模型能力增量扩展与适配器组合有工程价值。

  • 论文公开站arXiv

    通过信念自蒸馏进行用户模型提取

    User Model Extraction via Belief Self-Distillation

    摘要显示,该研究提出 Belief Self-Distillation(BSD)框架,让冻结的 LLM 充当自身教师,从自然对话中蒸馏出紧凑的用户表征,既可解码也可写回模型,从而将线性探测与因果探测统一。实验表明,BSD 能跨多个模型家族忠实恢复用户信念,且干预效果显著强于匹配的隐状态引导;改变模型推断的用户意图会改变拒绝行为,而请求本身保持不变。研究还发现不同独立训练的 LLM 在用户表征上收敛出共享几何结构。

    意义:该工作把用户信念变为可读可写的内部状态,为AI安全中的拒绝行为归因与干预提供了新工具,也提示跨模型用户表征可能存在共性。

  • 论文公开站arXiv

    通过STL引导的Stein变分策略梯度从稀疏成功信号学习机器人策略

    Learning Robot Policies from Sparse Success Signals via STL-Guided Stein Variational Policy Gradient

    摘要显示,该研究针对稀疏成功信号下机器人策略学习难题,提出STL-SVPG方法:以平滑的信号时序逻辑(STL)鲁棒性作为轨迹级训练目标,通过动力学求导将信用按对完整任务规范的影响分配给策略动作,而非仅依据局部进展。在六项四旋翼与机械臂任务(含事件触发、严格顺序、截止时间响应与物理接触)中,该方法在五项取得最高平均成功率,且仿真训练策略可迁移到真实世界。

    意义:为稀疏奖励与多条件时序任务提供可微轨迹级目标,利于机器人策略的信用分配与仿真到现实迁移。

  • 广告TeenieWeenie小熊女装26夏新品时尚优雅披肩式活力短袖T恤针织…联盟新款物料,适合对照规格与到手价再决定是否入手。淘宝¥423 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    通过输出后处理实现黑盒生成式AI的统计属性对齐

    Statistical attribute alignment for black-box generative AI via output post-processing

    摘要显示,该研究针对黑盒生成式AI提出输出后处理方法,使生成输出中某属性(如性别、种族、年龄等受保护属性)的分布与用户指定目标分布对齐,适用于公平性与合成数据生成等场景。作者针对精确与近似对齐分别设计算法,最小化对生成器的期望查询次数,并证明当请求输出数m趋于无穷时算法具有最优性。在文本到图像生成与地理编码人物生成任务上的实验表明,该后处理算法可改善统计属性对齐,与基于提示词的干预形成互补。

    意义:为开发者提供不依赖模型内部结构的黑盒后处理方案,可在公平性与合成数据场景中低成本控制输出属性分布。

  • 论文公开站arXiv

    逆向扩散的一阶平稳性

    First-Order Stationarity of Reverse Diffusions

    摘要显示,该工作为扩散模型建立与优化理论对应的一阶理论:当正向过程(加噪过程)的平稳势函数强凸时,基于SDE的过阻尼与欠阻尼Langevin逆向流以显式指数速率收缩相对Fisher散度,而基于ODE的逆向过程不具备此性质;进一步纳入离散化后,为两类采样器给出平均一阶平稳性界,即非凸优化中平均梯度范数保证的采样类比。该无凸性证明是局部的,仅保证score一致性,不保证全局模式权重。

    意义:为扩散采样提供类优化收敛保证,有助于理解SDE与ODE逆向过程的差异及采样器的可验证收敛指标。

  • 论文公开站arXiv

    面向高斯数据的无间隙差分隐私PCA

    Gap-free Differentially Private PCA for Gaussian Data

    摘要显示,该论文提出了一种针对高斯数据主成分分析(PCA)问题的无间隙差分隐私算法。原文仅给出简短声明,未披露具体技术细节、误差界或实验验证,因此该算法相对已有方法的改进幅度与适用条件尚不明确。

    意义:隐私保护机器学习方向的新算法声明,若成立可改善隐私PCA的精度与可用性,但需关注后续全文细节。

  • 论文公开站arXiv

    铬单磷族化合物磁性多样性的统一自旋-费米子框架

    A Unified Spin-Fermion Framework for Magnetic Diversity in Chromium Monopnictides

    摘要显示,同电子化合物通常预期具有相似磁性,但铬单磷族化合物CrX(X=Sb、As、P)却从CrSb的高温交错磁序,经CrAs的双螺旋反铁磁序,演变为CrP中无可分辨长程磁序。作者结合非共线居里顺磁态第一性原理计算、结构分析、磁相图计算与交换参数提取,提出统一微观框架,认为三者均为高自旋d^5构型与以磷族元素为主的巡游态耦合,从Sb到P化学压力增强配体巡游性,驱动结构从NiAs型向MnP型畸变并重构Cr-Cr交换作用。

    意义:为强关联材料中同电子组分如何产生迥异磁序提供统一微观机制,对自旋电子学与交错磁体设计有参考价值。

  • 广告清爽飘逸纯色100支细苎麻长裤夏季新品宽松文艺凉爽阔腿裤裙裤女联盟新款物料,适合对照规格与到手价再决定是否入手。淘宝¥135 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    学会停止而无需学会停止:自监督置信度训练提升推理效率

    Learning to Stop without Learning to Stop: Self-Supervised Confidence Training Improves Reasoning Efficiency

    摘要显示,该研究提出一种自监督置信度微调方法:让推理模型在自身推理轨迹的中间点预测对答案的置信度,训练仅用600道题,损失函数不含长度、效率或停止目标,推理时也不做置信度引导或早停。在Gemma、Qwen、Nemotron、GPT-OSS等模型及数学、科学、代码基准上,生成token最多减少25%且准确率持平,效果与显式优化短推理的方法相当,并基本保留原有高层推理结构。

    意义:为推理模型提效提供新监督信号:无需改推理流程或加长度惩罚,即可在保持准确率的同时显著降低推理成本。

  • 资讯公开站Electrek

    蔚来以超20亿美元向吉利出售换电业务30%股份

    NIO sells 30% of battery swap unit to Geely at more than $2 billion

    摘要显示,蔚来宣布与吉利控股子公司达成最终协议,吉利将获得蔚来能源(NIO Power)30%股权,投后估值约160亿元人民币(24亿美元)。吉利大部分对价并非现金,而是注入其自有商用换电业务外加6.4亿元人民币(9400万美元),同时蔚来在平行交易中取得吉利充电业务10%股份。

    意义:换电模式获大型车企资本与业务背书,或加速中国换电标准与网络整合,影响电动车补能生态竞争格局。