全球科技每日监测AI 与全技术每日扫描

中文读懂 AI 与全技术今天发生了什么

邮箱轻订阅 · 免费开订每日精选技术情报:中文标题 → 要点 → 详情链。主题月卡加量 · 数据 API 可对接。

AI 与全技术每日扫描

全球科技每日监测

中文读懂今天发生了什么 · 按时间更新 · 全量浏览

今日 125 条 · 论文 15 · 资讯 110 查看今日归档

免费邮箱订阅 主题月卡 数据 API →

数据源:本地 Harness 库 · 搜索「AGI」共 13 条

  • 论文公开站arXiv

    The Missing Primitive: Diagnosing and Repairing Mathematical Reasoning in Large Language Models

    While Large Language Models (LLMs) have demonstrated striking capabilities on frontier mathematical problems, it remains unclear whether they possess the structural mathematical understanding underlying their solutions. …

  • 论文公开站arXiv

    VISTA: A Visual Harness for Reasoning in an Interactive World

    We show that multimodal models possess strong reasoning abilities and that an appropriate harness can unlock their potential to solve tasks across diverse interactive environments. We introduce VISTA, a visual harness th…

  • 论文公开站arXiv

    去除时间捷径可改进非侵入式脑机文本解码

    Removing Timing Shortcuts Improves Non-Invasive Brain-to-Text

    研究发现,多项报道的非侵入式脑信号词解码性能提升,在完全不用脑数据的情况下也能复现。在 d'Ascoli 等人(2025)的工作中,受试者感知连续语音的脑活动时间序列被分段处理。

  • 论文公开站arXiv

    打破同质化陷阱:通过SplitMoE扩展视频扩散模型

    Breaking the Uniformity Trap: Scaling Video Diffusion Model via SplitMoE

    受大语言模型启发的混合专家(MoE)是扩展视觉生成模型的有前景范式,但传统token级MoE在同类专家池中独立路由token并趋向均匀化,限制了性能。本文提出SplitMoE方法。

  • 广告宽松压褶灯笼裤垂感西装裤女长款束脚裤早秋裤子新款样本,适合先看规格与上架节奏再决定是否入手。淘宝¥287 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    Rolling-WAM:带滚动想象的世界动作模型

    Rolling-WAM: World Action Models with Rolling Imagination

    摘要显示,世界动作模型(WAM)将动作生成与未来视觉预测耦合,但每个重规划周期都要完成完整的视频-动作联合去噪,带来显著延迟。Rolling-WAM 将联合去噪分散到连续的重规划周期中,用滑动窗口维护处于不同噪声水平的视频-动作块:每步完整去噪即将执行的动作块,同时部分精炼更远未来的块,并随新相机观测推进窗口。在 LIBERO、RoboTwin 与真实 Unitree G1 人形机器人上,摘要称其达到有竞争力的操作性能,并相较标准联合 …

    意义:为机器人操作中的视频-动作联合模型提供低延迟重规划思路,把计算摊到时间轴上,提升闭环响应速度。

  • 论文公开站arXiv

    投影非晶拓扑绝缘体

    Projected amorphous topological insulators

    摘要显示,作者提出投影无序拓扑绝缘体(PATIs):在母晶体中仅保留比例 x 的随机选择且相互不连通的格点,通过对剩余格点积分构建有效哈密顿量后,系统仍可具备量子化的全局拓扑不变量(强 PATI)。在母模型拓扑区间内还存在临界 x,低于该值时系统转为脆弱 PATI,仅在少量格点上支持量子化局域拓扑标记。两类相均存在边界能隙内模式,而平庸参数区则为普通绝缘体。强到脆弱 PATI 相变可由 x 调控,其平均关联长度指数 ν 约为 1.00~…

    意义:为无序/非晶拓扑材料设计提供新机制,说明无需完整晶格也可实现量子化拓扑不变量,对拓扑器件与容错边界态研究有参考价值。

  • 论文公开站arXiv

    LiMA:通过异步扩散桥接长期想象与实时灵巧操作

    LiMA: Bridging Long-term Imagination to Real-time Dexterous Manipulation via Asynchronous Diffusion

    摘要显示,LiMA 是一种异步双系统生成框架,将意图规划与反应式执行解耦:慢系统负责稀疏的长时程时空意图生成,快系统负责稠密高频动作精修,并通过 Latent Schrödinger Bridge Coupling 机制对齐稀疏意图与稠密轨迹。论文称其相较 Cosmos-Policy 降低 45.8% 推理延迟,在六项双臂灵巧操作任务上总体成功率 70.8%、子任务平均成功率 78.9%,并在未见场景中保持性能。

    意义:为 VLA 与 World-Action Model 的推理延迟与反应速度矛盾提供异步分层思路,对实时机器人操作与具身智能系统架构有参考价值。

  • 论文公开站arXiv

    DexTacWAM:面向灵巧操作的视触觉世界-动作模型

    DexTacWAM: A Visuo-Tactile World-Action Model for Dexterous Manipulation

    摘要显示,DexTacWAM 是一种视触觉世界-动作模型(WAM),将各指尖触觉独立编码,经手指与姿态感知的触觉压缩器聚合后注入视频扩散世界模型,实现视触觉联合世界建模。在 22 自由度双臂平台的六项富接触灵巧操作任务中均取得最高分,平均 70.6,最强基线为 38.0。消融表明收益来自将接触演化纳入预测世界状态,而非仅做触觉条件化。

    意义:把触觉纳入世界模型而非仅作条件输入,为富接触机器人操作提供了新范式,对具身智能与多模态世界模型研究有直接参考价值。

  • 广告Lavinia 黑色西装套装女早春新品经典休闲通勤直筒修身西装裤新款样本,适合先看规格与上架节奏再决定是否入手。淘宝¥985 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    LIMBO:学习并内化无模型障碍目标以实现敏捷安全全身控制

    LIMBO: Learning and Internalizing Model-Free Barrier Objectives for Agile and Safe Whole-Body Control

    摘要显示,LIMBO 提出一种在冻结基础控制器周围、基于黑盒状态转移与失败规范学习状态-动作控制屏障函数(Q-CBF),并将其安全结构蒸馏进任务策略的框架。学习到的安全值在合成阶段引导风险导向采样,在任务学习阶段提供动作级安全反馈,从而减少部署时在线安全过滤的需求。作者在 29 自由度人形机器人上演示了躲避球与低障碍下行走任务。

    意义:为高维全身控制提供可学习、可复用的安全证书,并减少部署时在线安全过滤,对安全强化学习与机器人控制有参考价值。

  • 论文公开站arXiv

    梦见接触之声:利用视频和音频生成实现零样本力感知操作与数据生成

    Dreaming the Sound of Contact: Leveraging Video and Audio Generation for Zero-Shot Force-Aware Manipulation and Data Generation

    摘要显示,该工作针对生成视频仅含运动学轨迹、缺乏力信息的问题,提出用生成接触声音的响度构造有界且随时间变化的期望力曲线,并结合生成视频从结构化自然语言任务提示中同时推导运动轨迹与期望力。作者在 Franka Panda 机器人上用闭环力调节器跟踪该音频塑形的力曲线,在多个需接触的任务上成功完成操作,而仅运动学基线失败;该流程还被用作数据生成引擎训练闭环策略。

    意义:为机器人操作引入音频作为力感知信号,弥补生成视频缺少接触力信息的短板,并提供可复用的数据生成思路。

  • 论文公开站arXiv

    智能体社会需要社会性治理框架

    Agentic Societies Need a Social Harness

    摘要显示,论文提出"智能体社会"概念,指多个AI智能体代表不同主体、跨信任边界自主协作。实验表明,即便诚实且能力足够的智能体,在现有 harness 与消息原语下也常无法达成满意结果;而故障或恶意智能体可通过通信("speech")漏洞拖延协作、影响结果并追求有害目标。作者主张除管理私有上下文与委托人通信的"个人 harness"外,还需"社会性 harness",并提出分层架构,实现失败预防、运行时无效消息检测与事后追责。

    意义:为多智能体系统提供跨信任边界的通信安全与追责设计思路,对构建可审计、抗攻击的智能体协作基础设施有直接参考价值。

  • 论文公开站arXiv

    惯性流形神经算子用于耗散时间相关偏微分方程

    Inertial Manifold Neural Operator for Dissipative Time-Dependent Partial Differential Equations

    本文提出惯性流形神经算子(IMNO),用于求解耗散时间相关偏微分方程。摘要显示,该算子利用耗散系统的低维结构,相比标准神经算子(如傅里叶神经算子)在长时间自回归训练和预测中具有更好的物理可解释性、准确性和稳定性。针对平移等变PDE,还提出了平移等变变体(IMNO-SE),通过保持对称性提升性能。

    意义:为耗散PDE的长期预测提供更稳定、可解释的神经算子,并引入对称性保持的归纳偏置,对科学计算和AI4Science有重要意义。

  • 广告林乔芝夏季新品时尚百搭休闲裤女小脚西装裤气质修身九分裤新款样本,适合先看规格与上架节奏再决定是否入手。淘宝¥800 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    Prime Agent:一种自我改进的递归语言模型工具链

    Prime Agent: A Self-Improving RLM Harness

    Prime Agent是一个开源工具链,用于长时程评估和编码智能体工作流。它采用递归语言模型抽象,通过持久化IPython REPL进行程序化上下文处理,并持续保存历史、记忆、技能和子智能体配置。递归子智能体可直接通信,人类可通过代理视图监控会话。该工具标准化执行、恢复、验证和资源核算,将策略构建留给模型,防止工具链故障影响模型表现。在ARC-AGI-3上,其RHAE Best@1从30%提升至95.5%,并在多项任务上达到或超过其他主…

    意义:提供标准化工具链,减少环境故障干扰,提升模型真实能力评估,对长时程智能体开发具有参考价值。