- 资讯公开站Ars Technica
出现比以往更快破解 RSA 的新方法
There's a new way to break RSA that's faster than anything we've seen before
摘要显示,此前密码学界普遍认为因式分解是破解 RSA 的唯一途径,但 Ars Technica 报道称出现了一种新的 RSA 破解方法,其速度超过以往已知方案。报道未披露具体技术细节、攻击复杂度或受影响密钥规模,仅指出该发现打破了「只能靠因式分解攻破 RSA」的传统认知,相关研究细节有待进一步公开。
意义:若该攻击被验证可行,将动摇 RSA 作为主流公钥加密基础的安全假设,开发者需关注密钥迁移与后量子密码替代方案。
- 论文公开站arXiv
交换多重态框架中的交错磁性与广义张量性质
Altermagnetism and generalised tensorial properties in the exchange multiplet framework
摘要显示,该工作基于 Bertaut–Izyumov 交换多重态形式,提出一个用于计算磁性材料时间反演奇张量性质的表示论框架。与依赖不同磁点群或自旋群的方法不同,该框架将序参量视为连续变量。对于恒定磁矩共线结构,协变性对 Landau–Lifshitz 展开中的张量交织子施加简单对称约束,得到可分解磁性与晶体学部分的规范形式,并自动恢复磁点群选择定则,同时分离共旋与非共旋贡献。
意义:为交错磁体与反铁磁体的张量性质计算提供连续序参量框架,便于第一性原理与实验对接。
- 论文公开站arXiv
我该加入哪里?语言引导目标预测的机器人群体加入
Where Should I Join? Robot Group Joining via Language-Guided Goal Prediction
摘要显示,社交导航通常假设目标已给定,而机器人加入群体需根据群体实时活动与队形预测加入位置。该工作提出语言引导的机器人群体加入任务:给定观测与目标群体的自然语言描述,机器人识别相关成员并预测符合社交规范的加入位姿。方法通过递归谱划分生成结构化候选子集,用语言条件图像-几何模型排序,再以人类队形先验生成多模态能量-朝向图。在对话、排队、观众场景中取得竞争性定位精度与亚秒级推理,加入位姿预测优于所有基线,并在真实机器人上验证。
意义:为社交导航引入语言引导的群体加入能力,对导盲机器人、自主代步车等需要理解人群语义与队形的应用有直接价值。
- 资讯公开站Electrek
Jackery 5040Wh Explorer 5000 Plus电源站独家优惠1000美元,Bluetti周年庆最后一天
Jackery 5,040Wh Explorer 5000 Plus power station exclusive $1,000 off, Final day of Bluetti’s Anniversary Sale, Worx, more
摘要显示,Jackery 5,040Wh Explorer 5000 Plus 便携电源站以 2,499 美元创年度低价,较 Prime Day 早期促销再省 1,000 美元。Bluetti 第六届周年庆 Power Week 促销进入最后一天,优惠自 799 美元起。Worx GT 3.0 20V 无线割草修边机附两块电池与线轴降至 80 美元,创 2026 年新低;Greenworks 80V 700 CFM 电动吹叶机优惠 60…
意义:对关注户外供电与储能设备的开发者与消费者,是获取大容量便携电源年度低价与促销截止时间的信息参考。
- 论文公开站arXiv
FleXray:通用临床X射线分割
FleXray: Universal Clinical X-ray Segmentation
摘要显示,X光因三维解剖被压缩为二维投影、结构重叠且边界模糊,导致通用分割标注数据难以构建。作者提出FleXray,利用已有3D全身CT分割数据集与生成式图像编辑模型构建基于物理的生成式X光数据引擎,合成带完整标注的二维X光。模型在未见研究数据集与真实临床X光上可分割60种解剖结构,并支持疾病分级测量、X光引导介入导航与病理目标的数据高效学习。
意义:为X光提供通用全身分割能力,降低对人工标注的依赖,可推动医学影像定量分析与AI辅助介入应用。
- 论文公开站arXiv
类型安全不等于无错误:约束决策头遵循选项名而非绑定规则
Type-Safe Is Not Error-Free: A Constrained Decision Head Follows the Option Name, Not the Rubric Bound to It
摘要显示,该研究考察了Jev及两个类似的开源权重模型在仅改变选项名称与评分标准对应关系时的表现。在1200个工作流决策中,将选项从0/1重命名为no/yes后,每百次回答多出70.4次变化,AUC从0.94降至0.23,表明决策排序出现系统性反转。该效应在全部4个谓词上均成立,且随选项数量增加而增强,并受读出几何影响。
意义:提醒开发者:类型安全的结构化输出并不保证模型正确理解选项语义,选项命名可能显著影响决策可靠性。
- 论文公开站arXiv
A2M:MCP生态中基于轨迹优化的智能体劫持
A2M: Trace-Optimized Agent Hijacking in the MCP Ecosystem
摘要显示,使用MCP协议的智能体依赖语义匹配从第三方服务器选择工具,攻击者可通过控制元数据与输出实施语义供应链攻击。作者提出A2M两阶段黑盒框架:Attraction阶段优化工具元数据以提高调用概率,Manipulation阶段利用执行轨迹精炼对抗性工具返回,引导智能体产生攻击者期望结果。在LiveMCPBench上,针对GLM-4.6优化的直接攻击在四个场景中恶意工具调用率达93.6%,认知拒绝服务下加权token成本升至基线32.4…
意义:揭示MCP工具选择机制的供应链风险,提醒开发者在工具审核与运行时隔离上加强防护。
- 论文公开站arXiv
DolphinBench:绘制智能体记忆的帕累托前沿
DolphinBench: Mapping the Pareto Frontier of Agent Memory
摘要显示,现有记忆基准多采用对话问答形式,问题本身已暗示需检索的事实,且仅以准确率评分,允许系统以不合理成本与时间换取高分。DolphinBench 改为通过智能体任务完成度直接评估记忆,包含三种知识工作角色,每角色约 50 万 token 用户消息,每个角色 200 项任务均经有/无相关历史对照验证,并要求同时报告总成本与延迟。
意义:为智能体记忆系统提供兼顾准确率、成本与延迟的评测基准,有助于避免以不合理开销刷分的记忆方案。
- 资讯公开站ScienceDaily Matter & Energy
各种大小的黑洞遵循同一惊人规律
Black holes of every size follow the same surprising rule
摘要显示,科学家发现不同质量的黑洞可能依据同一条普遍规律发射强大喷流。超大质量黑洞在撕裂恒星后不久即可产生喷流,并在数百至数千天后、当吸积率降至约爱丁顿极限的2%时再次喷发;该阈值此前已知会触发银河系中较小黑洞的喷流。
意义:若该规律成立,可用同一物理阈值统一解释不同尺度黑洞的喷流触发机制,为黑洞吸积与喷流建模提供可检验约束。
- 论文公开站arXiv
Gricea:面向对话式AI研究的开放科学平台
Gricea: An Open Science Platform for Conversational AI Research
摘要显示,对话式 AI(CAI)研究缺乏统一的系统与实验配置报告方式,阻碍复现与知识积累。作者提出 Gricea,一个将研究表示为可配置、可部署研究制品的开放科学平台,整合研究流程、被试界面与对话任务行为。在一项复现研究中,Gricea 复现了 CUI 2026 中 93% 符合条件的论文配置,同时指出 96% 论文存在阻碍忠实复现的信息缺失。用户研究显示不同背景研究者可成功构建可运行研究。
意义:为对话式 AI 研究提供可复现、可共享的实验基础设施,有助于缓解复现危机并推动累积式知识构建。
- 资讯公开站ScienceDaily Matter & Energy
科学家十年后开封信封,引力常数仍难解释
Scientists opened a sealed envelope after 10 years. Gravity still didn’t make sense
摘要显示,美国国家标准与技术研究院(NIST)一项历时十年的实验给出了万有引力常数的新测量值,该结果与另一项领先测量结果意外不一致,使这一已有 225 年历史的物理难题进一步加深。差异虽小,但对于自然界最基本的常数之一而言已足够显著,科学家尚不确定其原因来自隐藏的实验误差还是更令人意外的因素。
意义:引力常数测量长期不一致,若无法归因于实验误差,可能动摇精密测量与基础物理模型的可信度。
- 资讯公开站CNX Software
OpenMote——基于ESP32-S3的可编程通用遥控器,采用Wiimote外壳(众筹)
OpenMote – An ESP32-S3 programmable universal remote in a Wiimote shell (Crowdfunding)
摘要显示,Hat & Hammer 推出 OpenMote,一款采用任天堂 Wiimote 经典外形的 ESP32-S3 可编程万能遥控器,支持 WiFi、蓝牙 LE、红外收发、六轴 IMU 与 Home Assistant 集成,可控制智能家居与媒体中心,并可作为蓝牙游戏手柄,无需依赖云服务。产品分「Ready To Go」整机版与「Mod Your Own」裸板版,后者可直接装入现有 Wiimote 外壳。另内置麦克风、扬声器及 Q…
意义:展示了 ESP32-S3 在开源智能家居遥控与本地化控制场景的硬件设计思路,为开发者提供可扩展、免云端的参考方案。
- 开源项目公开站GitHub
Universal-Debloater-Alliance/universal-android-debloater-next-generation — 使用ADB的Rust跨平台GUI
Universal-Debloater-Alliance/universal-android-debloater-next-generation — Cross-platform GUI written in Rust using ADB to debloat non-rooted Android devices. Improve your privacy, the security and battery life of your device.
摘要显示,该项目由 Universal-Debloater-Alliance 维护,是一款用 Rust 编写的跨平台图形界面工具,借助 ADB 为未 root 的安卓设备移除预装应用,以提升隐私、安全性和电池续航。GitHub 星标约 9171,属于社区维护的下一代版本。
意义:为开发者提供免 root 的安卓系统精简方案,展示 Rust 跨平台 GUI 与 ADB 自动化结合的实用案例。
- 论文公开站arXiv
LLM助手的可验证社会推理
Verifiable Social Reasoning for LLM Assistants
摘要显示,针对LLM助手在社交咨询场景中难以评测的问题,研究者提出Fuse多智能体仿真框架:目标智能体带有隐藏动机,与包括用户代表的智能体互动,用户再向被评测助手咨询以推断该动机,从而天然构造可验证的真实标签。研究用2.4万条标注的人类研究验证仿真保真度,并在12个LLM上实验,发现用户中介会加剧社会推理难度、模型对用户有偏框架存在系统性敏感、模型有时需要比人类更多的细节才能做出正确预测,且更长对话不总能提升表现。作者开源Fuse及含2…
意义:为LLM社交推理提供可验证评测基准与开源数据集,揭示用户中介与偏见框架对模型判断的系统性影响,利于助手安全性评估。
- 资讯公开站Nature News
黏连蛋白重塑复制叉接触以助其减速与逆转
Cohesin reshapes replication fork contacts to aid fork slowing and reversal
该研究探讨黏连蛋白如何重塑复制叉的接触关系,从而协助复制叉减速与逆转,聚焦其在复制叉动态调控中的作用,具体分子机制与实验数据未在摘要中呈现。
意义:揭示黏连蛋白在DNA复制应激响应中的新角色,或为基因组稳定性与癌症相关研究提供线索。
- 论文公开站arXiv
EG-ARSA:面向低资源场景的视觉道路安全审计开放专家模型
EG-ARSA: An Expert-Grounded Open Model for Visual Road Safety Auditing in Low-Resource Settings
该研究提出专家接地蒸馏(EGD)框架,将机构道路安全专业知识迁移至紧凑视觉语言模型,用于可扩展的视觉道路安全审计。通过量化校准阶段,教师模型与权威实地审计达成显著一致(Cohen's kappa=0.74)。蒸馏后的80亿参数学生模型采用低秩适应。研究还发布了首个开放专家接地的孟加拉道路安全审计数据集BD-ARSA,含21,947条图像审计记录,以及首个专为此任务开发的视觉语言模型EG-ARSA。实验显示,接地微调显著提升了序数风险评估…
意义:为低资源环境提供可扩展的视觉道路安全审计方案,通过专家接地蒸馏提升模型可靠性,对AI在公共安全领域的落地具有示范意义。
- 论文公开站arXiv
基于智能体方法的活动数据收集、出行行为建模与天气敏感需求预测
An Agentic Approach for Active Data Collection, Travel Behavior Modeling, and Weather-Sensitive Demand Prediction
摘要显示,本研究提出一个三智能体工作流,整合对话式数据收集、结构化数据处理和行为预测。通过聊天机器人管理的图像增强陈述偏好调查,收集了454条学生通勤者在五种天气情景下的出行方式选择数据。使用多项逻辑模型分析天气关联,并以逻辑回归和随机森林作为机器学习基准。评估了九个本地部署的大语言模型,范围从2亿到350亿参数,在四种零样本提示条件下,并扩展了角色、少样本和视觉配置。最佳文本零样本LLM达到69.9%的准确率,而最佳视觉配置达到71.…
意义:该研究展示了大语言模型在出行行为预测中的潜力,并比较了不同提示策略的效果,为开发天气敏感的智能出行服务提供了新思路。