- 资讯公开站rss_bbc_business
我宁愿花几千块去度假:认识那些花掉子女遗产的退休老人
I'd rather pay thousands on a holiday: Meet the pensioners spending the kids' inheritance
- 资讯公开站rss_bbc_business
兽医处方费在新规下被设上限
Vet prescription fees capped under rule changes
作为规则更新的一部分,兽医还必须告知客户网上是否有更便宜的药品。相关诊所将在未来几个月内落实这些规定。
- 资讯公开站google_news_tsmc
台积电2030年High-NA EUV押注的关键不在机器,而在掩膜
TSMC's 2030 High-NA EUV Bet Isn't About the Machine — It's About the Mask - finance.biggo.com
- 论文公开站arXiv
利用单一传感单元测量历史进行非定常流中的水下导航
Underwater Navigation in Unsteady Flows Using Measurement Histories from a Single Sensing Unit
摘要显示,研究提出一种因果观测器,仅凭单一传感单元的历史测量估计侧向流速,为固定导航控制器提供输入。在二维尾流仿真中,该虚拟传感接口将同步流场采样点从三个减少到机器人中心。仅在 Re=100 圆柱尾流上训练,未重新训练即在 Re=205 和 240 上分别达到 84.4% 和 80.6% 成功率,低于直接空间感知 7.4 和 4.6 个百分点,但显著优于仅当前流速观测器。
意义:为水下机器人减少传感器数量、降低布局约束提供思路,并验证单点流场历史在闭环控制中的可用性。
- 论文公开站arXiv
FleXray:通用临床X射线分割
FleXray: Universal Clinical X-ray Segmentation
摘要显示,X光因三维解剖被压缩为二维投影、结构重叠且边界模糊,导致通用分割标注数据难以构建。作者提出FleXray,利用已有3D全身CT分割数据集与生成式图像编辑模型构建基于物理的生成式X光数据引擎,合成带完整标注的二维X光。模型在未见研究数据集与真实临床X光上可分割60种解剖结构,并支持疾病分级测量、X光引导介入导航与病理目标的数据高效学习。
意义:为X光提供通用全身分割能力,降低对人工标注的依赖,可推动医学影像定量分析与AI辅助介入应用。
- 论文公开站arXiv
类型安全不等于无错误:约束决策头遵循选项名而非绑定规则
Type-Safe Is Not Error-Free: A Constrained Decision Head Follows the Option Name, Not the Rubric Bound to It
摘要显示,该研究考察了Jev及两个类似的开源权重模型在仅改变选项名称与评分标准对应关系时的表现。在1200个工作流决策中,将选项从0/1重命名为no/yes后,每百次回答多出70.4次变化,AUC从0.94降至0.23,表明决策排序出现系统性反转。该效应在全部4个谓词上均成立,且随选项数量增加而增强,并受读出几何影响。
意义:提醒开发者:类型安全的结构化输出并不保证模型正确理解选项语义,选项命名可能显著影响决策可靠性。
- 论文公开站arXiv
扩展执行框架而非上下文:从无策略脚手架到可复用专家智能体
Grow the Harness, Not the Context: From Strategy-Free Scaffolds to Reusable Specialist Agents
摘要显示,该研究提出 Growing Harness 训练范式,从仅暴露固定模型与工具接口、不含任务求解控制器的无策略脚手架出发,利用函数级执行轨迹将失败定位到有限代码范围,由优化器联合修复一组失败,并以成功优先的留出集门控回滚有害修改,使控制结构从任务反馈中逐步涌现。在 BrowseComp-Plus 与 WebArena-Verified 及 4B 至 120B 三种模型上,六种设置中五种平均成功率最高,第六种落后最优 0.7 个百…
意义:该工作把智能体控制逻辑沉淀为可复用代码而非反复填充上下文,显著降低调用次数与推理成本,并为小模型补齐长程任务能力提供新思路。
- 论文公开站arXiv
A2M:MCP生态中基于轨迹优化的智能体劫持
A2M: Trace-Optimized Agent Hijacking in the MCP Ecosystem
摘要显示,使用MCP协议的智能体依赖语义匹配从第三方服务器选择工具,攻击者可通过控制元数据与输出实施语义供应链攻击。作者提出A2M两阶段黑盒框架:Attraction阶段优化工具元数据以提高调用概率,Manipulation阶段利用执行轨迹精炼对抗性工具返回,引导智能体产生攻击者期望结果。在LiveMCPBench上,针对GLM-4.6优化的直接攻击在四个场景中恶意工具调用率达93.6%,认知拒绝服务下加权token成本升至基线32.4…
意义:揭示MCP工具选择机制的供应链风险,提醒开发者在工具审核与运行时隔离上加强防护。
- 论文公开站arXiv
TM-APR:基于解析在线自适应的热成像时序记忆定位
TM-APR: Thermal Temporal-Memory Localization via Analytic Online Adaptation
摘要显示,该工作针对热成像视觉位置识别(Thermal VPR)在在线部署中面临的环境依赖强、在线重训练开销大、难以建模非线性漂移等问题,首次将解析类增量学习(ACIL)与域不变VPR结合,发现其无梯度矩阵更新可构成强基线,并进一步利用ACIL与现代控制理论的代数等价性,将无迹传播、高斯混合划分与极小极大H∞优化嵌入更新回路,实现O(1)复杂度的闭式矩阵更新,使在线学习延迟低于传感器采样间隔,从而避免实时SLAM轨迹跳变。
意义:为热成像SLAM/VPR在线部署提供免反向传播、低延迟的域自适应更新思路,对实时机器人与边缘AI有参考价值。
- 论文公开站arXiv
SWE-Serve:面向生产推理服务的智能体工程基准
SWE-Serve: Benchmarking Agentic Engineering For Production Inference Serving
摘要显示,SWE-Serve 是一个评估智能体完成生产级推理工程任务的基准,包含 53 个源自 SGLang 近期生产变更的仓库级任务,覆盖六大推理工程类别,任务在 CPU 或单张 H100 上执行,采用隐藏功能与回归测试、E2E 服务测试及性能门槛评估。在 11 个模型、31 种配置中,最佳配置平均 pass@1 为 75%,但在 19 个端到端任务中,约三分之一通过局部测试的补丁被服务级 E2E 测试拒绝,暴露出局部完成与生产正确性…
意义:该基准首次系统衡量智能体在生产推理服务中的端到端正确性,揭示局部通过率与真实部署要求之间的落差,为 AI 编码智能体的评估与改进提供更贴近生产的标尺。
- 论文公开站arXiv
CliffCompaction:面向长时程编码智能体的低成本压缩
CliffCompaction: Cost-Efficient Compaction for Long-Horizon Coding Agents
摘要显示,CliffCompaction 是一种自动压缩技术,在有限上下文窗口下可将成本降低最多 50%,同时在 Terminal-Bench 上保持或提升性能,并在 KernelBench 上取得领先结果。其核心在于压缩时只截断或丢弃内容,绝不改写重述,且每轮压缩只处理原始内容、丢弃旧压缩产物,以避免上下文漂移。摘要称其在 KernelBench 上 200 步后实现 2.23 倍、400 步后 3.58 倍的 CUDA 内核加速。
意义:为长周期编程智能体提供低成本上下文管理方案,使测试时扩展更经济,并开源 API 代理实现,便于开发者集成。
- 论文公开站arXiv
SpeakerMem-R1:面向多方对话的以说话人为中心双轨记忆
SpeakerMem-R1: Speaker-Centered Dual-Track Memory for Multi-Party Dialogue
摘要显示,多方对话中的长期记忆需区分「谁说了什么」、涉及对象、个体认知、群体共享信息及状态随时间的变化。现有通用 LLM 记忆系统易丢失人物与群体关系,难以整合分散于成员、群体与时间中的线索。作者提出 SpeakerMem-R1,采用双轨记忆存储带说话人标注的原文消息与派生状态,并分人物级、群体级视图,查询时按实体、事件、时间融合两轨证据;同时用 SpeakerLevenshtein 与说话人条件化 GRPO 训练 Writer-R1 …
意义:为多智能体与多方对话场景的长期记忆提供可归因、可本地部署的结构化方案,缓解人物关系丢失与状态重建难题。
- 论文公开站arXiv
一种带延迟信息共享的分散式部分可观测团队决策方法
A Decentralized Partially Observable Team Decision Methodology with Delayed Information Sharing
摘要显示,该研究针对具有低秩隐动态且系统模型未知的去中心化部分可观测团队决策问题,提出结合团队理论等价性与低秩模型表示的框架。团队成员仅依据本地私有信息与延迟共享的公共信息,各自学习近似低秩马尔可夫决策过程,并用最小二乘值迭代求解策略,无需集中式协调者或集中训练。文中证明成员侧解可逼近集中式团队最优策略,并给出有限样本性能保证与样本复杂度界。
意义:为多智能体在通信受限、模型未知场景下提供去中心化学习与规划的理论保证,对分布式强化学习与协作决策系统有参考价值。
- 论文公开站arXiv
DreamStream:面向端到端驾驶的策略导向生成式仿真
DreamStream: Towards Policy-Oriented Generative Simulation for End-to-End Driving
摘要显示,现有仿真平台存在仿真到真实的视觉差距,会破坏策略感知,难以评估端到端驾驶策略的闭环决策。作者提出 DreamStream,一种基于仿真器接地的自回归视频模型构建的生成式闭环仿真器,通过交通布局引导从大型预训练视频模型蒸馏,在改变视觉外观的同时保留场景布局与动态物体时序一致性等策略相关特征。作者还指出 FID 等感知指标会误判特征保留程度,并提出多表示指标 FDπ。摘要称,在 FDπ 下 DreamStream 相比最强先前闭环…
意义:为端到端自动驾驶提供更贴近策略感知的闭环仿真与评测指标,有望降低真实路测成本并暴露策略失效场景。
- 论文公开站arXiv
φ-RIE:从逼真重建到可交互环境
φ-RIE: From Photorealistic Reconstruction to Interactive Environments
摘要显示,3D高斯泼溅(3DGS)虽能对捕获场景实现照片级真实重建,但该表示本身不支持物理交互,因为物体外观可能与背景纠缠,且被遮挡的物体几何与背景内容未被观测。为此作者提出φ-RIE,一种高斯原生流水线,将选定物体转换为可移动的模拟器资产,同时保留其余重建内容,其核心是资产构建与源移除相耦合。在50个ScanNet++场景上,基于证据的选择与配准重试将20毫米匹配F1从0.336提升至0.383。
意义:为机器人仿真与具身智能提供从真实场景重建到可交互资产的转换路径,弥合视觉重建与物理仿真之间的鸿沟。
- 资讯公开站Entrepreneur
你的线上活动为何失败——以及让下一次大获成功的七步框架
Why Your Virtual Event Flopped — and the 7-Step Framework to Make the Next One Your Best Yet
摘要显示,商业活动领域已发生永久性变化,问题不在于是否使用虚拟活动,而在于如何有效使用。文章提出一个七步框架,旨在帮助组织者诊断虚拟活动失败原因,并优化下一次线上活动的策划与执行,从而提升参与效果。
意义:对开发者/AI行业而言,虚拟活动已成常态,该框架可指导线上会议、发布会和社区活动的策划与执行,提升参与度。
- 资讯公开站Ars Technica
实验室测试中虫卵长出尾巴,女子脑部寄生虫感染获确认
Woman's brain worm infection confirmed after eggs grow tails in lab test
摘要显示,一名女性脑部寄生虫感染在实验室检测中得到确认,关键依据是虫卵在检测过程中长出尾巴。原文指出,这类寄生虫并无单一的确诊检测方法,但虫卵长出尾巴这一现象具有相当的说服力。
意义:提醒开发者与AI行业:医学诊断中单一检测往往不足,多信号交叉验证对构建可靠的AI辅助诊断系统具有借鉴意义。
- 资讯公开站Ars Technica
Anthropic与OpenAI新模型承诺相同:花更少钱获得更多能力
New Anthropic, OpenAI models make same promise: A little more for a lot less money
摘要显示,Ars Technica 报道称 Anthropic 与 OpenAI 相继发布的新模型传递出相同信号:性能只小幅提升,但价格明显下降,前沿 AI 模型竞赛已进入「比价选购」阶段。报道未在摘要中给出具体模型名称、性能指标或定价数字。
意义:前沿模型竞争重心从单纯刷榜转向单位智能成本,开发者选型将更看重性价比与迁移成本。
- 资讯公开站CNX Software
Soulart Station:面向VR与VTuber的无标记全身动作追踪器(众筹)
Soulart Station – A markerless full-body motion tracker for VR and VTubers (Crowdfunding)
韩国初创公司 Soulart 推出 Soulart Station,一款面向 VR、VTubing 与动作捕捉的无标记全身动捕设备。摘要显示,该设备采用 ToF 传感器与板载双核 NPU,在本地运行机器学习模型处理 3D 点云,无需 PC GPU 或云端算力,可输出 23 关节 6DoF 动作数据,官方宣称 ML 延迟低于 10 毫秒;仅传输动作数据以保护隐私,支持 Wi-Fi,ToF 模块为 940nm 红外,SoC 型号尚未公布。
意义:端侧 NPU 完成动捕推理,可降低 VR/VTuber 使用成本与隐私风险,反映边缘 AI 在实时感知设备中的落地趋势。
- 资讯公开站Entrepreneur
Z世代正达到婴儿潮一代平均32岁才实现的财富里程碑
Gen Z Is Hitting a Critical Wealth Milestone the Average Boomer Didn’t Reach Until Age 32
摘要显示,Z世代在更年轻的年龄达到了一个关键的财富里程碑,而平均婴儿潮一代直到32岁才实现。文章指出,许多年轻美国人不得不遵循不同的财务策略。但摘要未提供具体年龄、数据来源或财富指标。
意义:若数据可靠,说明Z世代财富积累速度可能快于前代,或反映通胀与资产价格变化,影响消费与投资趋势。
- 资讯公开站Entrepreneur
你的产品可能对ChatGPT不可见,30秒即可检查
Your Products Could Be Invisible to ChatGPT. Here’s How to Check in 30 Seconds.
摘要显示,AI助手每天处理数千万条购物咨询,但多数电商企业并不清楚自己的产品是否出现在AI回答中。原文提出一种30秒自查方法,帮助商家判断产品在ChatGPT等AI购物场景中的可见性。
意义:AI购物入口正在成为新流量渠道,开发者需关注产品信息在LLM回答中的可见性与优化。
- 资讯公开站Entrepreneur
你的网站建立在千年前的构想之上,如今它比以往更重要
Your Website Is Built on a 1,000-Year-Old Idea. Here’s Why It Matters More Than Ever.
摘要显示,现代网站虽依赖复杂技术,但其可理解性所依据的原则可追溯至数百年前。文章将这一古老理念与当代网站设计相联系,认为在当前环境下该原则的重要性更为突出。原文未具体说明该理念的名称或技术细节。
意义:提醒开发者:技术栈再新,信息架构与可理解性仍依赖古老原则,值得在AI时代重新审视。
- 资讯公开站Entrepreneur
Oatly如何打破所有营销规则成为创意力量
How Oatly Became a Creative Force, by Breaking All of Marketing’s Rules
摘要显示,Oatly 创意总监 Michael Lee 在 Entrepreneur 的分享中,解释了如何打造引人注目的营销。文章以 Oatly 为例,探讨其通过打破传统营销规则而成为创意力量。
意义:对开发者/AI 行业而言,Oatly 的案例展示了打破常规的创意策略如何建立品牌,为产品营销和用户增长提供借鉴。
- 资讯公开站Entrepreneur
他打造了爱尔兰最有雄心的餐厅之一,最佳客户满意度建议从杯垫说起
He Built One of Ireland’s Most Ambitious Restaurants. His Best Customer Satisfaction Tip Starts With a Drink Coaster.
摘要显示,一位企业家在竞标心仪餐厅失败后获得第二次机会,最终打造出爱尔兰最具雄心的餐厅之一。文章称其客户满意度的最佳建议始于一个杯垫,强调细节才是真正让顾客回流的关键。
意义:对服务型产品与创业团队有启发:用户体验的差异化往往来自被忽视的微小细节,而非宏大策略。
- 资讯公开站Entrepreneur
创业如何帮助职场妈妈实现工作与生活平衡
How Entrepreneurship Helps Working Moms Achieve Work-Life Balance
摘要显示,Entrepreneur 将举办一场免费网络研讨会,探讨职场妈妈如何借助创业构建灵活的职业,同时兼顾家庭、工作与创业经营。活动聚焦创业作为平衡多重角色的路径,面向有类似需求的受众。
意义:对关注灵活就业与副业创业的开发者及AI从业者,提供创业平衡工作家庭的话题参考。