全球科技每日监测AI 与全技术每日扫描

中文读懂 AI 与全技术今天发生了什么

邮箱轻订阅 · 免费开订每日精选技术情报:中文标题 → 要点 → 详情链。主题月卡加量 · 数据 API 可对接。

AI 与全技术每日扫描

全球科技每日监测

中文读懂今天发生了什么 · 按时间更新 · 全量浏览

今日 125 条 · 论文 15 · 资讯 110 查看今日归档

免费邮箱订阅 主题月卡 数据 API →

数据源:本地 Harness 库 · 搜索「数据集」共 30 条

  • 论文公开站arXiv

    农田模式:并行维度注意力网络与数据集差异注意力用于作物分割

    Cropland PAtteRNS: Parallel Dimensional Attention Networks and Attention to Dataset Disparity for Crop Segmentation in Satellite Imagery Time Series Data

    卫星影像时间序列数据集和作物分割架构日益丰富,但在追求最新概念或最大数据集的过程中,两方面的重要事实被忽视。本文提出并行维度注意力网络及数据集差异注意力方法。

  • 论文公开站arXiv

    FurE:无需动物毛发数据集的高效实例级3D毛发重建

    FurE: Efficient Instance-Specific 3D Fur Reconstruction without Animal-Fur Datasets

    从多视角图像重建逼真可编辑的动物毛发面临精细细节、自遮挡与混淆等挑战,且不同于人类头发,缺乏动物毛发数据集。

  • 论文公开站arXiv

    通过发现时间解释中的重复概念揭示音频分类器中的捷径学习

    Uncovering shortcut learning in audio classifiers by discovering recurring concepts in temporal explanations

    机器学习数据集中事件间的相关性可能导致捷径学习,模型基于相关事件的出现来预测目标事件。当这些相关性是虚假的(源于数据收集偏差)时,模型很可能学到错误关联。

  • 论文公开站arXiv

    信还是不信:语音中的检索增强事实核查

    To Trust or Not to Trust: Retrieval-Augmented Fact Checking in Speech

    摘要显示,研究者提出 VeriSpeak,一个用于研究大型音频语言模型(LALM)语音事实核查能力的探针基准,包含 3,879 条口语化声明,覆盖时间、地理与关系类事实,真假标签均衡。实验发现文本与语音之间存在稳定的模态差距:能可靠核查书面声明的模型在同样内容以语音呈现时常常失败;仅靠检索收益有限,因为模型常将检索证据与语音声明混淆,而检索结合显式推理可提升声明-证据比对效果,思维调优的 LALM 达到 86.1% 准确率。

    意义:提示开发者:语音场景下事实核查不能简单复用文本能力,需重视跨模态差距与检索证据的显式推理比对。

  • 广告韩风新品原创自制白桃粉尼龙通勤ipad托特单肩包A4文件手提斜挎包新款·淘宝·市场见平板上架/在售信号淘宝¥78 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    在线阴谋论的智能体检测

    Agentic Detection of Online Conspiracies

    摘要显示,社交媒体上的阴谋论话语并非总以明确主张或固定词汇标记出现,相同表层内容可能表达支持、合理关切、批评、讽刺或嘲弄,核心挑战在于推断说话者的言外之力。作者提出一个配备社会查询工具的智能体框架,利用社会语境进行判断,并在覆盖2018年末至2023年初约80%–90%希伯来语推文的独特数据集上验证。在人工标注的对抗性数据集上,语境感知工作流持续优于纯文本分类,智能体框架也显著优于其他框架与设置。

    意义:为内容审核与虚假信息检测提供新思路:将阴谋论识别从文本分类转向社会语境推理,智能体加工具查询的范式对开发者构建可解释审核系统有参考价值。

  • 论文公开站arXiv

    EquivSVA:跨等价 RTL 实现的行为断言形式化验证数据集

    EquivSVA: A Formally Verified Dataset of Behavioral Assertions Across Equivalent RTL Implementations

    摘要显示,EquivSVA 是一个围绕行为族组织的形式化验证数据集,每个族包含同一外部可观察行为的四个结构不同 RTL 实现、共享接口级金标准属性、三个受控变异体及形式验证证据。数据集涵盖 12 个类别、120 个行为族、480 个参考 RTL 实现、914 个金标准属性和 360 个变异体,每个族均通过固定 17 项验证套件,并提供了族安全的训练、开发与测试划分。

    意义:为 LLM 生成 SystemVerilog 断言提供行为级评测基准,可检验断言是否捕捉外部可观察行为而非实现细节,推动形式化验证与代码生成研究。

  • 论文公开站arXiv

    FleXray:通用临床X射线分割

    FleXray: Universal Clinical X-ray Segmentation

    摘要显示,X光因三维解剖被压缩为二维投影、结构重叠且边界模糊,导致通用分割标注数据难以构建。作者提出FleXray,利用已有3D全身CT分割数据集与生成式图像编辑模型构建基于物理的生成式X光数据引擎,合成带完整标注的二维X光。模型在未见研究数据集与真实临床X光上可分割60种解剖结构,并支持疾病分级测量、X光引导介入导航与病理目标的数据高效学习。

    意义:为X光提供通用全身分割能力,降低对人工标注的依赖,可推动医学影像定量分析与AI辅助介入应用。

  • 论文公开站arXiv

    onPanda:通过词元级修正高效标注LLM与智能体对齐数据

    onPanda: Efficient Annotation of On-Policy Alignment Data for LLMs and Agents via Token-Level Correction

    摘要显示,onPanda是一款用于高效标注LLM对齐数据与Agent轨迹的交互式工具,核心交互为Token级校正:标注者定位首个不当Token,从候选Token中选择替代或自由编辑,系统截断其后内容并从修正前缀继续生成,循环此过程。摘要称小规模对照研究显示其中位标注时间较人工后编辑减少52%,且因绝大多数Token由模型生成,数据较好保留采样分布,适合构建on-policy SFT与偏好数据;同时发布Panda-CVL数据集及Token…

    意义:Token级校正以低成本产出贴近模型采样分布的on-policy数据,并天然形成带位置的正负样本,可提升SFT与偏好数据构建效率。

  • 广告Usicoor新品IPAD框贴类纸膜IPADair3/4/5肯特纸膜纳米…新款·淘宝·市场见平板上架/在售信号淘宝¥56 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    GameHorizon套件:游戏中的多时间跨度数据与评估

    GameHorizon Suite: Multi-Horizon Data and Evaluation in Gameplay

    摘要显示,现有游戏数据集与基准存在覆盖游戏少、缺少语言指令、依赖高方差在线回合等问题。为此作者提出 GameHorizon 统一数据与评测套件,包含可扩展的多时间尺度指令标注流水线 GameHorizon-Annotator、首个大规模 AAA 游戏数据集 GameHorizon-Data(21 款游戏、5000 小时、100 名人类专家玩家录制,含时间对齐视频、玩家操作与多时间尺度指令),以及支持可复现离线与分步在线测试的 GameH…

    意义:为游戏智能体提供可复现的多时间尺度评测与大规模对齐数据,有助于定位长程规划与动作控制的失败环节。

  • 论文公开站arXiv

    粒子竞争与合作:标签噪声下鲁棒图卷积网络学习

    Particle Competition and Cooperation for Robust Graph Convolutional Network Learning Under Label Noise

    摘要显示,该工作提出PCC+GCN混合框架,在GCN训练前用粒子竞争与合作(PCC)作为基于图的标签精炼阶段,通过粒子支配动态识别可疑标注节点,并决定保留、删除或重新分配其标签;PCC所用图可加入特征k近邻边,而GCN仍在原始图结构上训练。在NoisyGL基准的十个图数据集上,常规均匀、Pair、随机噪声及实例相关噪声下,该方法取得最高平均准确率与最佳平均排名,较基线GCN平均提升1.67个百分点,并在十个数据集中八个上为最快鲁棒方法。

    意义:为标签噪声下的图神经网络训练提供即插即用的标签精炼前置模块,兼顾精度与速度,对噪声标注场景的GCN落地有参考价值。

  • 论文公开站arXiv

    CodeMidas:从代码本身扩展智能体编码RL环境

    CodeMidas: Scaling Agentic Coding RL Environments from Code Itself

    摘要显示,现有编码智能体 RL 环境多依赖 issue、commit 等开发痕迹,任务来源受限。CodeMidas 提出一种智能体流水线,仅以源代码为任务专属输入,将代码库中已实现的功能转化为可执行 RL 环境,通过智能体探索形成行为规格、基于原始代码执行构建测试,并经执行校验与多次解轨迹筛选任务。其数据集含来自 3,185 个开源代码库的 5,545 个训练任务,覆盖 23 种语言与 15 个技术领域。

    意义:为编码智能体 RL 训练提供低成本、可扩展的任务生成路径,降低对 issue/commit 等人工痕迹的依赖,利于开发者构建自有代码库训练环境。

  • 论文公开站arXiv

    ERCPMP-Gx:用于结直肠息肉形态、组织病理与基因组表征的内镜图像视频数据集

    ERCPMP-Gx: Endoscopic Image and Video Dataset for Morphological, Histopathological, and Genomic Characterization of Colorectal Polyposis

    摘要显示,该数据集面向遗传性息肉病综合征的AI识别与分类,包含160张图像及配套视频片段,多数采用Olympus EVIS X1的白光、窄带成像、放大窄带成像与近聚焦模式采集。约八成病例为经临床或基因确诊的遗传性息肉病综合征(FAP、PJS、JPS、GNS),其余两成为形态重叠的非遗传性息肉及类息肉病变,用于鉴别分类,并关联组织病理与胚系检测信息。

    意义:为AI在内镜图像中区分遗传性与非遗传性息肉病提供多模态标注数据,有望推动结直肠癌早期筛查与个体化监测模型研发。

  • 广告韩系新品自制乖巧奶蓝色尼龙手提包ipad单肩包休闲学生上班斜挎包新款·淘宝·市场见平板上架/在售信号淘宝¥79 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    PointZero:用于学习可迁移3D动力学的3D点轨迹补全

    PointZero: 3D Point Track Completion for Learning Transferable 3D Dynamics

    摘要显示,该研究提出将三维点轨迹补全作为预训练目标,在无需机器人动作标签的情况下学习可迁移的三维动力学先验。给定单次RGB-D观测与稀疏部分三维轨迹,模型预测所有观测点的未来三维轨迹。作者构建了涵盖可变形、铰接与刚性物体的290万帧合成数据集,并训练了基于Transformer的PointZero,在相同数据上优于既有方法;微调后在PGND三维动力学基准及6/7项仿真与真实机器人操作任务上表现优异。

    意义:为机器人学习提供无需动作标签的3D动力学预训练范式,可纳入网络视频数据,降低对昂贵机器人数据的依赖。

  • 论文公开站arXiv

    LimiX-2:面向通用结构化数据智能的上下文机制网络

    LimiX-2: A Contextual Mechanism Network Towards General Structured-Data Intelligence

    摘要显示,LimiX-2 是 LimiX 家族新模型,依据既有缩放律进行模型与数据扩展,采用上下文机制网络(CMN)范式并以 Context-Conditional Masked Modeling 预训练。CMN 将上下文学习的组织原则从以目标为中心的预测转向机制导向的联合建模,学习 p(x, y | D_context) 而非传统表格 PFN 的 p(y | x, D_context)。预训练数据由结构因果模型生成。在 TabAren…

    意义:为表格/结构化数据提供新的基础模型范式,兼顾预测性能与因果可解释性,对表格 AI 与因果发现方向有参考价值。

  • 论文公开站arXiv

    LLM助手的可验证社会推理

    Verifiable Social Reasoning for LLM Assistants

    摘要显示,针对LLM助手在社交咨询场景中难以评测的问题,研究者提出Fuse多智能体仿真框架:目标智能体带有隐藏动机,与包括用户代表的智能体互动,用户再向被评测助手咨询以推断该动机,从而天然构造可验证的真实标签。研究用2.4万条标注的人类研究验证仿真保真度,并在12个LLM上实验,发现用户中介会加剧社会推理难度、模型对用户有偏框架存在系统性敏感、模型有时需要比人类更多的细节才能做出正确预测,且更长对话不总能提升表现。作者开源Fuse及含2…

    意义:为LLM社交推理提供可验证评测基准与开源数据集,揭示用户中介与偏见框架对模型判断的系统性影响,利于助手安全性评估。

  • 论文公开站arXiv

    ENCP:用于视觉语言导航的回合归一化共形预测

    ENCP: Episode-Normalized Conformal Prediction for Vision-and-Language Navigation

    摘要显示,针对视觉语言导航(VLN)智能体需多步序贯决策、标准共形预测在校准中无法为依赖且变长的导航回合提供覆盖保证的问题,作者提出回合归一化共形预测(ENCP):用策略残差置信度重新缩放非一致性分数,并为每个回合校准一个最大分数。在可交换校准与测试回合假设下,该方法以至少 1-α 的概率覆盖每一步真值,同时允许回合内步骤间存在依赖。在 R2R 与 REVERIE 数据集上、四种 VLN 策略与三种非一致性分数下,ENCP 在已见到未见…

    意义:为序贯决策智能体提供模型无关的不确定性估计与覆盖保证,可用于判断导航智能体何时应交由更强预测器或人类协助。

  • 广告UNAQUE 新品适用ApplePencil可替换笔芯小黑头ipad笔尖…新款·淘宝·Apple相关平板上架/在售信号淘宝¥29 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    MDTE:面向时序边事件的少数类感知扩散框架用于不平衡节点分类

    MDTE: Minority-Aware Diffusion over Temporal Edge Events for Imbalanced Node Classification

    MDTE是一个针对时序图类别不平衡节点分类的少数类感知扩散框架,通过条件扩散去噪重建稳定且可区分的时序边事件表示。它包含分布感知选择性传播,利用LOF过滤和聚类感知低频传播缓解多数类信息同化;以及多视图判别融合,通过特征重建和拓扑预测提取互补判别信号。在五个真实数据集上,MDTE在少数类指标上优于最强基线,少数类召回率最高提升23.53个百分点。

    意义:为时序图上的类别不平衡问题提供了新思路,通过扩散模型和分布感知传播提升少数类识别能力,对异常检测和稀有事件预测等应用有重要价值。

  • 论文公开站arXiv

    有效学习率主导语言模型预训练中的损失动态

    Effective Learning Rate Governs Loss Dynamics in Language Model Pretraining

    摘要显示,在语言模型预训练中发现有效学习率(ELR)坍缩现象:学习率与参数范数主要通过其比值(即有效学习率)影响损失动态。当ELR匹配时,不同运行间的损失轨迹在整个训练过程中坍缩,尽管学习率和参数范数差异显著。跨优化器、架构、数据集和模型规模,平均坍缩误差通常为几乘以10^-3,低于代表性配置中种子间变异。系统消融表明,归一化设计和学习率-范数变化的时间尺度是坍缩精度的关键决定因素。受控干预进一步显示,权重衰减和超球形状主要通过其诱导的…

    意义:为语言模型预训练提供统一的优化视角,有助于改进学习率调度与范数控制策略,提升训练效率与可预测性。

  • 论文公开站arXiv

    基于几何理论的鲁棒公平性审计方法

    A Geometric Theory of Robust Fairness Audits

    摘要显示,邻近性公平性审计通过比较特征空间中相似个体的预测来评估个体公平性,但其自身鲁棒性未知。微小的特征扰动可能改变局部邻域,导致审计结果不同。研究提出几何框架,建立邻域不变性的充分条件,量化邻域替换对审计不稳定性的传播,并引入审计波动性指标。基准数据集实验支持理论分析,解释此类审计的稳定性。

    意义:为公平性审计提供理论保障,帮助开发者理解扰动对审计结果的影响,提升AI系统公平性评估的可靠性。

  • 论文公开站arXiv

    BioKERN:通过生物核正则化实现组织学-转录组学的邻域检索

    BioKERN: Biological Kernel Regularization for Histology-to-Transcriptomics Neighborhood Retrieval

    摘要介绍BioKERN,一种多模态空间表征学习框架,通过结合转录组相似性和空间邻近性构建训练时的生物核,提供分级邻域监督并正则化嵌入几何。在Mouse Brain Visium和Human Liver GSE240429数据集上,BioKERN在单尺度和多尺度设置下均优于BLEEP,且受控实验表明改进主要源于生物核正则化而非模型容量增加。

    意义:为空间生物学多模态学习提供可解释的归纳偏置,帮助开发者构建保留生物结构的表征,提升检索性能。

  • 广告2026新款手机散热器磁吸半导体制冷冰封静音散热背夹适用于小米华为苹果i…新款·淘宝·配件样本·苹果相关散热模组上架/在售信号淘宝¥56.67 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    LAION-BVD:千万小时级开放视频数据集,助力多模态预训练

    LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training

    LAION-BVD是LAION发布的大规模开放视频数据集,包含从CommonCrawl收集的13亿条平台视频URL,成功下载8000万段视频,总时长1000万小时。该数据集旨在支持视频、音频和图像多模态预训练,通过场景检测提取片段并合成字幕。基于此训练的模型在视频-文本和音频-文本基准上表现优异,且性能随规模提升。此外,提取的场景帧作为图像-文本数据源,展现出与网络图像不同的分布,模型在图像-文本检索上表现强劲。数据集已开源,显著扩大了…

    意义:为多模态预训练提供千万小时级开放视频资源,填补大规模视频数据空白,推动视频、音频、图像联合学习研究。

  • 论文公开站arXiv

    老年人下肢骨折或髋关节置换术后功能恢复与社会隔离的多结局预测

    Predicting Multiple Clinical Outcomes Related to Functional Recovery and Social Isolation Among Older Adults After Lower-Limb Fracture or Hip Replacement

    摘要显示,该研究利用MAISON-LLF数据集,包含18名社区老年人的多模态传感器和临床评估数据,监测长达8周。提取46个日度特征,每两周评估5项临床结局。采用多输出回归算法联合预测临床评分,结果显示联合预测优于单独预测,其中NODE模型表现最佳(MSE=3.96,MAE=1.02)。SHAP分析强调了多模态传感器的重要性。

    意义:对开发者而言,该研究展示了多模态传感器数据在多输出回归中的潜力,可启发健康监测AI模型设计,提升对老年康复过程的综合评估能力。

  • 论文公开站arXiv

    基于适配器的少样本持续学习用于恶意数据包识别

    Adapter-Based Few-Shot Continual Learning for Malicious Packet Recognition

    摘要显示,针对恶意软件变体持续演化,作者提出一种基于适配器的少样本类增量学习框架,用于恶意数据包识别。该方法使用自监督学习骨干网络,并通过领域特定预训练初始化,在基础会话中采用低秩适配(LoRA)微调,同时冻结核心骨干以保留旧知识,增量会话使用原型分类头。实验表明,该方法在多个数据集上优于现有恶意软件FSCIL基线,达到最先进性能。

    意义:该研究为恶意软件检测提供了一种高效的持续学习方案,能适应新威胁而不遗忘旧知识,对网络安全领域的AI模型部署具有实用价值。

  • 论文公开站arXiv

    局部蒸馏:实现可解释AI的新方法

    Interpretable AI with Local Distillation

    摘要提出局部蒸馏方法,通过黑箱教师模型指导正则化线性学生模型,在查询点附近实现高精度与可解释性。教师通过加权相似预测结果的训练观测定义局部性,并利用伪观测锚定拟合。通过高斯随机化评估特征选择稳定性,并在17个基准数据集上验证,局部蒸馏在保持高精度的同时提供透明解释。

    意义:该方法为高 stakes 决策提供兼顾准确性与可解释性的模型,有助于增强AI信任度,推动可解释AI在金融、医疗等领域的应用。

  • 广告瑞士Giggles儿童含氟牙膏宝宝3一6到12岁婴幼儿勿吞咽可防蛀龋齿新款·淘宝·市场见相关商品上架/在售信号淘宝¥99 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    基于物理约束深度学习的非接触式三轴体震信号血压监测模型

    Physics-Constrained Deep Learning Model for Contactless Blood Pressure Monitoring from Triaxial Bodyseismography

    本文提出Phy-BP框架,用于基于三轴体震信号(BSG)的非接触式血压监测。该框架包含自适应质量控制算法,筛选富含心源性成分的BSG段,并建立物理模型描述体-床系统中的三维波传播,嵌入深度学习模型以对齐多轴特征。在21名受试者162小时医院数据集上,Phy-BP能动态过滤低质量测量,并通过物理一致性约束提升模型鲁棒性,尤其在训练样本有限时表现良好。

    意义:该研究将物理模型与深度学习结合,提升非接触式血压监测的鲁棒性和泛化能力,对可穿戴健康监测和AI医疗应用具有重要意义。