全球科技每日监测AI 与全技术每日扫描

中文读懂 AI 与全技术今天发生了什么

邮箱轻订阅 · 免费开订每日精选技术情报:中文标题 → 要点 → 详情链。主题月卡加量 · 数据 API 可对接。

AI 与全技术每日扫描

全球科技每日监测

中文读懂今天发生了什么 · 按时间更新 · 全量浏览

今日 125 条 · 论文 15 · 资讯 110 查看今日归档

免费邮箱订阅 主题月卡 数据 API →

数据源:本地 Harness 库 · 搜索「LoRA」共 11 条

  • 论文公开站arXiv

    UniSlider: Perceptually Uniform Sliders for Continuous Image Editing

    Sliders provide an intuitive interface for continuous image editing. In current generative approaches, however, the slider is simply a rescaling of the method's strength parameter, such as an adapter coefficient, a promp…

  • 论文公开站arXiv

    Planning to Learn

    Policy-gradient methods are central to modern reinforcement learning, including LLM post-training. When they struggle, the usual suspects are exploration, credit assignment and action-sampling noise. Classification has n…

  • 论文公开站arXiv

    FERPO: Forward Entropy-Regularized Policy Optimization

    Several state-of-the-art methods for online reinforcement learning in continuous control improve policies using action gradients of a learned critic. However, critics are typically trained to predict returns, and accurat…

  • 论文公开站arXiv

    WorldAuditBench:多模态智能体的交互式3D世界审计

    WorldAuditBench: Interactive 3D World Auditing with Multimodal Agents

    随着交互式3D世界被广泛用于研究智能行为,识别其中异常(如悬浮物体、可穿墙、与环境不一致的物体)的高效流程变得重要,本文提出相应基准。

  • 广告宝华韦健Zeppelin Pro齐柏林飞艇第6代新款 无线HIFI蓝牙智…京东新款样本,适合先看规格与上架节奏再决定是否入手。京东¥150 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    PReCache:通过低秩预计算与中性重建实现多 LoRA 智能体的高效 KV 缓存共享

    PReCache: Efficient KV Cache Sharing for Multi-LoRA Agents via Low-Rank Precomputation and Neutral Reconstruction

    多 LoRA 智能体系统通过共享公共骨干模型实现高效角色专业化。然而,每个智能体重复处理不断增长的共享轨迹并构建自己的 KV 缓存,在长时程任务中造成大量内存和计算冗余。

  • 论文公开站arXiv

    新的LoRA技能应只读不写

    New LoRA Skills Should Read but Never Write

    摘要显示,该论文针对多个独立训练的LoRA适配器难以合并的问题,指出权重空间合并会相互干扰、全量重训成本高、路由方案又失去单一模型的意义。作者提出READ方法,将每个适配器重写为保持更新等价的平衡规范形式,并让新旧技能耦合单向生长:新技能可读取旧技能输入子空间但不能写入其输出子空间,每次追加仅训练耦合矩阵中新技能对应的一行,组合更新可折叠进基础权重,无推理成本与路由。

    意义:为多任务LoRA合并提供免路由、零推理开销的持续学习方案,对模型能力增量扩展与适配器组合有工程价值。

  • 论文公开站arXiv

    用于高效端侧LLM生成式个性化的LoRA生成超网络

    LoRA-generating hypernetworks for efficient on-device LLM generative personalization

    摘要显示,该论文提出一种设备端LLM个性化方法:训练超网络将用户上下文token映射为适合该用户的LoRA,部署后在设备端合成个性化LoRA。该方法结合了上下文学习(ICL)与参数高效微调(PEFT)的优点:设备端阶段仅需前向传播,计算可行;同时通过权重修改基础模型,避免扩展输入序列带来的延迟增加,尤其适合移动设备场景。

    意义:为移动端LLM个性化提供无需反向传播的可行路径,降低设备端算力与延迟门槛,对端侧AI应用开发有参考价值。

  • 论文公开站arXiv

    基于适配器的少样本持续学习用于恶意数据包识别

    Adapter-Based Few-Shot Continual Learning for Malicious Packet Recognition

    摘要显示,针对恶意软件变体持续演化,作者提出一种基于适配器的少样本类增量学习框架,用于恶意数据包识别。该方法使用自监督学习骨干网络,并通过领域特定预训练初始化,在基础会话中采用低秩适配(LoRA)微调,同时冻结核心骨干以保留旧知识,增量会话使用原型分类头。实验表明,该方法在多个数据集上优于现有恶意软件FSCIL基线,达到最先进性能。

    意义:该研究为恶意软件检测提供了一种高效的持续学习方案,能适应新威胁而不遗忘旧知识,对网络安全领域的AI模型部署具有实用价值。

  • 广告华为Sound X5 蓝牙音箱新品AI大模型悦彰音箱家用桌面电脑音响无线…京东新款样本,适合先看规格与上架节奏再决定是否入手。京东¥1999 · 精选自 全球电商每日爆款去看看
  • 论文公开站arXiv

    ReWorld:具备长时记忆的交互式世界模型

    ReWorld: An Interactive World Model with Long-Horizon Memory

    摘要显示,ReWorld是一种交互式世界模型,通过混合注意力窗口和随机头路由,在训练时分离控制与记忆,推理时使用有界KV缓存和姿态索引地标库,实现长时记忆下的实时视频生成。数据引擎统一多源数据尺度,并通过LoRA蒸馏实现四步采样,在704x1280分辨率下实时生成,在动作跟随、长时记忆和视频质量方面优于六种现有模型。

    意义:ReWorld解决了交互式世界模型中控制与记忆的结构性矛盾,实现了长时记忆下的实时高保真视频生成,对虚拟现实、游戏和机器人仿真等应用具有重要意义。

  • 论文公开站arXiv

    注入、对齐、恢复:面向无检索文档知识内化的分阶段后训练框架

    Inject, Align, Recover: Staged Post-Training for Retrieval-Free Document Knowledge Internalization

    大型语言模型在推理时无法检索源文档时,往往难以回答关于特定文档集的问题。为此,本文提出IAR(注入、对齐、恢复)三阶段后训练框架,将固定语料转化为可用的参数化知识,实现无检索问答。注入阶段采用续写、改写和指令条件重建目标;对齐阶段使用仅答案的问答监督;恢复阶段合并领域适配模型与基础指令模型以恢复通用能力。实验显示,在多个模型家族和数据集上,IAR在领域问答准确率上平均提升3.6个百分点,通用性能平均提升12.1个百分点。

    意义:该框架为无需检索的文档知识内化提供了新方法,提升领域问答准确率的同时保持通用能力,对构建高效、实用的领域专用模型具有重要意义。

  • 论文公开站arXiv

    幻影增益:对照实测零基准审计自我改进

    Phantom Gains: Auditing Self-Improvement Against a Measured Null

    摘要显示,评估语言模型自我改进时,追踪个体问题得失易受测量伪影影响。对Qwen3-8B进行三轮LoRA自训练,与冻结对照比较,发现七种测量失败,每种在无对照时都会反转报告结论。贪心解码产生的记录在未训练模型上制造能力变化,扩展统计量错误归因。提出逐问题精确检验,在FDR控制下未检测到任何保留复制上的效应。外部蒸馏改善基础模型难及问题,而三种自训练未现此效,回归分析拒绝不对称性源于蒸馏总体增益更大(p<10^-8)。

    意义:为AI开发者提供评估模型自我改进的严谨审计方法,避免测量伪影导致虚假结论,对模型迭代和对比至关重要。