- 论文公开站arXiv
SILSA: Sliding-Window Slice Latents for Topology-Preserving High-Resolution 3D Generation
High-resolution 3D generation increasingly relies on voxel latents and multi-stage pipelines that first predict active structure and then synthesize local geometry. While effective, this design fragments continuous surfa…
- 论文公开站arXiv
Compression Footprints as Security Signals for Model-Poisoning Defense in Federated Learning
Lossy compression is widely used in Federated Learning (FL) but is generally treated as an error source, while conventional poisoning defenses inspect update geometry. In this work, we instead treat the compressor's resp…
- 论文公开站arXiv
去除时间捷径可改进非侵入式脑机文本解码
Removing Timing Shortcuts Improves Non-Invasive Brain-to-Text
研究发现,多项报道的非侵入式脑信号词解码性能提升,在完全不用脑数据的情况下也能复现。在 d'Ascoli 等人(2025)的工作中,受试者感知连续语音的脑活动时间序列被分段处理。
- 论文公开站arXiv
如何循环MoE:展平专家,解绑注意力
How to Loop MoE: Flatten the Experts, Untie the Attention
循环Transformer多次复用同一层块:通过额外计算让固定规模模型走得更远,更充分利用参数;而稀疏混合专家(MoE)模型每个token只激活少数专家。循环MoE将两者结合。
- 论文公开站arXiv
TokenCast:预测LLM智能体执行中的Token消耗
TokenCast: Forecasting Token Consumption During LLM Agent Execution
同一任务下LLM智能体各次运行的Token消耗可相差一个数量级以上,因智能体依据工具反馈与中间结果选择下一步,且上下文不断膨胀推高输入规模。
- 论文公开站arXiv
用价值移植引导语言模型目标
Steering Language Model Goals with Value Transplant
推理模型常表现得仿佛在追求目标,但其努力并不总指向用户意图,有时导致意外结果。先前工作研究了模型如何通过“价值”内部追踪其目标进展。
- 论文公开站arXiv
连续流心室辅助装置集成系统架构的高效生理控制
Efficient physiological control of an integrated system architecture for continuous-flow ventricular assist devices: in-silico study
摘要显示,该研究提出并评估了一套用于连续流心室辅助装置(VAD)生理控制的集成系统架构(ISA)。控制器基于VAD流入插管的压力测量估算心率和心室充盈压,动态调节转速以优化装置与患者交互。在27个仿真场景中,转速相对基线6000 rpm调整范围为-10%(-600 rpm)至+43%(+2600 rpm),消除了无控制条件下出现的12例心室抽吸与回流事件,并观察到左心室射血分数、心肌氧耗、氧输送及心脏功率等血流动力学与代谢指标的改善。
意义:为VAD智能闭环控制提供仿真验证路径,展示基于压力传感的生理自适应调速可减少抽吸等不良事件,对医疗AI与植入式设备控制算法开发者有参考价值。
- 论文公开站arXiv
嵌入模型以奇特方式度量
Embedding Models Measure in Peculiar Ways
摘要显示,该研究考察嵌入空间是否反映质量、距离、时间和体积等物理测量,而这些量本应具有唯一客观的语义等价与距离关系。结果发现,嵌入空间对物理测量的建模仅较弱,且呈现出相当奇特的度量模式;进一步分析表明,物理测量的嵌入表示受表层字符串相似性强烈影响,重新校准相似度也未显著改善对齐效果。
意义:提示嵌入模型的语义相似度可能被表层字符串特征主导,对需要数值与物理量推理的应用构成风险。
- 论文公开站arXiv
模型增长、递归和边界算子如何影响缩放指数
How Model Growth, Recursion, and Boundary Operators Influence Scaling Exponents
摘要显示,该研究挑战了缩放定律中指数固定的传统认知,指出架构干预可改变预训练缩放指数,从而随算力增加带来指数级性能提升。作者以循环Transformer为锚点,发现模型增长(含是否共享权重)对缩放指数影响最大:7.4B增长架构在CORE上以约20倍更少算力匹配GPT-3 13B,且算力效率增益随规模增大。普通Transformer中加入边界算子也有较小增益;数据受限多轮训练下,循环具正则化效果,且随规模增加循环数为算力最优。
意义:若缩放指数可被架构改变,则算力效率提升会随规模放大,为开发者提供超越单纯堆参数的新扩展路径。
- 论文公开站arXiv
读取不等于使用:检索、判断与AI金融研究工作流的设计
Reading Is Not Using: Retrieval, Judgment, and the Design of AI Financial Research Workflows
摘要显示,大型语言模型在金融分析中的评估通常基于检索能力,而非检索信息对判断的影响。研究发现,在长上下文金融分析中存在“检索-整合缺口”:当无关上下文从2000增至128000个token时,风险披露对投资判断的影响降至噪声水平,尽管直接检索仍准确。该现象在多个模型家族和任务中复现,且更强大的模型仅推迟而非消除此缺口。因果记忆干预表明,压缩摘要和源文本查找共同传递披露信息,而工作流架构(如分块-总结流水线会逐出相关信息)决定传递成败。因…
意义:对AI行业而言,提示了仅靠检索评估的不足,强调工作流设计对模型实际决策的影响,为金融AI系统开发提供关键考量。