- 论文公开站arXiv
解剖信息神经网络:在损失与架构中编码解剖先验,含导丝诱发主动脉髂动脉变形的SE(3)公式
Anatomy-Informed Neural Networks: Encoding Anatomic Priors in Loss and Architecture, with an SE(3) Formulation of Guidewire-Induced Aortoiliac Deformation
摘要介绍了解剖信息神经网络(AINN),将软解剖先验作为损失中的惩罚项(如分支惩罚),硬解剖先验(如血管连续性)内置于架构和状态表示中,使无效预测在构造上不可能。该方法应用于临床案例:导丝介入时主动脉髂动脉树的变形。通过将血管中心线和导丝路径提升至SE(3)中的曲线,耦合Cosserat杆与血管,使用Wasserstein-2最优传输损失,由2D血管造影训练3D预测。
意义:该工作为医学影像与手术导航提供新范式,利用解剖先验提升模型泛化性,对自主血管内介入导航有重要意义。
- 论文公开站arXiv
LLM缓存应使用哪种驱逐策略?跨工作负载、容量和编码器的系统研究
Which Eviction Policy Should an LLM Cache Use? A Systematic Study Across Workloads, Capacities, and Encoders
摘要显示,使用CLEVER协议评估了FIFO、LRU、LFU、ARC、GDSF、流式SISO及语义冗余策略,在18种设置中,无策略优于LFU超过0.041个百分点。FIFO和流式SISO在紧容量下落后LFU达8.67和8.55个百分点。条件打包结果解释了改进缺失。审计发现,在MiniLM中位阈值下,仅2.1-3.9%的命中可替换答案,质量调整后命中率从51-60%降至1.1-2.2%。阈值不跨编码器迁移。LFU是最强简单默认策略。
意义:为LLM缓存驱逐策略提供了系统比较,指出LFU作为强默认选择,并强调答案有效性验证的重要性,对缓存系统设计有指导意义。
- 论文公开站arXiv
可解释的Transformer模型用于结构化电子健康记录上的临床预测任务
Explainable Transformer Models for Clinical Prediction Tasks on Structured Electronic Health Records
摘要显示,研究者提出BERT-LER模型,一种基于BERT架构的模型,用于编码电子健康记录(EHR)时间线。该模型在包含7500万患者的去标识化EHR数据集上预训练和微调,将实验室检测结果编码为离散令牌,并通过基于百分位的分箱保留分级信息,结合集成梯度方法提供令牌级归因。在EHRShot基准和哮喘严重程度进展研究中,BERT-LER在预测性能上与公开基准模型竞争,在实验室相关任务上常超越它们,且归因与临床已知风险因素一致。
意义:该研究将实验室值表示与可解释性统一于一个框架,为EHR基础模型提供方法论补充,有助于临床预测的可靠性和临床采纳。