- 论文公开站arXiv
照搬相同,蒸馏差异:线性视觉Transformer的初始化
Copy the Same, Distill the Difference: Initializing Linear Vision Transformers
线性视觉Transformer(ViT)旨在用线性复杂度注意力算子替代Softmax ViT中的注意力,以实现更高效的token路由,但需要从头预训练,且通常性能不及原版Softmax。如何初始化是关键。
- 论文公开站arXiv
用自适应循环Transformer改进测试时扩展
Improving Test-Time Scaling with Adaptive Looped Transformers
循环Transformer通过复用层进行潜在计算,展现出良好的参数效率。此前研究在参数量或每token FLOPs匹配下比较循环与非循环模型,但循环是否改善测试时扩展尚不明确。
- 论文公开站arXiv
面向智能体强化学习高效压缩的KV-streams
KV-streams for Efficient Compaction in Agentic Reinforcement Learning
扩展智能体LLM的时域受限于需将越来越长的上下文轨迹装入GPU内存。上下文压缩是缓解该问题最常用的机制,可在给定轨迹下保持GPU内存恒定,但多数压缩策略存在不足。
- 论文公开站arXiv
如何循环MoE:展平专家,解绑注意力
How to Loop MoE: Flatten the Experts, Untie the Attention
循环Transformer多次复用同一层块:通过额外计算让固定规模模型走得更远,更充分利用参数;而稀疏混合专家(MoE)模型每个token只激活少数专家。循环MoE将两者结合。
- 论文公开站arXiv
神经调和测度算子
Neural Harmonic Measure Operator
我们提出神经调和测度算子(NHMO),一种用于变形状区域上椭圆偏微分方程问题的神经求解器。区域的调和测度是一种边界概率分布,与任意边界数据积分后即返回Dirichlet Laplace解。
- 资讯公开站rss_gf_news
拉伸天线:在9SW上采用9SW与SLATE™先进封装技术的先进天线调谐
Stretching the antenna: Advanced antenna tuning with 9SW and SLATE™ advanced packaging technology on 9SW
- 资讯公开站rss_gf_news
驱动下一次架构转变:深入解读GF的48V方案
Powering the next architecture shift: Inside GF’s approach to 48V
- 资讯公开站rss_mtwmag
AMTEX 2026:Machine Tools World 对话 Roxy Lin
AMTEX 2026 – Machine Tools World connected with Ms. Roxy Lin
在 AMTEX 2026 台湾馆,Machine Tools World 与 Roxy Lin 交流智能制造最新发展。她指出,印度是台湾企业扩大先进制造技术应用的重要市场。
- 资讯公开站rss_mtwmag
AMTEX 2026——机床世界连线蔡清枝女士
AMTEX 2026 – Machine Tools World connected with Ms. Ching-Chi Tsai
AMTEX 2026 | 台湾馆 在 AMTEX 2026 上,我们在台湾馆连线了蔡清枝女士,探讨塑造智能制造未来的最新发展。从先进技术到更智能的生产流程,这次对话重点介绍了创新如何帮助制造商变得更高效、更互联、更具未来准备。💡 关键要点:台湾馆正在展示可支持印度制造商迈向更自动化和互联生产的技术。🎥 观看完整采访,直接聆听蔡清枝女士的分享,了解他们对制造业未来的看法。#AMTEX2026 #台湾馆 #智能制造 #制造业 #工业自动化 …
- 资讯公开站rss_mtwmag
AMTEX 2026:Machine Tools World 对话 Vanessa Chang
AMTEX 2026 – Machine Tools World connected with Vanessa Chang
在 AMTEX 2026 台湾馆,Machine Tools World 与 Vanessa Chang 探讨智能制造趋势。她表示,印度对自动化和先进制造日益增长的需求,正为台湾科技公司带来新机遇。
- 资讯公开站gnews_asml_industry
AI芯片需求加速,ASML瞄准2028年出货110多台EUV设备
ASML Eyes 110+ EUV Tools in 2028 as AI Chip Demand Accelerates - Yahoo Finance
- 资讯公开站gnews_asml_industry
ASML 上涨 1.4%,EUV 产能逼近 110 台门槛
ASML Gains 1.4% as EUV Capacity Chases a 110-Tool Threshold - Yahoo Finance
- 资讯公开站rss_electronics_weekly
Gimlet Cloud 与 Cerebras 合作加速推理
Gimlet cloud and Cerebras to accelerate inference
Gimlet Labs 与 Cerebras Systems 达成合作,将 Cerebras 晶圆级计算与 Gimlet Cloud 结合,以大规模提供超高速 AI 推理服务。
- 资讯公开站rss_windpower_eng
美国2025年风电装机量将比上一年增加36%
US to install 36% more wind turbines in 2025 than previous year
根据Wood Mackenzie与美国清洁能源协会(ACP)发布的《美国风能监测》报告,美国预计在2025年新增超过7 GW的风电装机,较上一年增长36%,五年展望与上一季度预测相比保持不变。在充满挑战的……
- 资讯公开站rss_plastics_today
TotalEnergies Corbion 推出用于空气过滤的可再生 PLA
TotalEnergies Corbion Launches Renewable PLA for Air Filtration
- 资讯公开站rss_plastics_today
AI驱动专利公司为初创企业大幅降低成本
AI-Powered Patent Firm Slashes Costs for Startups
Fearn推出一家AI原生专利公司,提供三天内完成临时申请和固定费用服务,将前大型律所专家与内部工程团队相结合,服务于制造业和技术领域的初创企业。
- 资讯公开站rss_arxiv_cs_ai
BioDyad:同步生物医学发现与机器学习工程
BioDyad: Synchronize Biomedical Discovery and Machine Learning Engineering
arXiv:2609.31939v1 公告类型:新 摘要:智能体生物医学机器学习(ML)依托生物医学证据获取与可执行程序搜索两方面的互补进展。现有系统连接了这些能力的部分方面,但在整个程序搜索过程中协调它们仍具挑战性。新证据必须指导候选构建,执行结果必须为后续发现与复用提供信息,验证需求必须契合搜索预算。我们提出 BioDyad,通过蒙特卡洛图搜索中的两个层级将生物医学发现与 ML 工程耦合。其科学层级将先验生物医学指导与迭代发现相结合…
- 资讯公开站rss_arxiv_cs_ai
通过嵌入式编码改进大语言模型的医学计算能力
Improving Medical Calculation of LLMs with Embedded Coding
arXiv:2609.31908v1 公告类型:新 摘要:大语言模型(LLM)在医学考试和问答基准上表现良好,但在需要精确数值输出的医学计算任务上仍不可靠。这些计算支撑着用药剂量、器官功能评估和预后评分等高风险决策,即使很小的误差也可能带来严重的临床后果。我们提出 MedCode,一个通过训练 LLM 生成嵌入式可执行代码来改进医学计算的框架。给定临床情境,模型识别相关计算器,提取其输入变量,并生成一段将算术运算委托给确定性解释器的脚本…
- 资讯公开站rss_arxiv_cs_ai
EmailBench:评估LLM智能体在企业邮件与生产力任务上的基准
EmailBench: A Benchmark for Evaluating LLM Agents on Enterprise Email and Productivity Tasks
arXiv:2609.31906v1 公告类型:新 摘要:企业邮件智能体必须结合信息检索、结构化状态变更、时间推理和多步协调。近期的智能体基准包含生产力任务,但很少有以自包含环境中的类型化邮件工作流为中心。我们推出 EmailBench,一个涵盖 16 个任务类别、206 个邮件与生产力场景的基准。该基准将带类型化邮件 API 规范与提供商中立命名相结合,包含一个确定性的、受 Enron 启发的合成语料库,以及一套场景套件,其主题选择参…
- 资讯公开站rss_arxiv_cs_ai
COUNTERMEM:面向语言智能体的世界模型验证反事实记忆
COUNTERMEM: World-Model Verified Counter-Factual Memory for Language Agents
arXiv:2609.31874v1 公告类型:新 摘要:现有智能体记忆框架主要通过智能体与事实世界的交互来构建记忆,例如记住已采取行动的反馈,以提升未来任务的表现。然而,这些框架在构建记忆时很少提出“如果……会怎样”的问题:如果采取了不同的行动,反馈是否会改变,以及这种反馈如何能成为有用的记忆?在主动环境中直接获取此类反馈可能代价高昂,并且可能改变用于比较所需的状态。在这项工作中,我们提出了 COUNTERMEM,一个用于跨任务构建和…
- 资讯公开站rss_arxiv_cs_ai
ConflictVLA-Bench:评估视觉-语言-动作模型对前提冲突的行为反应
ConflictVLA-Bench: Benchmarking Behavioral Responses of Vision-Language-Action Models to Premise Conflicts
arXiv:2609.31792v1 公告类型:新 摘要:视觉-语言-动作(VLA)模型在操作任务上表现强劲,但其对无效任务前提的反应仍未被充分探索。现有对前提冲突的评估往往聚焦于最终任务结果,然而仅凭任务失败无法区分行为脱离与继续追求随后出现执行错误。我们将后一种模式称为“失败坚持”(Failed Persistence)。为研究这一现象,我们提出 ConflictVLA-Bench,它将冲突 rollout 与前提一致的参考 rol…
- 资讯公开站rss_arxiv_cs_ai
SMARtCARE:面向有限自主临床决策支持的隐私保护智能体AI系统
SMARtCARE: Privacy-Preserving Agentic AI Systems for Bounded-Autonomy Clinical Decision Support
arXiv:2609.31763v1 公告类型:新 摘要:长上下文临床AI系统在既往入院记录超出当前推理上下文时,可能遗漏相关患者病史。在ICU监测中,这会导致早期生命体征漂移看似非特异性,即使其与既往恶化模式相似。SMARtCARE通过四状态临床决策支持架构解决这一缺口:稳定、元认知、辅助和受管制(撤销)。SMARtCARE不自动检索既往记录,而是使用患者既往轨迹的有损六通道指纹。当当前漂移与该指纹匹配且既往记录不在上下文中时,系统会…
- 资讯公开站rss_digitimes
Cerebras 将助力 Gimlet 推进更快的 AI 推理
Cerebras to power Gimlet's push for faster AI inference
随着对能够从日益复杂的 AI 模型提供更快响应的计算系统的需求增长,Cerebras Systems 正通过与 Gimlet Labs 的合作,扩大其在 AI 推理基础设施领域的布局。
- 论文公开站arXiv
复合自适应控制的收缩动力学表示统计学习
Statistical Learning of Contractive Dynamical Representations for Composite Adaptive Control
提出一种面向动态耦合扰动下复合自适应跟踪控制的表示学习框架,将经典扰动适应控制(DAC)与近期末层自适应扰动抑制方法联系起来。
- 论文公开站arXiv
TokenCast:预测LLM智能体执行中的Token消耗
TokenCast: Forecasting Token Consumption During LLM Agent Execution
同一任务下LLM智能体各次运行的Token消耗可相差一个数量级以上,因智能体依据工具反馈与中间结果选择下一步,且上下文不断膨胀推高输入规模。