- 资讯公开站rss_arxiv_cs_ai
通过嵌入式编码改进大语言模型的医学计算能力
Improving Medical Calculation of LLMs with Embedded Coding
arXiv:2609.31908v1 公告类型:新 摘要:大语言模型(LLM)在医学考试和问答基准上表现良好,但在需要精确数值输出的医学计算任务上仍不可靠。这些计算支撑着用药剂量、器官功能评估和预后评分等高风险决策,即使很小的误差也可能带来严重的临床后果。我们提出 MedCode,一个通过训练 LLM 生成嵌入式可执行代码来改进医学计算的框架。给定临床情境,模型识别相关计算器,提取其输入变量,并生成一段将算术运算委托给确定性解释器的脚本…
- 论文公开站arXiv
复合自适应控制的收缩动力学表示统计学习
Statistical Learning of Contractive Dynamical Representations for Composite Adaptive Control
提出一种面向动态耦合扰动下复合自适应跟踪控制的表示学习框架,将经典扰动适应控制(DAC)与近期末层自适应扰动抑制方法联系起来。
- 论文公开站arXiv
TokenCast:预测LLM智能体执行中的Token消耗
TokenCast: Forecasting Token Consumption During LLM Agent Execution
同一任务下LLM智能体各次运行的Token消耗可相差一个数量级以上,因智能体依据工具反馈与中间结果选择下一步,且上下文不断膨胀推高输入规模。
- 资讯公开站rss_arxiv_cs_ai
Benchy:迈向面向任务型AI基准测试的通用语言
Benchy: towards a universal language for task-oriented AI benchmarks
arXiv:2609.30550v1 公告类型:新 摘要:Benchy 是一种用于对 AI 程序进行基准测试的语义语言与执行引擎。一个基准由程序、评分函数和数据集完整指定,B=(P,S,D),并与接受测试的 AI 系统相分离;一次运行将二者绑定,R=(B,AI)。基准以规范 YAML 编写,其中每个语义概念只有一种有效语法,并由共享的任务/领域/语言本体分类,且被确定性地编译为规范 JSON 中间表示,由引擎执行。编译改变的是表示,而非…
- 资讯公开站CNX Software
Walnut Pi CM2:基于全志T527八核SoC的低价树莓派CM5替代方案
Walnut Pi CM2 – A cheaper Raspberry Pi CM5 alternative based on Allwinner T527 octa-core SoC
Walnut Pi CM2是一款低成本、兼容树莓派CM5的计算模块,搭载全志T527八核Cortex-A55处理器,最高4GB LPDDR4内存、16GB eMMC闪存,并可选配无线模块。
- 论文公开站arXiv
新的LoRA技能应只读不写
New LoRA Skills Should Read but Never Write
摘要显示,该论文针对多个独立训练的LoRA适配器难以合并的问题,指出权重空间合并会相互干扰、全量重训成本高、路由方案又失去单一模型的意义。作者提出READ方法,将每个适配器重写为保持更新等价的平衡规范形式,并让新旧技能耦合单向生长:新技能可读取旧技能输入子空间但不能写入其输出子空间,每次追加仅训练耦合矩阵中新技能对应的一行,组合更新可折叠进基础权重,无推理成本与路由。
意义:为多任务LoRA合并提供免路由、零推理开销的持续学习方案,对模型能力增量扩展与适配器组合有工程价值。
- 资讯公开站CNX Software
紧凑型长波红外相机:STM32N6 MCU搭配Lynred ATI320热传感器
Compact Long-Wave Infrared camera pairs STM32N6 MCU with Lynred ATI320 thermal sensor
摘要显示,8devices 推出 8Sight T100 紧凑型长波红外热成像相机,面向无人机、机器人与工业应用。其将 Lynred ATI320 长波红外传感器与 STM32N6(Arm Cortex-M55,含 Neural-ART NPU 与硬件 ISP)结合,可提供 320×240、60fps 热成像视频,并完全离线运行,支持部署自定义 AI 模型进行目标检测、异常检测或温度触发事件。
意义:该产品把热成像传感器与带 NPU 的 MCU 集成在紧凑模块中,使边缘设备无需云端即可完成实时热成像 AI 推理,利好无人机与工业检测开发者。
- 论文公开站arXiv
作者验证的对比学习
Contrastive Learning for Authorship Verification
摘要显示,在测试设定下对比学习方法在作者身份验证任务上优于基于分类的方法。研究识别出损失函数、批量大小、训练时长、预训练模型、输入上下文长度及随机文本片段数据增强为影响模型性能的关键因素,并据此构建了ModernBERT双编码器模型,在PAN21作者身份验证任务上取得98.4%的准确率。
意义:为文本作者归属与AI生成内容溯源提供高精度基线,双编码器+对比学习范式可迁移至其他文本匹配任务。
- 资讯公开站CNX Software
移远SE200ZC-AP智能模块支持最多五摄像头,搭载瑞芯微RV1126B/BJ SoC
Quectel SE200ZC-AP smart module supports up to five cameras with Rockchip RV1126B/BJ SoC
摘要显示,移远通信推出40×40mm紧凑型智能模块SE200ZC-AP,基于瑞芯微RV1126B/RV1126BJ四核Arm Cortex-A53 SoC,集成12MP ISP、8MP AI-ISP与3 TOPS NPU。模块通过两路4-lane MIPI CSI和一路DVP接口支持最多五路12MP摄像头,配备千兆以太网、USB 3.0/2.0、两路CAN FD及丰富外设,提供1GB/2GB/4GB LPDDR4x与64GB eMMC,…
意义:为边缘视觉与工业AI设备提供高集成、多摄像头接入的国产SoC模块方案,便于开发者快速构建智能安防、机器人与车载视觉产品。
- 资讯公开站CNX Software
联发科天玑 CX C10 Max 八核 Cortex-X925/X9/A720 SoC 瞄准 Googlebook
MediaTek Dimensity CX C10 Max octa-core Cortex-X925/X9/A720 SoC targets Googlebooks
摘要显示,联发科 Dimensity CX C10 Max 采用 3nm 工艺与「全大核」八核 Armv9 CPU 架构,搭载 11 核 Immortalis-G925 MC11 GPU 和算力最高 55 TOPS 的 890 NPU,面向一款「即将推出的高端超便携 Googlebook 设备」,主打全天续航。Googlebook 是谷歌新的高端笔记本品类,围绕 Gemini Intelligence 构建,运行代号 Aluminium…
意义:联发科切入 Googlebook 高端笔记本平台,意味着 Arm 阵营在 PC 端再添竞争者,端侧 AI 算力与 Gemini 生态整合值得开发者关注。
- 论文公开站arXiv
基于 LLM 的代码漏洞修复中的指标失效:实证研究与变更感知筛选
Metrics Failure in LLM-Based Code Vulnerability Repair: An Empirical Study and a Change-Aware Screen
摘要显示,作者通过五项对照实验(203个Big-Vul漏洞函数、三个开源代码LLM、三种提示策略)论证编译率在单函数漏洞修复评估中不可靠:约64%的编译失败与模型无关,同一补丁在单个编译器标准标志下编译率波动1.8至2.7倍,且与参考相似度指标给出的模型排序相反;作为优化目标还会奖励删除与占位符式非修复。整函数CodeBLEU同样失效,连未修改的漏洞输入也得分高于所有模型。作者另考察仅对编辑区域打分的diff_F1变更感知筛选方法。
意义:提醒开发者与研究者:以编译率或整函数相似度衡量LLM漏洞修复会得出误导性结论,评估应关注实际修改区域。
- 资讯公开站CNX Software
Soulart Station:面向VR与VTuber的无标记全身动作追踪器(众筹)
Soulart Station – A markerless full-body motion tracker for VR and VTubers (Crowdfunding)
韩国初创公司 Soulart 推出 Soulart Station,一款面向 VR、VTubing 与动作捕捉的无标记全身动捕设备。摘要显示,该设备采用 ToF 传感器与板载双核 NPU,在本地运行机器学习模型处理 3D 点云,无需 PC GPU 或云端算力,可输出 23 关节 6DoF 动作数据,官方宣称 ML 延迟低于 10 毫秒;仅传输动作数据以保护隐私,支持 Wi-Fi,ToF 模块为 940nm 红外,SoC 型号尚未公布。
意义:端侧 NPU 完成动捕推理,可降低 VR/VTuber 使用成本与隐私风险,反映边缘 AI 在实时感知设备中的落地趋势。
- 论文公开站arXiv
CodeMidas:从代码本身扩展智能体编码RL环境
CodeMidas: Scaling Agentic Coding RL Environments from Code Itself
摘要显示,现有编码智能体 RL 环境多依赖 issue、commit 等开发痕迹,任务来源受限。CodeMidas 提出一种智能体流水线,仅以源代码为任务专属输入,将代码库中已实现的功能转化为可执行 RL 环境,通过智能体探索形成行为规格、基于原始代码执行构建测试,并经执行校验与多次解轨迹筛选任务。其数据集含来自 3,185 个开源代码库的 5,545 个训练任务,覆盖 23 种语言与 15 个技术领域。
意义:为编码智能体 RL 训练提供低成本、可扩展的任务生成路径,降低对 issue/commit 等人工痕迹的依赖,利于开发者构建自有代码库训练环境。
- 论文公开站arXiv
FAMOS:从稀疏观测前馈式建模3D铰接物体
FAMOS: Feed-Forward 3D Articulation Modeling from Sparse Observations
摘要显示,FAMOS 是一种前馈模型,可从稀疏、无序的部分点云集合中预测可动部件分割与关节参数,联合推理多个观测并支持可变数量输入(含单视图)。方法引入 Multi-state Articulation Transformer,交替进行状态级与全局注意力,并提出 observed articulation span 目标以监督各部件在输入观测中的运动范围。作者还构建程序化数据生成器合成自标注资产,在 PartNet-Mobility、A…
意义:为机器人操作与具身智能提供无需逐物体优化的稀疏视图铰接物体建模方案,降低对类别级形状先验与密集观测的依赖。
- 资讯公开站CNX Software
AAEON MIX-PTLWV1 Panther Lake 工业 mini-ITX 主板:四路 DisplayPort、双 10GbE 等
AAEON MIX-PTLWV1 Panther Lake industrial mini-ITX motherboard offers quad DisplayPort, dual 10GbE, and more
AAEON MIX-PTLWV1 是一款基于 Intel Core Ultra 系列 3“Panther Lake”处理器的工业 mini-ITX 主板,配备两个 10GbE 和两个 2.5GbE RJ45 网口,以及四个支持 4K 输出的 DisplayPort。该主板支持最高 128GB DDR5 C/SO-DIMM 内存、M.2 NVMe 存储、可选 WiFi/蓝牙与 4G LTE/5G 模块、PCIe Gen4 x8 扩展槽、六…
意义:面向边缘计算与工业视觉场景,提供高密度网络与多屏输出,为开发者提供 Panther Lake 平台的工控主板选型参考。
- 资讯公开站CNX Software
基于CVITEK CV1842H-P的边缘AI相机模块支持夜视与AI-ISP
CVITEK CV1842H-P-based edge AI camera module offers night vision and AI-ISP support (Crowdfunding)
AIMORELOGY Ovis是一款基于CVITEK CV1842H-P SoC的开源AI视觉相机模块,提供全彩1080p夜视和1.5 TOPS边缘AI推理能力,采用紧凑堆叠式模块化设计。其20×20mm核心板集成CV1842H-P、2 Gbit NAND闪存、USB与UART调试焊盘;传感器板搭载SC235HAI图像传感器并增加以太网和UART接口,可选CVBS板。面向无人机、机器人、安防系统、智能相机及定制嵌入式视觉产品。
意义:为开发者提供低功耗、带NPU与夜视能力的开源视觉模块,可加速无人机、机器人和安防等边缘AI视觉产品原型开发。
- 资讯公开站CNX Software
Alif Semi Balletto B1与Ensemble E1C开发板搭载Cortex-M55+Ethos-U55 MCU
Alif Semi Balletto B1 and Ensemble E1C StartKits feature Cortex-M55 + Ethos-U55 MCU for IoT and Edge AI
Alif Semiconductor发布Ensemble E1C(SK-E1C)与Balletto B1(SK-B1)两款低成本开发板,基于其Cortex-M55+Ethos-U55微控制器。两者均配备160MHz Cortex-M55 CPU、Ethos-U55 NPU、2MB SRAM与1.8/1.9MB NVM,并提供Arducam摄像头接口、mikroBUS扩展插槽和两个PDM麦克风。Balletto B1额外支持BLE 5.3…
意义:为 IoT 与边缘 AI 开发者提供低成本、带 NPU 的 Cortex-M55 开发平台,便于快速验证语音、视觉与传感器类端侧 AI 方案。
- 资讯公开站CNX Software
NeoEyes NE302:基于STM32N6的微型USB-C WiFi 6边缘AI视觉摄像头
NeoEyes NE302 – A tiny USB-C-powered WiFi 6 Edge AI Vision camera based on STM32N6 MCU
CamThink发布NeoEyes NE302微型WiFi 6边缘AI摄像头,基于STM32N6 Arm Cortex-M55 MCU与Neural-ART NPU,面向开发者与创客。相比同芯片的NE301,该机无电池、USB-C仅供电,内存降至32MB PSRAM与64MB SPI flash,并取消4G LTE、音频晶圆、PIR接口、16针GPIO及PoE支持。
意义:为开发者提供低成本、小体积的 MCU 级边缘 AI 视觉方案,便于快速集成到嵌入式视觉与物联网项目。
- 资讯公开站CNX Software
Amlogic A123X与C305X2 Cortex-A320 SoC面向工业和低功耗AIoT
Amlogic A123X and C305X2 Arm Cortex-A320 SoCs target industrial and low-power AIoT applications
Amlogic推出四核A123X与双核C305X2两款基于Arm Cortex-A320(Armv9.2-A、SVE2)的SoC,面向机器人、行车记录仪、IP摄像头、视频会议等工业及电池供电边缘AI与IoT场景。Amlogic成为首个发布Cortex-A320 SoC的芯片厂商。A123X支持4K 60fps H.264/H.265编码与4K 30fps解码,并集成4 TOPS ADLA2 NPU与8 TOPS ADLA3 NPU。官方…
意义:Cortex-A320 首次商用落地,为低功耗边缘 AI 设备提供 Armv9 新选择,可能影响工业 AIoT 芯片选型与端侧 NPU 竞争格局。
- 资讯公开站CNX Software
LattePanda Mu Ultra计算模块搭载Intel Core Ultra 5 226V/7 256V Lunar Lake CPU
LattePanda Mu Ultra Compute Module features Intel Core Ultra 5 226V/7 256V Lunar Lake CPU for AI workloads
LattePanda Mu Ultra是一款x86计算模块,采用Intel Core Ultra 5 226V或Ultra 7 256V(Lunar Lake)处理器,配备16GB DDR5内存,沿用69.6×60mm紧凑尺寸,AI性能最高115 TOPS。目标应用包括机器人、工业自动化、便携仪器、视觉AI及边缘AI。
意义:为边缘 AI 与机器人开发者提供紧凑、高算力的 x86 模块选项,Lunar Lake 的 NPU 与 Arc GPU 可支撑本地 AI 推理。
- 资讯公开站CNX Software
Amlogic A311Y3 Cortex-A78/A55 边缘 AI 模块提供最高 8 TOPS 算力
Amlogic A311Y3 Cortex-A78/A55 Edge AI system-on-module delivers up to 8 TOPS
Boardcon CM311Y3 系统级模块基于 Amlogic A311Y3 八核 Cortex-A78/A55 SoC,集成最高 8 TOPS NPU,面向 4K 视频监控、AI 边缘计算、交互终端等,配备最高 16GB LPDDR5 与 256GB eMMC。
意义:为边缘 AI 设备提供高算力、低功耗的国产 SoC 模块方案,便于开发者快速集成 4K 视觉与机器人应用。
- 论文公开站arXiv
输入凸神经网络L_p-Lipschitz常数的参数化复杂度及Zonotopes上L_p-范数最大化
Parameterized Complexity of $L_p$-Lipschitz Constants for Input Convex Neural Networks and $L_p$-Norm Maximization over Zonotopes
摘要显示,该研究探讨了两层输入凸神经网络(ICNNs)计算L_p-Lipschitz常数的问题,该问题等价于在Zonotope上最大化对偶范数。对于固定的p∈(1,∞)∩Q,在d维Zonotope上最大化L_p-范数是W[1]-难的,且暴力枚举算法在指数时间假设下本质最优。通过二元性,相同难度适用于两层ReLU ICNN的L_p-Lipschitz常数计算。证明先建立L_2情形,再通过泰勒近似推广至任意固定p。该结果解决了COLT'25…
意义:该研究明确了ICNN Lipschitz常数计算的计算复杂性边界,对神经网络的鲁棒性验证和安全性分析有重要指导意义,也为相关算法设计提供了理论依据。