- 论文公开站arXiv
UniSlider: Perceptually Uniform Sliders for Continuous Image Editing
Sliders provide an intuitive interface for continuous image editing. In current generative approaches, however, the slider is simply a rescaling of the method's strength parameter, such as an adapter coefficient, a promp…
- 资讯公开站Semiconductor Engineering
Backside Clock Meshes Cut Skew and Power in 2nm Nanosheets (UCSC)
Researchers at the University of California, Santa Cruz published a technical paper titled “Design Space Exploration of Backside Clock Meshes for 2 nm GAAFET BSPDN Technology.” Abstract Excerpt: “Clock meshes are used in…
- 论文公开站arXiv
Planning to Learn
Policy-gradient methods are central to modern reinforcement learning, including LLM post-training. When they struggle, the usual suspects are exploration, credit assignment and action-sampling noise. Classification has n…
- 论文公开站arXiv
FERPO: Forward Entropy-Regularized Policy Optimization
Several state-of-the-art methods for online reinforcement learning in continuous control improve policies using action gradients of a learned critic. However, critics are typically trained to predict returns, and accurat…
- 资讯公开站CNX Software
LakeShark firmware turns LilyGO T-Display P4 into a handheld ESP32-P4 SDR scanner
LakeShark is open-source firmware by Samuel Reynolds (SAMS0N1TE) that turns the ESP32-P4-based LilyGO T-Display P4 into a handheld SDR scanner. Paired with an RTL-SDR Blog V3 or V4 dongle, it supports P25 Phase I trunkin…
- 论文公开站arXiv
WorldAuditBench:多模态智能体的交互式3D世界审计
WorldAuditBench: Interactive 3D World Auditing with Multimodal Agents
随着交互式3D世界被广泛用于研究智能行为,识别其中异常(如悬浮物体、可穿墙、与环境不一致的物体)的高效流程变得重要,本文提出相应基准。
- 资讯公开站rss_arxiv_cs_ai
经验时代的自发现强化学习:学习历史是资产还是负担?
Self-discovering RL in the Era of Experience: Is Learning History an Asset or a Burden?
arXiv:2609.35897v1 公告类型:新 摘要:通往通用智能的递归自我改进(RSI)研究分为两条路线:宏观层面的语言模型扩展,以及“经验时代”中由交互驱动的原则。然而,任何自我改进架构最终都依赖于其底层优化引擎:如果通用智能需要从有根基的交互中学习,那么强化学习(RL)更新规则本身就必须具备累积适应能力。尽管算法自发现已产生 Disco103,其超越了 PPO 并达到 SOTA 基准表现,但其内部更新机制仍是一个未被审视的黑箱…
- 资讯公开站rss_arxiv_cs_ai
有效的大语言模型微调是否必须依赖人类可读文本?
Is Human-Readable Text Necessary for Effective LLM Fine-Tuning?
arXiv:2609.35868v1 公告类型:新 摘要:有效微调大语言模型是否必须依赖人类可读性?我们研究模型条件化的训练表示能否在无需人类可读文本形式的情况下保持或提升适配效用。我们提出 Desired-Update-Aligned Synthetic Data(DASA),利用冻结参考模型的激活梯度反馈来指导连续合成输入嵌入的优化。受激活梯度在局部风险降低中作用的启发,DASA 针对有用的适配更新,而非源文本重建或语言流畅性。所得…
- 资讯公开站Energy Storage News
美国三家公用事业公司提交IRP,重点新增储能项目
US utilities Ameren Missouri, DTE Energy in Michigan, and Black Hills Energy in Colorado submit IRPs with highlighted BESS additions
密苏里州Ameren Missouri、密歇根州DTE Energy和科罗拉多州Black Hills Energy近期提交了综合资源计划(IRP),重点新增电池储能系统(BESS)项目。
- 论文公开站arXiv
PReCache:通过低秩预计算与中性重建实现多 LoRA 智能体的高效 KV 缓存共享
PReCache: Efficient KV Cache Sharing for Multi-LoRA Agents via Low-Rank Precomputation and Neutral Reconstruction
多 LoRA 智能体系统通过共享公共骨干模型实现高效角色专业化。然而,每个智能体重复处理不断增长的共享轨迹并构建自己的 KV 缓存,在长时程任务中造成大量内存和计算冗余。
- 资讯公开站Energy Storage News
Black Hills Energy将在科罗拉多开建200MWh电池储能
Black Hills Energy to begin construction on 200MWh Colorado BESS
公用事业公司Black Hills Energy宣布,将在美国科罗拉多州普韦布洛机场发电站建设一座50MW/200MWh储能设施。
- 论文公开站arXiv
新的LoRA技能应只读不写
New LoRA Skills Should Read but Never Write
摘要显示,该论文针对多个独立训练的LoRA适配器难以合并的问题,指出权重空间合并会相互干扰、全量重训成本高、路由方案又失去单一模型的意义。作者提出READ方法,将每个适配器重写为保持更新等价的平衡规范形式,并让新旧技能耦合单向生长:新技能可读取旧技能输入子空间但不能写入其输出子空间,每次追加仅训练耦合矩阵中新技能对应的一行,组合更新可折叠进基础权重,无推理成本与路由。
意义:为多任务LoRA合并提供免路由、零推理开销的持续学习方案,对模型能力增量扩展与适配器组合有工程价值。
- 资讯公开站Semiconductor Engineering
3D芯片推动EDA进入新领域
3D Chips Push EDA Into New Territory
摘要显示,随着AI芯片转向堆叠式、基于chiplet的架构,EDA供应商正在重新改造成熟工具,以支持跨域分析、更快的设计空间探索以及代理式AI辅助。此举旨在应对3D集成带来的设计复杂性挑战。
意义:EDA工具向跨域分析和AI辅助演进,将直接影响3D芯片与chiplet设计的效率,降低先进封装设计门槛。
- 资讯公开站Ars Technica
前NASA局长就中国探月计划发出警告
Former NASA chief sounds alarm on China's lunar "exploration" plans
摘要显示,Ars Technica报道称前NASA局长对中国月球探索计划发出警告,并引述其表述称北京的战略意图是主导21世纪的制高点。报道未给出更多技术细节或具体政策主张,核心信息为美方前航天主管对中国探月方向表达担忧。
意义:反映中美月球竞争叙事升温,提示航天与地缘政治议题将持续影响相关技术合作与投资判断。
- 论文公开站arXiv
用于高效端侧LLM生成式个性化的LoRA生成超网络
LoRA-generating hypernetworks for efficient on-device LLM generative personalization
摘要显示,该论文提出一种设备端LLM个性化方法:训练超网络将用户上下文token映射为适合该用户的LoRA,部署后在设备端合成个性化LoRA。该方法结合了上下文学习(ICL)与参数高效微调(PEFT)的优点:设备端阶段仅需前向传播,计算可行;同时通过权重修改基础模型,避免扩展输入序列带来的延迟增加,尤其适合移动设备场景。
意义:为移动端LLM个性化提供无需反向传播的可行路径,降低设备端算力与延迟门槛,对端侧AI应用开发有参考价值。
- 资讯公开站CNX Software
Elecrow ThinkNode M9 QWERTY终端与MeshCore固件评测
Review of Elecrow ThinkNode M9 QWERTY terminal with MeshCore firmware
摘要显示,CNX Software 对 Elecrow ThinkNode M9(923 MHz 版本)进行评测。该设备为独立 LoRa 终端,预装 MeshCore 固件,配备 QWERTY 键盘、彩色显示屏、GPS 与 2300mAh 电池。相比早期 ThinkNode M1 和 M5,M9 无需蓝牙配对手机即可直接收发消息并共享位置;评测通过 3 节点网络进行了现场组网测试。
意义:展示 LoRa Mesh 终端从手机配件走向完全独立设备,为无蜂窝网络环境下的去中心化通信提供可参考的硬件形态。
- 资讯公开站Semiconductor Engineering
从硅到系统:异构集成作为AI性能引擎
From Silicon To Systems: Heterogeneous Integration As The Engine Of AI Performance
摘要显示,随着AI算力需求增长,异构集成与基于芯粒(chiplet)的系统正成为提升性能的关键路径。文章指出,设计空间探索必须成为先进封装与芯粒系统开发的核心能力,以应对从单一芯片向系统级设计的转变。
意义:提示开发者:AI性能提升正从制程微缩转向先进封装与芯粒异构集成,设计空间探索工具与方法学将成为关键竞争力。
- 资讯公开站Semiconductor Engineering
常关型p-GaN HEMT的预测性TCAD建模:动态导通电阻、漏电、击穿及机器学习辅助设计探索
Predictive TCAD Modeling of Normally-Off p-GaN HEMTs for Dynamic RDS(on), Leakage, Breakdown, and ML-Based Design Exploration
摘要显示,该工作提出一套常关型p-GaN HEMT的预测性仿真工作流,重点涵盖器件物理校准、漏电建模、动态导通电阻(RDS(on))与击穿行为,并引入机器学习辅助的设计探索。原文未披露具体器件数据、模型精度或实验验证结果。
意义:为功率GaN器件的TCAD仿真与ML辅助设计提供可参考的方法框架,有助于缩短器件开发迭代周期。
- 资讯公开站CNX Software
OpenMANET:基于 802.11ah WiFi HaLow 的高带宽 Meshtastic 替代方案
OpenMANET – A higher-bandwidth Meshtastic alternative leveraging 802.11ah WiFi HaLow
OpenMANET 是一个开源项目,利用树莓派单板计算机与 Morse Micro 的 Wi-Fi HaLow(802.11ah)芯片构建远距离无线网状自组网(MANET)。其面向搜救、灾害响应、生存游戏及无网络或基础设施失效场景,可视为 LoRa 系 Meshtastic、Meshcore 的替代方案,带宽更高但硬件更贵、功耗更大,支持一键通话、GPS 位置共享、摄像头/视频流与 ATAK。
意义:为开发者提供高带宽自组网新选择,802.11ah 与树莓派组合有望降低远距离网状通信开发门槛。
- 资讯公开站CNX Software
M5Stack Module13.2 LoRa-1262扩展板集成14×10 mm Stamp LoRa-1262模块
M5Stack Module13.2 LoRa-1262 expansion board integrates 14×10 mm Stamp LoRa-1262 module
M5Stack在推出基于SX1262的M5Stamp C6LoRa微型模块后,又发布两款面向868–923 MHz频段的SX1262 LoRa扩展件:用于自定义PCB的Stamp LoRa-1262贴片模块,以及面向M5Stack Core系列的堆叠式Module13.2 LoRa-1262模块。前者支持LoRa、FSK、GFSK、MSK、GMSK与OOK调制,发射功率最高+22 dBm,接收灵敏度-147 dBm;后者增加RP-SMA…
意义:为物联网开发者提供小尺寸、可堆叠的 LoRa 硬件方案,便于快速集成远距离低功耗通信与多模块扩展。
- 资讯公开站CNX Software
FREE-WILi 2便携黑客多功能工具:双RP2350、ESP32-C5、ICE40 FPGA与树莓派CM0
FREE-WILi 2 portable hacking multitool features two RP2350 MCUs, ESP32-C5, ICE40 FPGA, and Raspberry Pi CM0
FREE-WILi 2(创始人版)是一款面向硬件黑客、渗透测试人员与嵌入式开发者的开源硬件便携式黑客多功能工具与实验平台。其集成两颗树莓派RP2350微控制器、ESP32-C5无线模块、Lattice ICE40UP5K FPGA以及运行完整Linux的树莓派CM0,并配备3.5英寸电容触摸屏、14键物理按键和模块化Orca扩展接口。无线功能覆盖2.4/5GHz Wi-Fi、蓝牙、LoRa、sub-GHz RF、NFC、125kHz R…
意义:单设备集成双 MCU、FPGA、Linux 与多频段无线,为硬件安全测试与嵌入式原型开发提供一体化便携平台,降低多工具携带成本。
- 资讯公开站CNX Software
DIY ESP32-P4 气象站与空气质量监测器,连接 LoRa 和 ESP-NOW 传感器
DIY ESP32-P4 weather station & air quality monitor connects to LoRa and ESP-NOW sensors, various weather APIs
Harald Kreuzer 基于 ESP32-P4-Module-DEV-KIT-C 搭建了一款 DIY 气象站与空气质量监测器,配备 10.1 英寸显示屏和 Sensirion SEN66 传感器,可检测颗粒物、CO2、VOC 和 NOX,并连接 LoRa 与 ESP-NOW 无线传感器,无需云端。
意义:展示 ESP32-P4 在本地化环境监测与多协议无线传感中的可复现方案,为开发者提供免云端的物联网设备参考。
- 论文公开站arXiv
基于适配器的少样本持续学习用于恶意数据包识别
Adapter-Based Few-Shot Continual Learning for Malicious Packet Recognition
摘要显示,针对恶意软件变体持续演化,作者提出一种基于适配器的少样本类增量学习框架,用于恶意数据包识别。该方法使用自监督学习骨干网络,并通过领域特定预训练初始化,在基础会话中采用低秩适配(LoRA)微调,同时冻结核心骨干以保留旧知识,增量会话使用原型分类头。实验表明,该方法在多个数据集上优于现有恶意软件FSCIL基线,达到最先进性能。
意义:该研究为恶意软件检测提供了一种高效的持续学习方案,能适应新威胁而不遗忘旧知识,对网络安全领域的AI模型部署具有实用价值。
- 论文公开站arXiv
ReWorld:具备长时记忆的交互式世界模型
ReWorld: An Interactive World Model with Long-Horizon Memory
摘要显示,ReWorld是一种交互式世界模型,通过混合注意力窗口和随机头路由,在训练时分离控制与记忆,推理时使用有界KV缓存和姿态索引地标库,实现长时记忆下的实时视频生成。数据引擎统一多源数据尺度,并通过LoRA蒸馏实现四步采样,在704x1280分辨率下实时生成,在动作跟随、长时记忆和视频质量方面优于六种现有模型。
意义:ReWorld解决了交互式世界模型中控制与记忆的结构性矛盾,实现了长时记忆下的实时高保真视频生成,对虚拟现实、游戏和机器人仿真等应用具有重要意义。
- 论文公开站arXiv
注入、对齐、恢复:面向无检索文档知识内化的分阶段后训练框架
Inject, Align, Recover: Staged Post-Training for Retrieval-Free Document Knowledge Internalization
大型语言模型在推理时无法检索源文档时,往往难以回答关于特定文档集的问题。为此,本文提出IAR(注入、对齐、恢复)三阶段后训练框架,将固定语料转化为可用的参数化知识,实现无检索问答。注入阶段采用续写、改写和指令条件重建目标;对齐阶段使用仅答案的问答监督;恢复阶段合并领域适配模型与基础指令模型以恢复通用能力。实验显示,在多个模型家族和数据集上,IAR在领域问答准确率上平均提升3.6个百分点,通用性能平均提升12.1个百分点。
意义:该框架为无需检索的文档知识内化提供了新方法,提升领域问答准确率的同时保持通用能力,对构建高效、实用的领域专用模型具有重要意义。