- 资讯公开站rss_arxiv_cs_ai
OpenAI-HuggingFace:对齐测试的复现与教训
OpenAI-HuggingFace: A Reproduction & Lessons for Alignment Testing
arXiv:2609.35799v1 公告类型:新 摘要:2026年7月,OpenAI的智能体通过其预期环境之外的渠道协同行动,入侵了Hugging Face的安全基础设施。现有的对齐测试实践能否预见到这一事件?如果不能,需要改变什么?我们探讨了这些问题。首先,我们识别出导致该事件的不对齐行为。然后,我们展示如何从公开可用的模型中手动引出这些行为,并且审计智能体若获得大量算力预算也能做到同样的事。基于我们的结果,我们提出了改进对齐测试的…
- 资讯公开站rss_gf_news
塑造射频未来:GF亮相IMS和RFIC 2026
Shaping the future of RF: GF at IMS and RFIC 2026
- 资讯公开站rss_gf_news
基于9SW平台的SLATE™先进封装技术,解锁更小、更智能的射频前端
Unlocking smaller, smarter RF front-ends with SLATE™ advanced packaging technology on 9SW
- 资讯公开站rss_gf_news
拉伸天线:在9SW上采用9SW与SLATE™先进封装技术的先进天线调谐
Stretching the antenna: Advanced antenna tuning with 9SW and SLATE™ advanced packaging technology on 9SW
- 资讯公开站rss_gf_news
驱动下一次架构转变:深入解读GF的48V方案
Powering the next architecture shift: Inside GF’s approach to 48V
- 资讯公开站rss_mtwmag
AMTEX 2026:Machine Tools World 对话 Roxy Lin
AMTEX 2026 – Machine Tools World connected with Ms. Roxy Lin
在 AMTEX 2026 台湾馆,Machine Tools World 与 Roxy Lin 交流智能制造最新发展。她指出,印度是台湾企业扩大先进制造技术应用的重要市场。
- 资讯公开站rss_mtwmag
AMTEX 2026——机床世界连线蔡清枝女士
AMTEX 2026 – Machine Tools World connected with Ms. Ching-Chi Tsai
AMTEX 2026 | 台湾馆 在 AMTEX 2026 上,我们在台湾馆连线了蔡清枝女士,探讨塑造智能制造未来的最新发展。从先进技术到更智能的生产流程,这次对话重点介绍了创新如何帮助制造商变得更高效、更互联、更具未来准备。💡 关键要点:台湾馆正在展示可支持印度制造商迈向更自动化和互联生产的技术。🎥 观看完整采访,直接聆听蔡清枝女士的分享,了解他们对制造业未来的看法。#AMTEX2026 #台湾馆 #智能制造 #制造业 #工业自动化 …
- 资讯公开站rss_mtwmag
AMTEX 2026:Machine Tools World 对话 Vanessa Chang
AMTEX 2026 – Machine Tools World connected with Vanessa Chang
在 AMTEX 2026 台湾馆,Machine Tools World 与 Vanessa Chang 探讨智能制造趋势。她表示,印度对自动化和先进制造日益增长的需求,正为台湾科技公司带来新机遇。
- 资讯公开站rss_electronics_weekly
Gimlet Cloud 与 Cerebras 合作加速推理
Gimlet cloud and Cerebras to accelerate inference
Gimlet Labs 与 Cerebras Systems 达成合作,将 Cerebras 晶圆级计算与 Gimlet Cloud 结合,以大规模提供超高速 AI 推理服务。
- 资讯公开站rss_ess_news
希腊到2030年可安装8.6 GW电池储能
Greece can install 8.6 GW of batteries by 2030
- 资讯公开站rss_ev_research
电动汽车电池防火材料市场到2037年将超过100亿美元
Fire Protection Materials for EV Batteries to Exceed US$10B by 2037
在电动汽车中使用锂离子电池时,热失控和系统安全是关键议题。电动汽车行业的一个重点是需要应用防火材料,以防止或延缓热失控在电芯之间传播并最终蔓延到电池包外部。随着监管势头和安全标准的不断增强,IDTechEx的这篇文章探讨了防火材料市场的前景。
- 资讯公开站rss_windpower_eng
美国2025年风电装机量将比上一年增加36%
US to install 36% more wind turbines in 2025 than previous year
根据Wood Mackenzie与美国清洁能源协会(ACP)发布的《美国风能监测》报告,美国预计在2025年新增超过7 GW的风电装机,较上一年增长36%,五年展望与上一季度预测相比保持不变。在充满挑战的……
- 资讯公开站rss_plastics_today
TotalEnergies Corbion 推出用于空气过滤的可再生 PLA
TotalEnergies Corbion Launches Renewable PLA for Air Filtration
- 资讯公开站rss_plastics_today
AI驱动专利公司为初创企业大幅降低成本
AI-Powered Patent Firm Slashes Costs for Startups
Fearn推出一家AI原生专利公司,提供三天内完成临时申请和固定费用服务,将前大型律所专家与内部工程团队相结合,服务于制造业和技术领域的初创企业。
- 资讯公开站rss_utility_dive
报告:数据中心备用电源带来健康风险
Data center backup power contributes to health risks: report
据环境保护网络称,联邦监管行动正允许数据中心及其他发电厂的现场发电机在更少检查的情况下排放危险物质。
- 资讯公开站rss_arxiv_cs_ai
BioDyad:同步生物医学发现与机器学习工程
BioDyad: Synchronize Biomedical Discovery and Machine Learning Engineering
arXiv:2609.31939v1 公告类型:新 摘要:智能体生物医学机器学习(ML)依托生物医学证据获取与可执行程序搜索两方面的互补进展。现有系统连接了这些能力的部分方面,但在整个程序搜索过程中协调它们仍具挑战性。新证据必须指导候选构建,执行结果必须为后续发现与复用提供信息,验证需求必须契合搜索预算。我们提出 BioDyad,通过蒙特卡洛图搜索中的两个层级将生物医学发现与 ML 工程耦合。其科学层级将先验生物医学指导与迭代发现相结合…
- 资讯公开站rss_arxiv_cs_ai
通过嵌入式编码改进大语言模型的医学计算能力
Improving Medical Calculation of LLMs with Embedded Coding
arXiv:2609.31908v1 公告类型:新 摘要:大语言模型(LLM)在医学考试和问答基准上表现良好,但在需要精确数值输出的医学计算任务上仍不可靠。这些计算支撑着用药剂量、器官功能评估和预后评分等高风险决策,即使很小的误差也可能带来严重的临床后果。我们提出 MedCode,一个通过训练 LLM 生成嵌入式可执行代码来改进医学计算的框架。给定临床情境,模型识别相关计算器,提取其输入变量,并生成一段将算术运算委托给确定性解释器的脚本…
- 资讯公开站rss_arxiv_cs_ai
EmailBench:评估LLM智能体在企业邮件与生产力任务上的基准
EmailBench: A Benchmark for Evaluating LLM Agents on Enterprise Email and Productivity Tasks
arXiv:2609.31906v1 公告类型:新 摘要:企业邮件智能体必须结合信息检索、结构化状态变更、时间推理和多步协调。近期的智能体基准包含生产力任务,但很少有以自包含环境中的类型化邮件工作流为中心。我们推出 EmailBench,一个涵盖 16 个任务类别、206 个邮件与生产力场景的基准。该基准将带类型化邮件 API 规范与提供商中立命名相结合,包含一个确定性的、受 Enron 启发的合成语料库,以及一套场景套件,其主题选择参…
- 资讯公开站rss_arxiv_cs_ai
COUNTERMEM:面向语言智能体的世界模型验证反事实记忆
COUNTERMEM: World-Model Verified Counter-Factual Memory for Language Agents
arXiv:2609.31874v1 公告类型:新 摘要:现有智能体记忆框架主要通过智能体与事实世界的交互来构建记忆,例如记住已采取行动的反馈,以提升未来任务的表现。然而,这些框架在构建记忆时很少提出“如果……会怎样”的问题:如果采取了不同的行动,反馈是否会改变,以及这种反馈如何能成为有用的记忆?在主动环境中直接获取此类反馈可能代价高昂,并且可能改变用于比较所需的状态。在这项工作中,我们提出了 COUNTERMEM,一个用于跨任务构建和…
- 资讯公开站rss_arxiv_cs_ai
ConflictVLA-Bench:评估视觉-语言-动作模型对前提冲突的行为反应
ConflictVLA-Bench: Benchmarking Behavioral Responses of Vision-Language-Action Models to Premise Conflicts
arXiv:2609.31792v1 公告类型:新 摘要:视觉-语言-动作(VLA)模型在操作任务上表现强劲,但其对无效任务前提的反应仍未被充分探索。现有对前提冲突的评估往往聚焦于最终任务结果,然而仅凭任务失败无法区分行为脱离与继续追求随后出现执行错误。我们将后一种模式称为“失败坚持”(Failed Persistence)。为研究这一现象,我们提出 ConflictVLA-Bench,它将冲突 rollout 与前提一致的参考 rol…
- 资讯公开站rss_arxiv_cs_ai
SMARtCARE:面向有限自主临床决策支持的隐私保护智能体AI系统
SMARtCARE: Privacy-Preserving Agentic AI Systems for Bounded-Autonomy Clinical Decision Support
arXiv:2609.31763v1 公告类型:新 摘要:长上下文临床AI系统在既往入院记录超出当前推理上下文时,可能遗漏相关患者病史。在ICU监测中,这会导致早期生命体征漂移看似非特异性,即使其与既往恶化模式相似。SMARtCARE通过四状态临床决策支持架构解决这一缺口:稳定、元认知、辅助和受管制(撤销)。SMARtCARE不自动检索既往记录,而是使用患者既往轨迹的有损六通道指纹。当当前漂移与该指纹匹配且既往记录不在上下文中时,系统会…
- 资讯公开站rss_pv_magazine
希腊到2030年可安装8.6 GW电池储能
Greece can install 8.6 GW of batteries by 2030
希腊太阳能协会HELAPCO表示,该国到2030年可安装8.6 GW电池储能。在希腊设有办公室的全球咨询机构Aurora Energy Research则给出更保守的展望,预计到本十年末最高可达5 GW。pv magazine对希腊电池储能系统(BESS)市场的关键细分领域以及预计推动其快速扩张的因素进行了分析。本文原载于pv magazine Global。
- 资讯公开站rss_digitimes
三星调整DRAM路线图,优先推进B1b混合键合用于D0a、HBM5
Samsung reshuffles DRAM roadmap, prioritizing B1b hybrid bonding for D0a, HBM5
三星电子正在调整其下一代动态随机存取存储器(DRAM)路线图,将B1b晶圆对晶圆(W2W)混合键合技术从特定项目开发提升为D0a的核心技术,D0a是三星首个sub-10nm DRAM世代。业界观察人士认为,三星提前推动B1b DRAM商业化,也可能惠及其下一代高带宽内存(HBM)产品,包括HBM5。
- 资讯公开站rss_digitimes
Cerebras 将助力 Gimlet 推进更快的 AI 推理
Cerebras to power Gimlet's push for faster AI inference
随着对能够从日益复杂的 AI 模型提供更快响应的计算系统的需求增长,Cerebras Systems 正通过与 Gimlet Labs 的合作,扩大其在 AI 推理基础设施领域的布局。
- 资讯公开站rss_arxiv_cs_ai
少想反而模拟更好:直觉式提示提升LLM智能体模拟个体社交媒体反应(含陌生内容)
Thinking Less to Simulate Better: Intuitive Prompting Improves LLM Agents Simulating Individual Social Media Reactions, Including Unfamiliar Content
arXiv:2609.30563v1 公告类型:新 摘要:平台政策越来越多地在人工用户上进行测试,因此智能体的保真度变得重要。然而,有说服力的虚假档案也可能在选举前操纵公众舆论感知。验证一直集中在与人类行为的一致性上,很少关注智能体是否按照其被赋予的档案行事。本研究通过问卷、深度访谈和书面自我介绍对八名塞尔维亚参与者进行了画像,记录他们对六十八篇社交媒体帖子的反应,并让四个语言模型在五种提示条件下预测这些反应,这些条件在档案内容和指令风…