全球科技每日监测AI 与全技术每日扫描

中文读懂 AI 与全技术今天发生了什么

邮箱轻订阅 · 免费开订每日精选技术情报:中文标题 → 要点 → 详情链。主题月卡加量 · 数据 API 可对接。

AI 与全技术每日扫描

全球科技每日监测

中文读懂今天发生了什么 · 按时间更新 · 全量浏览

今日 125 条 · 论文 15 · 资讯 110 查看今日归档

免费邮箱订阅 主题月卡 数据 API →

数据源:本地 Harness 库 · 搜索「数据集」共 3 条

  • 资讯公开站rss_arxiv_cs_ai

    通过嵌入式编码改进大语言模型的医学计算能力

    Improving Medical Calculation of LLMs with Embedded Coding

    arXiv:2609.31908v1 公告类型:新 摘要:大语言模型(LLM)在医学考试和问答基准上表现良好,但在需要精确数值输出的医学计算任务上仍不可靠。这些计算支撑着用药剂量、器官功能评估和预后评分等高风险决策,即使很小的误差也可能带来严重的临床后果。我们提出 MedCode,一个通过训练 LLM 生成嵌入式可执行代码来改进医学计算的框架。给定临床情境,模型识别相关计算器,提取其输入变量,并生成一段将算术运算委托给确定性解释器的脚本…

  • 资讯公开站rss_arxiv_cs_ai

    Benchy:迈向面向任务型AI基准测试的通用语言

    Benchy: towards a universal language for task-oriented AI benchmarks

    arXiv:2609.30550v1 公告类型:新 摘要:Benchy 是一种用于对 AI 程序进行基准测试的语义语言与执行引擎。一个基准由程序、评分函数和数据集完整指定,B=(P,S,D),并与接受测试的 AI 系统相分离;一次运行将二者绑定,R=(B,AI)。基准以规范 YAML 编写,其中每个语义概念只有一种有效语法,并由共享的任务/领域/语言本体分类,且被确定性地编译为规范 JSON 中间表示,由引擎执行。编译改变的是表示,而非…

  • 资讯公开站Semiconductor Engineering

    开放基准评估2.5D和3D IC的AI热模型(UTS、慕尼黑工大、上海科大)

    Open Benchmark Evaluates AI Thermal Models for 2.5D and 3D ICs (UTS, TU Munich, ShanghaiTech)

    摘要显示,悉尼科技大学、上海科技大学和慕尼黑工业大学的研究人员联合发表了一篇题为“IC-ThermBench: An Open, Progressive Benchmark for Generalizable 2.5D/3D-IC Thermal Learning”的技术论文。该基准结合了已有的3D-IC稳态、瞬态及工业封装任务,并新增了一个包含50,000个样本的2.5D chiplet数据集,旨在评估AI热模型的泛化能力。

    意义:为AI驱动的2.5D/3D IC热分析提供标准化评估平台,有助于推动热建模方法的可复现性与泛化能力比较。