跳到正文

#产品更新

今日 0 条
10月6日周二
  1. Google Research73

    Google 发布地球AI人口动态基础模型PDFM

    Google Research 发布地球AI人口动态基础模型PDFM,将搜索趋势、环境等隐私数据压缩为位置嵌入。该模型在麻疹疫苗、心血管疾病、登革热、产后抑郁和霍乱预测中验证了提升效果,并作为Population Dynamics Insights在Google Maps Platform开放预览。

    推荐理由:原文展示了PDFM在五大公共卫生场景的实测增益,读者可评估其作为现成地理空间特征提升现有模型的效果。

10月5日周一
  1. GitHub Blog · AI & ML68

    GitHub发布ReviewBench开源基准用于评估AI代码审查

    GitHub发布ReviewBench,一个基于1.039亿个真实Pull Request分布构建的开源AI代码审查离线基准。该基准包含219个Pull Request和经过人工验证的多源黄金数据集,支持按严重程度和类别切片,并提供Grounded与Augmented两套指标体系。

    推荐理由:GitHub发布ReviewBench基准,提供可复现的离线评估方法,帮助开发者选择并优化AI代码审查工具。

9月24日周四
  1. Microsoft Research72

    微软发布支持推理卸载的 Physical AI Toolchain

    微软发布 Physical AI Toolchain,新增支持将物理 AI 推理卸载至边缘或云 GPU 的能力。实测表明,该方案可提升任务成功率,使电池续航延长数小时,并提供基于 Kubernetes 的自动容器化部署工具。

    推荐理由:微软发布支持推理卸载的工具链,实测显示可显著提升机器人性能并延长续航。

9月18日周五
  1. Google Research62

    Google 发布基于 GenUI 的教育模拟生成实验,开放 30 余个 STEM 示例

    Google Research 发布基于生成式 UI(GenUI)的教育模拟生成实验,允许教师动态创建定制化的互动学习模拟。该实验已发布包含物理、化学等学科的 30 余个 AI 生成示例,并开放 Google for Education Pilot Program 供学校申请试用。

    推荐理由:Google 发布基于 GenUI 的教育模拟生成实验,提供 30 余个 STEM 示例并开放教师试点,展示了生成式 UI 在定制教学中的落地路径。

9月8日周二
  1. Google DeepMind83

    Google DeepMind 发布 AlphaGenome Atlas 全基因组变异预测平台

    Google DeepMind 发布 AlphaGenome Atlas,包含人类基因组中90亿种单核苷酸变异的分子影响预测。平台提供 AVI 评分、特征归因及 DNA 序列基序,已用于发现罕见病致病突变及解析复杂性状关联。

    推荐理由:预计算了全基因组90亿种单核苷酸变异,提供AVI评分与可视化门户,加速罕见病与复杂性状研究。

8月22日周六
6月24日周三
  1. Hugging Face Blog67

    Hugging Face 联合 Treble 推出 FFASR 远场语音识别基准

    Hugging Face 联合 Treble 推出首个开源远场语音识别(FFASR)基准,覆盖 14 种模拟房间与多信噪比条件。评测显示远场低信噪比下的字错误率显著高于近场,并提供准确率与推理速度的权衡分析。

    推荐理由:首次公开远场语音识别基准,提供仿真与实测对照,直观展示真实声学环境下的性能差距。

12月23日周二
  1. Hugging Face Blog75

    ServiceNow 发布 AprielGuard 安全模型,统一检测安全风险与对抗攻击

    ServiceNow 发布 AprielGuard,一款 8B 参数的安全与对抗鲁棒性守护模型,可检测 16 类安全风险及提示注入、越狱等对抗攻击。该模型支持 32k 长上下文与 Agent 工作流,提供推理与非推理双模式,已在多项公开基准上验证了性能。

    推荐理由:ServiceNow 发布 AprielGuard 安全模型,统一检测 16 类安全风险与对抗攻击,支持 32k 长上下文与 Agent 工作流。

11月19日周三
  1. Google Research85

    Google 发布端到端实时语音翻译模型并部署于 Google Meet 和 Pixel 10

    Google 发布端到端实时语音翻译模型,延迟仅2秒并保留原声,已在 Google Meet 和 Pixel 10 部署。该模型基于 AudioLM 和 SpectroStream 架构,支持英、西、德、法、意、葡等语言。

    推荐理由:端到端架构将延迟降至2秒并保留原声,已在Google Meet和Pixel 10部署,可据此评估实时语音翻译的技术进展。

11月14日周五
  1. Google Research61

    Google Research 发布全球天然林地图及AI基准数据集

    Google Research 联合 Google DeepMind 发布 Natural Forests of the World 2020 地图及数据集,利用 MTSViT 模型实现 10 米分辨率天然林识别,准确率达 92.2%。同时发布 Planted 和 ForTy 两个大规模基准数据集,用于支持 EUDR 合规及下一代森林分类模型研发。

    推荐理由:发布全球首个10米分辨率天然林地图及基准数据集,为合规与生态监测提供高精度AI基线。

11月5日周三
  1. Google Research70

    Google 发布 ForestCast 预测森林砍伐风险并开源基准数据集

    Google Research 与 DeepMind 发布 ForestCast,利用纯卫星数据和视觉 Transformer 模型预测森林砍伐风险。同时开源首个用于训练深度学习模型的公开基准数据集,旨在帮助政府和企业提前干预以遏制森林损失。

    推荐理由:基于纯卫星数据预测森林砍伐风险并开源基准数据集,为生态保护提供可复现的AI工具。

9月3日周三
  1. Hugging Face Blog75

    SandboxAQ 开源 SAIR 数据集:524 万条高精度蛋白-配体 3D 结构加速药物研发

    SandboxAQ 在 Hugging Face 开源 SAIR 数据集,包含 524 万条由 Boltz1 生成的 AI 共折叠蛋白-配体 3D 结构及实验验证的 IC50 数据。该数据集采用 CC BY 4.0 许可,97% 的结构通过了 PoseBusters 验证,旨在解决 AI 药物研发中高质量结构数据的长期短缺问题。

    推荐理由:SAIR 开源了 524 万条高精度蛋白-配体 3D 结构及 IC50 数据,为 AI 药物发现提供了稀缺的高质量训练集。