跳到正文

#Google

今日 1 条
5月16日周六
  1. Google DeepMind72

    Google DeepMind发布Co-Scientist并验证其在肝纤维化药物发现中的应用

    Google DeepMind发布科研智能体Co-Scientist,斯坦福大学Gary Peltz团队利用其从海量文献中筛选出3种候选药物,并在活体人类肝细胞实验中证实其中2种能阻断肝纤维化并促进细胞再生,其中癌症药物伏立诺他(vorinostat)效果显著,阻断了91%的损伤反应。

    推荐理由:通过斯坦福大学独立实验验证了Co-Scientist在药物重定位中的有效性,为科研工作者提供了可参考的AI辅助发现路径。

5月12日周二
  1. Google DeepMind80

    Google DeepMind 发布 Co-Scientist 多智能体科研助手

    Google DeepMind 发布 Co-Scientist,这是一个基于 Gemini 的多智能体 AI 系统,旨在通过生成、辩论和进化假设来加速科学研究。该系统包含生成、辩论和进化三个阶段,利用“思想锦标赛”机制对假设进行交叉验证和排名,目前已通过 Hypothesis Generation 工具向研究人员开放。

    推荐理由:原文披露了基于 Gemini 的多智能体协作机制与“思想锦标赛”验证流程,为科研场景下的 AI 智能体提供了可迁移的方法论。

5月6日周三
5月2日周六
4月30日周四
  1. Google DeepMind73

    Google DeepMind 发布 AI co-clinician 研究:实时多模态医疗辅助能力评估

    Google DeepMind 发布 AI co-clinician 研究,探索 AI 智能体在医生监督下辅助患者的“三元护理”模式。研究通过 120 次模拟远程问诊对比 GPT-realtime,发现 AI 在 140 项评估指标中 68 项优于初级全科医生,但在识别红旗症状等关键判断上仍不及专家。

    推荐理由:通过对比GPT-realtime等前沿模型,验证了AI在实时多模态问诊中的能力边界与临床辅助价值。

4月27日周一
  1. Google DeepMind45

    Google DeepMind 与韩国科学技术信息通信部达成合作

    Google DeepMind 宣布与韩国科学技术信息通信部(MSIT)建立合作伙伴关系,将在首尔设立 AI Campus 以支持韩国 AI 战略。双方将利用 Gemini 驱动的 AlphaFold、AlphaGenome 等前沿 AI for Science 模型,加速生命科学、能源及气象领域的科研突破。此外,合作还涵盖人才培养及与韩国 AI 安全研究所(AISI)的安全研究协作。

4月23日周四
4月22日周三
  1. Google Research68

    Google Research 发布 ReasoningBank 智能体经验学习框架

    Google Research 发布论文介绍 ReasoningBank,一种让智能体从成功与失败经验中学习并自我进化的记忆框架。该框架提炼全局推理模式,结合记忆感知测试时扩展(MaTTS)提升 WebArena 和 SWE-Bench-Verified 上的成功率与效率。

    推荐理由:提出从成功与失败经验中提炼结构化推理模式的记忆框架,结合测试时扩展实现智能体自我进化。

4月16日周四
  1. Google Research36

    Google Research 发布 MoGen 模型,利用 AI 合成神经元加速大脑连接组学重建

    Google Research 发布 MoGen 模型,利用 AI 合成神经元加速大脑连接组学重建。该模型基于 PointInfinity 点云流匹配技术生成逼真的 3D 神经元形态,将其加入 PATHFINDER 训练数据后,小鼠轴突重建错误率降低 4.4%。这一改进相当于在全脑规模下节省 157 人年的手动校对时间,MoGen 已作为开源模型发布。

  2. Google DeepMind75

    Gemini 3.1 Flash TTS 发布,引入细粒度音频标签实现自然语言控制

    Google DeepMind 发布 Gemini 3.1 Flash TTS 文本转语音模型,引入细粒度音频标签(audio tags)支持自然语言控制语音风格、节奏和表达。该模型支持 70 多种语言,在 Artificial Analysis 基准测试中表现优异,已面向开发者、企业和 Workspace 用户开放预览,所有生成音频均嵌入 SynthID 水印。

    推荐理由:引入细粒度音频标签实现自然语言控制,兼顾高音质与低成本,为开发者提供精准表达控制。

4月13日周一
  1. Google DeepMind76

    Gemini Robotics-ER 1.6 发布,增强具身推理与仪表读取能力

    Google DeepMind 发布 Gemini Robotics-ER 1.6,显著增强空间推理、多视角理解及仪表读取能力。该模型支持通过 Gemini API 和 Google AI Studio 调用,具备通过代码执行与视觉推理实现高精度仪表读数,并提升了物理安全约束遵循能力。

    推荐理由:新增仪表读取与多视角推理能力,为具身智能体提供可验证的物理世界交互方案。

4月9日周四
  1. Google Research60

    Google 发布 PaperVizAgent 与 ScholarPeer 两个科研 AI 智能体

    Google Research 发布两个实验性 AI 智能体:PaperVizAgent 可从文本自动生成出版级学术图表,在多项指标上超越 GPT-Image-1.5 等基线;ScholarPeer 模拟资深审稿人,通过多智能体协作和实时文献检索生成深度评审意见。

    推荐理由:Google 发布两个实验性 AI 智能体,分别用于生成高质量学术图表和模拟资深审稿人,展示了 AI 深度介入科研流程的潜力。

4月1日周三
  1. Google Research38

    Google Research:构建更可靠的 AI 基准测试,需要多少标注员才够?

    Google Research 发布研究指出,AI 基准测试中常见的 3-5 名标注员标准往往不足以捕捉人类意见的细微差异,建议每条目使用超过 10 名标注员。研究通过模拟测试发现,标注策略取决于评估指标:追求准确率时增加条目数量更有效,而捕捉观点多样性则需增加标注员数量。在优化比例后,仅需约 1,000 次总标注即可实现高可复现性,相关模拟器已开源。

3月31日周二
  1. Google Research68

    Google Research 发布论文估算量子计算机破解加密货币的量子资源

    Google Research 发布白皮书,估算未来量子计算机仅需不到 50 万物理量子比特即可破解保护加密货币的椭圆曲线加密。研究提出使用零知识证明负责任地披露漏洞,并建议区块链向抗量子密码学迁移。

    推荐理由:论文给出了突破椭圆曲线加密的量子资源新估算,并提出了零知识证明的负责任披露方法。

3月29日周日
  1. Google DeepMind72

    Google DeepMind 发布 AI 指针概念,探索 Gemini 驱动的跨应用交互

    Google DeepMind 发布 AI 指针概念,展示基于 Gemini 的原型,通过视觉与语义理解实现跨应用自然交互。该功能已集成至 Chrome 和 Googlebook,支持在网页中直接询问特定内容或进行可视化对比。

    推荐理由:文章展示了基于 Gemini 的 AI 指针原型,通过自然语言与视觉上下文结合,探索跨应用无缝交互的新范式。

3月26日周四
  1. Google DeepMind85

    Google 发布 Gemini 3.1 Flash Live 语音模型

    Google 发布 Gemini 3.1 Flash Live 语音模型,在 ComplexFuncBench Audio 基准测试中得分 90.8%,支持更自然的对话与多语言实时交互。该模型已上线 Gemini Enterprise、Gemini Live 和 Search Live,并集成 SynthID 音频水印。

    推荐理由:模型在语音基准测试中刷新纪录并降低延迟,为开发者构建语音智能体提供了更可靠的底层能力。

  2. Google DeepMind68

    Google DeepMind 发布 Lyria 3 Pro 音乐生成模型

    Google DeepMind 发布 Lyria 3 Pro,支持生成长达3分钟且具备结构意识的音乐曲目,可自定义前奏、主歌等元素。该模型已接入 Vertex AI、Google AI Studio、Google Vids、Gemini 应用及 ProducerAI,面向企业和创作者开放。

    推荐理由:模型支持3分钟长曲并细化结构控制,同时扩展至多个Google产品,可据此评估其工作流整合价值。

3月25日周三
  1. Google Research75

    Google 发布 Vibe Coding XR 工作流加速 AI + XR 原型开发

    Google 发布 Vibe Coding XR 工作流,结合 Gemini 的长上下文推理与 XR Blocks 框架,将自然语言直接转化为功能性的 Android XR 应用。该工作流利用 Gemini 进行多步规划与空间逻辑处理,在 60 秒内生成包含物理感知和交互的 3D 体验,并提供了桌面模拟器与 Android XR 头显的实时预览功能。

    推荐理由:原文展示了利用 Gemini 长上下文推理将自然语言直接转化为 XR Blocks 应用的完整工作流,为空间计算原型开发提供了可复用的新范式。

  2. Google Research68

    Google 发布 TurboQuant:零精度损失的 KV 缓存压缩算法

    Google Research 发布 TurboQuant 算法,结合 PolarQuant 和 QJL 技术实现零精度损失的向量量化。该算法将 KV 缓存压缩至少 6 倍,在 Gemma 和 Mistral 模型上实现最高 8 倍推理加速,并显著提升高维向量搜索召回率。

    推荐理由:TurboQuant 通过零开销量化将 KV 缓存压缩 6 倍并加速推理,为长上下文场景提供了可迁移的高效压缩方案。

  3. Google Research62

    Google Research 发布 S2Vec 框架学习城市建成环境特征

    Google Research 发布 S2Vec,一种自监督框架,利用 S2 几何分区和掩码自编码将城市建成环境转化为通用嵌入向量。该模型在零样本地理适应任务中表现优异,能预测人口密度和收入等社会经济指标,但在环境任务中需结合卫星图像。

    推荐理由:提出自监督框架将城市建成环境转化为通用嵌入向量,在零样本地理适应任务中表现优异。

3月18日周三
  1. Google Research65

    Google Research 在 The Check Up 大会展示医疗AI从创新到临床落地的进展

    Google Research 在 The Check Up 大会上展示了AI在医疗领域的最新进展,涵盖从个性化健康到临床辅助的多个方向。在临床协作方面,与 NHS 合作的研究显示AI可识别25%的漏诊乳腺癌,并联合 Beth Israel Deaconess 测试 AMIE 多智能体系统。

    推荐理由:系统展示了从临床辅助到公共卫生到科研加速的AI应用全景,揭示了多模态与智能体在医疗场景的落地路径。

  2. Google Research75

    Google Research 发布 AI 辅助乳腺癌筛查研究:双读流程可减 46% 工作量

    Google Research 联合英国 NHS 发表两项研究,证实 AI 辅助乳腺癌筛查系统在双读流程中表现不劣于纯人工,且可减少 46% 的人工阅片工作量。AI 在独立检测中灵敏度高于首位放射科医生,能识别 25% 的漏诊间期癌,但需解决模型可解释性及数据漂移问题。

    推荐理由:研究证实AI辅助双读流程在保持检测准确率的同时,可显著减少放射科医生工作量,为缓解医疗人力短缺提供实证。

  3. Google DeepMind43

    Google DeepMind 发布 AGI 认知评估框架

    Google DeepMind 发布“AGI 认知分类”框架,提出感知、推理等 10 项关键认知能力以衡量通用人工智能进展。该框架配套发布 Kaggle 黑客松,邀请社区针对学习、元认知等五项能力构建评估基准。活动提供 20 万美元奖金池,提交截止至 4 月 16 日。

3月17日周二
  1. Google Research60

    Google 研究论文:LLM 在超导领域专家级问答中的表现评估

    Google 与康奈尔大学合作在 PNAS 发表论文,评估 GPT-4o、Claude 3.5 等六款 LLM 在高能超导领域的专家级问答表现。基于精选文献的 NotebookLM 和自建 RAG 系统在准确性、平衡性和证据支持上优于开放网络模型。研究指出模型在视觉推理和时序理解上仍有不足,并将发布 CMT-benchmark 进行更严格评估。

    推荐理由:通过专家盲评对比发现,基于精选文献的 NotebookLM 在科学准确性上优于开放网络模型,揭示了 RAG 在科研场景中的关键价值。

3月12日周四
  1. Google Research70

    Google Flood Hub 上线 AI 驱动的城市内涝预测功能

    Google Research 宣布在 Flood Hub 上线城市内涝(Flash Flood)预测功能,利用 AI 方法将预警时间提前至 24 小时。该模型通过 Gemini 分析公开新闻报道构建 Groundsource 数据集,结合全球气象数据预测人口密集区的内涝风险,在部分南方国家的表现与美国国家气象局相当。

    推荐理由:利用Gemini提取新闻数据构建训练集,在缺乏地面观测的南方国家实现24小时城市内涝预测。

  2. Google Research68

    Google 发布 Groundsource 将新闻转化为城市内涝历史数据

    Google 发布 Groundsource 框架,利用 Gemini 从全球新闻中提取结构化历史数据,构建了包含 260 万条城市内涝事件的开放数据集。该数据集已用于提升 Google Flood Hub 的预报能力,可提前 24 小时预测近全球范围的城市内涝。

    推荐理由:利用 Gemini 从新闻中提取结构化数据,填补了城市内涝历史数据空白,并直接用于提升 Flood Hub 的预报能力。

  3. Google Research73

    Google发布AMIE真实世界临床可行性研究结果

    Google Research发布AMIE在真实门诊环境中的前瞻性可行性研究,结果显示系统在100名患者中零安全拦截,诊断准确率在90%的最终诊断中匹配,且医患体验良好。

    推荐理由:研究在真实门诊场景中验证了AMIE的安全性与诊断准确性,为医疗AI的临床落地提供了实证依据。

3月9日周一
  1. Google DeepMind22

    从游戏到生物学:AlphaGo 十年影响力回顾

    Google DeepMind 回顾 AlphaGo 十年影响力,其突破开启了现代 AI 时代并推动 AGI 发展。AlphaGo 的搜索与强化学习技术衍生出 AlphaFold 2,成功预测 2 亿种蛋白质结构并获诺贝尔奖。此外,相关技术已应用于 AlphaProof 数学推理、AlphaEvolve 算法发现及 AI 共科学家等前沿科学领域。

3月7日周六
3月5日周四
  1. Google Research65

    Google Research:通过模仿贝叶斯模型训练大语言模型

    Google Research 发表论文,提出通过监督微调让大语言模型模仿贝叶斯助手,从而学会概率推理。该方法使模型在航班推荐任务中显著优于基线,并能将学到的推理能力泛化至酒店推荐和网购等未见领域。

    推荐理由:研究提出通过模仿贝叶斯模型进行监督微调,使大模型学会概率推理并跨领域泛化。

3月4日周三
  1. Google DeepMind83

    Google 发布 Gemini 3.1 Flash-Lite 模型

    Google 发布 Gemini 3.1 Flash-Lite 模型,定价为输入 0.25 美元/百万 token、输出 1.50 美元/百万 token。该模型在 Artificial Analysis 基准测试中比 2.5 Flash 快 2.5 倍,输出速度提升 45%,并支持自适应思考层级。

    推荐理由:以极低定价和显著提速在保持质量的同时优化了高并发场景的推理成本。

2月27日周五
  1. Google DeepMind83

    Google 发布 Nano Banana 2 图像生成模型

    Google DeepMind 发布 Nano Banana 2(Gemini 3.1 Flash Image),结合 Pro 级智能与 Flash 速度,支持多主体一致性和精确文本渲染。该模型已上线 Gemini、Search、AI Studio 及 Google Ads 等产品,并集成 SynthID 和 C2PA 溯源技术。

    推荐理由:Nano Banana 2 将 Pro 级能力与 Flash 速度结合,提供多主体一致性和精确文本渲染,适合快速迭代场景。

2月20日周五
  1. Google DeepMind80

    Gemini 3.1 Pro 发布,ARC-AGI-2 得分翻倍

    Google DeepMind 发布 Gemini 3.1 Pro,在 ARC-AGI-2 基准测试中取得 77.1% 的得分,推理性能是 3 Pro 的两倍以上。该模型已在 Gemini API、Vertex AI、Gemini CLI、Android Studio 及 NotebookLM 等平台开放预览。

    推荐理由:ARC-AGI-2得分翻倍体现推理能力跃升,覆盖开发者与企业场景,可据此评估复杂任务处理潜力。

2月18日周三
  1. Google Research68

    Google发布MapTrace合成数据管线,提升多模态大模型地图路径追踪能力

    Google发布MapTrace合成数据生成管线,利用Gemini和Imagen模型生成200万对地图与路径数据。在Gemma 3 27B和Gemini 2.5 Flash上微调后,模型在MapBench基准上的路径追踪误差显著降低,成功率大幅提升。

    推荐理由:提出MapTrace合成数据生成管线,通过微调显著提升多模态大模型在地图路径追踪任务上的空间推理能力。

2月17日周二
2月13日周五
  1. Google DeepMind85

    Gemini 3 Deep Think 重大升级并开放 API 访问

    Google 发布 Gemini 3 Deep Think 重大升级,在 ARC-AGI-2 等基准上刷新纪录,并首次通过 Gemini API 向研究人员和企业开放。

    推荐理由:更新后的推理模式在多项学术基准上刷新纪录,并首次通过 API 向开发者开放,可据此评估前沿推理能力的落地路径。

2月11日周三
  1. Google Research15

    时变容量下非抢占式调度最大化吞吐量研究

    Google Research 在 SPAA 2025 发表研究,针对时变容量环境下的非抢占式作业调度问题,提出最大化吞吐量的常数因子近似算法。离线场景中,Greedy 策略在单位利润下实现 1/2-近似,不同利润下实现 1/4-近似。在线场景中,允许重启的 Greedy 变体保持 1/2-竞争比,而禁止重启的严格模型下算法性能受限。

  2. Google Research55

    Google Research 发布开源框架 DialogLab 用于模拟多角色动态人机对话

    Google Research 发布开源原型框架 DialogLab,用于设计、模拟和测试动态多角色人机对话。该框架通过可视化界面解耦社交设置与对话流程,支持拖拽式角色配置与结构化脚本编排。评估显示,其“人工控制”模式在模拟真实人类行为时比全自动或纯响应式代理更具沉浸感和有效性。