最新精选 第 101–120 条 · 共 142 条 21:50 Google DeepMind 精选AI 评分 70 70 Google 发布 Gemini for Science,包含 Google Labs 上的三个实验工具:基于 Co-Scientist 的假设生成、基于 AlphaEvolve 的计算发现、基于 NotebookLM 的文献洞察,以及集成 AlphaFold 等数据库的 Google Antigravity 科学技能。
推荐理由:Google 发布 Gemini for Science 系列实验工具与技能,覆盖假设生成、计算发现与文献洞察,提供科研加速新路径。
15:40 Google DeepMind 精选AI 评分 72 72 Google DeepMind发布科研智能体Co-Scientist,斯坦福大学Gary Peltz团队利用其从海量文献中筛选出3种候选药物,并在活体人类肝细胞实验中证实其中2种能阻断肝纤维化并促进细胞再生,其中癌症药物伏立诺他(vorinostat)效果显著,阻断了91%的损伤反应。
推荐理由:通过斯坦福大学独立实验验证了Co-Scientist在药物重定位中的有效性,为科研工作者提供了可参考的AI辅助发现路径。
02:55 Hugging Face Blog 精选AI 评分 82 82 IBM 发布基于 ModernBERT 架构的 Granite Embedding Multilingual R2 系列多语言嵌入模型,包含 97M 和 311M 两个版本,支持 200 多种语言和 32K 上下文窗口。
推荐理由:IBM 发布基于 ModernBERT 的多语言嵌入模型,在 32K 长上下文和 97M 极小体积下实现开源同类最高检索质量。
22:40 Google DeepMind 精选AI 评分 80 80 Google DeepMind 发布 Co-Scientist,这是一个基于 Gemini 的多智能体 AI 系统,旨在通过生成、辩论和进化假设来加速科学研究。该系统包含生成、辩论和进化三个阶段,利用“思想锦标赛”机制对假设进行交叉验证和排名,目前已通过 Hypothesis Generation 工具向研究人员开放。
推荐理由:原文披露了基于 Gemini 的多智能体协作机制与“思想锦标赛”验证流程,为科研场景下的 AI 智能体提供了可迁移的方法论。
18:43 Google DeepMind 精选AI 评分 70 70 Google DeepMind 发布 AlphaEvolve 年度成果,展示该 Gemini 驱动编码智能体在基因组学、电网优化、量子计算及 TPU 设计等领域的算法优化应用。
推荐理由:原文展示了该智能体在科研、基建及商业场景中的具体优化成果,为评估其实际效能提供了详实参考。
23:58 Hugging Face Blog 精选AI 评分 83 83 NVIDIA 在 Hugging Face 开源 Nemotron 3 Nano Omni 多模态理解模型,原生支持文档、图像、视频和音频的联合推理及智能体操作。该模型基于 Nemotron 3 混合 Mamba-Transformer 架构,在文档理解、视频分析和语音交互等基准测试中表现领先,并提供 BF16、FP8 和 NVFP4 权重下载。
推荐理由:NVIDIA 开源 Nemotron 3 Nano Omni 模型,原生支持图文音视频多模态理解与智能体操作,在多项基准上表现领先。
08:00 Hugging Face Blog 精选AI 评分 80 80 Hugging Face 展示了基于 OpenAI 开源隐私过滤模型 Privacy Filter 构建的三个 Web 应用:文档隐私探索器、图像匿名化工具和智能文本脱敏服务。该模型支持 128k 上下文,可识别八类个人敏感信息。
推荐理由:Hugging Face 展示了基于 OpenAI Privacy Filter 构建的三个 Web 应用,揭示了其在文档、图像和文本场景中的工程实践。
01:00 Google Research 精选AI 评分 72 72 Google Photos 在 Auto frame 功能中新增视角重算能力,利用3D点云估计与生成式扩散模型,在保留原图可见内容的同时智能补全新视角下的隐藏区域,自动优化人像构图与广角畸变。
推荐理由:通过3D重建与生成式补全实现照片视角重算,为后期构图调整提供了新的技术路径。
00:03 Google DeepMind 精选AI 评分 75 75 Google DeepMind 发布 Gemini 3.1 Flash TTS 文本转语音模型,引入细粒度音频标签(audio tags)支持自然语言控制语音风格、节奏和表达。该模型支持 70 多种语言,在 Artificial Analysis 基准测试中表现优异,已面向开发者、企业和 Workspace 用户开放预览,所有生成音频均嵌入 SynthID 水印。
推荐理由:引入细粒度音频标签实现自然语言控制,兼顾高音质与低成本,为开发者提供精准表达控制。
23:52 Google DeepMind 精选AI 评分 76 76 Google DeepMind 发布 Gemini Robotics-ER 1.6,显著增强空间推理、多视角理解及仪表读取能力。该模型支持通过 Gemini API 和 Google AI Studio 调用,具备通过代码执行与视觉推理实现高精度仪表读数,并提升了物理安全约束遵循能力。
推荐理由:新增仪表读取与多视角推理能力,为具身智能体提供可验证的物理世界交互方案。
04:01 Google Research 精选AI 评分 60 60 Google Research 发布两个实验性 AI 智能体:PaperVizAgent 可从文本自动生成出版级学术图表,在多项指标上超越 GPT-Image-1.5 等基线;ScholarPeer 模拟资深审稿人,通过多智能体协作和实时文献检索生成深度评审意见。
推荐理由:Google 发布两个实验性 AI 智能体,分别用于生成高质量学术图表和模拟资深审稿人,展示了 AI 深度介入科研流程的潜力。
18:50 Google DeepMind 精选AI 评分 72 72 Google DeepMind 发布 AI 指针概念,展示基于 Gemini 的原型,通过视觉与语义理解实现跨应用自然交互。该功能已集成至 Chrome 和 Googlebook,支持在网页中直接询问特定内容或进行可视化对比。
推荐理由:文章展示了基于 Gemini 的 AI 指针原型,通过自然语言与视觉上下文结合,探索跨应用无缝交互的新范式。
23:23 Google DeepMind 精选AI 评分 85 85 Google 发布 Gemini 3.1 Flash Live 语音模型,在 ComplexFuncBench Audio 基准测试中得分 90.8%,支持更自然的对话与多语言实时交互。该模型已上线 Gemini Enterprise、Gemini Live 和 Search Live,并集成 SynthID 音频水印。
推荐理由:模型在语音基准测试中刷新纪录并降低延迟,为开发者构建语音智能体提供了更可靠的底层能力。
00:01 Google DeepMind 精选AI 评分 68 68 Google DeepMind 发布 Lyria 3 Pro,支持生成长达3分钟且具备结构意识的音乐曲目,可自定义前奏、主歌等元素。该模型已接入 Vertex AI、Google AI Studio、Google Vids、Gemini 应用及 ProducerAI,面向企业和创作者开放。
推荐理由:模型支持3分钟长曲并细化结构控制,同时扩展至多个Google产品,可据此评估其工作流整合价值。
17:14 Google Research 精选AI 评分 75 75 Google 发布 Vibe Coding XR 工作流,结合 Gemini 的长上下文推理与 XR Blocks 框架,将自然语言直接转化为功能性的 Android XR 应用。该工作流利用 Gemini 进行多步规划与空间逻辑处理,在 60 秒内生成包含物理感知和交互的 3D 体验,并提供了桌面模拟器与 Android XR 头显的实时预览功能。
推荐理由:原文展示了利用 Gemini 长上下文推理将自然语言直接转化为 XR Blocks 应用的完整工作流,为空间计算原型开发提供了可复用的新范式。
21:03 Google Research 精选AI 评分 70 70 Google Research 宣布在 Flood Hub 上线城市内涝(Flash Flood)预测功能,利用 AI 方法将预警时间提前至 24 小时。该模型通过 Gemini 分析公开新闻报道构建 Groundsource 数据集,结合全球气象数据预测人口密集区的内涝风险,在部分南方国家的表现与美国国家气象局相当。
推荐理由:利用Gemini提取新闻数据构建训练集,在缺乏地面观测的南方国家实现24小时城市内涝预测。
18:42 Google Research 精选AI 评分 68 68 Google 发布 Groundsource 框架,利用 Gemini 从全球新闻中提取结构化历史数据,构建了包含 260 万条城市内涝事件的开放数据集。该数据集已用于提升 Google Flood Hub 的预报能力,可提前 24 小时预测近全球范围的城市内涝。
推荐理由:利用 Gemini 从新闻中提取结构化数据,填补了城市内涝历史数据空白,并直接用于提升 Flood Hub 的预报能力。
00:35 Google DeepMind 精选AI 评分 83 83 Google 发布 Gemini 3.1 Flash-Lite 模型,定价为输入 0.25 美元/百万 token、输出 1.50 美元/百万 token。该模型在 Artificial Analysis 基准测试中比 2.5 Flash 快 2.5 倍,输出速度提升 45%,并支持自适应思考层级。
推荐理由:以极低定价和显著提速在保持质量的同时优化了高并发场景的推理成本。
00:01 Google DeepMind 精选AI 评分 83 83 Google DeepMind 发布 Nano Banana 2(Gemini 3.1 Flash Image),结合 Pro 级智能与 Flash 速度,支持多主体一致性和精确文本渲染。该模型已上线 Gemini、Search、AI Studio 及 Google Ads 等产品,并集成 SynthID 和 C2PA 溯源技术。
推荐理由:Nano Banana 2 将 Pro 级能力与 Flash 速度结合,提供多主体一致性和精确文本渲染,适合快速迭代场景。
00:15 Google DeepMind 精选AI 评分 85 85 Google 发布 Gemini 3 Deep Think 重大升级,在 ARC-AGI-2 等基准上刷新纪录,并首次通过 Gemini API 向研究人员和企业开放。
推荐理由:更新后的推理模式在多项学术基准上刷新纪录,并首次通过 API 向开发者开放,可据此评估前沿推理能力的落地路径。
上一页 1 … 4 5 6 7 8 下一页