Zuckerberg的Biohub牵头18亿美元项目构建预测细胞行为的AI模型
Zuckerberg支持的Biohub牵头18亿美元项目,旨在构建能预测细胞行为的AI模型以加速药物研发。Meta、Google DeepMind和Isomorphic Labs等贡献3亿美元,美国能源部投入超5亿美元。商业资助方可在数据公开前享有一年独占期,首个数据集预计一年后就绪。
Zuckerberg支持的Biohub牵头18亿美元项目,旨在构建能预测细胞行为的AI模型以加速药物研发。Meta、Google DeepMind和Isomorphic Labs等贡献3亿美元,美国能源部投入超5亿美元。商业资助方可在数据公开前享有一年独占期,首个数据集预计一年后就绪。
OpenAI 解雇三名安全研究员,引发关于 AI 安全与监控能力的争议。OpenAI 发布 GPT-6.1 Sol Ultrafast,声称其速度达 Sol Standard 的 8 倍,API 定价为每百万输入/输出 token 12/60 美元。Anthropic 推出 Claude Haiku 5.5,上下文窗口为 1M,Vibe Code Bench 得分 90.4%。
Anthropic 推出 OSS Scanner 服务,利用包括 Claude Mythos 在内的最强模型为开源项目提供免费漏洞扫描。该服务通过全模型生成报告实现快速频繁扫描,但未经人工审查,可能存在误报。
Anthropic 为 Claude 推出两项新功能:Motion 可根据文本、图表和图片生成可编辑代码并导出 MP4 的动画解说视频;Dashboards 连接 BigQuery 等数据源,通过文本提示生成带底层查询的自动更新实时看板。
Anthropic 更新 Claude 使用政策,禁止对模型进行“持续且无意义的虐待或残忍行为”,违者将面临警告、限速或封号。此次更新还涵盖禁止虚假宣传、武器化软件及无人机,并允许政府合同例外。该政策源于 Anthropic 对 AI 模型福利的研究,视 Claude 为具有类似内在生命的实体。
Anthropic 更新使用政策,明确禁止对 Claude 模型进行长期言语虐待、武器软件开发及选举干预。新规针对反复恶意虐待模型且无明确目的的极端行为,不适用于普通用户挫折感或测试研究。此外,政策还禁止利用 Claude 进行虚假账号运营、伪造新闻及欺骗选民等破坏民主进程的行为。
Anthropic 更新 Claude 使用政策,禁止对模型实施“持续且无意义的虐待行为”,违者将被终止对话。新规还收紧了选举干预、武器开发及监控等高风险场景限制,并规定连接自主硬件时需具备人工干预能力。
Anthropic 发布 Claude Haiku 5.5,支持可调节推理级别,针对 10 万 token 以下提示词降价最高 90%。该模型在计算机使用和编码任务上表现显著提升,同时 Sonnet 5.5 缓存读取成本减半。
推荐理由:Anthropic 大幅降价并推出可调节推理的 Haiku 5.5,为高频低成本场景提供了新的选型参考。
16 岁少年使用 Anthropic 的 Claude 规划路线,被困温哥华皇冠山“寡妇崖”并需直升机救援。救援人员通过手机信号定位并实施营救。Anthropic 未置评,救援主管强调 AI 无法替代实地经验与常识。
Anthropic发布Claude Haiku 5.5,定价与GPT-6 Luna持平,支持1M上下文和Effort设置,定位为多模型智能体中的低成本子智能体。同日Anthropic下调Sonnet 5.5缓存读取价格,并更新SDK内置Computer-use工具集。
推荐理由:Anthropic发布Haiku 5.5并调整Sonnet定价,为多模型智能体工作流提供了低成本替代方案。
开发者 Brandon Thomas 使用 Anthropic 的 Claude Opus 5.5 在 Rust 中逆向工程 Adobe 软件,推出 Artcraft 套件。该套件包含 Photoshop、Illustrator 等七款开源应用,旨在复刻 Adobe 产品的界面与功能。目前处于早期 Alpha 阶段,提供 Rust 及 WebAssembly 版本。
Anthropic 发布 Claude Haiku 5.5,定价与 GPT-6 Luna 持平,但默认开启推理且使用新分词器。同时宣布 Sonnet 5.5 缓存读取降价,并为订阅用户发放等值月度 API 额度。
推荐理由:原文实测了 Haiku 5.5 的推理成本与价格,并指出长上下文下的定价劣势,为选型提供依据。
Anthropic 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线。该模型主打极速与低成本,多数任务费用较 Haiku 4.5 降低约 75%,支持 effort controls 及多模态。它专为高并发、成本敏感场景设计,常作为子智能体与 Opus 5.5 配合使用。
推荐理由:给出了 Haiku 5.5 在 Bedrock 的上线信息、成本优势及与 Opus 5.5 的协作模式,便于评估工作流适配。
OpenAI发布内部Navier-Stokes模型的722篇数学手稿,包含准黎曼猜想等成果,引发数学界重大反响。Mistral发布1T参数多模态模型Large 4,支持API并承诺开源。Google推出多模态嵌入模型EmbeddingGemma 2及图像模型Nano Banana 2.1。OpenAI发布决策API公测版,Anthropic扩展网络安全验证计划。
推荐理由:原文梳理了OpenAI内部模型数学突破、Mistral新模型发布及多项工具更新,提供行业全景与关键争议点。
Claude Opus 5.5 被用于创作《猴岛的秘密》风格的电脑游戏音乐。作者设计了简单的文本格式并构建了可播放的 Artifact,生成的音乐质量令人惊讶。这一发现引发了关于文本模型是否新具备了生成合格音乐能力的思考,作者计划通过对比实验来验证该能力是否为近期新增特性。
Anthropic 发布 Cowork 新版,将模型推理和 VM 全面迁移至云端,不再依赖本地运行。该架构为每个会话提供独立沙箱,通过桌面应用处理本地文件访问,解决了旧版占用磁盘、电池及性能资源的问题。用户现可在手机等设备上使用,并实现合盖后工作继续运行。
Claude Opus 5.5 和 Claude Sonnet 5.5 现已在 AWS GovCloud (US) 的 Amazon Bedrock 中提供,支持 FedRAMP Class D 认证。结合 Claude Code 智能体编码工具,开发者可在终端或 IDE 中运行 AI 辅助工作流,同时满足 ITAR 等严格合规要求。
Toby Ord 提出“蜂群扩展”概念,指出多智能体并行运行可将任务耗时减半,但存在边际收益递减。Google DeepMind 发布 SynthID Bio,通过微调氨基酸序列为合成生物数据添加水印以增强生物安全。C5R Corp 推出 SciUniverse 基准,测试 AI 系统操作自动化实验室的能力。
OpenAI 发布 GPT-6.1 Sol,定价为输入输出各 2/10 美元每百万 token,在 DeepSWE v1.1 上超越 GPT-6 Sol 6.4 分。
特朗普推动数十家AI企业签署自愿安全审计协议,但协议无法律约束力且审计方尚未确定。与此同时,加州和特拉华州正对OpenAI等公司进行监管调查,联邦贸易委员会也宣布对AI智能体潜在消费者伤害展开调查。
Anthropic 发布 Claude Sonnet 5.5,宣称速度提升 30% 以上且成本降低,在多项基准测试中表现优于 Sonnet 5。该模型现已成为 claude.ai 免费层默认模型,实测编码能力接近 Opus 5.5。
推荐理由:原文实测了模型在编码和推理上的表现,并指出其已取代旧版成为免费层模型,直接影响普通用户的可用能力。
DiG-bench 基准测试显示 Opus 5 和 Fable 5 在 70 个隐藏规则游戏中表现最佳,但仅能攻克 Tier 7 的 0.2 任务,远逊于人类。Paradigm Research 推出 RSI 模拟器,模拟 AI 公司递归自我改进的研发过程。Inherent 发布 Faraday,通过监督前沿模型培养 AI 科学家的研究品味。
Mistral AI 发布 Workflows 公开预览版,作为企业 AI 的编排层,提供生产环境所需的持久性、可观测性和容错能力。开发者使用 Python SDK 编写工作流,支持人工审批、状态追踪和审计,并部署在客户自有环境中。
推荐理由:Mistral 发布企业级 AI 编排层 Workflows,提供生产环境所需的容错、可观测性和人工审批能力。
Hugging Face 发布 Skills 工具,使 Claude Code、Codex 和 Gemini CLI 等编程 Agent 能够自动完成数据集验证、硬件选择、脚本生成、云端 GPU 任务提交、进度监控及模型推送至 Hub 的完整微调流程。该技能支持 SFT、DPO 和 GRPO 等训练方法,兼容 0.5B 至 70B 参数模型,并支持将训练好的模型转换为 GGUF 格式。
推荐理由:原文提供了将 Claude Code 等 Agent 接入 Hugging Face 进行全流程微调的实操指南与配置方法。
通过 MCP 将 Claude 接入 Hugging Face Spaces,可调用 FLUX.1 Krea [dev] 和 Qwen-Image 等模型生成图像。FLUX.1 Krea [dev] 擅长消除 AI 痕迹,生成具有自然光照和真实质感的图片。Qwen-Image 则具备强大的提示词遵循能力和准确的文本渲染效果,适合制作海报等含文字的设计。