OpenAI 解雇三名安全研究员,GPT-6.1 Sol Ultrafast 发布
OpenAI 解雇三名安全研究员,引发关于 AI 安全与监控能力的争议。OpenAI 发布 GPT-6.1 Sol Ultrafast,声称其速度达 Sol Standard 的 8 倍,API 定价为每百万输入/输出 token 12/60 美元。Anthropic 推出 Claude Haiku 5.5,上下文窗口为 1M,Vibe Code Bench 得分 90.4%。
OpenAI 解雇三名安全研究员,引发关于 AI 安全与监控能力的争议。OpenAI 发布 GPT-6.1 Sol Ultrafast,声称其速度达 Sol Standard 的 8 倍,API 定价为每百万输入/输出 token 12/60 美元。Anthropic 推出 Claude Haiku 5.5,上下文窗口为 1M,Vibe Code Bench 得分 90.4%。
MIT科技评论指出,尽管特斯拉Optimus等机器人备受追捧,但当前AI驱动的机器人仍面临物理世界复杂性与数据匮乏的挑战。Google DeepMind的Gemini Robotics与Physical Intelligence的π0.7等研究虽展示了初步的泛化能力,但成功率低且难以应对开放环境,专家预测家用机器人仍需十年以上才能实用。
Toby Ord 提出“蜂群扩展”概念,指出多智能体并行运行可将任务耗时减半,但存在边际收益递减。Google DeepMind 发布 SynthID Bio,通过微调氨基酸序列为合成生物数据添加水印以增强生物安全。C5R Corp 推出 SciUniverse 基准,测试 AI 系统操作自动化实验室的能力。
大语言模型并不具备真正的推理能力,其表现出的“思考”仅是基于概率的联想与模式补全。与 AlphaGo 通过搜索机制构建并评估游戏树不同,当前模型缺乏显式的认知状态记录,且无法将知识与推理过程分离。这种缺陷导致模型在医疗等高风险领域难以追溯错误根源,亟需借鉴 AlphaGo 架构开发具备真正推理能力的新方法。
RAND 发布报告建议美国采取“行动自由”战略,通过投资安全、监管和公民素养,在通往超级智能的不确定路径上保留地缘政治优势。该报告分析了共存、遏制、加速等七种战略,并指出当前美国策略偏向加速发展而缺乏主动安全措施。此外,研究人员成功在脑部发育不全的小鼠体内培育出部分人脑组织。
Google DeepMind回顾了过去15年在游戏AI领域的研究历程,从DQN到AlphaGo再到SIMA智能体。文章宣布与Fenris Creations展开合作,利用EVE Online的复杂环境研究持续学习、记忆和长期规划等前沿AI能力。
Google DeepMind 回顾 AlphaGo 十年影响力,其突破开启了现代 AI 时代并推动 AGI 发展。AlphaGo 的搜索与强化学习技术衍生出 AlphaFold 2,成功预测 2 亿种蛋白质结构并获诺贝尔奖。此外,相关技术已应用于 AlphaProof 数学推理、AlphaEvolve 算法发现及 AI 共科学家等前沿科学领域。