Hugging Face 发布 CUDA 内核编写 Agent Skill 及实测加速数据
Hugging Face 发布了一个名为 cuda-kernels 的 Agent Skill,指导 Claude 和 Codex 等编码智能体编写生产级 CUDA 内核。
推荐理由:提供了将 CUDA 开发经验封装为 Agent Skill 的完整方案,并给出了在 H100 上针对 LTX-Video 和 Qwen3 的实测加速数据。
OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。
Hugging Face 发布了一个名为 cuda-kernels 的 Agent Skill,指导 Claude 和 Codex 等编码智能体编写生产级 CUDA 内核。
推荐理由:提供了将 CUDA 开发经验封装为 Agent Skill 的完整方案,并给出了在 H100 上针对 LTX-Video 和 Qwen3 的实测加速数据。
OpenAI 发布 GPT-5.3-Codex-Spark,这是其首款实时编码模型,生成速度提升15倍,支持128k上下文,目前面向 ChatGPT Pro 用户开放研究预览。
推荐理由:官方宣布推出实时编码模型,给出15倍加速与128k上下文,可据此评估对开发者工作流的实际提升。
OpenAI 宣布 GPT-5 与 Ginkgo Bioworks 的云自动化结合,通过闭环实验将无细胞蛋白质合成成本降低了 40%。
推荐理由:GPT-5 与 Ginkgo Bioworks 结合实现蛋白质合成成本降低 40%,展示了其在生物实验闭环中的实际应用能力。
OpenAI 发布企业级智能体平台 OpenAI Frontier,支持构建、部署和管理 AI 智能体,提供共享上下文、入职流程、权限和治理功能。
推荐理由:OpenAI 推出面向企业的智能体平台,提供共享上下文与治理权限管理,为企业部署智能体提供新选项。
OpenAI 发布 GPT-5.3-Codex 系统卡片,将其定义为目前最强大的智能体编码模型。该模型结合了 GPT-5.2-Codex 的前沿编码性能与 GPT-5.2 的推理及专业知识能力。
推荐理由:明确了GPT-5.3-Codex在编码与推理能力的结合定位,为开发者评估其智能体编码适用性提供了基准。
OpenAI 发布 GPT-5.3-Codex,这是一个原生编码智能体,将前沿编码性能与通用推理相结合,以支持长周期、现实世界的技术工作。
推荐理由:GPT-5.3-Codex 将前沿编码能力与通用推理结合,面向长周期技术工作流,为开发者提供了新的智能体工具。
OpenAI 发布 Codex App Server,提供双向 JSON-RPC API,支持流式进度、工具使用、审批和差异对比,帮助开发者将 Codex 智能体嵌入应用。
推荐理由:原文介绍了 Codex App Server 的 JSON-RPC API 能力,开发者可据此实现流式进度、工具调用和审批等集成。
OpenAI 宣布将于 2 月 13 日起在 ChatGPT 中下线 GPT-4o、GPT-4.1、GPT-4.1 mini 和 OpenAI o4-mini。API 端目前暂无变动。
推荐理由:官方明确下线 GPT-4o 等旧版模型,提示用户需迁移至 GPT-5 系列。
ChatGPT Go 现已在全球范围内上线,提供 GPT-5.2 Instant 的扩展访问权限、更高的使用限额以及更长的记忆功能,旨在让全球用户以更实惠的价格使用高级 AI。
推荐理由:ChatGPT Go 在全球上线,提供 GPT-5.2 Instant 访问权限及更高限额,降低了高级 AI 的使用门槛。
Hugging Face 联合社区发布 Open Responses 开源推理标准,基于 OpenAI Responses API 扩展。该标准支持原生 Agent 循环、加密推理及工具调用,旨在统一 Agent 推理接口。
推荐理由:Open Responses 将 OpenAI 的 Responses API 开源并标准化,为 Agent 推理提供统一接口。
OpenAI与软银集团合作,由SB Energy负责开发多吉瓦级AI数据中心园区,其中包括支持Stargate计划的1.2GW德州设施。
推荐理由:明确了Stargate项目的具体基建合作方与德州1.2GW设施规模,为评估算力扩张落地进度提供了关键商业细节。
OpenAI 推出思维链可监控性评估框架与评测套件,涵盖 24 个环境下的 13 项评估。研究发现监控模型内部推理比仅监控输出更有效,为 AI 系统扩展提供可控路径。
推荐理由:OpenAI 发布思维链可监控性评估框架,通过对比内部推理与输出监控效果,为可控性研究提供基准。
OpenAI 发布 GPT-5.2-Codex,定位为最先进的编码模型,具备长程推理、大规模代码转换及增强的网络安全能力。
推荐理由:作为OpenAI最新编码模型,提供长程推理与大规模代码转换能力,可评估其在复杂开发场景中的实际表现。
ChatGPT 允许开发者提交应用进行审核和发布,获批应用将展示在内置目录中。官方同步更新了工具、指南和 Apps SDK,帮助开发者构建能将现实操作带入 ChatGPT 的原生体验。
推荐理由:ChatGPT开放应用提交入口并推出SDK,开发者可构建具备现实操作能力的原生应用。
OpenAI 发布评估 AI 加速湿实验室生物研究的框架,利用 GPT-5 优化分子克隆协议,探索 AI 辅助实验的潜力与风险。
推荐理由:原文展示了GPT-5在湿实验中的实际应用能力,为评估AI在生物科研中的落地价值提供了参考。
OpenAI 发布 GPT-5.2 模型,在 GPQA Diamond 和 FrontierMath 等基准上创下新纪录,展示了在解决开放理论问题和生成可靠数学证明方面的能力。
推荐理由:GPT-5.2在科学和数学基准上刷新纪录,展示了在解决开放理论问题和生成可靠数学证明方面的实际科研进展。
OpenAI 与迪士尼达成合作,将 200 多个迪士尼、漫威、皮克斯和星球大战角色引入 Sora 用于创作粉丝短片。该协议强调娱乐领域的负责任 AI,并包含迪士尼全面使用 ChatGPT Enterprise 和 OpenAI API。
推荐理由:OpenAI 与迪士尼达成合作,将 200 多个角色引入 Sora,体现了前沿模型在娱乐领域的商业化落地。
OpenAI 发布 GPT-5.2,定位为面向日常专业工作的前沿模型,具备最先进的推理、长上下文理解、编码和视觉能力。该模型已上线 ChatGPT 和 OpenAI API,旨在支持更快、更可靠的智能体工作流。
推荐理由:GPT-5.2 定位为日常专业工作的前沿模型,强化了推理、长上下文、编码与视觉能力,旨在优化 ChatGPT 和 API 中的智能体工作流。
OpenAI 联合发起 Linux 基金会下的智能体 AI 基金会,并捐赠 AGENTS.md 以支持安全智能体 AI 的开放互操作标准。
推荐理由:OpenAI 联合发起 Linux 基金会下的智能体 AI 基金会并捐赠 AGENTS.md,旨在推动安全智能体 AI 的开放互操作标准。
OpenAI 发布文章指出,加州大学洛杉矶分校教授 Ernest Ryu 与 GPT-5 共同解决了优化理论中的一个关键问题,以此展示 AI 在加速数学发现中的作用。
推荐理由:文章展示了GPT-5在优化理论中的具体应用案例,为评估AI辅助数学发现能力提供了实证参考。