OpenAI 发布 GPT-4.1 模型系列及首个 nano 模型
OpenAI 在 API 中发布 GPT-4.1 新模型家族,在编码、指令遵循和长上下文理解方面实现全面改进,并首次发布 nano 模型,面向全球开发者开放。
推荐理由:GPT-4.1 系列在编码、指令遵循和长上下文理解上全面增强,并首次推出 nano 模型,开发者可立即通过 API 接入。
OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。
OpenAI 在 API 中发布 GPT-4.1 新模型家族,在编码、指令遵循和长上下文理解方面实现全面改进,并首次发布 nano 模型,面向全球开发者开放。
推荐理由:GPT-4.1 系列在编码、指令遵循和长上下文理解上全面增强,并首次推出 nano 模型,开发者可立即通过 API 接入。
OpenAI 宣布完成 400 亿美元新一轮融资,投后估值达到 3000 亿美元。这笔资金将用于推动 AI 研究前沿、扩展计算基础设施,并为每周 5 亿 ChatGPT 用户提供更强工具。
推荐理由:OpenAI 宣布 400 亿美元融资及 3000 亿美元估值,为后续算力扩张与 AGI 研发提供资金保障。
OpenAI 宣布在 GPT-4o 中引入原生图像生成功能,强化了文本渲染和指令遵循能力,并开放了 ChatGPT Images 2.5 入口。
推荐理由:GPT-4o 原生集成图像生成功能并强化文本渲染,为多模态交互提供了更直接的入口。
OpenAI 更新 GPT-4o 系统卡片,确认其具备图像生成功能。该能力显著强于早期的 DALL·E 3 系列,可生成写实风格图像并支持以图片作为输入进行转换。
推荐理由:官方确认4o具备图像生成能力并支持图生图,标志着多模态能力向生成端延伸。
OpenAI 发布 GPT-4.5 研究预览版,定位为目前最大且知识最丰富的模型。
推荐理由:OpenAI 发布 GPT-4.5 研究预览版,定位为目前最大且知识最丰富的模型,提供前沿能力体验。
OpenAI 发布 SWE-Lancer 基准,旨在评估前沿大语言模型能否通过完成真实的自由职业软件工程任务赚取 100 万美元。
推荐理由:OpenAI 发布 SWE-Lancer 基准,通过真实自由职业任务评估前沿模型在软件工程中的实际变现能力。
OpenAI 推出 Deep Research,这是一个利用推理能力综合大量在线信息并完成多步研究任务的智能体。该功能今日向 Pro 用户开放,Plus 和 Team 用户随后可用。
推荐理由:OpenAI 推出基于推理的 Agent 处理多步研究任务,明确了 Pro 及 Plus 用户的开放节奏。
OpenAI 发布 o3-mini 模型。
OpenAI 及其战略合作伙伴发布 Stargate 基础设施计划,旨在构建 AGI 的基础设施。官方正在面向工业界招募数据中心基础设施领域的合作伙伴,合作范围涵盖电力、土地、建设及设备供应等全链条环节。
推荐理由:OpenAI 联合合作伙伴公开招募数据中心基础设施供应商,涉及电力、土地及建设等环节。
OpenAI 发布针对 o1 模型的新对齐策略,直接教授模型安全规范及其推理能力。
推荐理由:原文介绍了o1模型的新对齐策略,读者可据此了解模型安全机制的演进方向。
OpenAI 发布 o1 模型,并推出 Realtime API 改进及新的微调方法等开发者工具。
推荐理由:OpenAI 发布 o1 模型并更新开发者工具,提供模型能力变化与接入入口。
OpenAI 宣布视频生成模型 Sora 正式开放使用,用户可通过 sora.com 生成最高 1080p 分辨率、最长 20 秒的视频,支持宽屏、竖屏和方形比例,并允许导入自有素材进行扩展、混剪或从文本生成全新内容。
推荐理由:Sora 正式开放使用,支持生成 1080p 视频,用户可自定义比例并导入素材进行混剪。
OpenAI 发布 ChatGPT Pro,旨在扩大前沿 AI 的使用范围。
OpenAI 推出 ChatGPT 搜索功能,旨在提供带有相关网页来源链接的快速、实时答案。
推荐理由:ChatGPT 新增搜索功能,提供带有来源链接的快速实时回答,可据此评估其对现有搜索场景的替代潜力。
OpenAI 发布研究,展示了简化、稳定并扩展连续时间一致性模型的方法,在仅使用两步采样的情况下实现了与领先扩散模型相当的样本质量。
推荐理由:研究展示了连续时间一致性模型在两步采样下达到主流扩散模型画质,为高效图像生成提供新路径。
OpenAI 宣布推出 Realtime API,允许开发者在应用中构建快速的语音到语音交互体验。
推荐理由:原文宣布推出实时语音 API,开发者可据此构建低延迟的语音交互应用。
OpenAI 宣布开发者现在可以使用图像和文本对 GPT-4o 进行微调,以增强模型的视觉能力。
推荐理由:GPT-4o 微调 API 新增图像输入支持,开发者可利用图文数据优化模型视觉能力。
OpenAI 发布 o1 模型。
OpenAI 发布 o1-mini 模型,旨在推进成本高效的推理能力。
OpenAI 宣布 GPT-4o 现已开放微调功能。
推荐理由:GPT-4o 开放微调功能,开发者可据此优化模型在特定任务上的表现。