Cornerstone OnDemand 利用 Amazon Bedrock 将数据库诊断时间缩短 78%
Cornerstone OnDemand 构建的多智能体系统 Orion AI 利用 Amazon Bedrock 和 Strands Agents,将数据库诊断时间从 45 分钟缩短至 10 分钟,降幅达 78%。
Cornerstone OnDemand 构建的多智能体系统 Orion AI 利用 Amazon Bedrock 和 Strands Agents,将数据库诊断时间从 45 分钟缩短至 10 分钟,降幅达 78%。
Ambrosia Energy CEO Ben Longmier 与 Bloom Energy SVP Bill Thayer 将在 TechCrunch Disrupt 2026 的 Smart Systems Stage 探讨 AI 基础设施繁荣带来的商业机遇。会议将分析算力需求增长与电力、电网、数据中心等物理基础设施供应之间的瓶颈,以及由此催生的能源、冷却和电气设备等新兴市场需求。
AWS 发布 Amazon Bedrock AgentCore payments,支持 x402 协议实现 AI 智能体按次付费。该功能提供托管钱包、基础设施层支出限制及链上审计,BlockRun 与 Incarna 已将其用于 Base 网络上的 USDC 结算。
推荐理由:AWS 发布 AgentCore payments 支持 x402 协议,提供托管钱包与基础设施层支出限制,解决 Agent 高频小额支付难题。
AWS发布参考架构,介绍如何在Amazon SageMaker HyperPod EKS集群中实现多租户隔离。方案结合IAM Identity Center、SageMaker AI域、Kubernetes命名空间、HyperPod Task Governance及Kubecost,为多个团队提供身份认证、工作负载隔离、资源公平分配与成本分摊。
Oracle 利用 ChatGPT Work 和 Codex 将招聘、工程和运营中的专家知识转化为快速可重复的工作流,把原本需要数天的工作缩短至几分钟。
《战争机器:E日》于 10 月 6 日登陆 GeForce NOW,Ultimate 会员可体验 GeForce RTX 5080 级性能及 DLSS、Reflex 技术。Fire TV 用户即将支持通过 Amazon 直接购买会员。本周云游戏库新增《STAR WARS: Galactic Racer》等 10 款游戏。
LegalOn 通过策略性匹配 Astra、Sol 和 Luna 任务并管理预算,将 Codex 每日估算成本降低 65%,同时保持开发速度。
AVEVA 首席技术官 Arti Garg 强调,随着基础模型、物理 AI 和智能体 AI 加速工业应用,必须建立负责任的安全治理框架。该框架强调安全、效率及人类监督,主张 AI 应辅助而非替代关键决策中的人类。同时需通过 IEEE 工作组制定标准,量化并管理 AI 对环境的影响,以实现可持续的自动化。
微软发布 Surface Laptop Ultra,搭载 Nvidia RTX Spark SoC,起售价 2599 美元,10 月 16 日发货。该设备配备 5120 核或 6144 核 Blackwell GPU 及最高 128GB LPDDR5x 统一内存,支持本地 AI 开发与 AAA 游戏运行。
微软发布Agent Lightning v1.0,通过LLM代理复用部署端Agent进行强化学习训练,代码仅约3,500行。该框架原生支持Kubernetes,无需商业沙箱服务,在Qwen3.5-9B上仅用6,000个样本在SWE-bench Verified上提升14.6个百分点。
推荐理由:框架通过LLM代理复用部署端Agent,提供轻量级RL训练方案与Kubernetes原生支持。
AWS 提出智能体价值模型,指出传统 RPA 投资回报模型无法捕捉智能体在异常处理、决策质量和变更韧性方面的价值。该框架强调释放的工时需通过减少支出或重新部署转化为实际经济收益。例如在理赔流程中,仅释放工时并不等于省钱,必须结合错误纠正成本降低和人员重新部署产生的价值进行综合计算。
Qlik 利用 Amazon Bedrock 构建 Qlik Answers,解决企业员工获取可信数据答案的需求。该系统通过分层架构实现精准路由,结合 Amazon OpenSearch Service 检索与 Guardrails 安全过滤,确保回答有据可查。自 2026 年 2 月全面上线以来,其 Discovery Agent 已为客户发现超 10 万次异常,显著提升了企业运营效率。
AWS发布教程,展示如何结合AWS DevOps Agent、Lambda持久化函数、EventBridge与Bedrock构建自动化修复工作流。该方案将Agent的调查结论转化为预验证的修复动作,通过工具白名单与人工审批门控确保安全,实现从诊断到修复的闭环。
推荐理由:提供基于AWS Lambda持久化函数与Bedrock的自动化修复架构,将人工审批前置,降低运维MTTR。
AWS 发布构建 AI 智能体的指南,旨在填补业务人员从概念认知到动手构建的能力差距。通过为期六周的结构化项目,非技术背景人员利用 Strands Agents SDK 和 Amazon Bedrock 成功构建了多智能体原型。该方案通过导师制与迭代练习,帮助业务团队掌握 AI 工具的实际应用能力。
Mistral 发布万亿参数模型 Mistral Large 4(昵称 Le Chonk),主打编程与网络安全,声称性能接近顶级闭源模型。
推荐理由:Mistral 发布万亿参数开源模型,主打编程与垂直领域,提供闭源替代方案。
Stacklok 发布开源云原生智能体框架 Mecatl,将智能体循环与执行环境解耦,支持在 Kubernetes 上集中管理智能体会话、工具调用和上下文。
推荐理由:Stacklok 发布基于 Kubernetes 的开源智能体框架 Mecatl,提供企业级云原生管理方案。
Radisson Hotel Group 联合 Accenture 基于 OpenAI 技术构建 ChatGPT 插件,帮助旅客在规划行程时查找、比较和预订酒店。该插件利用 ChatGPT 的交互能力,将酒店发现功能直接整合至对话场景中,简化了旅行预订流程。
OpenAI发布内部Navier-Stokes模型的722篇数学手稿,包含准黎曼猜想等成果,引发数学界重大反响。Mistral发布1T参数多模态模型Large 4,支持API并承诺开源。Google推出多模态嵌入模型EmbeddingGemma 2及图像模型Nano Banana 2.1。OpenAI发布决策API公测版,Anthropic扩展网络安全验证计划。
推荐理由:原文梳理了OpenAI内部模型数学突破、Mistral新模型发布及多项工具更新,提供行业全景与关键争议点。
AWS发布教程,展示如何在Amazon Bedrock AgentCore和开源框架OpenClaw上构建带长期记忆的AI助手。方案通过AgentCore Memory实现上下文持久化,结合Claude Haiku 4.5和Sonnet 4.5进行任务路由,并提供CloudFormation模板一键部署。
推荐理由:原文给出了基于AgentCore和OpenClaw构建带记忆智能体的完整架构与代码,读者可直接复用该模式。
AWS 发布指南,协助客户依据 ISO/IEC 42005:2025 标准建立 AI 系统影响评估流程。该标准提供结构化方法,涵盖评估生命周期、触发重评因素及轻量级分类,旨在将 AI 风险识别整合至企业现有风险管理生态中。AWS 同时提供 AIMS 实施指南和 Well-Architected Framework: Responsible AI Lens 等工具支持合规落地。
Amazon SageMaker HyperPod 通过 SageMaker Unified Studio 提供四层控制体系,涵盖组织、项目、集群和工作负载,以解决多团队共享加速计算资源时的治理难题。文章详细阐述了如何设计身份、容量和可观测性策略,在保持基础设施团队对集群操作控制权的同时,向机器学习团队提供项目上下文中的批准计算资源。
Amazon SageMaker 新增从 SageMaker Studio UI 直接创建和管理 HyperPod Spaces 的功能。数据科学家无需使用 CLI 工具,即可在 HyperPod EKS 集群上启动 JupyterLab 和 Code Editor 环境。该功能支持配置计算资源、查看空间状态及通过浏览器或远程 IDE 直接访问开发环境。
AWS 发布教程,展示如何利用 Amazon Bedrock AgentCore、Managed Knowledge Base 和 Nova Sonic 构建语音旅行管家。该方案通过 AgentCore Gateway 和 MCP 协议连接后端服务,支持实时语音交互由 Amazon Nova 2.5 Sonic 驱动,并支持动态扩展。
电信运营商正将 AI 战略建立在开源模型之上,89% 的受访者认为其对公司 AI 战略至关重要。NVIDIA Nemotron 系列提供前沿推理性能,300 亿参数的 Nemotron 3 LTM 针对电信任务微调。运营商可利用开源模型实现本地化定制、安全部署及合规治理,构建面向企业的 AI 服务。
Jump Trading 利用 ChatGPT 扩展量化研究。通过结合多种数据源与人工审查,该机构将长期运行的 AI 工作流整合至量化研究流程中,以提升研究效率。
Claude Opus 5.5 和 Claude Sonnet 5.5 现已在 AWS GovCloud (US) 的 Amazon Bedrock 中提供,支持 FedRAMP Class D 认证。结合 Claude Code 智能体编码工具,开发者可在终端或 IDE 中运行 AI 辅助工作流,同时满足 ITAR 等严格合规要求。
Amazon SageMaker AI 发布 aws-ai-ml 智能体技能,支持通过 Model Context Protocol (MCP) 接入 Kiro、Claude Code 等编码智能体。该技能可自动为模型生成 SageMaker Python SDK v3 部署代码,提供基准测试、实例选型推荐及性能对比功能。
推荐理由:通过 MCP 协议将 SageMaker 推理优化能力接入主流编码智能体,实现从自然语言到可执行部署代码的自动化闭环。
Amazon Quick 发布 Quick Resource Migrator,通过托管在 Amazon Bedrock AgentCore 上的 MCP 服务器,实现 Agent、连接器、知识库等资源的跨账号自动化迁移。该工具支持幂等更新、权限保真、版本备份与回滚,并提供预览与审计记录,解决企业手动迁移易出错且难审计的问题。
Amazon Quick 控制台不支持直接从 Admin 或 Author 降级为 Reader,需通过手动删除重建或 AWS CLI 分步降级实现。CLI 方法遵循 Admin 到 Author、再到 Restricted Reader 最后到 Reader 的顺序,Pro 用户也需借助中间 Legacy 角色完成过渡。此举有助于落实最小权限原则并降低基于角色的订阅成本。
OpenAI 发布 GPT-6.1 Sol,定价为输入输出各 2/10 美元每百万 token,在 DeepSWE v1.1 上超越 GPT-6 Sol 6.4 分。
MIT Technology Review 发布报告指出,企业 AI 正从工具转向自主智能体运营模式。全球 AI 投资预计 2026 年达 2.5 万亿美元,但多数企业面临数据孤岛与整合滞后。报告强调,通过可组合架构与主权控制实现数据就绪,而非单纯追求数据量,是构建可复合智能的关键。
Google 发布基于可信执行环境(TEE)的下一代联邦学习系统,通过公开透明日志和可重现构建实现可验证的隐私保障。Gboard 已部署该系统,在获得更强隐私保护和更高精度的同时,显著缩短了模型训练时间。
推荐理由:Google 发布基于 TEE 的联邦学习系统,提供可验证隐私保障,Gboard 已部署并实现训练加速。
Airbnb CTO Ahmad Al-Dahle 详解“内外兼修”AI 战略:内部 60% 代码由 AI 生成,客服 50% 工单由 AI 解决,通过 Everest 上下文图加速新产品上线。
GeForce NOW 10 月新增 25 款游戏,其中《CONTROL Resonant》和《巫师 3:重制版》已上线。Performance 和 Ultimate 会员可领取《CONTROL Resonant》的第三冰棒球帽奖励,Ultimate 会员还能体验 GeForce RTX 5080 级云渲染性能。其余 19 款游戏将在 10 月陆续加入。
NVIDIA AI Factories 通过高生产力、长耐用性和高通用性最大化投资回报。Vera Rubin NVL72 系统较 GB300 NVL72 提升 30 倍每兆瓦吞吐量,DeepSeek V4 Pro 模型每百万 token 成本降低 45 倍。A100 GPU 服役六年仍具商业价值,CUDA 平台确保硬件跨代兼容并支持各类 AI 及非 AI 负载。
Google 发布 Gemini 4 Argon 模型,API 定价为输入 2 美元/百万 token、输出 10 美元/百万 token,支持 100 万 token 输出。该模型在 DeepSWE v1.1 基准测试中得分 77.9%,已用于内部代码迁移并节省大量内存。
推荐理由:Argon 提供百万级输出与工程基准领先数据,可评估其在长程任务与代码重构中的实际价值。
微软研究院开发了一套机器学习管道,针对美国本土66,935个变电站预测空间天气风险,可提前30至60分钟发出预警。该系统在2020-2026年评估期间检测到近80%的主要空间天气事件,Dst预测器在62.2%的高峰时段优于Burton方程。
CoreWeave 宣布在云平台上提供 NVIDIA Vera Rubin NVL72 系统和首款 AI 专用 CPU Vera,并推出 CoreWeave Forge 平台。
Google Research 提出 Diffusion Controller 框架,将图像生成过程重构为连续控制问题,通过轻量级“转向阻尼器”网络动态调整生成轨迹。该框架在灰盒和全白盒环境下均优于 LoRA,实现了更优的质量与效率平衡。
推荐理由:提出统一控制框架解决图像生成引导难题,在受限访问下优于LoRA。
Mistral 在慕尼黑开设新枢纽,重点推进工业 AI 与物理 AI 研发。公司计划到 2030 年建设 1GW 欧洲算力,并依托开源权重架构保障数据主权。Mistral 已收购 Emmi AI 组建物理 AI 团队,正与宝马、西门子能源合作开发工程仿真应用。