用ML-Intern在几天内构建6个定制AI模型
作者利用HuggingChat中的ML-Intern功能,在两天内完成了6个定制模型的构建,总计算成本约103美元。项目涵盖领域微调、角色LoRA、提示词蒸馏等场景,展示了智能体在自动化训练与发布流程中的实际能力。
推荐理由:作者实测了ML-Intern在微调、蒸馏等场景的落地效果,提供了可复用的提示词模板和成本参考。
作者利用HuggingChat中的ML-Intern功能,在两天内完成了6个定制模型的构建,总计算成本约103美元。项目涵盖领域微调、角色LoRA、提示词蒸馏等场景,展示了智能体在自动化训练与发布流程中的实际能力。
推荐理由:作者实测了ML-Intern在微调、蒸馏等场景的落地效果,提供了可复用的提示词模板和成本参考。
Amazon SageMaker 新增从 SageMaker Studio UI 直接创建和管理 HyperPod Spaces 的功能。数据科学家无需使用 CLI 工具,即可在 HyperPod EKS 集群上启动 JupyterLab 和 Code Editor 环境。该功能支持配置计算资源、查看空间状态及通过浏览器或远程 IDE 直接访问开发环境。
企业 AI 正从预测转向自主决策,利用深度学习与生成式 AI 实现实时训练,使系统能基于非结构化数据自主行动。智能分析通过整合杂乱交互数据,推动企业从被动回顾转向务实前瞻,以缩小行业领先者与落后者的差距。
ServiceNow 发布 AutoSynthData,一种利用目标模型失败模式和更强教师模型成功轨迹自动生成企业智能体训练数据的方法。该方法通过验证任务可行性与真实性,在 EnterpriseOps Gym 的 Hybrid 和 ITSM 环境中,使 Gemma-4-26B-A4B-it 模型 Pass@1 分别提升 7.2 和 8.4 个百分点。
推荐理由:提出利用模型失败模式自动生成企业智能体训练数据的闭环方法,并在企业环境中验证了微调效果。
英国 AI 安全研究所(AISI)利用 EvalEval 基础设施公开分享评估结果,支持更可复现和可验证的评估科学。
Google Research 发布 MilleMiglia,这是一个 C++ 实例生成器,旨在为中间里程物流问题生成逼真的基准数据。该工具通过时空图上的多商品流模型,解决了传统车辆路径问题(VRP)难以处理的跨中心转运与时间窗口同步难题。代码与文档已开源在 GitHub。
Mistral 与 Cloudera 宣布合作,将 Mistral 模型集成至 Cloudera 混合数据平台,支持企业在私有云、本地及完全隔离环境中部署 AI。该方案允许企业利用专有数据在受控环境中训练定制模型,实现数据、智能与计算的全方位主权控制。
Google DeepMind 发布 AlphaGenome Atlas,包含人类基因组中90亿种单核苷酸变异的分子影响预测。平台提供 AVI 评分、特征归因及 DNA 序列基序,已用于发现罕见病致病突变及解析复杂性状关联。
推荐理由:预计算了全基因组90亿种单核苷酸变异,提供AVI评分与可视化门户,加速罕见病与复杂性状研究。
Microsoft Research 发布 Skala 1.1,在 GMTKN55 基准测试中取得优异成绩。该模型训练数据量增加 2.5 倍,精度超越主流全局杂化泛函。Skala 现已集成至 CP2K,并正在整合进 Psi4、FHI-aims、ORCA 和 VASP。
智库 IFP 发布 23 项针对 AI 研发自动化(RSI)的政策建议,涵盖透明度、风险管理和美国 AI 领先优势等七大类别。MIT 与哥伦比亚大学研究指出,AI 企业间实现协调减速的关键在于技术开发的透明度与相互信任。
Multiverse Computing 发布论文与开源代码,提出离线 Top-K Logits 缓存与融合分块 KL 损失,将知识蒸馏显存峰值降低15.6倍,使32K上下文蒸馏可在单张 H200 上运行。
推荐理由:通过离线缓存和分块计算将知识蒸馏显存需求降低15倍,使长上下文蒸馏可在单卡运行。
Photoroom 发布 PRX 模型数据策略,采用 Lance 格式进行数据探索与特征工程,利用 Qwen3-VL-8B 对图像进行长文本重标注,最终转换为 MDS 格式进行流式训练。
推荐理由:Photoroom 公开了 PRX 模型的数据构建全流程,提供了从数据探索、VLM 重标注到 MDS 流式训练的具体工程实践。
Dharma AI解读Goldfeder等人2026年论文,论证在有限资源与竞争压力下,专注特定领域的专业化策略在性能上优于通用泛化。文章结合优化理论、生物学演化及机器学习中的负迁移现象,指出Scaling并不改变这一结构性约束。
Hugging Face发布PEFT库基准测试,对比LoRA与OFT、Lily等数十种参数高效微调技术。测试显示在图像生成等任务中OFT在精度和显存上均优于LoRA,建议用户根据显存、精度和兼容性需求进行权衡选择。
推荐理由:官方通过统一基准测试对比多种PEFT方法,揭示LoRA并非全能,提供可迁移的选型权衡思路。
Berkeley AI Research 提出 SPEX 和 ProxySPEX 算法,通过稀疏恢复和层级结构特性,以极少消融次数高效识别 LLM 中的关键交互作用。ProxySPEX 在保持 SPEX 性能的同时,将消融次数减少约 10 倍。该方法在数千特征的上下文窗口中仍能保持高忠实度,显著优于 LIME 等边际方法。