跳到正文

#产品更新

今日 17 条
8月7日周四
  1. Hugging Face Blog75

    TRL 新增 MPO、GRPO 等视觉语言模型对齐算法及 vLLM 集成

    Hugging Face TRL 库新增 MPO、GRPO、GSPO、RLOO 和 Online DPO 等视觉语言模型对齐算法,并原生支持 VLM 的 SFT 训练。同时集成 vLLM 以加速在线对齐过程中的样本生成,提供 colocate 和 server 两种运行模式。

    推荐理由:TRL 新增 MPO、GRPO 等 VLM 对齐算法及 vLLM 集成,提供可复用的训练配置与脚本。

8月5日周二
  1. Hugging Face Blog68

    NVIDIA 开源 AI-Q 智能体栈,Llama Nemotron 登顶 DeepResearch Bench

    NVIDIA 发布开源 AI-Q 智能体栈,基于 Llama 3.3-70B 和 Llama-3.3-Nemotron-Super-49B-v1.5 模型,在 Hugging Face DeepResearch Bench 的 LLM with Search 类别中以 40.52 分登顶。该方案支持本地部署与隐私合规,提供完整的推理追踪与评估指标。

    推荐理由:NVIDIA 开源 AI-Q 智能体栈并在 DeepResearch Bench 登顶,展示了 Llama Nemotron 在复杂推理任务中的能力。

7月29日周二
  1. Hugging Face Blog70

    Hugging Face 发布开源实验追踪库 Trackio

    Hugging Face 发布开源实验追踪库 Trackio,提供兼容 wandb 的轻量级 Python 库,支持本地 Gradio 仪表盘及与 Hugging Face Spaces 同步分享。该工具内置与 Transformers 和 Accelerate 的集成,支持 GPU 能耗追踪,数据默认本地持久化并自动备份至 Parquet 数据集。

    推荐理由:Trackio 提供兼容 wandb 的轻量级实验追踪方案,支持本地运行与 Spaces 同步,便于分享与数据提取。

7月25日周五
  1. Hugging Face Blog68

    PyArrow 新增 Parquet CDC 功能,配合 Xet 存储层提升数据去重效率

    Hugging Face 宣布 PyArrow 和 Pandas 现已支持 Parquet Content-Defined Chunking (CDC) 功能,配合 Xet 存储层可实现基于内容的数据去重。该功能通过减少 Parquet 文件在内容变更时的字节级差异,显著降低数据上传、下载及存储成本。

    推荐理由:PyArrow 新增 Parquet CDC 功能配合 Xet 存储层,显著降低数据集上传下载与存储成本。

7月22日周二
  1. Hugging Face Blog65

    NVIDIA NIM 支持一键部署 Hugging Face 上的 10 万+ LLM

    NVIDIA 宣布 NIM 推理微服务现支持在 Hugging Face 上快速部署超过 10 万个大语言模型。NIM 提供单一 Docker 容器,自动识别模型格式并选择 TensorRT-LLM、vLLM 或 SGLang 后端,无需手动配置即可实现高性能部署。

    推荐理由:NVIDIA NIM 提供统一容器自动适配 Hugging Face 模型,简化了部署流程。

7月17日周四
  1. Mistral AI68

    Mistral Le Chat 新增 Deep Research 智能体与 Voxtral 语音功能

    Mistral 发布 Le Chat 多项新功能,包括 Deep Research 智能体可自动生成结构化研究报告;基于 Voxtral 模型的语音模式支持自然对话;Magistral 推理模型提供原生多语言思考能力;Projects 功能支持将对话分组管理;与 Black Forest Labs 合作实现图像直接编辑。

    推荐理由:Le Chat 新增 Deep Research 智能体、Voxtral 语音交互及 Magistral 多语言推理,提供了更完整的 AI 助手工作流。

  2. Hugging Face Blog60

    Gradio 5.38.0 更新:增强 MCP 服务器支持

    Gradio 5.38.0 版本更新,增强了对 MCP 服务器协议的支持。新增功能包括:支持本地文件上传、实时进度通知、一行代码将 OpenAPI 规范转换为 MCP 服务器、通过 gr.Header 简化认证配置以及自定义工具描述。

    推荐理由:Gradio 5.38.0 新增文件上传、OpenAPI 转换等 MCP 功能,降低了构建智能体应用的技术门槛。

7月16日周三
  1. Hugging Face Blog75

    Hugging Face 发布 Ettin 开源模型套件

    Hugging Face 发布 Ettin 模型套件,包含 17M 至 1B 参数的编码器与解码器模型。该套件使用完全相同的 2T tokens 公开数据、架构和训练配方,实现了两种架构的公平对比。编码器在分类和检索任务上优于 ModernBERT,解码器在生成任务上优于 Llama 3.2 1B。

    推荐理由:Ettin 提供完全一致的开源训练配方与数据,为对比编码器与解码器架构提供了公平基准。

7月15日周二
  1. Hugging Face Blog72

    Hugging Face 宣布全面迁移至 Xet 存储系统

    Hugging Face 宣布将 Hub 全面迁移至 Xet 存储系统,目前已有超 100 万用户和 50 万个仓库使用。Xet 将成为新用户的默认存储,旧仓库将自动迁移,同时 Hugging Face 计划开源 Xet 协议及底层基础设施。

    推荐理由:Hugging Face 宣布全面迁移至 Xet 存储,通过底层架构升级实现 PB 级数据的高效传输与无缝兼容。

7月11日周五
  1. Mistral AI78

    Mistral 发布 Devstral Medium 及升级 Devstral Small 1.1

    Mistral AI 发布 Devstral Medium 和升级版的 Devstral Small 1.1。Devstral Medium 在 SWE-Bench Verified 上得分 61.6%,超越 Gemini 2.5 Pro 和 GPT 4.1,价格仅为后者的四分之一。

    推荐理由:Devstral Medium 在 SWE-Bench Verified 上超越 Gemini 2.5 Pro 且价格更低,Small 1.1 开源并刷新开放模型记录。

7月3日周四
  1. Mistral AI35

    Mistral AI 发布 AI for Citizens 倡议

    Mistral AI 推出 AI for Citizens 倡议,旨在帮助各国政府及公共机构利用 AI 技术重塑公共服务并推动创新。该计划提供 Mistral AI 的尖端模型、AI 聊天与编程助手,支持私有化部署、SaaS 及无服务器 API 等多种方式,确保数据主权与合规。通过定制化研发与生态建设,助力各国摆脱对封闭供应商的依赖,实现 AI 技术的自主可控。

6月11日周三
  1. Mistral AI50

    Mistral AI 发布 Mistral Compute 基础设施服务

    Mistral AI 发布 Mistral Compute,提供包含 GPU、编排、API 及服务的私有集成 AI 基础设施栈。作为 NVIDIA 合作伙伴,该服务提供数万张 GPU 资源,支持从裸金属服务器到全托管 PaaS 的多种形态。此举旨在满足欧洲等地区对数据主权和可持续性的要求,为各国政府、企业及研究机构提供独立可控的 AI 算力环境。

6月4日周三
  1. Mistral AI75

    Mistral 发布 Mistral Code 企业级 AI 编程助手

    Mistral 发布 Mistral Code,整合 Codestral、Devstral 等四种模型,提供 IDE 插件、私有化部署及企业级管控,目前面向 JetBrains 和 VSCode 开放私有测试。

    推荐理由:整合了四种专用模型与企业级管控,提供私有化部署选项,适合对安全合规有严格要求的开发者。

5月28日周三
  1. Mistral AI78

    Mistral 发布首个代码专用嵌入模型 Codestral Embed

    Mistral AI 发布首个代码专用嵌入模型 Codestral Embed,支持不同维度和精度输出以平衡检索质量与存储成本。该模型在 SWE-Bench 等基准上表现优于 Voyage Code 3、Cohere Embed v4.0 及 OpenAI 大嵌入模型,API 定价为每百万 token 0.15 美元。

    推荐理由:官方发布首个代码专用嵌入模型,提供多维精度选择并宣称在多项基准上超越竞品。

5月27日周二
  1. Mistral AI78

    Mistral 发布 Agents API,支持多智能体编排与 MCP 工具调用

    Mistral 发布 Agents API,提供内置代码执行、图像生成、文档库和网页搜索连接器,以及持久记忆功能。该 API 支持多智能体动态编排与任务交接,并兼容 MCP 协议。在 SimpleQA 基准测试中,开启网页搜索后 Mistral Large 和 Medium 的准确率分别提升至 75% 和 82.32%。

    推荐理由:Mistral 推出官方智能体 API,内置代码执行、搜索等连接器及持久记忆,支持多智能体编排与 MCP 协议。

5月21日周三
  1. Mistral AI85

    Mistral 发布 Devstral 智能体编码模型

    Mistral 发布 Devstral 智能体编码模型,在 SWE-Bench Verified 基准上取得 46.8% 成绩,超越 Deepseek-V3 和 Qwen3 等更大模型。该模型支持本地部署与 API 调用,提供 Apache 2.0 开源许可。

    推荐理由:Mistral 发布 Devstral 智能体模型,在 SWE-Bench Verified 基准上超越开源与闭源竞品,并提供本地部署与 API 接入。

5月7日周三
  1. Mistral AI68

    Mistral 发布 Le Chat Enterprise 企业版 AI 助手

    Mistral 发布 Le Chat Enterprise,基于全新 Mistral Medium 3 模型,提供企业搜索、自定义智能体构建、文档库及混合部署等能力。该版本支持 Google Drive、Sharepoint 等连接器,即将支持 MCP,并可在 Google Cloud Marketplace 获取,支持私有化部署与严格的数据安全控制。

    推荐理由:Mistral 推出企业版 Le Chat 并集成新模型,提供私有化部署与自定义智能体构建能力。

3月7日周五
  1. Mistral AI83

    Mistral 发布 Mistral OCR API

    Mistral 发布 Mistral OCR API,支持图像和 PDF 输入,可高精度提取文本、表格、公式及嵌入图片,并输出有序交错的 Markdown 或结构化 JSON。该模型在多项基准测试中超越竞品,支持多语言处理,API 定价为每 1000 页 1 美元,已在 Le Chat 中作为默认文档理解模型使用。

    推荐理由:Mistral 发布专用 OCR API 并公布基准数据与定价,为 RAG 场景提供结构化文档解析方案。

2月18日周二
  1. Hugging Face Blog36

    Hugging Face Hub 新增 Hyperbolic、Nebius AI Studio 和 Novita 三个无服务器推理提供商

    Hugging Face Hub 新增 Hyperbolic、Nebius AI Studio 和 Novita 三个无服务器推理提供商,支持 DeepSeek-R1 和 Flux.1 等模型。用户可在设置中配置 API Key 或选择由 HF 路由的请求,并通过 Python 和 JS SDK 无缝集成。PRO 用户每月可获得 2 美元推理额度,免费用户享有少量免费配额。

2月17日周一
  1. Mistral AI70

    Mistral Saba 发布,首款面向中东与南亚的区域语言模型

    Mistral AI 发布 Mistral Saba,这是一款 24B 参数的区域语言模型,针对中东和南亚语言(如阿拉伯语、泰米尔语)进行了优化。该模型在区域语言任务上表现优于大 5 倍的通用模型,支持 API 调用及单 GPU 本地部署,速度超过 150 tokens/秒。

    推荐理由:原文给出了24B参数模型在阿拉伯语等区域语言上的性能优势及本地部署能力,读者可据此评估区域化定制方案。

2月14日周五
  1. Hugging Face Blog67

    Hugging Face 引入 Math-Verify 修复 Open LLM Leaderboard 数学评测

    Hugging Face 引入 Math-Verify 解析器重测 Open LLM Leaderboard 全部 3,751 个模型,修正了旧版在格式提取、符号转换和数值比较上的缺陷。重测后模型平均得分提升 4.66 分,Qwen 和 DeepSeek 等模型分数大幅上涨,Nvidia AceMath 登顶 MATH-Hard 榜单。

    推荐理由:Hugging Face 引入 Math-Verify 重测全量模型,修正了旧版解析缺陷,导致榜单排名大幅洗牌。

2月12日周三
  1. Hugging Face Blog65

    Hugging Face 开源 Xet 技术加速 Hub 上传下载

    Hugging Face 开源 xet-core 和 hf_xet,通过内容定义分块与块聚合技术加速 Hub 上的文件传输。该技术将分块聚合成最大 64MB 的块,显著减少网络请求和存储开销,实测上传速度提升近 2 倍。

    推荐理由:通过引入块聚合机制优化上传下载速度,为处理大型模型仓库提供了可复用的工程实践。

2月4日周二
  1. Hugging Face Blog72

    Hugging Face 开源 smolagents 框架复现 Deep Research

    Hugging Face 开源了 smolagents 框架以复现 OpenAI Deep Research 的搜索智能体。该框架采用 CodeAgent 架构,在 GAIA 验证集上达到 55.15% 的成绩,优于此前开源方案。

    推荐理由:Hugging Face 开源了复现 OpenAI Deep Research 的 smolagents 框架,展示了 CodeAgent 在 GAIA 基准上的性能提升。

  2. Hugging Face Blog82

    Hugging Face LeRobot 上线 π0 和 π0-FAST 机器人基础模型

    Hugging Face 官方宣布将 Physical Intelligence 开发的 π0 和 π0-FAST 视觉-语言-动作(VLA)模型接入 LeRobot 仓库。π0 基于流匹配实现 50Hz 实时动作生成,π0-FAST 引入 FAST 频域动作序列分词技术,训练速度提升 5 倍。

    推荐理由:官方将π0和π0-FAST模型接入LeRobot,提供了从推理到微调的完整工程路径。

1月28日周二
  1. Hugging Face Blog73

    Hugging Face 发布 Open-R1 项目开源复现 DeepSeek-R1

    Hugging Face 发布 Open-R1 项目,旨在系统复现 DeepSeek-R1 的数据收集与纯强化学习训练流程。项目计划通过蒸馏高质量推理数据集、构建数学与代码数据集,并开源多阶段训练配方,以验证并推广推理模型技术。

    推荐理由:Hugging Face 宣布启动开源复现项目,旨在公开 DeepSeek-R1 的训练数据与代码,推动推理模型技术透明化。

1月24日周五
  1. Hugging Face Blog72

    Hugging Face smolagents 原生支持视觉语言模型

    Hugging Face 在 smolagents 中新增对视觉语言模型(VLM)的原生支持,允许在智能体管道中直接使用视觉能力。通过提供初始图像输入和基于回调的动态截图机制,开发者可轻松构建如自主网页浏览等视觉智能体。

    推荐理由:原生支持视觉模型并给出动态截图回调示例,便于开发者快速构建具备视觉能力的智能体。

1月23日周四
  1. Hugging Face Blog72

    Hugging Face 发布 SmolVLM 256M 和 500M 模型

    Hugging Face 发布 SmolVLM 256M 和 500M 两个新模型,其中 256M 参数版本号称全球最小视觉语言模型。新模型采用更小的 SigLIP 视觉编码器和优化的 Tokenization 技术,支持 Transformers、MLX 和 ONNX 格式,旨在降低端侧和消费级设备的运行成本。

    推荐理由:Hugging Face 发布 SmolVLM 256M 和 500M 模型,在保持轻量级的同时提供多模态能力,适合端侧部署。

1月22日周三
1月16日周四
  1. Mistral AI38

    Mistral AI 宣布 Le Chat 集成 AFP 新闻源

    Mistral AI 宣布与法新社(AFP)达成全球合作,Le Chat 将接入 AFP 新闻稿以增强事实准确性。该集成支持法语、英语等六种语言,利用 AFP 每日 2,300 条新闻内容,确保回复基于可靠且最新的资讯。此项功能将在未来几周向所有 Le Chat 用户推出。

  2. Hugging Face Blog70

    TGI 引入多后端支持,统一 vLLM 与 TensorRT-LLM 部署

    Hugging Face 发布 TGI Backends 架构,通过统一前端层集成 vLLM、TensorRT-LLM 和 llama.cpp 等推理引擎。该更新旨在简化生产环境部署,计划于 2025 年第一季度支持 vLLM,并持续扩展对 AWS Neuron 和 Google TPU 的原生支持。

    推荐理由:原文给出了统一前端架构和具体后端规划,读者可据此评估现有部署路径的迁移成本与性能收益。

1月15日周三
  1. Hugging Face Blog82

    Hugging Face 发布静态嵌入模型及训练方法,CPU 推理速度提升 400 倍

    Hugging Face 发布 sentence-transformers/static-retrieval-mrl-en-v1 和 static-similarity-mrl-multilingual-v1 两个静态嵌入模型,在 CPU 上比主流模型快 100-400 倍,同时保持 85% 以上的性能。文章公开了基于对比学习和 Matryoshka 表示学习的完整训练策略、数据集选择及代码实现。

    推荐理由:Hugging Face 开源了基于静态嵌入的高效模型及完整训练代码,为低延迟和端侧部署提供了可复用的实践方案。

1月10日周五
  1. Hugging Face Blog78

    Hugging Face 发布 vdr-2b-multi-v1 多语言视觉文档检索模型

    Hugging Face 发布 vdr-2b-multi-v1 多语言视觉文档检索模型及 vdr-2b-v1 英文版,支持无需 OCR 直接检索多语言文档。模型基于 50 万高质量合成样本训练,在 ViDoRe 基准测试中表现优异,支持 Matryoshka 表示学习与二值量化以实现高效检索。

    推荐理由:开源多语言视觉文档检索模型及50万样本数据集,支持跨语言检索与高效向量压缩。

12月31日周二
  1. Hugging Face Blog75

    Hugging Face 发布 smolagents 库,让模型通过编写代码实现智能体功能

    Hugging Face 发布 smolagents 库,支持模型通过编写代码来调用工具,简化了智能体开发流程。该库兼容 Hugging Face Hub 及 OpenAI、Anthropic 等外部模型,并展示了开源模型在智能体工作流中具备与顶级闭源模型竞争的能力。

    推荐理由:Hugging Face 推出 smolagents 库,通过让模型直接编写代码来调用工具,简化了智能体开发并提升了开源模型表现。

12月18日周三
  1. Hugging Face Blog74

    IBM 等联合发布 Bamba-9B 混合 Mamba2 模型

    IBM、普林斯顿大学等联合发布 Bamba-9B 混合 Mamba2 模型,在 vLLM 中推理吞吐量提升 2.5 倍、延迟降低 2 倍。该模型基于 2.2T token 开源数据训练,性能接近 Llama 3.1 8B,并开源了完整训练代码与数据加载器。

    推荐理由:Bamba-9B 验证了混合 Mamba2 架构在推理效率上的优势,为突破 KV-cache 瓶颈提供了可复现的开源方案。

12月17日周二
  1. Hugging Face Blog72

    TII 发布 Falcon 3 系列开源大模型

    TII 发布 Falcon 3 系列开源大模型,包含 1B、3B、7B、10B 参数 Transformer 模型及 7B Mamba 模型。Falcon3-10B-Base 在 13B 以下模型中表现最佳,数学和代码能力显著提升。所有模型均开源,并支持 GGUF、GPTQ 等格式。

    推荐理由:TII 发布 1B 至 10B 参数模型,在数学和代码推理上表现突出,为端侧部署提供高效选择。

12月16日周一
  1. Hugging Face Blog72

    Hugging Face 发布合成数据生成器,支持零代码构建数据集与微调模型

    Hugging Face 发布合成数据生成器,用户可通过自然语言描述零代码生成文本分类和对话数据集,并支持使用 AutoTrain 直接微调模型。工具基于 distilabel 和 Hugging Face API,提供网页应用、私有部署及 Apache 2.0 开源代码。

    推荐理由:Hugging Face 推出零代码合成数据生成器,打通从自然语言描述到模型微调的完整工作流。

12月9日周一
  1. Hugging Face Blog68

    Hugging Face 发布文本到图像生成开源偏好数据集

    Hugging Face 社区发布了面向文本到图像生成的开源偏好数据集,包含 1 万对偏好样本,涵盖多种图像风格与提示词复杂度。数据集采用 Apache 2.0 协议,附带用于数据预处理和后处理的代码,并提供了基于 FLUX.1-dev 模型的 LoRA 微调适配器。

    推荐理由:开源了文本到图像生成的偏好数据集及微调代码,为社区提供了可复用的训练素材。