跳到正文

#Hugging Face

今日 0 条
9月9日周二
  1. Hugging Face Blog82

    Hugging Face 发布 mmBERT 多语言模型

    Hugging Face 发布 mmBERT,基于 ModernBERT 架构训练的多语言编码器模型,覆盖 1800 多种语言,在 XTREME 和 MTEB 基准上显著超越 XLM-R 等前代模型。该模型采用三阶段渐进式语言学习策略,在 3T+ tokens 数据上训练,推理速度提升 2-4 倍,并开源了模型权重、训练数据及微调代码。

    推荐理由:开源了覆盖1800种语言的现代BERT架构模型,提供了显著的性能与速度提升及微调代码。

9月4日周四
  1. Hugging Face Blog82

    Google发布EmbeddingGemma开源多语言嵌入模型

    Google发布EmbeddingGemma,一款仅308M参数、支持100多种语言的开源多语言嵌入模型,专为端侧设备设计。该模型基于Gemma3架构,在MTEB基准测试中表现优异,并提供了Sentence Transformers、LangChain、LlamaIndex等主流框架的集成示例及微调指南。

    推荐理由:模型仅308M参数且支持100+语言,适合端侧部署,并提供了多框架集成与微调指南。

9月3日周三
  1. Hugging Face Blog75

    SandboxAQ 开源 SAIR 数据集:524 万条高精度蛋白-配体 3D 结构加速药物研发

    SandboxAQ 在 Hugging Face 开源 SAIR 数据集,包含 524 万条由 Boltz1 生成的 AI 共折叠蛋白-配体 3D 结构及实验验证的 IC50 数据。该数据集采用 CC BY 4.0 许可,97% 的结构通过了 PoseBusters 验证,旨在解决 AI 药物研发中高质量结构数据的长期短缺问题。

    推荐理由:SAIR 开源了 524 万条高精度蛋白-配体 3D 结构及 IC50 数据,为 AI 药物发现提供了稀缺的高质量训练集。

9月2日周二
  1. Hugging Face Blog72

    Hugging Face 教程:在 ZeroGPU Spaces 中使用 PyTorch 提前编译加速

    Hugging Face 发布教程,展示如何在 ZeroGPU Spaces 中利用 PyTorch 提前编译(AoT)技术加速图像和视频生成。通过结合 FP8 量化、动态形状处理和 FlashAttention-3,FLUX.1-dev 等模型可获得 1.3 至 1.8 倍的速度提升。

    推荐理由:原文给出了在ZeroGPU上结合AoT编译与量化加速的具体代码,读者可直接复用以优化生成类应用。

8月19日周二
8月18日周一
  1. Hugging Face Blog68

    从零构建生产级CUDA内核:PyTorch原生算子开发与Hub分发指南

    Hugging Face发布kernel-builder教程,指导开发者从零构建生产级CUDA内核。通过build.toml和flake.nix实现环境隔离与多架构编译,将内核注册为PyTorch原生算子以兼容torch.compile,并支持通过Hub进行版本管理与分发。

    推荐理由:文章提供从零构建可复用PyTorch CUDA内核的完整工程指南,涵盖构建、版本控制与Hub分发。

8月14日周四
  1. Hugging Face Blog70

    Hugging Face开源Kimina-Prover-RL训练管线及Lean 4定理证明模型

    Hugging Face开源了Kimina-Prover-RL,一个基于Verl框架的Lean 4形式化定理证明训练管线,并发布了1.7B和0.6B两个模型。该管线采用类DeepSeek-R1的结构化推理范式,结合格式奖励和错误纠正机制,在MiniF2F基准上刷新了开源模型在对应参数规模下的SOTA成绩。

    推荐理由:开源了基于Verl的Lean 4定理证明训练管线及0.6B和1.7B模型,为小参数模型形式化推理提供了可复现的SOTA方案。

8月13日周三
8月12日周二
8月8日周五
8月7日周四
  1. Hugging Face Blog75

    TRL 新增 MPO、GRPO 等视觉语言模型对齐算法及 vLLM 集成

    Hugging Face TRL 库新增 MPO、GRPO、GSPO、RLOO 和 Online DPO 等视觉语言模型对齐算法,并原生支持 VLM 的 SFT 训练。同时集成 vLLM 以加速在线对齐过程中的样本生成,提供 colocate 和 server 两种运行模式。

    推荐理由:TRL 新增 MPO、GRPO 等 VLM 对齐算法及 vLLM 集成,提供可复用的训练配置与脚本。

8月5日周二
  1. Hugging Face Blog92

    OpenAI 发布 GPT OSS 开源推理模型,Hugging Face 详解部署与推理优化

    OpenAI 发布 GPT OSS 开源模型系列,包含 120B 和 20B 两个 MoE 版本,采用 mxfp4 量化以支持单卡部署。Hugging Face 提供详细指南,涵盖 transformers、vLLM 和 llama.cpp 等框架的本地推理、Flash Attention 3 优化及工具调用能力。

    推荐理由:OpenAI 发布开源推理模型,Hugging Face 提供从本地量化部署到云端推理的完整工程支持。

  2. Hugging Face Blog68

    NVIDIA 开源 AI-Q 智能体栈,Llama Nemotron 登顶 DeepResearch Bench

    NVIDIA 发布开源 AI-Q 智能体栈,基于 Llama 3.3-70B 和 Llama-3.3-Nemotron-Super-49B-v1.5 模型,在 Hugging Face DeepResearch Bench 的 LLM with Search 类别中以 40.52 分登顶。该方案支持本地部署与隐私合规,提供完整的推理追踪与评估指标。

    推荐理由:NVIDIA 开源 AI-Q 智能体栈并在 DeepResearch Bench 登顶,展示了 Llama Nemotron 在复杂推理任务中的能力。

7月31日周四
  1. Hugging Face Blog72

    Gradio 新增 MCP 支持:构建具备虚拟试穿能力的 AI 购物助手

    Hugging Face 官方博客介绍 Gradio 新增 Model Context Protocol (MCP) 集成,可将 Python 函数自动转换为 LLM 工具。文章演示了如何利用该功能结合 IDM-VTON 模型和 Playwright,在 VS Code 中构建一个能自动浏览网页并生成虚拟试穿效果的 AI 购物助手。

    推荐理由:Gradio 新增 MCP 支持可将 Python 函数自动转为 LLM 工具,本文演示了如何快速构建具备网页浏览与虚拟试穿能力的 AI 助手。

7月29日周二
  1. Hugging Face Blog70

    Hugging Face 发布开源实验追踪库 Trackio

    Hugging Face 发布开源实验追踪库 Trackio,提供兼容 wandb 的轻量级 Python 库,支持本地 Gradio 仪表盘及与 Hugging Face Spaces 同步分享。该工具内置与 Transformers 和 Accelerate 的集成,支持 GPU 能耗追踪,数据默认本地持久化并自动备份至 Parquet 数据集。

    推荐理由:Trackio 提供兼容 wandb 的轻量级实验追踪方案,支持本地运行与 Spaces 同步,便于分享与数据提取。

7月25日周五
  1. Hugging Face Blog68

    PyArrow 新增 Parquet CDC 功能,配合 Xet 存储层提升数据去重效率

    Hugging Face 宣布 PyArrow 和 Pandas 现已支持 Parquet Content-Defined Chunking (CDC) 功能,配合 Xet 存储层可实现基于内容的数据去重。该功能通过减少 Parquet 文件在内容变更时的字节级差异,显著降低数据上传、下载及存储成本。

    推荐理由:PyArrow 新增 Parquet CDC 功能配合 Xet 存储层,显著降低数据集上传下载与存储成本。

7月23日周三
7月22日周二
  1. Hugging Face Blog65

    NVIDIA NIM 支持一键部署 Hugging Face 上的 10 万+ LLM

    NVIDIA 宣布 NIM 推理微服务现支持在 Hugging Face 上快速部署超过 10 万个大语言模型。NIM 提供单一 Docker 容器,自动识别模型格式并选择 TensorRT-LLM、vLLM 或 SGLang 后端,无需手动配置即可实现高性能部署。

    推荐理由:NVIDIA NIM 提供统一容器自动适配 Hugging Face 模型,简化了部署流程。

7月18日周五
7月17日周四
  1. Hugging Face Blog60

    Gradio 5.38.0 更新:增强 MCP 服务器支持

    Gradio 5.38.0 版本更新,增强了对 MCP 服务器协议的支持。新增功能包括:支持本地文件上传、实时进度通知、一行代码将 OpenAPI 规范转换为 MCP 服务器、通过 gr.Header 简化认证配置以及自定义工具描述。

    推荐理由:Gradio 5.38.0 新增文件上传、OpenAPI 转换等 MCP 功能,降低了构建智能体应用的技术门槛。

7月16日周三
  1. Hugging Face Blog75

    Hugging Face 发布 Ettin 开源模型套件

    Hugging Face 发布 Ettin 模型套件,包含 17M 至 1B 参数的编码器与解码器模型。该套件使用完全相同的 2T tokens 公开数据、架构和训练配方,实现了两种架构的公平对比。编码器在分类和检索任务上优于 ModernBERT,解码器在生成任务上优于 Llama 3.2 1B。

    推荐理由:Ettin 提供完全一致的开源训练配方与数据,为对比编码器与解码器架构提供了公平基准。

7月15日周二
  1. Hugging Face Blog72

    Hugging Face 宣布全面迁移至 Xet 存储系统

    Hugging Face 宣布将 Hub 全面迁移至 Xet 存储系统,目前已有超 100 万用户和 50 万个仓库使用。Xet 将成为新用户的默认存储,旧仓库将自动迁移,同时 Hugging Face 计划开源 Xet 协议及底层基础设施。

    推荐理由:Hugging Face 宣布全面迁移至 Xet 存储,通过底层架构升级实现 PB 级数据的高效传输与无缝兼容。

3月4日周二
2月28日周五
2月27日周四
2月19日周三
  1. Hugging Face Blog77

    Google 发布 PaliGemma 2 Mix 系列视觉语言模型

    Google 发布 PaliGemma 2 Mix 系列视觉语言模型,该系列在 OCR、长短期图像描述等视觉语言任务上进行了微调。提供 3B、10B、28B 三种参数规模及 224x224、448x448 两种分辨率,支持通过 Transformers 框架进行推理和微调,并开放了 10B 模型的在线 Demo。

    推荐理由:Google 发布 PaliGemma 2 Mix 系列微调模型,提供开箱即用的视觉语言任务能力,便于快速评估预训练模型在下游任务上的表现。

2月18日周二
  1. Hugging Face Blog36

    Hugging Face Hub 新增 Hyperbolic、Nebius AI Studio 和 Novita 三个无服务器推理提供商

    Hugging Face Hub 新增 Hyperbolic、Nebius AI Studio 和 Novita 三个无服务器推理提供商,支持 DeepSeek-R1 和 Flux.1 等模型。用户可在设置中配置 API Key 或选择由 HF 路由的请求,并通过 Python 和 JS SDK 无缝集成。PRO 用户每月可获得 2 美元推理额度,免费用户享有少量免费配额。

2月14日周五
  1. Hugging Face Blog67

    Hugging Face 引入 Math-Verify 修复 Open LLM Leaderboard 数学评测

    Hugging Face 引入 Math-Verify 解析器重测 Open LLM Leaderboard 全部 3,751 个模型,修正了旧版在格式提取、符号转换和数值比较上的缺陷。重测后模型平均得分提升 4.66 分,Qwen 和 DeepSeek 等模型分数大幅上涨,Nvidia AceMath 登顶 MATH-Hard 榜单。

    推荐理由:Hugging Face 引入 Math-Verify 重测全量模型,修正了旧版解析缺陷,导致榜单排名大幅洗牌。

2月13日周四
  1. Hugging Face Blog56

    10亿级分类与嵌入推理的成本优化与基准测试

    Hugging Face 发布文章,通过实测分析10亿级文本分类、嵌入及视觉嵌入推理的成本与延迟。使用Infinity服务器和k6工具,在NVIDIA L4等硬件上寻找最优Batch Size与并发数。结果显示文本分类10亿次成本约253美元,嵌入约409美元,而视觉嵌入因模型复杂和图像Token多,成本高达44496美元。

2月12日周三
  1. Hugging Face Blog75

    Hugging Face 发布视频生成数据集构建工具与脚本

    Hugging Face 发布用于构建视频生成数据集的开源工具与脚本,提供包含 yt-dlp 下载、多模型过滤(水印、美学、NSFW、运动)及 Florence-2 标注的三阶段流水线,并分享了 finetrainers/crush-smol-v0 等微调案例。

    推荐理由:提供从下载、清洗到标注的完整视频数据集构建流程,帮助开发者高效准备视频生成模型训练数据。

  2. Hugging Face Blog65

    Hugging Face 开源 Xet 技术加速 Hub 上传下载

    Hugging Face 开源 xet-core 和 hf_xet,通过内容定义分块与块聚合技术加速 Hub 上的文件传输。该技术将分块聚合成最大 64MB 的块,显著减少网络请求和存储开销,实测上传速度提升近 2 倍。

    推荐理由:通过引入块聚合机制优化上传下载速度,为处理大型模型仓库提供了可复用的工程实践。

2月10日周一
2月4日周二
  1. Hugging Face Blog68

    Hugging Face 与 Adyen 联合发布 DABStep 多步推理数据智能体基准

    Hugging Face 与 Adyen 联合发布 DABStep 基准,包含 450 多个基于真实金融支付业务提取的多步数据分析任务。评测显示,即使是 o3-mini 等最强推理模型,准确率也仅为 16%,暴露出当前 AI 智能体在复杂数据推理上的显著不足。

    推荐理由:基于真实业务数据构建,揭示了当前最强推理模型在复杂多步数据分析任务中准确率不足20%的显著差距。

  2. Hugging Face Blog72

    Hugging Face 开源 smolagents 框架复现 Deep Research

    Hugging Face 开源了 smolagents 框架以复现 OpenAI Deep Research 的搜索智能体。该框架采用 CodeAgent 架构,在 GAIA 验证集上达到 55.15% 的成绩,优于此前开源方案。

    推荐理由:Hugging Face 开源了复现 OpenAI Deep Research 的 smolagents 框架,展示了 CodeAgent 在 GAIA 基准上的性能提升。

  3. Hugging Face Blog82

    Hugging Face LeRobot 上线 π0 和 π0-FAST 机器人基础模型

    Hugging Face 官方宣布将 Physical Intelligence 开发的 π0 和 π0-FAST 视觉-语言-动作(VLA)模型接入 LeRobot 仓库。π0 基于流匹配实现 50Hz 实时动作生成,π0-FAST 引入 FAST 频域动作序列分词技术,训练速度提升 5 倍。

    推荐理由:官方将π0和π0-FAST模型接入LeRobot,提供了从推理到微调的完整工程路径。