跳到正文

#Hugging Face

今日 0 条
10月1日周二
9月23日周一
  1. Hugging Face Blog17

    Hugging Face Daily Papers 页面隐藏功能指南

    Hugging Face 推出 Daily Papers 页面,已收录超 3,700 篇论文并拥有超 12k 订阅者。作者可一键认领论文以关联账号,用户可通过评论 @username 与作者实时互动,并在评论区输入 @librarian-bot 获取相关论文推荐。页面支持多语言评论及内置翻译,并集成 arXiv 扩展功能以快速跳转至 Hugging Face 论文页或 Spaces 演示。

  2. Hugging Face Blog68

    Hugging Face 发布 FineVideo 数据集及构建管线

    Hugging Face 发布 FineVideo 数据集,包含 4.3 万个视频、3.4k 小时时长及丰富的结构化标注。文章详细披露了从 YouTube-Commons 中筛选动态内容、构建分类法,以及利用 Gemini 1.5 Pro 和 GPT4o 进行时间级语义标注的完整技术管线。

    推荐理由:文章详细披露了构建4.3万小时高质量视频数据集的过滤与标注管线,为多模态模型训练提供了可复用的工程方法。

9月18日周三
9月17日周二
  1. Hugging Face Blog70

    Hugging Face 推出数据集 SQL Console 功能

    Hugging Face 推出数据集 SQL Console 功能,允许用户直接在浏览器中运行 SQL 查询、过滤和发现数据集。该功能基于 DuckDB WASM 引擎,无需后端依赖,支持导出 Parquet 格式结果,并内置了数据格式转换等实用示例。

    推荐理由:基于浏览器端 DuckDB WASM 实现零依赖查询,提供数据探索与格式转换的便捷入口。

9月16日周一
  1. Hugging Face Blog65

    HuggingChat 发布社区工具功能

    HuggingChat 发布社区工具功能,允许用户将 Hugging Face 上的公开 Space 直接转化为模型可调用的工具。该功能扩展了多模态支持,涵盖图像理解、视频生成及语音合成,并支持用户创建自定义工具或基于私有文档构建 RAG 工具。

    推荐理由:HuggingChat 开放将社区 Space 转为工具的功能,支持多模态交互与自定义 RAG,丰富了现有工作流。

9月13日周五
9月4日周三
8月21日周三
  1. Hugging Face Blog68

    Hugging Face 发布 DataCollatorWithFlattening 实现 Flash Attention 2 无填充训练

    Hugging Face 发布 DataCollatorWithFlattening,使 Flash Attention 2 兼容无填充指令微调,训练吞吐量最高提升 2 倍,峰值显存降低 20%,且不影响收敛质量。

    推荐理由:通过新数据整理器实现无填充训练,在保持收敛质量的同时显著提升训练吞吐量和降低显存占用。

8月19日周一
8月14日周三
8月13日周二
  1. Hugging Face Blog30

    ggml 入门指南

    ggml 是一个专注于 Transformer 推理的 C/C++ 开源机器学习库,具有极简、轻量且兼容性好的特点。该库核心代码少于 5 个文件,编译后二进制体积小于 1MB,支持量化张量以节省内存。本文面向开发者介绍 ggml 的基础概念、编译方法及核心 API 使用,涵盖上下文、计算图及后端接口等关键术语。

8月12日周一
  1. Hugging Face Blog73

    Hugging Face 推出统一工具调用 API 与工程实践

    Hugging Face 推出统一工具调用 API,通过 Chat Templating 屏蔽多模型差异,使代码可跨 Mistral、Cohere、NousResearch 和 Llama 等模型复用。Transformers 库新增辅助功能,支持将 Python 函数自动转为 JSON Schema,并提供完整文档与示例。

    推荐理由:Hugging Face 推出统一工具调用 API,通过 Chat Templating 屏蔽多模型差异,提供可复用的工程实现方案。

  2. Hugging Face Blog70

    TII 发布 Falcon Mamba 7B 纯 Mamba 架构模型

    TII 发布 Falcon Mamba 7B,这是首个性能强劲的无注意力 7B 模型,基于 Mamba 架构实现线性时间序列建模。该模型在长序列生成中保持恒定吞吐量且显存不增,支持 4-bit 量化及 torch.compile 加速,并提供指令微调版本。

    推荐理由:Falcon Mamba 7B 验证了纯 Mamba 架构在长序列推理上的效率优势,为 Transformer 之外的替代方案提供了可复用的工程实践。

8月8日周四
  1. Hugging Face Blog68

    Hugging Face 收购 XetHub 以升级 Hub 存储与协作能力

    Hugging Face 宣布收购 XetHub,其团队将负责将 Hub 的存储后端从 Git LFS 替换为更优化的版本。XetHub 技术支持 TB 级仓库的 Git 扩展、分块存储与去重,使用户在更新大型数据集或模型时仅需上传变更部分,从而大幅提升协作与版本管理效率。

    推荐理由:Hugging Face 收购 XetHub 以替换 Git LFS 存储后端,将显著提升 TB 级数据集和模型的版本管理与协作效率。

8月6日周二
  1. Hugging Face Blog32

    Hugging Face 2024 安全功能亮点

    Hugging Face 于 2024 年 8 月 6 日发布了 Hub 平台的安全功能亮点。面向所有用户,平台提供细粒度 Token 访问控制、双因素认证 (2FA)、Commit 签名、组织访问控制及包含恶意软件与密钥扫描的自动化安全扫描。针对 Enterprise 用户,平台进一步支持基于 SAML 2.0 和 OpenID Connect 协议的单点登录 (SSO) 以及资源组管理。

  2. Hugging Face Blog68

    Hugging Face 联合 Albumentations 发布文档图像多模态增强教程

    Hugging Face 联合 Albumentations AI 发布 TextImage Augmentation 教程,介绍一种同时修改文档图像和文本的多模态数据增强方法。该方法支持随机插入、删除、替换和停用词插入,可生成合成数据并保留修改后的文本标注,适用于视觉语言模型(VLM)在文档图像上的微调。

    推荐理由:提供结合文本与图像修改的文档增强方法,帮助解决视觉语言模型在文档数据上的微调难题。

9月28日周四
9月26日周二
  1. Hugging Face Blog42

    Llama 2 在 Amazon SageMaker 上的基准测试

    Hugging Face 对 Llama 2 在 Amazon SageMaker 上的 60 种部署配置进行了基准测试,评估了 7B、13B 和 70B 参数规模模型在不同 EC2 实例和负载下的延迟与吞吐量。测试涵盖 GPTQ 4-bit 量化技术,旨在为最具成本效益、最佳延迟和最佳吞吐量场景提供优化策略。

9月22日周五
  1. Hugging Face Blog43

    Hugging Face 推出 Inference for PROs

    Hugging Face 推出 Inference for PROs,为付费用户提供精选模型的专属 API 端点及更高速率限制。该服务支持 Meta Llama 3、Mixtral 8x7B 等模型,利用 text-generation-inference 实现极速推理。PRO 用户可借此便捷地进行原型开发与测试,无需自行部署基础设施。

9月19日周二
  1. Hugging Face Blog13

    Rocket Money 携手 Hugging Face 实现 ML 模型规模化生产部署

    Rocket Money 选择 Hugging Face Inference API 替代原有正则系统,以支撑其个人理财应用中超过 4000 个类别的交易分类任务。该方案成功应对了每月 1 亿笔交易的突发负载,实现了动态扩展与低延迟推理。经过三个月评估,Rocket Money 确认该服务具备高可用性,并与其建立了紧密的技术合作伙伴关系。

9月13日周三
  1. Hugging Face Blog72

    Hugging Face 发布高效图像生成模型 Würstchen

    Hugging Face 发布高效图像生成模型 Würstchen,通过42倍空间压缩实现比 SDXL 更快的推理速度与更低的显存占用。该模型在 Diffusers 库中集成,支持 PyTorch 2.0 SDPA 加速与 torch.compile 优化,并提供多种显存节省策略。

    推荐理由:通过42倍极端压缩显著降低训练与推理成本,为资源受限场景提供高效图像生成方案。

9月11日周一
  1. Hugging Face Blog33

    SafeCoder 与闭源代码助手对比

    Hugging Face 发布 SafeCoder,基于 155 亿参数的 StarCoder 模型提供企业级代码辅助。该方案具备 8192-token 上下文窗口,支持在本地或云端通过 Docker 部署,实现完全的数据隐私与定制化微调。相比 GitHub Copilot 等闭源服务,SafeCoder 提供模型架构、训练数据及详细指标的透明度,并允许企业完全控制基础设施与合规性。

9月8日周五
9月6日周三
  1. Hugging Face Blog83

    Hugging Face 上线 Falcon 180B 开源大模型

    Hugging Face 上线了 TII 发布的 180B 参数开源大语言模型 Falcon 180B,该模型在 3.5 万亿 token 上预训练,性能对标 PaLM-2 Large。文章提供了 Transformers 集成代码、量化部署方案及硬件需求参考。

    推荐理由:Hugging Face 上线了 180B 参数开源模型,提供了量化部署指南与硬件需求,方便开发者评估与接入。

9月1日周五
8月30日周三
8月10日周四
8月9日周三
  1. Hugging Face Blog68

    使用Transformers优化Bark语音生成模型

    本文演示了如何利用Hugging Face生态中的BetterTransformer、半精度和CPU卸载技术优化Bark语音生成模型。结合这三种优化手段,Bark-large的显存占用可从5GB降至2GB,推理速度提升约23%。

    推荐理由:原文给出了结合BetterTransformer、半精度和CPU卸载的具体代码,读者可直接复用以显著降低Bark模型的显存占用并提升推理速度。

  2. Hugging Face Blog28

    BentoML 部署 DeepFloyd IF 实战指南

    BentoML 通过定义 Service、构建 Bento 并部署至 Kubernetes 或 Yatai,实现 DeepFloyd IF 的高效生产级部署。DeepFloyd IF 采用三级级联像素扩散架构,利用 T5-XXL-1.1 编码提示词以增强复杂指令理解。该方案支持对 Stage 1 至 Stage 3 的 Runners 独立扩展资源,满足高并发推理需求。

8月8日周二
  1. Hugging Face Blog68

    Hugging Face 发布 Swift Transformers 工具链,支持在 Apple 设备上运行 LLM

    Hugging Face 发布 Swift Transformers 工具链,包含 swift-transformers 库、swift-chat 演示应用及 Core ML 转换工具,支持在 Apple 设备上本地运行 Llama 2 等大语言模型。

    推荐理由:Hugging Face 发布 Swift Transformers 工具链,提供从模型转换到本地推理的完整方案,降低端侧部署门槛。

8月2日周三
  1. Hugging Face Blog40

    利用全同态加密保护大语言模型隐私

    Zama 提出利用全同态加密(FHE)技术,在保护用户查询隐私的同时维护模型知识产权。通过 Hugging Face transformers 库与 Concrete-Python,将 GPT2 的注意力机制适配至 TFHE 架构,实现加密数据上的模型推理。实验显示,采用 4-bit 量化后,模型在加密状态下仍能保持原始精度的 96%。

8月1日周二
  1. Hugging Face Blog55

    实用3D资产生成:PS1风格工作流分步指南

    本文介绍利用生成式AI结合Blender和Unity构建PS1风格3D资产的分步工作流。首先使用OpenAI的Shap-E模型通过文本生成3D模型,随后在Blender中通过Decimate降低多边形数量,利用Dream Textures插件生成无缝纹理,完成UV映射后导出至Unity,最终实现低精度复古风格的3D资产应用。

7月27日周四
  1. Hugging Face Blog72

    Stable Diffusion XL 支持 Core ML 混合位量化,可在 Mac 端侧运行

    Hugging Face 与 Apple 联合发布 Stable Diffusion XL 的 Core ML 版本,支持在 Mac 端侧运行。引入混合位调色板量化技术,将模型体积从 4.8 GB 压缩至 1.4 GB,同时保持较高生成质量。

    推荐理由:提供了混合位调色板量化技术,在显著压缩模型体积的同时保持生成质量,支持在 Mac 端侧高效运行。

7月24日周一
  1. Hugging Face Blog68

    Hugging Face 发布 Agents.js 库

    Hugging Face 发布 Agents.js,这是一个面向 JavaScript 的库,用于在浏览器或服务器端为 LLM 提供工具访问能力。该库内置多模态工具,支持自定义 LLM 和工具,并允许传入文件作为输入。

    推荐理由:Hugging Face 发布面向 JavaScript 的 Agent 库,提供开箱即用的多模态工具与自定义扩展能力。

7月21日周五
7月20日周四
  1. Hugging Face Blog35

    🤗 Diffusers 发布一周年回顾

    🤗 Diffusers 库迎来发布一周年,回顾其在社区支持下拓展的多项核心功能。新增 DeepFloyd IF 和 SDXL 等高分辨率图像生成支持,并引入 VideoFusion 和 Shap-E 实现文本到视频及 3D 模型生成。同时集成 Consistency Models 加速推理,提供 PyTorch 2.0 优化及安全检测组件。