跳到正文

全部动态

今日 6 条
6月23日周五
  1. Hugging Face Blog70

    Open LLM Leaderboard MMLU 评估差异解析

    Hugging Face 博客解析 Open LLM Leaderboard 中 MMLU 分数与 LLaMA 论文不符的原因,对比了 EleutherAI Harness、HELM 和原始实现的差异,指出 Prompt 和概率计算方式不同导致分数不可直接比较,并宣布将更新 Harness 以匹配原始实现。

    推荐理由:原文通过对比三种MMLU实现,揭示了评估细节如何导致分数差异,帮助读者理解开源基准的可复现性。

6月20日周二
6月16日周五
6月15日周四
  1. Hugging Face Blog70

    Hugging Face 发布支持 6-bit 量化的 Stable Diffusion Core ML 模型

    Hugging Face 发布了四个官方 Stable Diffusion 模型的 6-bit palettized 版本,支持在 iPhone、iPad 和 Mac 上更高效地运行。配合更新的 coremltools 和 ml-stable-diffusion 仓库,开发者可轻松转换自定义模型并享受更低的内存占用与更快的推理速度。

    推荐理由:提供了6-bit量化模型下载与转换代码,帮助开发者在苹果设备上高效部署图像生成模型。

6月13日周二
6月12日周一
  1. Hugging Face Blog20

    Hugging Face Hub 面向 GLAM 领域的应用指南

    Hugging Face Hub 面向画廊、图书馆、档案馆和博物馆(GLAM)领域发布应用指南,介绍如何利用该平台共享和访问机器学习模型、数据集及演示应用。平台目前托管超过 19 万个模型、3.3 万个数据集和 10 万个应用,支持通过 API 部署或集成 Transformers 库使用。文章详细演示了如何筛选特定任务与语言的模型,以及如何上传 CSV 格式的数据集。

6月7日周三
6月6日周二
6月5日周一
  1. Hugging Face Blog86

    Hugging Face 发布 Falcon 开源大语言模型

    阿布扎比技术创新研究所(TII)发布 Falcon-7B 和 Falcon-40B 开源大语言模型,采用 Apache 2.0 协议。Falcon-40B 在 Open LLM Leaderboard 上排名第一,以 2800 PF-days 算力超越 LLaMA-65B。

    推荐理由:Falcon 40B 以较低算力成本在基准测试中超越 LLaMA-65B,展示了多查询注意力与 RefinedWeb 数据的高效性。

6月2日周五
  1. Hugging Face Blog28

    Hugging Face Unity API 实现语音识别教程

    Hugging Face 发布 Unity API 语音识别教程,指导开发者在 Unity 游戏中实现语音转文本功能。教程详细演示了如何设置 UI 组件、编写 C# 脚本调用麦克风录制音频,并将 WAV 格式数据通过 API 处理。该功能可用于 NPC 交互、游戏指令控制及无障碍辅助。

6月1日周四
5月31日周三
5月25日周四
5月24日周三
  1. Hugging Face Blog88

    Hugging Face 整合 4-bit 量化与 QLoRA 技术

    Hugging Face 在 transformers 中整合了 bitsandbytes 的 4-bit 量化与 QLoRA 技术,支持在消费级 GPU 上运行和微调大模型。QLoRA 通过 4-bit NormalFloat 存储和双重量化降低显存占用,使单卡微调 65B 参数模型成为可能。

    推荐理由:官方整合了4-bit量化与QLoRA技术,提供了在消费级硬件上运行和微调大模型的完整工具链。

5月23日周二
  1. Hugging Face Blog65

    Safetensors 通过安全审计并将在 Transformers 中成为默认格式

    Hugging Face 联合 EleutherAI 和 Stability AI 宣布 safetensors 库已通过 Trail of Bits 的安全审计,确认无导致任意代码执行的严重漏洞。该库将作为核心依赖加入 Transformers 并设为默认保存格式,提供比 pickle 更安全且加载速度更快的张量存储方案。

    推荐理由:官方联合第三方完成安全审计并宣布将其设为默认格式,为模型加载提供了安全与性能保障。

  2. Hugging Face Blog43

    Hugging Face 与 IBM 合作 watsonx.ai,面向 AI 开发者的下一代企业级工作室

    Hugging Face 与 IBM 宣布合作,将 Hugging Face 开源库集成至 IBM watsonx.ai 平台。watsonx.ai 是基于 RedHat OpenShift 构建的下一代企业 AI 工作室,支持在云端和本地部署,旨在帮助客户训练、验证、微调及部署传统机器学习与生成式 AI 模型。双方还将合作将 IBM 开发的大语言模型开源至 Hugging Face Hub。

5月22日周一
5月18日周四
5月16日周二
5月15日周一
  1. Hugging Face Blog36

    如何在单张 AMD GPU 上使用 ROCm 运行类 ChatGPT 聊天机器人

    本文详解如何在单张 AMD GPU 上使用 ROCm 运行 130 亿参数的开源聊天机器人 Vicuna 13B。通过 GPTQ 技术将模型量化至 4-bit,可将显存需求从 28GB 降至 6GB,从而在内存受限环境下实现高效推理。教程提供了基于 Docker 和 PyTorch 的完整部署步骤,包括模型下载、量化及 Web UI 服务搭建。

  2. Hugging Face Blog70

    RWKV架构正式集成至Hugging Face transformers库

    Hugging Face宣布将RWKV架构正式集成至transformers库,该架构结合了RNN的推理效率与Transformer的训练优势。目前提供169M至14B参数的预训练模型及RWKV-4 Raven对话模型,并附带权重转换脚本。

    推荐理由:RWKV架构正式集成至Hugging Face transformers库,提供从预训练到Chat微调的多种模型及权重转换工具。

5月11日周四
  1. Hugging Face Blog78

    Hugging Face 推出辅助生成技术降低文本生成延迟

    Hugging Face 在 Transformers 库中引入辅助生成(Assisted Generation)技术,利用小模型生成候选 token 并由大模型验证,从而减少前向传播次数。该方法在模型显存不足需卸载时最高可实现 10 倍加速,在显存充足时也可获得 2 至 3 倍加速,且支持贪婪解码与采样。

    推荐理由:Hugging Face 在 Transformers 中引入辅助生成技术,通过小模型辅助大模型解码,显著降低文本生成延迟。

5月9日周二
  1. Hugging Face Blog73

    Hugging Face 发布 StarChat Alpha 编程助手

    Hugging Face 发布基于 StarCoder 微调的编程助手 StarChat Alpha,采用 ChatML 格式与 OpenAssistant 数据集训练,提供代码、数据集及模型下载。

    推荐理由:文章展示了基于StarCoder微调出StarChat Alpha的过程,提供了ChatML格式和DeepSpeed训练代码供开发者复用。

5月8日周一
  1. Hugging Face Blog38

    深入解析文本生成视频模型

    文本生成视频模型正成为生成式AI的重要进展,旨在从文本描述中生成时空一致的视频序列。该任务面临计算成本高、高质量数据集稀缺及视频描述模糊等独特挑战。Hugging Face 博客回顾了从 GAN 到 Transformer 再到扩散模型的演进,并分享了相关演示与资源。

5月4日周四
  1. Hugging Face Blog82

    StarCoder 发布:面向代码的大语言模型

    Hugging Face 发布 StarCoder 和 StarCoderBase 代码大语言模型,在 HumanEval 等基准上达到开源 SOTA。模型基于 The Stack 数据集训练,提供完整训练数据、PII 移除工具及 BigCode OpenRAIL-M 许可证。

    推荐理由:模型在HumanEval等基准上达到开源SOTA,提供完整训练数据与治理工具,适合二次开发。

5月1日周一
  1. Hugging Face Blog36

    如何在 Unity 项目中安装和使用 Hugging Face Unity API

    Hugging Face Unity API 允许开发者在 Unity 项目中通过 Git URL 安装并调用 Hugging Face Inference API。该 API 支持对话、文本生成、图像生成、分类、问答、翻译、摘要及语音识别等任务,并提供自定义模型端点配置。开发者可通过 API Wizard 输入密钥测试连接,并在脚本中异步调用相应方法处理回调结果。

4月27日周四