跳到正文

全部动态

今日 42 条
9月28日周四
9月27日周三
  1. Mistral AI90

    Mistral AI 发布 Mistral 7B 开源模型

    Mistral AI 发布 Mistral 7B,这是一个 7.3B 参数的大语言模型,采用分组查询注意力(GQA)和滑动窗口注意力(SWA)技术。该模型在 Apache 2.0 协议下开源,在多项基准测试中表现优于 Llama 2 13B,接近 Llama 1 34B 水平,并在代码和推理任务上展现出显著优势。

    推荐理由:开源了7.3B参数模型并采用SWA与GQA技术,在多项基准上超越Llama 2 13B,兼顾了性能与推理效率。

9月26日周二
  1. Hugging Face Blog42

    Llama 2 在 Amazon SageMaker 上的基准测试

    Hugging Face 对 Llama 2 在 Amazon SageMaker 上的 60 种部署配置进行了基准测试,评估了 7B、13B 和 70B 参数规模模型在不同 EC2 实例和负载下的延迟与吞吐量。测试涵盖 GPTQ 4-bit 量化技术,旨在为最具成本效益、最佳延迟和最佳吞吐量场景提供优化策略。

9月22日周五
  1. Hugging Face Blog43

    Hugging Face 推出 Inference for PROs

    Hugging Face 推出 Inference for PROs,为付费用户提供精选模型的专属 API 端点及更高速率限制。该服务支持 Meta Llama 3、Mixtral 8x7B 等模型,利用 text-generation-inference 实现极速推理。PRO 用户可借此便捷地进行原型开发与测试,无需自行部署基础设施。

9月19日周二
  1. Hugging Face Blog13

    Rocket Money 携手 Hugging Face 实现 ML 模型规模化生产部署

    Rocket Money 选择 Hugging Face Inference API 替代原有正则系统,以支撑其个人理财应用中超过 4000 个类别的交易分类任务。该方案成功应对了每月 1 亿笔交易的突发负载,实现了动态扩展与低延迟推理。经过三个月评估,Rocket Money 确认该服务具备高可用性,并与其建立了紧密的技术合作伙伴关系。

9月13日周三
  1. Hugging Face Blog72

    Hugging Face 发布高效图像生成模型 Würstchen

    Hugging Face 发布高效图像生成模型 Würstchen,通过42倍空间压缩实现比 SDXL 更快的推理速度与更低的显存占用。该模型在 Diffusers 库中集成,支持 PyTorch 2.0 SDPA 加速与 torch.compile 优化,并提供多种显存节省策略。

    推荐理由:通过42倍极端压缩显著降低训练与推理成本,为资源受限场景提供高效图像生成方案。

9月11日周一
  1. Hugging Face Blog33

    SafeCoder 与闭源代码助手对比

    Hugging Face 发布 SafeCoder,基于 155 亿参数的 StarCoder 模型提供企业级代码辅助。该方案具备 8192-token 上下文窗口,支持在本地或云端通过 Docker 部署,实现完全的数据隐私与定制化微调。相比 GitHub Copilot 等闭源服务,SafeCoder 提供模型架构、训练数据及详细指标的透明度,并允许企业完全控制基础设施与合规性。

9月8日周五
9月6日周三
  1. Hugging Face Blog83

    Hugging Face 上线 Falcon 180B 开源大模型

    Hugging Face 上线了 TII 发布的 180B 参数开源大语言模型 Falcon 180B,该模型在 3.5 万亿 token 上预训练,性能对标 PaLM-2 Large。文章提供了 Transformers 集成代码、量化部署方案及硬件需求参考。

    推荐理由:Hugging Face 上线了 180B 参数开源模型,提供了量化部署指南与硬件需求,方便开发者评估与接入。

9月1日周五
8月30日周三
8月10日周四
8月9日周三
  1. Hugging Face Blog68

    使用Transformers优化Bark语音生成模型

    本文演示了如何利用Hugging Face生态中的BetterTransformer、半精度和CPU卸载技术优化Bark语音生成模型。结合这三种优化手段,Bark-large的显存占用可从5GB降至2GB,推理速度提升约23%。

    推荐理由:原文给出了结合BetterTransformer、半精度和CPU卸载的具体代码,读者可直接复用以显著降低Bark模型的显存占用并提升推理速度。

  2. Hugging Face Blog28

    BentoML 部署 DeepFloyd IF 实战指南

    BentoML 通过定义 Service、构建 Bento 并部署至 Kubernetes 或 Yatai,实现 DeepFloyd IF 的高效生产级部署。DeepFloyd IF 采用三级级联像素扩散架构,利用 T5-XXL-1.1 编码提示词以增强复杂指令理解。该方案支持对 Stage 1 至 Stage 3 的 Runners 独立扩展资源,满足高并发推理需求。

8月8日周二
  1. Hugging Face Blog73

    使用TRL库通过DPO微调Llama 2

    Hugging Face发布TRL库中的DPO训练器,通过直接偏好优化算法简化大语言模型对齐流程。文章展示了结合QLoRA技术,使用stack-exchange偏好数据集对Llama 2 7B模型进行监督微调与DPO对齐的完整代码实现。

    推荐理由:文章提供了TRL库中DPO训练器的代码实现与参数配置,可直接复现基于偏好数据的模型对齐流程。

  2. Hugging Face Blog68

    Hugging Face 发布 Swift Transformers 工具链,支持在 Apple 设备上运行 LLM

    Hugging Face 发布 Swift Transformers 工具链,包含 swift-transformers 库、swift-chat 演示应用及 Core ML 转换工具,支持在 Apple 设备上本地运行 Llama 2 等大语言模型。

    推荐理由:Hugging Face 发布 Swift Transformers 工具链,提供从模型转换到本地推理的完整方案,降低端侧部署门槛。

8月2日周三
  1. Hugging Face Blog40

    利用全同态加密保护大语言模型隐私

    Zama 提出利用全同态加密(FHE)技术,在保护用户查询隐私的同时维护模型知识产权。通过 Hugging Face transformers 库与 Concrete-Python,将 GPT2 的注意力机制适配至 TFHE 架构,实现加密数据上的模型推理。实验显示,采用 4-bit 量化后,模型在加密状态下仍能保持原始精度的 96%。

8月1日周二
  1. Hugging Face Blog55

    实用3D资产生成:PS1风格工作流分步指南

    本文介绍利用生成式AI结合Blender和Unity构建PS1风格3D资产的分步工作流。首先使用OpenAI的Shap-E模型通过文本生成3D模型,随后在Blender中通过Decimate降低多边形数量,利用Dream Textures插件生成无缝纹理,完成UV映射后导出至Unity,最终实现低精度复古风格的3D资产应用。

7月27日周四
  1. Hugging Face Blog72

    Stable Diffusion XL 支持 Core ML 混合位量化,可在 Mac 端侧运行

    Hugging Face 与 Apple 联合发布 Stable Diffusion XL 的 Core ML 版本,支持在 Mac 端侧运行。引入混合位调色板量化技术,将模型体积从 4.8 GB 压缩至 1.4 GB,同时保持较高生成质量。

    推荐理由:提供了混合位调色板量化技术,在显著压缩模型体积的同时保持生成质量,支持在 Mac 端侧高效运行。

7月24日周一
  1. Hugging Face Blog68

    Hugging Face 发布 Agents.js 库

    Hugging Face 发布 Agents.js,这是一个面向 JavaScript 的库,用于在浏览器或服务器端为 LLM 提供工具访问能力。该库内置多模态工具,支持自定义 LLM 和工具,并允许传入文件作为输入。

    推荐理由:Hugging Face 发布面向 JavaScript 的 Agent 库,提供开箱即用的多模态工具与自定义扩展能力。

7月21日周五
7月20日周四
  1. Hugging Face Blog35

    🤗 Diffusers 发布一周年回顾

    🤗 Diffusers 库迎来发布一周年,回顾其在社区支持下拓展的多项核心功能。新增 DeepFloyd IF 和 SDXL 等高分辨率图像生成支持,并引入 VideoFusion 和 Shap-E 实现文本到视频及 3D 模型生成。同时集成 Consistency Models 加速推理,提供 PyTorch 2.0 优化及安全检测组件。

7月18日周二
  1. Hugging Face Blog95

    Meta发布Llama 2开源大模型家族

    Meta发布Llama 2开源大模型家族,包含7B、13B和70B参数量的预训练及对话微调模型,采用宽松许可允许商用。Hugging Face提供完整集成支持,包括Transformers推理、Inference Endpoints部署及基于PEFT的单卡微调方案。

    推荐理由:Meta发布Llama 2并提供Hugging Face集成与微调指南,为开源替代闭源模型提供了具体路径。

7月17日周一
7月14日周五
7月3日周一
7月1日周六
6月29日周四
6月20日周二
6月16日周五
6月15日周四
6月12日周一
  1. Hugging Face Blog20

    Hugging Face Hub 面向 GLAM 领域的应用指南

    Hugging Face Hub 面向画廊、图书馆、档案馆和博物馆(GLAM)领域发布应用指南,介绍如何利用该平台共享和访问机器学习模型、数据集及演示应用。平台目前托管超过 19 万个模型、3.3 万个数据集和 10 万个应用,支持通过 API 部署或集成 Transformers 库使用。文章详细演示了如何筛选特定任务与语言的模型,以及如何上传 CSV 格式的数据集。

6月7日周三
6月6日周二