跳到正文

#部署/工程

今日 4 条
6月15日周四
5月25日周四
5月24日周三
5月23日周二
  1. Hugging Face Blog65

    Safetensors 通过安全审计并将在 Transformers 中成为默认格式

    Hugging Face 联合 EleutherAI 和 Stability AI 宣布 safetensors 库已通过 Trail of Bits 的安全审计,确认无导致任意代码执行的严重漏洞。该库将作为核心依赖加入 Transformers 并设为默认保存格式,提供比 pickle 更安全且加载速度更快的张量存储方案。

    推荐理由:官方联合第三方完成安全审计并宣布将其设为默认格式,为模型加载提供了安全与性能保障。

5月16日周二
5月1日周一
  1. Hugging Face Blog36

    如何在 Unity 项目中安装和使用 Hugging Face Unity API

    Hugging Face Unity API 允许开发者在 Unity 项目中通过 Git URL 安装并调用 Hugging Face Inference API。该 API 支持对话、文本生成、图像生成、分类、问答、翻译、摘要及语音识别等任务,并提供自定义模型端点配置。开发者可通过 API Wizard 输入密钥测试连接,并在脚本中异步调用相应方法处理回调结果。

4月27日周四
4月6日周四
4月5日周三
  1. Hugging Face Blog65

    StackLLaMA:手把手教你用RLHF微调LLaMA模型

    Hugging Face 发布 StackLLaMA 模型及完整训练管线,详细演示了如何结合 SFT、奖励建模和 PPO 算法,利用 PEFT 技术在单卡或集群上对 LLaMA 进行 RLHF 微调,并分享了训练中的稳定性问题与解决方案。

    推荐理由:文章完整展示了基于LLaMA 7B、PEFT和TRL库进行RLHF微调的实操流程,包含代码与踩坑经验。

3月28日周二
3月9日周四
2月23日周四
2月15日周三
  1. Hugging Face Blog40

    为什么我们转向 Hugging Face Inference Endpoints,以及你可能也应该这样做

    我们已将部分机器学习推理模型从 AWS ECS 迁移至 Hugging Face Inference Endpoints,以简化部署流程并降低认知负荷。测试显示,Hugging Face 的 RoBERTa 微调模型在大型实例上的延迟低至 80ms,比 ECS 方案快两倍以上。虽然成本增加了 24% 至 50%,但节省的运维时间远超差价。

2月6日周一
1月2日周一
12月14日周三
12月1日周四
11月23日周三
  1. Hugging Face Blog12

    机器学习总监洞察 [第4部分]

    Hugging Face 发布机器学习总监洞察系列第四期,收录 Javier Mansilla、Shaun Gittens 等四位总监的行业见解。Mercado Libre 总监 Javier Mansilla 分享了机器学习在电商领域的应用,涵盖欺诈预防、推荐系统及基础设施优化,并指出需关注用户体验与长期技术债务。

11月8日周二
  1. Hugging Face Blog15

    Hugging Face 调整 Inference API 定价策略并推出 Inference Endpoints

    Hugging Face 宣布停用 Inference API 的付费层级,推荐用户转向新推出的 Inference Endpoints 以获取企业级推理服务。平台同步升级了 Spaces 的硬件选项,用户只需绑定信用卡即可按需选择硬件运行 ML 演示。所有付费服务及 PRO 订阅费用将于每月月初统一结算并提供合并发票。

11月2日周三
10月14日周五
  1. Hugging Face Blog61

    Hugging Face 发布 Inference Endpoints 托管推理服务

    Hugging Face 发布 Inference Endpoints,允许用户通过几步操作将模型从 Hub 直接部署到 AWS 等云厂商的托管基础设施。服务支持 Public、Protected 和 Private 三种安全模式,其中 Private 模式可通过 AWS PrivateLink 实现 VPC 内网访问,并提供自动扩缩容、监控日志和 API 调用能力。

    推荐理由:官方发布托管推理服务,提供从公开到私有VPC的多级安全部署选项,降低生产环境部署门槛。