跳到正文

#教程/实践

今日 3 条
5月25日周四
5月23日周二
5月16日周二
5月8日周一
  1. Hugging Face Blog38

    深入解析文本生成视频模型

    文本生成视频模型正成为生成式AI的重要进展,旨在从文本描述中生成时空一致的视频序列。该任务面临计算成本高、高质量数据集稀缺及视频描述模糊等独特挑战。Hugging Face 博客回顾了从 GAN 到 Transformer 再到扩散模型的演进,并分享了相关演示与资源。

5月1日周一
  1. Hugging Face Blog36

    如何在 Unity 项目中安装和使用 Hugging Face Unity API

    Hugging Face Unity API 允许开发者在 Unity 项目中通过 Git URL 安装并调用 Hugging Face Inference API。该 API 支持对话、文本生成、图像生成、分类、问答、翻译、摘要及语音识别等任务,并提供自定义模型端点配置。开发者可通过 API Wizard 输入密钥测试连接,并在脚本中异步调用相应方法处理回调结果。

4月27日周四
4月5日周三
  1. Hugging Face Blog65

    StackLLaMA:手把手教你用RLHF微调LLaMA模型

    Hugging Face 发布 StackLLaMA 模型及完整训练管线,详细演示了如何结合 SFT、奖励建模和 PPO 算法,利用 PEFT 技术在单卡或集群上对 LLaMA 进行 RLHF 微调,并分享了训练中的稳定性问题与解决方案。

    推荐理由:文章完整展示了基于LLaMA 7B、PEFT和TRL库进行RLHF微调的实操流程,包含代码与踩坑经验。

3月28日周二
3月27日周一
3月24日周五
  1. Hugging Face Blog70

    Hugging Face 详解如何使用 diffusers 训练 ControlNet

    Hugging Face 博客详解了使用 diffusers 训练 ControlNet 的三步流程:规划条件、构建数据集与模型训练。文章以训练面部姿态控制模型为例,展示了从 FaceSynthetics 数据集准备到使用 A100 进行训练的具体代码与参数配置,并提供了适配 8GB 至 16GB 显存的优化方案。

    推荐理由:原文详述了基于diffusers训练ControlNet的三步流程与显存优化技巧,提供了可直接复用的实操指南。

3月10日周五
3月3日周五
  1. Hugging Face Blog72

    Hugging Face Diffusers 集成 ControlNet 教程

    Hugging Face 发布教程介绍如何在 Diffusers 中使用 StableDiffusionControlNetPipeline,涵盖边缘、姿态等多种条件控制及多条件组合方法,并演示了通过优化调度器、CPU卸载和xformers实现推理加速与显存节省。

    推荐理由:文章详细演示了Diffusers中ControlNet的集成与优化技巧,提供可复用的代码与性能调优方案。

3月1日周三
2月15日周三
2月7日周二
  1. Hugging Face Blog38

    生成故事:AI 助力游戏开发 #5

    本文介绍利用 ChatGPT 为农场游戏生成故事内容的方法与限制。语言模型易复制现有故事并产生重复,直接商用存在法律与伦理风险。建议将 AI 用于构思大纲或细节补充,最终内容需人工撰写以确保原创性。

2月6日周一
2月3日周五
  1. Hugging Face Blog38

    深入解析视觉-语言模型

    视觉-语言模型通过结合图像和文本编码器,利用对比学习、PrefixLM、交叉注意力融合及 MLM/ITM 等策略进行预训练,以实现零样本泛化。Hugging Face 博客介绍了这些核心训练方法,并展示了如何利用 🤗 Transformers 库进行实验。

1月26日周四
1月24日周二
  1. Hugging Face Blog36

    对话智能体为何有用?

    本文梳理 ChatGPT、LaMDA、BlenderBot 等对话智能体的技术细节,指出指令遵循(IFT)与监督微调(SFT)是核心共性。文章详细解析了基于人类标注与模型引导的数据构建方法,并探讨了 RLHF 等对齐技术在确保模型安全与有用性方面的关键作用。

1月20日周五
  1. Hugging Face Blog26

    3D 资产生成:AI 游戏开发 #3

    当前文本生成 3D 技术尚未达到实用化标准,无法直接用于游戏开发。尽管 DreamFusion、Point-E 等研究在视图合成方面取得进展,但生成的资产仍需大量后期处理才能就绪。作者建议暂时使用基础几何体代替,并关注 NeRF 转网格或引擎内直接渲染等未来方向。

1月16日周一
1月9日周一
1月3日周二
  1. Hugging Face Blog13

    图机器学习入门

    本文介绍图机器学习的基础知识,涵盖图的定义、表示方法及应用场景。图由节点和边组成,可用于药物发现、推荐系统等任务。文中还简要介绍了图神经网络及基于 Transformer 的图学习方法。

1月2日周一
12月15日周四
12月1日周四
11月21日周一
11月8日周二
11月7日周一
  1. Hugging Face Blog75

    使用Diffusers训练Stable Diffusion的Dreambooth技巧

    Hugging Face发布基于Diffusers训练Stable Diffusion的Dreambooth技巧。推荐低学习率(如1e-6)配合较多训练步数(人脸约1200步)以避免过拟合;微调文本编码器可显著提升质量,但需24GB显存;过拟合时改用DDIM调度器并增加推理步数能改善效果。

    推荐理由:原文基于大量实验给出了Dreambooth微调Stable Diffusion的具体超参数建议和避坑指南。

11月3日周四