跳到正文

全部动态

今日 6 条
7月8日周一
7月3日周三
7月1日周一
  1. Hugging Face Blog74

    Hugging Face 发布 smolagents 并在 GAIA 基准测试中登顶

    Hugging Face 发布独立库 smolagents,其前身 Transformers Agents 基于 Code Agent 在 GAIA 基准测试验证集上取得 44.2% 的成绩排名第一。该方案通过代码执行、安全解释器及多智能体编排,展示了代码动作在复杂任务中的优势。

    推荐理由:文章分享了基于代码智能体在GAIA基准测试中取得高分的技术细节,为构建复杂Agent系统提供了可迁移的实践经验。

6月27日周四
  1. Hugging Face Blog86

    Gemma 2 发布:Google 开源新一代大语言模型

    Google 发布 Gemma 2 开源大语言模型,包含 9B 和 27B 两种参数规模。该模型在训练数据量、滑动窗口注意力、Logit 软截断及知识蒸馏等方面进行了技术升级,并在多项基准测试中表现优异。Hugging Face 已提供 Transformers 集成、微调工具及推理端点支持。

    推荐理由:文章详细拆解了Gemma 2的技术改进与生态集成,为开发者评估和部署提供了具体参考。

6月25日周二
6月24日周一
  1. Hugging Face Blog68

    Hugging Face 博客:微调 Microsoft Florence-2 视觉语言模型

    Hugging Face 博客发布教程,展示如何在受限资源下微调 Microsoft Florence-2 视觉语言模型。文章通过 DocVQA 数据集实验,验证了冻结视觉编码器并使用小学习率(1e-6)微调的有效性,验证集 Levenshtein 相似度从 0 提升至 57.0,并提供了 Colab 笔记本与完整代码。

    推荐理由:提供在受限资源下微调 Florence-2 的完整代码与实验数据,展示如何将其适配至文档问答等下游任务。

6月21日周五
  1. OpenAI News40

    OpenAI 收购 Rockset

    OpenAI 宣布收购 Rockset。此次收购旨在增强 OpenAI 在实时数据处理与向量搜索方面的能力,以支持其 AI 应用的底层基础设施需求。

6月20日周四
  1. Hugging Face Blog28

    Hugging Face 与 Argilla 回顾 Data Is Better Together 开源数据集协作计划

    Hugging Face 联合 Argilla 发起 Data Is Better Together 倡议,推动开源社区协作构建高质量数据集。社区已完成包含 10K 提示词的 DIBT/10k_prompts_ranked 数据集及多语言评估项目,并发布了 DPO/ORPO 和 KTO 等数据集构建指南。目前该计划仍在持续招募贡献者以完善多语言及特定领域资源。

  2. OpenAI News15

    一致性模型

    一致性模型(Consistency Models)旨在解决扩散模型依赖迭代采样导致生成速度慢的问题。扩散模型虽在图像、音频和视频生成领域取得显著进展,但其迭代过程限制了生成效率。

6月19日周三
  1. Hugging Face Blog15

    Prezi 如何利用 Hugging Face Hub 和专家支持计划加速多模态机器学习路线图

    Prezi 加入 Hugging Face 专家支持计划,加速多模态机器学习路线图。其旗舰产品 Prezi AI 结合图像和文本,通过引入开源重排模型优化资产搜索,实现更便宜、快速且准确的演示生成。专家指导帮助非机器学习工程师团队筛选视觉语言模型,并利用 Inference Endpoints 便捷部署,显著提升开发效率。

6月18日周二
  1. OpenAI News17

    使用自定义 GPT 提升开发者生产力

    Paf 在全公司范围采用 ChatGPT Enterprise,工程师日常使用自定义 GPT 加速常规开发任务。该公司还将 ChatGPT Enterprise 集成至 grit:lab 编程学院,以 AI 增强、系统架构思维培养新一代软件开发者。目前 70% 的 Paf 员工(涵盖财务、HR、营销及客服等业务团队)活跃使用该服务。

6月17日周一
6月13日周四
  1. Hugging Face Blog47

    Hugging Face Accelerate 0.30.0 发布:统一 DeepSpeed 与 FSDP 混合精度处理

    Hugging Face Accelerate 0.30.0 发布,通过上游 PR 统一了 DeepSpeed 与 PyTorch FSDP 的混合精度处理逻辑。FSDP 现支持“混合精度”与“低精度”两种模式,前者将参数上铸为 fp32 以对齐 DeepSpeed 行为,后者保留 bf16 以节省显存。在四张 A100 GPU 上,两者吞吐量表现相近,MFU 均约为 0.40。

6月12日周三
  1. Hugging Face Blog78

    Hugging Face TRL 引入 RLOO 算法替代 PPO 进行在线 RLHF 训练

    Hugging Face 在 TRL 中引入 RLOO 算法作为 PPO 的替代方案,用于在线 RLHF 训练。该算法将完整回复视为单一动作,显存占用降低 50-70%,训练速度提升 2-3 倍,且在 Pythia 模型上表现优于 DPO。

    推荐理由:TRL 引入 RLOO 算法替代 PPO,显著降低显存占用并提升训练速度,为在线 RLHF 提供了更高效的工程方案。

  2. Hugging Face Blog86

    Hugging Face Diffusers 支持 Stable Diffusion 3 Medium 发布

    Hugging Face Diffusers 正式支持 Stability AI 发布的 Stable Diffusion 3 Medium (SD3) 模型。该模型包含20亿参数,采用多模态扩散Transformer架构和条件流匹配训练。文章提供了在Diffusers中运行推理、使用显存优化技术以及在A100上实现4倍加速的代码示例,并附带了基于LoRA的微调脚本。

    推荐理由:文章详细拆解了SD3 Medium的架构与训练方法,并提供了在Diffusers中运行及微调的具体代码和显存优化方案。

6月10日周一
6月8日周六
6月7日周五
  1. Hugging Face Blog15

    Hugging Face 宣布重构 Transformers 文档

    Hugging Face 宣布对 Transformers 文档进行全面重构,旨在解决因内容增量式堆叠导致的体验割裂与导航困难问题。新文档将转向以代码和解决方案为导向,并采用更灵活的有机结构替代僵化的分类体系。此举旨在更好地服务于希望将 AI 集成到产品中的开发者群体。

6月6日周四
6月5日周三
  1. Mistral AI68

    Mistral 推出模型微调服务与开源 SDK

    Mistral 在 la Plateforme 推出模型微调服务,提供开源微调 SDK、托管微调及定制训练三种方式。托管服务兼容 Mistral 7B 和 Mistral Small,采用 LoRA 技术实现高效微调。

    推荐理由:提供开源SDK、托管微调及定制训练三种入口,覆盖不同技术栈与数据需求。

  2. Mistral AI13

    Mistral AI 微调黑客松

    Mistral AI 宣布举办微调黑客松活动,参赛者可使用其新推出的微调 API 进行项目开发。活动时间为 2024 年 6 月 5 日至 30 日,优胜者将获得 2,500 欧元 Mistral API 积分。参与者需通过 La Platforme 注册并添加支付信息以访问 API,部分入选者可获得 100 美元免费积分。

6月4日周二
5月30日周四
5月29日周三
  1. OpenAI News25

    自动化客服智能体

    MavenAGI 推出基于 GPT-4 构建的 AI 客服智能体,旨在自动化客户服务流程。该智能体已获 Tripadvisor、Clickup 和 Rho 等公司采用,帮助其节省时间并提升客户服务体验。

  2. Mistral AI83

    Mistral 发布首个代码模型 Codestral

    Mistral 发布首个代码模型 Codestral,这是一个 22B 参数的开源权重生成式 AI 模型,支持 80 多种编程语言和 32k 上下文窗口。该模型提供 HuggingFace 下载及专用 API 端点 codestral.mistral.ai,并已在 LlamaIndex、LangChain 及 VSCode 等开发工具中完成集成。

    推荐理由:Mistral 发布首个代码模型 Codestral,提供 22B 开源权重与专用 API 端点,支持 80 多种编程语言及 32k 上下文。