跳到正文

全部动态

今日 48 条
10月22日周三
  1. Hugging Face Blog71

    Sentence Transformers 正式并入 Hugging Face

    Hugging Face 宣布 Sentence Transformers 从达姆施塔特工业大学 UKP Lab 正式转入 Hugging Face,由 Tom Aarsen 继续领导项目。该项目拥有超过 16,000 个公开模型和百万级月活用户,将继续保持 Apache 2.0 开源协议和社区驱动模式。

    推荐理由:Sentence Transformers 正式并入 Hugging Face,由官方接手维护,为开源嵌入生态带来更稳定的基础设施支持。

10月21日周二
  1. Hugging Face Blog77

    Hugging Face AI Sheets 新增视觉支持,支持图像提取与生成

    Hugging Face 发布 AI Sheets 重大更新,新增视觉支持。用户可在表格中直接上传图像,利用开源模型提取收据、文档等结构化数据,或根据文本生成、编辑图像。该工具基于 Inference Providers 运行,支持导出至 Hugging Face Hub。

    推荐理由:AI Sheets 新增视觉支持,无需代码即可在表格中完成图像提取、生成与编辑,为数据标注和内容生产提供新工具。

  2. Hugging Face Blog70

    Hugging Face 开源OCR模型选型指南与部署教程

    Hugging Face 发布指南,对比了 Nanonets-OCR2、OlmOCR-2、Granite-Docling 等开源OCR模型的能力与成本,介绍了 OlmOCR-Bench 等评测基准,并提供了基于 vLLM 和 Transformers 的本地部署与批量推理代码。

    推荐理由:系统梳理了多款开源OCR模型的能力差异与评测基准,并提供了本地部署与批量推理的实操代码。

10月17日周五
  1. Hugging Face Blog30

    Hugging Face 发起 AI for Food Allergies 项目,探索 AI 在食物过敏研究中的应用

    Hugging Face 发起 AI for Food Allergies 项目,旨在构建首个社区驱动的研究实验室,探索人工智能如何推动食物过敏研究。该项目利用 ProtBERT、ESM-2 等深度学习模型分析氨基酸序列以预测过敏原,并结合 NLP 和计算机视觉技术解析成分标签,以加速过敏原发现并辅助临床诊断。

10月16日周四
10月15日周三
  1. Hugging Face Blog38

    三步在 Intel CPU 上运行 VLM

    Hugging Face 发布教程,指导用户通过 Optimum Intel 和 OpenVINO 在 Intel CPU 上运行 SmolVLM2-256M-Video-Instruct 视觉语言模型。教程涵盖将模型转换为 OpenVINO IR、应用权重或静态量化以优化内存和推理速度,以及执行推理的具体步骤。

10月14日周二
  1. Hugging Face Blog68

    NVIDIA 发布 Nemotron-Personas-India 合成数据集

    NVIDIA 发布 Nemotron-Personas-India,首个对齐印度人口、地理和文化分布的合成数据集,包含 2100 万个角色记录,支持英语和印地语。该数据集基于 NeMo Data Designer 生成,覆盖 27 个字段,旨在解决印度多语言 AI 训练的数据缺口,支持开发者微调本地化模型。

    推荐理由:NVIDIA 发布首个对齐印度人口分布的合成数据集,为多语言 AI 微调提供隐私安全的数据基础。

10月13日周一
10月11日周六
10月10日周五
10月9日周四
10月8日周三
10月7日周二
  1. Hugging Face Blog80

    BigCode 发布 BigCodeArena 代码生成评测平台及自动化基准

    BigCode 发布 BigCodeArena,首个支持代码实际执行与人类投票的模型对比平台,并开源了包含1.4万对话的社区数据。同时推出 BigCodeReward 和 AutoCodeArena 两个新基准,利用执行结果显著提升奖励模型对齐度,并在自动化评测中显示 GPT-5 等模型表现领先。

    推荐理由:平台引入代码执行反馈机制,并开源了包含1.4万对话的社区评测数据及自动化基准,为代码模型评估提供了新标准。

10月6日周一
  1. OpenAI News70

    OpenAI Codex 正式开放并新增 Slack 集成与 SDK

    OpenAI 宣布 Codex 正式全面开放,新增 Slack 集成、Codex SDK 以及用量仪表盘和 Workspace 管理等管理员工具,旨在提升大规模使用的易用性与管理效率。

    推荐理由:原文宣布 Codex 正式开放并新增 Slack 集成与 SDK,开发者可据此评估其在企业级工作流中的集成能力。

10月2日周四
  1. Hugging Face Blog67

    Hugging Face 详解如何将 3B 参数 OCR 模型适配 Core ML 实现端侧推理

    Hugging Face 发布教程详解如何将 RedNote 的 3B 参数 OCR 模型 dots.ocr 转换为 Core ML 格式以在 Apple 设备上运行。文章通过简化模型结构、修复 PyTorch 到 CoreML 转换中的算子报错,成功将模型部署至端侧,并预告后续将介绍 MLX 集成与 Neural Engine 量化优化。

    推荐理由:详细拆解了将3B参数OCR模型适配Core ML的具体步骤与踩坑经验,为端侧部署提供了可复用的工程参考。

10月1日周三
  1. Hugging Face Blog42

    Hugging Face 发布检索嵌入基准 RTEB

    Hugging Face 发布检索嵌入基准(RTEB)Beta 版,旨在通过混合开放与私有数据集策略,可靠评估嵌入模型在真实应用中的检索准确性。该基准涵盖 20 种语言及法律、医疗等关键领域,默认使用 NDCG@10 作为排行榜指标,以解决现有基准存在的泛化差距和与企业用例脱节问题。

9月30日周二
  1. OpenAI News78

    OpenAI 发布 Sora 2 视频生成模型

    OpenAI 发布 Sora 2,这是一款新的视频和音频生成模型。该模型引入了更准确的物理模拟、更清晰的写实感、同步音频、增强的可控性以及更广泛的风格范围。

    推荐理由:原文给出了Sora 2在物理准确性、写实度、音频同步等方面的核心能力变化,读者可据此评估其视频生成水准。

  2. OpenAI News40

    负责任地发布 Sora

    OpenAI 发布 Sora 2 及 Sora 应用,将安全作为基础以应对先进视频模型带来的新型安全挑战。该方案锚定于具体的保护措施,旨在通过构建安全底座来负责任地推出这一社会创作平台。

  3. OpenAI News80

    OpenAI 发布 Sora 2 视频生成模型

    OpenAI 发布 Sora 2,这是一款支持同步对话和音效的视频生成模型。目前旧版 Sora 产品已不再可用。

    推荐理由:Sora 2 引入了同步对话和声对话与音效功能,同时旧版产品已下线,明确了视频生成能力的迭代方向。