OpenAI 与 Lenfest Institute AI 合作及奖学金项目
OpenAI 与 Lenfest Institute 推出 AI Collaborative 和 Fellowship program 合作项目。
OpenAI 与 Lenfest Institute 推出 AI Collaborative 和 Fellowship program 合作项目。
dottxt 与 Hugging Face 联合发布 Outlines-core 0.1.0,将结构化生成核心算法重写为 Rust。该版本索引编译速度提升约 2x,消除首次运行延迟,并提供 Python 绑定及跨语言扩展能力。
推荐理由:核心算法重写为 Rust 带来编译加速与跨语言绑定能力,有助于提升结构化生成的性能与集成效率。
Hugging Face 发布 Transformers.js v3,引入 WebGPU 支持,推理速度最高提升 100 倍。新增 120 种模型架构,支持 Node.js、Deno 和 Bun 环境,并提供 25 个新示例项目。
推荐理由:引入WebGPU加速与多端运行时支持,为前端和边缘端部署提供可迁移的高性能推理方案。
Hugging Face 宣布与 Protect AI 合作,将 Guardian 安全扫描工具集成至 Hub 扫描套件。所有公开模型仓库在上传文件时将自动接受 Guardian 扫描,以检测 pickle 等序列化格式中的任意代码执行漏洞。
Hugging Face 发布 Speech-to-Speech 项目,支持多语言语音交互。文章详解如何通过自定义 Docker 镜像将级联模型部署到 Inference Endpoints,并提供了基于 WebSocket 的低延迟服务端与客户端代码实现。
Hugging Face Diffusers 正式支持 Stable Diffusion 3.5 Large,提供 8B 参数模型及少步推理的 Turbo 版本。文章介绍了 QK 归一化与双注意力层等架构变化,并给出了量化推理与 LoRA 微调的实操代码。
推荐理由:文章详细说明了SD3.5 Large的架构变化及Diffusers使用方式,并提供了量化推理与微调的实操指南。
Keras 已原生支持加载 Llama 3.2 模型,用户可直接使用 safetensors 格式权重进行生成、训练和微调。文章演示了通过 keras-hub 调用模型,利用 JAX 后端实现多 GPU/TPU 并行推理,并展示了在 TPU 上微调 Llama 3.1 8B 模型的完整流程。
Mistral AI 发布 Ministral 3B 和 8B 两款端侧模型,支持 128k 上下文,在多项基准测试中超越 Gemma 2 和 Llama 3.2 等同类模型。Ministral 8B 提供研究用途权重,API 定价分别为每百万 token 0.1 美元和 0.04 美元。
推荐理由:原文给出了两款端侧模型的具体参数、性能对比与定价,读者可据此评估本地部署的可行性与成本。
Hugging Face 修复了 Transformers Trainer 在梯度累积时损失计算不匹配的问题,确保数学等价于全批量训练。同时暴露 API 允许用户传入自定义损失函数,并将在后续版本中全面支持。
推荐理由:修复了梯度累积下损失计算偏差,并开放自定义损失函数API,帮助开发者规避训练误差。
OpenAI 分析了 ChatGPT 如何根据用户姓名做出不同回应。研究利用 AI 研究助手保护隐私,旨在评估模型在对待不同姓名用户时的公平性表现。
OpenAI 推出 MLE-bench,用于评估 AI 智能体在机器学习工程任务中的表现。该基准旨在衡量智能体执行相关工程工作的能力。
Gradio 5 发布,经 Trail of Bits 独立审计修复多项安全漏洞,默认保障机器学习应用安全。修复涵盖本地运行、Hugging Face Spaces 部署、内置分享链接及 CI 供应链等场景,包括 CORS 配置错误、SSRF、任意文件上传、远程代码执行及 GitHub Actions 风险。所有修复已验证并包含在 Gradio 5.0 版本中。
Hugging Face 验证 AMD 5th Gen EPYC Turin CPU 在 LLM 推理中实现 2 倍加速。通过 ZenDNN PyTorch 插件 zentorch 优化 torch.compile,AMD Turin 在 Meta LLaMA 3.1 8B 的摘要、聊天等五种场景下,吞吐量较 AMD Genoa 提升约 2 倍。
Hugging Face博客介绍利用Dask和Coiled将数据处理规模从100行扩展至2.11亿行的方法。通过FineWeb-Edu分类器在云端多GPU上并行运行文本分类,实现了TB级数据集的高效清洗与结构化。
Hugging Face 发布 Gradio 5 稳定版,引入服务端渲染(SSR)实现近乎即时的浏览器加载,并支持基于 WebSockets 和 WebRTC 的低延迟流式传输。新版本更新了组件现代设计,内置 AI Playground 辅助生成应用,并增强了 Web 安全性。
推荐理由:Gradio 5 引入服务端渲染与低延迟流式传输,显著改善 ML 应用性能与实时交互体验。
OpenAI 与 Hearst Content 达成合作,将 Hearst 旗下标志性品牌的精选生活方式和本地新闻内容引入 OpenAI 的产品中。
Hugging Face 在 Transformers 4.45.0 中将动态推测解码设为默认操作模式,该方法通过动态调整草稿模型生成的 token 数量,相比静态或启发式方法最高实现 2.7 倍加速。用户无需修改代码即可直接受益,同时支持通过配置参数切换至启发式或静态模式。
推荐理由:动态推测解码已作为默认模式集成至 Transformers 4.45.0,无需修改代码即可实现最高 2.7 倍的推理加速。
Hugging Face 发布 Open FinLLM Leaderboard,填补金融领域大语言模型评估空白。该榜单涵盖信息提取、情感分析、信用风险评分等七大类别,采用零样本评估方法,通过准确率、F1 分数等指标衡量模型在真实金融场景中的表现。
OpenAI 推出 Canvas 功能,旨在为 ChatGPT 用户提供更新的写作与编码方式。
2024年中国AI企业加速海外扩张,华为、腾讯、阿里等巨头聚焦中东、东南亚及非洲的云计算与AI基础设施,字节跳动则深耕西方B2C市场。面对国内238个大语言模型引发的激烈价格战与盈利压力,MiniMax、01.AI等初创公司转向海外C端应用探索,Talkie和PopAI等产品已实现盈利。
OpenAI 宣布获得新融资,旨在扩大人工智能的益处。此举标志着公司在实现通用人工智能造福全人类使命方面取得进展。
OpenAI 宣布推出 Realtime API,允许开发者在应用中构建快速的语音到语音交互体验。
推荐理由:原文宣布推出实时语音 API,开发者可据此构建低延迟的语音交互应用。
OpenAI 宣布开发者现在可以使用图像和文本对 GPT-4o 进行微调,以增强模型的视觉能力。
推荐理由:GPT-4o 微调 API 新增图像输入支持,开发者可利用图文数据优化模型视觉能力。
OpenAI 在 API 中推出提示词缓存功能,为模型近期已看到的输入提供自动折扣。
OpenAI 在 API 中提供模型蒸馏功能,允许用户使用大型前沿模型的输出来微调更具成本效益的模型。该功能完全在 OpenAI 平台上运行,旨在帮助用户利用大模型的生成能力优化自身模型性能。
Altera 利用 GPT-4o 构建了一种新型的人类协作领域。该方案通过整合 GPT-4o 模型能力,探索智能体与人类协同工作的新模式,旨在优化人机交互流程并提升协作效率。
OpenAI 封禁了疑似属于 SweetSpecter 账户,该组织被追踪为中国关联的网络活动方。该组织利用 AI 研究漏洞、编写代码并支持鱼叉式网络钓鱼活动。
OpenAI 封禁了伊朗起源的 STORM-2035 账户,这些账户利用 AI 生成针对美国和英国选举的内容并跨平台发布。
OpenAI 封禁了疑似属于伊朗关联黑客组织 CyberAv3ngers 的账号。该组织利用 AI 研究工业控制系统、默认凭据及潜在目标。
BenCzechMark 是首个全面评估大语言模型捷克语能力的评测基准,涵盖 50 项任务和 9 个类别。该基准包含 90% 的原生非翻译内容,提供准确率、精确匹配、AUROC 和困惑度等指标。目前排行榜已收录 25 多个不同规模的开源模型。
OpenAI 封禁了利用 AI 起草针对越南公众人物和平台进行虐待性举报的账户。该行动旨在遏制滥用举报机制的行为,维护平台秩序。
OpenAI 封禁了名为“A2Z”的账号,这些账号利用 AI 生成关于选举、乌克兰及政治议题的多语言影响力内容。该行动旨在打击跨平台的多语言虚假信息传播活动。
OpenAI 封禁了使用 AI 生成批评俄罗斯反腐基金会及相关人物评论的账号。此举旨在限制利用人工智能工具进行特定政治或社会议题的自动化批评内容传播。
OpenAI 封禁了源自俄罗斯的“Stop News”账号,这些账号利用 AI 生成多语言文章和帖子,旨在针对乌克兰及西方国家。该行动旨在遏制由 AI 驱动的影响力活动。
OpenAI 封禁了一个可能源自美国的账号,该账号利用 AI 生成了伪造的 ChatGPT 错误提示,声称检测到“俄罗斯水军”活动。
OpenAI 禁止了卢旺达起源的账号使用 AI 生成党派评论。此举旨在防止在卢旺达选举前夕出现由人工智能生成的政治评论网络。
OpenAI 封禁了与伊朗关联的 STORM-0817 账户。这些账户利用 AI 技术调试 Android 恶意软件、抓取社交平台数据并翻译工具。此举旨在遏制利用人工智能进行的恶意网络活动。
OpenAI 封禁了通过以色列初创公司访问其模型,在 X 上生成对话并发送博彩网站链接的账号。
Hugging Face 发布教程介绍如何将 InstantMesh 等生成的顶点着色网格转换为 UV 映射纹理网格。文章提供 InstantTexture 库的快速转换方法,并详细解析使用 xatlas 生成 UV 映射、重心插值填充纹理及去孔平滑的底层实现步骤。
推荐理由:提供从顶点着色网格到UV贴图纹理网格的转换代码与原理,适合3D生成后处理参考。
OpenAI 发布基于 GPT-4o 的新模型,用于升级 Moderation API。该模型在检测有害文本和图像方面更准确,帮助开发者构建更稳健的审核系统。