API 中的模型蒸馏
OpenAI 在 API 中提供模型蒸馏功能,允许用户使用大型前沿模型的输出来微调更具成本效益的模型。该功能完全在 OpenAI 平台上运行,旨在帮助用户利用大模型的生成能力优化自身模型性能。
OpenAI 在 API 中提供模型蒸馏功能,允许用户使用大型前沿模型的输出来微调更具成本效益的模型。该功能完全在 OpenAI 平台上运行,旨在帮助用户利用大模型的生成能力优化自身模型性能。
Altera 利用 GPT-4o 构建了一种新型的人类协作领域。该方案通过整合 GPT-4o 模型能力,探索智能体与人类协同工作的新模式,旨在优化人机交互流程并提升协作效率。
OpenAI 封禁了疑似属于 SweetSpecter 账户,该组织被追踪为中国关联的网络活动方。该组织利用 AI 研究漏洞、编写代码并支持鱼叉式网络钓鱼活动。
OpenAI 封禁了伊朗起源的 STORM-2035 账户,这些账户利用 AI 生成针对美国和英国选举的内容并跨平台发布。
OpenAI 封禁了疑似属于伊朗关联黑客组织 CyberAv3ngers 的账号。该组织利用 AI 研究工业控制系统、默认凭据及潜在目标。
BenCzechMark 是首个全面评估大语言模型捷克语能力的评测基准,涵盖 50 项任务和 9 个类别。该基准包含 90% 的原生非翻译内容,提供准确率、精确匹配、AUROC 和困惑度等指标。目前排行榜已收录 25 多个不同规模的开源模型。
OpenAI 封禁了利用 AI 起草针对越南公众人物和平台进行虐待性举报的账户。该行动旨在遏制滥用举报机制的行为,维护平台秩序。
OpenAI 封禁了名为“A2Z”的账号,这些账号利用 AI 生成关于选举、乌克兰及政治议题的多语言影响力内容。该行动旨在打击跨平台的多语言虚假信息传播活动。
OpenAI 封禁了使用 AI 生成批评俄罗斯反腐基金会及相关人物评论的账号。此举旨在限制利用人工智能工具进行特定政治或社会议题的自动化批评内容传播。
OpenAI 封禁了源自俄罗斯的“Stop News”账号,这些账号利用 AI 生成多语言文章和帖子,旨在针对乌克兰及西方国家。该行动旨在遏制由 AI 驱动的影响力活动。
OpenAI 封禁了一个可能源自美国的账号,该账号利用 AI 生成了伪造的 ChatGPT 错误提示,声称检测到“俄罗斯水军”活动。
OpenAI 禁止了卢旺达起源的账号使用 AI 生成党派评论。此举旨在防止在卢旺达选举前夕出现由人工智能生成的政治评论网络。
OpenAI 封禁了与伊朗关联的 STORM-0817 账户。这些账户利用 AI 技术调试 Android 恶意软件、抓取社交平台数据并翻译工具。此举旨在遏制利用人工智能进行的恶意网络活动。
OpenAI 封禁了通过以色列初创公司访问其模型,在 X 上生成对话并发送博彩网站链接的账号。
Hugging Face 发布教程介绍如何将 InstantMesh 等生成的顶点着色网格转换为 UV 映射纹理网格。文章提供 InstantTexture 库的快速转换方法,并详细解析使用 xatlas 生成 UV 映射、重心插值填充纹理及去孔平滑的底层实现步骤。
推荐理由:提供从顶点着色网格到UV贴图纹理网格的转换代码与原理,适合3D生成后处理参考。
OpenAI 发布基于 GPT-4o 的新模型,用于升级 Moderation API。该模型在检测有害文本和图像方面更准确,帮助开发者构建更稳健的审核系统。
明尼苏达州企业翻译办公室利用 ChatGPT 解决多语言沟通障碍,有效弥合了不同语言群体间的沟通鸿沟。该举措旨在通过 AI 技术提升公共服务效率,确保非英语母语者能够更便捷地获取政府资源与信息。
OpenAI 与 GEDI 宣布达成战略合作,旨在将意大利语新闻内容引入 ChatGPT。此举标志着 OpenAI 在拓展多语言新闻数据源方面迈出重要一步,有助于提升 ChatGPT 在意大利语语境下的信息获取能力与内容丰富度。
Hugging Face 发布 Llama 3.2,包含 11B 和 90B 视觉模型及 1B 和 3B 端侧文本模型。视觉模型支持 128k 上下文与链式推理,端侧模型支持工具调用与离线运行。欧盟用户被限制使用多模态模型。
推荐理由:Meta 发布多模态与端侧模型,提供从消费级到生产级的部署方案与基准数据。
Mercado Libre 推出 AI 开发平台 Verdi,该平台由 GPT-4o 驱动。
Hugging Face 推出 Daily Papers 页面,已收录超 3,700 篇论文并拥有超 12k 订阅者。作者可一键认领论文以关联账号,用户可通过评论 @username 与作者实时互动,并在评论区输入 @librarian-bot 获取相关论文推荐。页面支持多语言评论及内置翻译,并集成 arXiv 扩展功能以快速跳转至 Hugging Face 论文页或 Spaces 演示。
Hugging Face 发布 FineVideo 数据集,包含 4.3 万个视频、3.4k 小时时长及丰富的结构化标注。文章详细披露了从 YouTube-Commons 中筛选动态内容、构建分类法,以及利用 Gemini 1.5 Pro 和 GPT4o 进行时间级语义标注的完整技术管线。
推荐理由:文章详细披露了构建4.3万小时高质量视频数据集的过滤与标注管线,为多模态模型训练提供了可复用的工程方法。
Hugging Face 发布教程,介绍如何利用 Optimum-Intel 和 OpenVINO GenAI 将 Transformers 模型部署到边缘设备。内容涵盖环境配置、模型导出为 OpenVINO IR、基于 NNCF 的 INT4 量化优化,以及通过 LLMPipeline 在 Python 和 C++ 中进行推理部署的具体代码示例。
制药公司 Genmab 正式采用 ChatGPT Enterprise,以利用 OpenAI 在安全和隐私方面的承诺。此举标志着 Genmab 将企业级 AI 工具整合至其工作流程中,旨在通过受控的 AI 环境提升运营效率并保障数据合规性。
Hugging Face 发布基于 BitNet 架构的 LLaMA3 8B 1.58bit 模型,公开了通过动态 Lambda 调度实现微调的技术细节与 Triton 自定义内核,模型在 MMLU 等基准上表现优异。
推荐理由:文章公开了将LLaMA3微调至1.58bit的量化方法与代码,为降低大模型推理成本提供了可复用的工程方案。
OpenAI 发布 GPT-4 在巴西教育领域的应用案例,展示如何利用该模型改善教学与学习过程。
Mistral AI 发布 Mistral Small v24.09 模型,下调全线模型 API 价格,并推出 la Plateforme 免费层。le Chat 免费开放 Pixtral 12B 视觉能力,支持任意尺寸图片理解。
推荐理由:官方同步更新模型定价与发布新模型,提供了免费层与Apache 2.0授权,便于评估成本与部署方案。
Mistral 发布 Pixtral 12B 多模态模型,采用 400M 视觉编码器与 12B 解码器,支持 128K 长上下文及可变图像尺寸。该模型在 MMMU 推理基准上达到 52.5%,支持图表理解、文档问答及多图像处理,以 Apache 2.0 协议开源。
推荐理由:Pixtral 12B 提供原生多模态与 128K 长上下文,兼顾文本与图像能力,适合本地部署与 API 集成。
Hugging Face 推出数据集 SQL Console 功能,允许用户直接在浏览器中运行 SQL 查询、过滤和发现数据集。该功能基于 DuckDB WASM 引擎,无需后端依赖,支持导出 Parquet 格式结果,并内置了数据格式转换等实用示例。
推荐理由:基于浏览器端 DuckDB WASM 实现零依赖查询,提供数据探索与格式转换的便捷入口。
OpenAI 发布关于其安全与安保实践的更新。该更新旨在向公众通报公司在保障模型安全及系统防护方面的最新进展与具体措施。
HuggingChat 发布社区工具功能,允许用户将 Hugging Face 上的公开 Space 直接转化为模型可调用的工具。该功能扩展了多模态支持,涵盖图像理解、视频生成及语音合成,并支持用户创建自定义工具或基于私有文档构建 RAG 工具。
推荐理由:HuggingChat 开放将社区 Space 转为工具的功能,支持多模态交互与自定义 RAG,丰富了现有工作流。
Hugging Face 发布 Accelerate 1.0.0 首个候选版,新增 FP8 训练、torch.compile 及多模型 DeepSpeed 支持。该版本稳定了核心 API,并提供了详细的弃用项与迁移指南。
OpenAI 发布 o1 模型。
OpenAI 发布 o1-mini 模型,旨在推进成本高效的推理能力。
OpenAI 发布 o1 贡献相关内容。
OpenAI o1 在编程决策中采用更具人类特征的方式。Cognition 首席执行官兼联合创始人 Scott Wu 对此进行了详细解析,阐述了该模型在代码生成与逻辑判断上的独特机制。
遗传学家 Catherine Brownstein 演示了如何利用 OpenAI o1 加速罕见医疗挑战的诊断过程。该案例展示了大语言模型在专业医疗领域的应用潜力,通过自动化分析提升诊断效率。
量子物理学家 Mario Krenn 使用 OpenAI o1 辅助回答生活中的重大科学问题。该模型被应用于量子物理领域的研究,帮助探索相关领域的核心疑问。
经济学家 Tyler Cowen 解析 OpenAI o1 处理复杂经济学问题的方式。该模型通过结合经济学理论与推理能力,应对高难度的专业领域挑战。
Ada 利用 GPT-4 技术树立了全新的客户服务标准。该方案通过集成前沿的大语言模型能力,旨在提升服务效率与质量,为行业提供了新的实践参考。