TII 发布 Falcon ASR 语音识别模型,支持阿联酋方言
TII 发布 Falcon ASR 语音识别模型,参数量 1.6B,针对阿联酋方言优化并支持英语、法语、西班牙语和葡萄牙语。在公开基准上平均词错率(WER)为 20.92%,优于此前最佳结果,并提供在线 Demo 体验。
推荐理由:模型针对阿联酋方言优化并支持多语种,提供了可验证的基准成绩与在线体验入口。
TII 发布 Falcon ASR 语音识别模型,参数量 1.6B,针对阿联酋方言优化并支持英语、法语、西班牙语和葡萄牙语。在公开基准上平均词错率(WER)为 20.92%,优于此前最佳结果,并提供在线 Demo 体验。
推荐理由:模型针对阿联酋方言优化并支持多语种,提供了可验证的基准成绩与在线体验入口。
Hugging Face 发布 Nemotron 系列模型在 IOI 2026 和 IMO 2026 竞赛中获金牌的成绩。Nemotron-3-Ultra-CC 在 IOI 中得分 535.4/600,IMO 系统得分 30/42。官方开源了相关模型权重、训练数据集、推理代码及 NeMo-Skills 工具包。
推荐理由:原文给出了 Nemotron 在 IOI 和 IMO 的金牌成绩及微调方法,读者可据此复现顶尖编程与数学推理能力。
Google DeepMind 发布 EmbeddingGemma 2,这是一个基于 Gemma 4 架构的 7.4 亿参数多模态嵌入模型,原生支持文本、代码、图像、音频和视频的统一嵌入空间。
推荐理由:7.4亿参数原生多模态模型,支持端侧运行与向量截断,适合隐私优先的本地检索场景。
Reflection 发布 Beam,一款 501B 总参数 / 23B 激活参数的 MoE 代码模型,声称在 SWE-bench Verified 上得分 80.9,推理效率是 GLM 5.2 的 3–4 倍。该模型使用 23.8T 预训练 token 从头训练,全量权重将于本月以 Apache 2.0 协议开源。
Ai2 开源了 AstaBrief 8B 模型,该模型基于 Qwen3-8B 微调,专为快速生成带引用的科学文献综述报告而设计。在 Asta 平台中,该模型作为 Fast 模式上线,报告生成速度比原有的 Thinking 模式快约 3.5 倍,同时保持了相近的引用准确性和用户满意度。
推荐理由:开源了针对科学报告生成的轻量模型,提供了一整套数据筛选与评估方法,可迁移至其他垂直领域。
H company 发布 Holo4 系列通用智能体模型,包含 27B 密集版和 35B-A3B MoE 版,支持通过 GUI、代码、MCP 和 API 与软件交互。模型在 OSWorld 2.0 等基准测试中表现优异,权重已在 Hugging Face 开源,并提供 Holotron4 Nano 版本。
推荐理由:提供多接口通用智能体模型及开源权重,展示跨平台工作流能力与成本优势。
Mistral AI 宣布完成 30 亿欧元 D 轮融资,投后估值超 210 亿欧元,创下欧洲科技公司最大股权融资纪录。三星电子领投,资金将用于扩大算力、前沿研究及基础设施,以支持其主权 AI 战略。
推荐理由:融资规模刷新欧洲科技纪录,资金将用于扩大算力与前沿研究,强化其主权AI战略。
Thinking Machines 在 Hugging Face 开源 Inkling 1T参数多模态大模型及 Inkling-Small(276B/12B),原生支持图像、文本和音频输入,具备1M上下文窗口与智能体能力。模型提供BF16与NVFP4量化版本,支持SGLang、vLLM等推理引擎,并附带多项基准测试与部署配置。
推荐理由:提供了1T参数多模态模型及276B小模型的架构细节、量化部署方案与基准测试,便于评估其推理与多模态能力。
Hugging Face 发布 Agentic Resource Discovery (ARD) 规范的开源参考实现 Discover Tool,提供 CLI 和 REST API 供开发者搜索和调用 Agent 技能与 MCP 服务器。
推荐理由:Hugging Face 发布开源参考实现,将 Hub 搜索能力接入行业新标准,提供 CLI 和 API 供开发者调用。