Microsoft Research· Chad Atalla, Jennifer Neville·· 2 天前AI 评分31
微软研究播客:AI 的失败与评估
What AI gets wrong and what failure teaches us
AI 导读
微软研究播客对话 Jennifer Neville,探讨评估在推动 AI 系统性能边界中的作用,以及模型在传统基准测试之外出现的“意外失败”。Neville 分享了与当前 AI 系统协作的实用指导,并强调当结果违背预期时仔细审视数据的重要性。
来源:Microsoft Research · microsoft.com