跳到正文
原文
Google Research·· 2026-03-05精选AI 评分65

Google Research:通过模仿贝叶斯模型训练大语言模型

Teaching LLMs to reason like Bayesians

AI 导读

Google Research 发表论文,提出通过监督微调让大语言模型模仿贝叶斯助手,从而学会概率推理。该方法使模型在航班推荐任务中显著优于基线,并能将学到的推理能力泛化至酒店推荐和网购等未见领域。

推荐理由

研究提出通过模仿贝叶斯模型进行监督微调,使大模型学会概率推理并跨领域泛化。

来源:Google Research · research.google