Google Research·· 2026-03-05精选AI 评分65
Google Research:通过模仿贝叶斯模型训练大语言模型
Teaching LLMs to reason like Bayesians
AI 导读
Google Research 发表论文,提出通过监督微调让大语言模型模仿贝叶斯助手,从而学会概率推理。该方法使模型在航班推荐任务中显著优于基线,并能将学到的推理能力泛化至酒店推荐和网购等未见领域。
推荐理由
研究提出通过模仿贝叶斯模型进行监督微调,使大模型学会概率推理并跨领域泛化。
来源:Google Research · research.google