跳到正文
原文
Google Research·· 2026-04-03AI 评分46

Google Research 评估 LLM 行为倾向与人类的对齐程度

Evaluating alignment of behavioral dispositions in LLMs

AI 导读

Google Research 提出一套框架,用心理学问卷改写成情境判断测试(SJT),在真实用户-助手场景中评估 LLM 行为倾向与人类共识的对齐程度。对 25 个 LLM 的大规模分析发现两类差距:模型倾向偏离人类标注者共识,以及在无共识时无法覆盖人类意见分布。

来源:Google Research · research.google