Assessing the Quality of Personality Measures Generated by Large Language Models
待投稿 · PNAS
大语言模型能否以低成本、可扩展的方式,从学生书信中测量大五人格特质?这些测量能否
有效预测未来表现?我们把 LLM 当作多评分者框架中的一个额外“评分者”,证明 AI 评分
在教师、学生和家长报告之外仍保有独立的预测力。