news 2026/8/26 17:22:17

Large Language Models are Highly Aligned with Human Ratings of Emotional Stimuli

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Large Language Models are Highly Aligned with Human Ratings of Emotional Stimuli

文章总结与翻译

一、主要内容

该研究聚焦大型语言模型(LLMs)与人类对情绪刺激评分的一致性,旨在明确LLMs对情绪刺激的解读方式,为其在需情绪智力的场景(如助手、治疗师、教师)应用提供依据。

1. 研究背景

  • 情绪对人类行为和认知影响重大,是心理学研究百年重点,而当前对人工智能如何理解、解读情绪刺激的认知不足。
  • 心理学界对情绪组织框架存在争议:一种认为是快乐、愤怒、悲伤、恐惧、厌恶五类离散情绪(Ekman,1992;Izard,1992),另一种认为是唤醒度和效价两个维度(Russell,1980),需探究LLMs的情绪处理是否与人类类似及是否采用类似人类心理学的情绪理解框架。

2. 研究方法

  • 数据来源:采用多个公开数据集,包括OASIS、NAPS等图像数据集和ANEW等单词数据集,这些数据集均由大量人类对情绪特质(唤醒度、效价,ANEW还包含五类情绪)进行过评分。
  • 模型选择:选取GPT-4o、GPT-4omini、Gemma2-9B、Llama3-8B、Solar 10.7B等主流高性能LLMs。
  • 实验过程:模拟各原始研究范式让LLMs进行评分,每个评分范式和数据集设置20个LLM“参与者”(初始化后完成完整试验),温度参数设为1.0,剔除触发模型内容过滤器的项目后,在项目层面将各LLM组与人类组(各情绪评分量表下每个项目的参与者均值和标准差)进行比较。

3. 研

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/26 17:21:44

GTool: Graph Enhanced Tool Planning with Large Language Model

GTool:基于图增强的大语言模型工具规划方法(文章总结与翻译) 一、文章主要内容总结 1. 研究背景与问题 当前大语言模型(LLMs)在自然语言处理任务中表现突出,但在数值计算、复杂问题求解等场景中依赖外部工具(如API、算法)。工具规划作为LLMs与工具交互的核心能力,需…

作者头像 李华
网站建设 2026/8/26 17:12:36

人工智能+软件”新范式:从卖工具到卖成果的商业模式革命

# “人工智能软件”新范式:从卖工具到卖成果的商业模式革命2026年6月,国家工业信息安全发展研究中心在第四届软件创新发展大会上发布《“人工智能软件”发展洞察》报告,明确提出一个关键判断:**AI时代软件价值的底层逻辑正在发生根…

作者头像 李华
网站建设 2026/8/26 17:10:17

AI生成的减肥计划,到底能不能相信?专家分析

社交平台之上, 众多的网友纷纷分享, 由AI大模型所生成的减肥计划, 网络截图。近段时间, AI减肥变得相当流行, 把自己当下的体重以及目标体重输入到AI大模型, 大模型会生成减肥的计划, 含括食谱、运动方案等内容, 用户依照去做就行。在社交平台之上, 有不少网友, 去分享自身的 A…

作者头像 李华
网站建设 2026/8/26 17:07:58

DeepSeek LeetCode LCP 53. 守护太空城 Java实现

实现这道题的核心思路是利用状态压缩动态规划。因为 time[i] 最大只有 5,所以可以用一个 5 位的二进制数来表示某个舱室在 5 个时刻的屏障开启情况。问题的难点在于处理相邻舱室的联合屏障,我们可以通过枚举上一个舱室在哪些时刻开启了联合屏障来解决。以…

作者头像 李华
网站建设 2026/8/26 17:04:56

所见即所得前端开发,Codex 内置浏览器让改图更直观

告别切屏焦虑:Codex 内置浏览器重塑前端工作流 对于前端开发者而言,最打断心流的瞬间往往不是逻辑复杂,而是频繁的上下文切换。传统开发模式下,我们像是在走钢丝:左边是代码编辑器,右边是浏览器预览窗口。改…

作者头像 李华