news 2026/9/28 3:32:39

Leveraging Large Language Models for Classifying App Users‘ Feedback

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Leveraging Large Language Models for Classifying App Users‘ Feedback

文章主要内容总结

本文聚焦于利用大型语言模型(LLMs)解决应用用户反馈分类的挑战,传统方法依赖有监督机器学习,但受限于标注数据集的规模和质量。研究通过三个核心实验评估了4种先进LLMs(GPT-3.5-Turbo、GPT-4o、Flan-T5、Llama3-70b)的性能:

  1. LLMs在用户反馈分类中的基础能力:在零样本设置下,LLMs对不同来源(应用商店、X平台、论坛)和分类方案的用户反馈进行分类,结果显示其在粗粒度分类(如“bug报告”“功能请求”“其他”)中表现较好,但细粒度分类效果不佳。
  2. 粗粒度分类方案的影响:将数据集统一为“bug报告”“功能请求”“其他”的粗粒度方案后,LLMs的分类准确性显著提升,尤其在应用商店数据集上;但X平台和论坛数据的表现仍不理想。
  3. LLMs用于数据集增强:利用多个LLMs的共识标注数据,增强人工标注的训练集,发现这能有效提升基于Transformer的分类器(如DistilBERT)的性能,且通用数据与特定应用数据的增强效果差异不显著。

文章创新点

  1. 全面评估LLMs在用户反馈分类中的适用性:首次系统对比了4种LLMs在8个不同来源(应用商店、社交平台、论坛)和分类方案(细粒度、粗粒度)下的表现,揭示了分类方案粒度对LLMs性能的关键影响。
  2. 提出基于LLMs共识的数据集增强方法:证明通过多个LLMs的共识标注数据增强训练集,可有效解决标
版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/28 3:31:52

USB接口ESD防护整改全解析:从TVS选型到PCB布局的完整实战复盘

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华