LIST | 社科(经管)数据挖掘文献资料汇总

如何从网络世界中高效地采集数据?是否能从文本中挖掘出人类的偏见等认知信息?如何从杂乱的文本数据中抽取文本信息(变量)?本文汇总的列表将让你对文本、对Python文本分析个全面的了解...

2024-04-15 · 2 min · 大邓

LIST| 文本分析代码资料汇总

如何使用Python从网络中爬取数据,如何从文本数据中抽取信息。本文汇总了常见的python代码案例,方便大家快速学习...

2024-04-15 · 3 min · 大邓

教程 | 使用大模型将文本数据转化为结构化数据

实验数据为外卖评论, 今天咱们做个有难度的文本分析任务,从不同维度(味道、速度、服务)对外卖评论进行打分(-1.0~1.0)文本分析(也称为文本挖掘或自然语言处理,NLP)是指使用计算机算法和技术从大量文本数据中提取有价值信息的过程。文本分析的目标是从非结构化的文本数据中识别模式、提取关键信息、理解语义,并将其转化为结构化数据以便进一步分析和应用。...

2025-02-14 · 4 min · 大邓

PNAS | GPT 是多语言心理文本分析的有效工具

许多领域(包括心理学、社会学、通信、政治学和计算机科学)都使用计算方法来分析文本数据。但是,现有的文本分析方法存在许多缺点。字典方法虽然易于使用,但与最近的方法相比通常不是很准确。机器学习模型虽然更准确,但可能难以训练和使用。我们证明,大型语言模型 GPT 能够使用简单的提示准确检测 12 种语言文本中的各种心理结构(由手动注释者判断),无需额外的训练数据。因此,GPT 克服了现有方法中存在的局限性。GPT 在几种较少使用的语言中也很有效,这可以促进来自研究不足的环境中的文本分析研究。...

2025-02-17 · 1 min · 大邓

实验 | 使用本地大模型预测在线评论情感类别和分值

情感分析是分析文本以确定消息的情绪基调是积极、消极还是中性的过程。通过情感分析,我们可以了解文本是否表现出快乐、悲伤、愤怒等情绪。主要的计算方法有语义词典法、机器学习法、混合方法、其他方法。 随着chatGPT这类大语言模型的出现, 它们增强了文本理解能力,使我们能够更精准的把握文本中的语义和情绪,也因此大型语言模型 (LLM) 一出场就有实现情感分析功能。Sentiment analysis is the process of analyzing text to determine whether the emotional tone of a message is positive, negative, or neutral. Through sentiment analysis, we can understand whether the text expresses emotions such as happiness, sadness, anger, etc. The main computational methods are semantic dictionary method, machine learning method, hybrid method, and other methods. With the emergence of large language models such as chatGPT, they enhance text understanding capabilities, allowing us to more accurately grasp the semantics and emotions in the text. Therefore, large language models (LLMs) have implemented sentiment analysis functions as soon as they appeared....

2025-02-07 · 4 min · 大邓