关于情感分析,你不得不知道的11件事
近来,关于情感分析的研究一直被大家所津津乐道,然而关于这项分析方法究竟有多大的实用性,则是众说纷纭。有人认为情感分析堪比打开人类市场研究新世界大门的钥匙,而另一些人则认为,这项技术只是骗人的万灵油,甚至与占卜无异。那么,究竟谁是对的呢?
相较而言,我(笔者)更倾向于站在前者的阵营中。基于文本分析,自动情感分析技术为基于李克特量表的传统分析方法(Likert-reliant methodologies)注入了新的动力,使得研究人员能通过社群倾听技术实时掌控客户反馈的倾向变化,并由此实现了对客户心声的深入挖掘。
对于后者的阵营,我认为他们对情感分析产生质疑的原因可能来自于对这种分析方法实现能力与局限性的认识扭曲。这样的认识扭曲也许是由于某些能力不足的解决方案供应商造成的,不过不管它们究竟来自何方,我都会倾力而为去揭穿它们,还原一个有真正实际意义的情感分析技术。
我们目标是鼓励适当的使用情感分析技术并防止滥用。为了做到这点,对市场教育的呼唤十分重要,我通过会议的形式做了很多这样的事,在今年7月15号到16号的纽约情感分析研讨会上,我特地点明了这样十一件情感分析研究者必须知道的事:
1)在情感分析中,通过直接匹配词典来查找词汇是一种简单明了的方法,也但略显粗俗。词的意思往往会根据句式、语境以及上下文之间的关联而发生变化,进行情感分析时我们需要将语言学与统计学的方法都应用到其中。
2)文档层面的情感分析或许正在面临过时。我们情感分析的目标应该关注于实体(entity)、概念(concept)以及主题(topic)的层面。(例如,一部iPhone6是一个实体,iPhone是一个概念范畴,而智能手机则是它所属的主题)
3)“情感”的一般语言定义包括态度(attitude)、意见(opinion)、感觉(feelings)和情绪(emotion)。最先进的情感分析技术可以让你超越正负面倾向得分的局限,根据情绪——如快乐、惊讶、恐惧、厌恶、愤怒、悲伤等对文本情感进行评价,而不是仅仅是一个表达程度的分数。
4)请将眼界放宽:情感分析是情感计算(Affective computing)大家族的一份子,这个家族涉及到了所有与人类情感相关、来自人类情感或是对人类情感产生影响的现象计算研究。情感分析与家族中的其他伙伴皆有所联系,但在技术和方法上有着较为明显的区别。
5)并非所有的情感都是平等的。不论是情感的倾向还是强度,我们都需要努力去理解。同时,研究情感如何转化为行动也具有同样重要的意义。
6)不论你是否在项目中使用了语言工程、统计模型与机器学习方法,在很多情况下,也许针对特定领域训练合适的模型,才是模型优化的关键。
7)必须注意那些有关于准确率的说法。对于模型的准确性,这世界上不存在绝对的衡量标准,因此在度量模型的准确性时,我们总会遇到各种各样的麻烦。正因如此,有的解决方案供应商们甚至可能在提出分析模型之后对模型准确性的测量过程避而不谈。一种公认可行的准确度测量方法是将模型结果与一份经过完全精准的人工注释/分类的语料进行对比,这也意味着我们需要让人工和机器同时去进行一项庞大的语料分析工作,再进行二者匹配程度的计算。但是当你真的去尝试这样的做法时,所谓人工一方作出的判断究竟是对是错,同样也很难说明清楚。与此同时,面向不同层面的文本分析软件之间也很难进行准确度的对比,例如有些软件只做了文档层面的分析,而另一些则能够对实体和概念进行了解析,我们能说在实体层面具有70%准确率的软件就优于在文档层面具有97%准确率的软件吗?
8)文本是最常见的情感数据来源,但它并不是唯一的一个。针对视频的面部编码技术,针对音频流的语音分析,都可以用于检测人类的情绪反应,而这些也都是更先进的情感状态评估方法。而有关人类情感分析下一个前沿领域也有可能是:神经科学、可穿戴仪器开发和生理学的其他研究手段。
9)语言是人类使用的最有活力和发展最快速的工具之一。计算机技术在社会中普及给了我们前所未有的语言表现能力,众所周知的表情符号(emoji)就是这一进程中的典型例子。表情符号不仅仅是人类语言的扩音器,它在发展过程中逐渐获得了自己的语法和特殊语义,从而自然而然地如潮水般涌入广大的网络社交媒体中。对于情感分析研究者来说,我们也应该紧跟时代发展的脚步,去针对各种新诞生的语言表达形式进行相关的挖掘与研究。
10)通过将行为表现与情感分析模型进行联系,或是根据人口与文化范畴对语料进行分类,能够帮助你提升分析与预测的能力。当你面对庞杂的大规模数据时,请毫不犹豫地运用这个方法。
11)一些先进的概念,如动机、影响、维护和催化,都是建立在对人类情感和行为进行建模以及社群网络分析的基础上的。在数据咨询行业,研究的最主要目标是对市场以及消费者进行解析,而这种解析的最终目标则是创造使消费者“行动起来”的条件。作为情感分析研究者,你需要面向上述概念开展你的工作。
好了,上面便是我个人(笔者)对情感分析这些事的理解,当你在开始设计下一项有关的调查研究时,或是当你不知道如何将社交媒体挖掘应用到你的研究中时,不妨考虑一下使用情感分析。多思考一些实际可行的情感算法也许会对你有所帮助,将它结合于行为分析或是其他先进的市场细分技术,可能会使你找到洞悉潜在客户行为的方法。总而言之,情感分析值得重视,它是绝对能够为你的市场研究带来一些令人眼前一亮的新东西的。
数据分析咨询请扫描二维码
《Python数据分析极简入门》 第2节 5 Pandas数学计算 importpandasaspdd=np.array([[81,&n ...
2024-11-23数据分析涉及多个方面的学习,包括理论知识和实践技能。以下是数据分析需要学习的主要方面: 基础知识: 数据分析的基本概念 ...
2024-11-22数据分析适合在多个单位工作,包括但不限于以下领域: 金融行业:金融行业对数据分析人才的需求非常大,数据分析师可以从事经 ...
2024-11-22数据分析是一种涉及从大量数据中提取有用信息和洞察力的过程。其工作内容主要包括以下几个方面: 数据收集与整理:数据分析师 ...
2024-11-22数据分析师需要掌握多种技能,以确保能够有效地处理和分析数据,并为业务决策提供支持。以下是数据分析师需要掌握的主要技能: ...
2024-11-22数据开发和数据分析是两个密切相关但又有所区别的领域。以下是它们的主要区别: 定义和目标: 数据开发:数据开发涉及数据的 ...
2024-11-22数据架构师是负责设计和管理企业数据架构的关键角色,其职责涵盖了多个方面,包括数据治理、数据模型设计、数据仓库构建、数据安 ...
2024-11-22数据分析师需要具备一系列技能,以确保能够有效地处理、分析和解释数据,从而支持决策制定。以下是数据分析师所需的关键技能: ...
2024-11-22数据分析师需要具备一系列技能,以确保能够有效地处理、分析和解释数据,从而支持决策制定。以下是数据分析师所需的关键技能: ...
2024-11-22数据分析师需要具备一系列的技能和能力,以确保能够有效地处理、分析和解释数据,从而支持业务决策。以下是数据分析师所需的主要 ...
2024-11-22需求持续增长 - 未来数据分析师需求将持续上升,企业对数据驱动决策的依赖加深。 - 预测到2025年,中国将需要高达220万的数据人 ...
2024-11-22《Python数据分析极简入门》 第2节 4 Pandas条件查询 在pandas中,可以使用条件筛选来选择满足特定条件的数据 importpanda ...
2024-11-22数据分析师的工作内容涉及多个方面,主要包括数据的收集、整理、分析和可视化,以支持商业决策和问题解决。以下是数据分析师的一 ...
2024-11-21数据分析师必须掌握的技能可以从多个方面进行归纳和总结。以下是数据分析师需要具备的主要技能: 统计学基础:数据分析师需要 ...
2024-11-21数据分析入门的难易程度因人而异,总体来看,入门并不算特别困难,但需要一定的学习和实践积累。 入门难度:数据分析入门相对 ...
2024-11-21数据分析是一项通过收集、整理和解释数据来发现有用信息的过程,它在现代社会中具有广泛的应用和重要性。数据分析能够帮助人们更 ...
2024-11-21数据分析行业正在迅速发展,随着技术的不断进步和数据量的爆炸式增长,企业对数据分析人才的需求也与日俱增。本文将探讨数据分析 ...
2024-11-21数据分析的常用方法包括多种技术,每种方法都有其特定的应用场景和优势。以下是几种常见的数据分析方法: 对比分析法:通过比 ...
2024-11-21企业数字化转型是指企业利用数字技术对其业务进行改造和升级,以实现提高效率、降低成本、创新业务模式等目标的过程。这一过程不 ...
2024-11-21数据分析作为一个备受追捧的职业领域,吸引着越来越多的女性加入其中。对于女生而言,在选择成为一名数据分析师时,行业选择至关 ...
2024-11-21