大数据告诉你,经典电影哪家强_数据分析师
听说过这句话吗:一千个影迷心中,就有一千个哈利波特。
一部电影好不好看,这绝对是能让两个老朋友打起来的话题。这位只看特效闪瞎眼的科幻片,那位独爱温情脉脉的文艺片,这位推崇意象塞满屏幕的魔幻现实风格,那位偏好严谨精妙的悬疑推理剧情。青菜萝卜,各有所好,哪部电影更经典,一时间,谁也说不服谁。
打一架决定谁说的对?且慢动手,咱们来听互联网电影大数据的……什么?电影大数据是个啥?
这就要从互联网电影数据库(Internet Movie Database, 简称IMDb)说起了。这个数据库,是亚马逊网络电子商务公司旗下的一个网站,在这里,你能找到几乎最详细的电影资料,从演员表、票房收入到剧情梗概、幕后花絮,可谓是应有尽有。
其中最要紧的一项,就是由网友们提交的电影之间的“联系”。这些联系包括“参考”、“恶搞”、“放映”、“续作”等等。也可以说,这种联系,是新拍的电影,对老电影的“引用”,俗称“向经典致敬”。
这样致敬的例子太多啦,最近很火的电影《一步之遥》里,姜文坐在百叶窗前,黑西装的领子上别着一枚红玫瑰,怀里还抱着一只兔子。眼尖的观众立刻就看出来啦,这不是经典美国电影《教父》里的场景吗,一样的布景和镜头景别,一样的服装和光线,甚至还有一样位置的玫瑰花。
哦,有一点儿不同,马龙·白兰度怀里抱着的是只猫。
甭管抱的是什么,这就是向经典致敬了。《教父》被致敬的次数,已经排到了电影史上的第八位。这部1972年的名作,自入选以来,已经被长间隔引用了162次。排名第一的影片《绿野仙踪》于1939年上映,其长间隔引用数据是565次,把第二名《星球大战》系列甩出了200多次,后者的数据是297次。
上文说到的长间隔引用次数,正是芝加哥西北大学复杂系统研究院联席主任路易斯·阿马拉尔教授所认为的评价电影重要与否的最佳指标。
路易斯·阿马拉尔教授率领的科学团队,已经为电影衡量标准这事儿奋斗了很久。在他们看来,票房、专家点评、获奖与否、观众口碑,统统做不得准——票房可以靠宣传和排期,专家和观众的看法都有主观喜好因素,甚至会“带有偏见”,评奖的猫腻就更多了——除了冰冷又可爱的大数据,还有什么标准能更显得科学呢。
为了分析电影的影响力,研究团队选择借助互联网电影数据库的引用功能:一个是计算电影被搜索引擎超链接的次数,另一个是计算电影在上映后,25年以上的时间跨度中,被其他电影引用的次数,也就是长间隔引用次数。
25年这个阈值,是研究团队通过观察经验分布和零模型对比发现的。低于这个年限的电影被引用,还很有可能是受潮流影响,只有真正的好片儿,才受得住时间的考验。
事实上,在预测电影的重要性方面,数据科学也的确要比影评人更客观。阿马拉尔教授带着他的“长间隔引用次数”,一出手就能镇住一片。在海量计算之后,研究团队给出的“最具影响力”的电影榜单里,上榜影片入选美国国家影片登记表的,比其他各种专家的影评意见都靠谱。看来,大数据不但能预测商业行为,还能帮你列一份必看电影名单,只不过等待的时间有点久,要花足足25年。
不过,人到底是主观的动物。我猜想,对那些骨灰级影迷而言,任你大数据再科学、再准确,真到了讨论电影好不好看的时候,两个老朋友仍然能打起来。比如我,就是喜欢《星球大战》甚于《绿野仙踪》,无论大数据怎么显示,对我来说,排名第二的这部片子,还是比第一名的重要。
还是那句话,一千个影迷心中,永远有一千个哈利波特!
数据分析咨询请扫描二维码
《Python数据分析极简入门》 第2节 2 Pandas数据类型 Pandas 有两种自己独有的基本数据结构。需要注意的是,它固然有着两种数据 ...
2024-11-01《Python数据分析极简入门》 第2节 1 Pandas简介 说好开始学Python,怎么到了Pandas? 前面说过,既然定义为极简入门,我们只抓 ...
2024-10-31在当今数据驱动的世界中,数据科学与工程专业的重要性愈发凸显。无论是推动技术进步,还是在商业决策中提供精准分析,这一专业都 ...
2024-10-30在当今信息爆炸的时代,数据已成为企业决策和战略制定的核心资源。爬虫工程师因此成为数据获取和挖掘的关键角色。本文将详细介绍 ...
2024-10-30在当今数据驱动的世界中,数据分析是揭示商业洞察和推动决策的核心力量。选择合适的数据分析工具对于数据专业人士而言至关重要。 ...
2024-10-30能源企业在全球经济和环境保护双重压力下,正面临前所未有的挑战与机遇。数字化转型作为应对这些挑战的关键手段,正在深刻变革传 ...
2024-10-30近年来,随着数据科学的逐步发展,Python语言的使用率也越来越高,不仅可以做数据处理,网页开发,更是数据科学、机器学习、深度 ...
2024-10-30大数据分析师证书 针对不同知识,掌握程度的要求分为【领会】、【熟知】、【应用】三个级别,考生应按照不同知识要求进行学习。 ...
2024-10-30《Python数据分析极简入门》 附:Anaconda安装教程 注:分Windows系统下安装和MacOS系统安装 1. Windows系统下安装 第一步清华大 ...
2024-10-29拥抱数据分析的世界 - 成为一名数据分析工程师是一个充满挑战和机遇的职业选择。要成功地进入这个领域,你需要掌握一系列关键技 ...
2024-10-28降本增效:管理战略的关键 企业管理中的降本增效不仅是一项重要的战略举措,更是激发竞争力、提高盈利能力的关键。这一理念在当 ...
2024-10-28企业数字化是指利用数字技术和信息化手段,对企业的各个方面进行改造和优化,以提升生产效率、服务质量和市场竞争力的过程。实现 ...
2024-10-28数据科学专业毕业后,毕业生可以选择从事多种不同的岗位和领域。数据科学是一个快速发展且广泛应用的领域,毕业生在企业、学术界 ...
2024-10-28学习数据科学与大数据技术是当今职业发展中至关重要的一环。从基础到高级,以下是一些建议的课程路径: 基础课程: Python编程 ...
2024-10-28在信息技术和数据科学领域,数据架构师扮演着至关重要的角色。他们负责设计和管理企业中复杂的数据基础设施,以支持数据驱动的决 ...
2024-10-28进入21世纪以来,随着信息技术的迅猛发展,大数据已经成为全球最具影响力的技术之一,并成为企业数字化转型的核心驱动力。大数据 ...
2024-10-28随着科技的迅猛发展,数字化转型已成为现代企业保持竞争力和推动增长的关键战略之一。数字化不仅仅是技术的应用,它代表着一种全 ...
2024-10-28银行业正处于一个前所未有的数字化转型时期。在数字经济的驱动下,金融科技如大数据、人工智能、生物识别、物联网和云计算等技术 ...
2024-10-28数据分析可视化是一门艺术与科学相结合的技术,其主要目标是将复杂的数据变得更易于理解和分析。通过将数据以图表的形式呈现,我 ...
2024-10-28数据分析师在现代信息密集型的商业世界中扮演着至关重要的角色。他们通过专业的技能和敏锐的商业洞察力,帮助企业从大量数据中提 ...
2024-10-28