基于Python+pyecharts 实现国内上映电影票房评分可视化分析项目源码

本文主要是介绍基于Python+pyecharts 实现国内上映电影票房评分可视化分析项目源码,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

基于Python+pyecharts 实现国内上映电影票房评分可视化分析项目源码

项目内容

统计2018年在国内上映的所有电影,分别获取上映电影的票房、评分(豆瓣、猫眼、时光、imdb)、类型、上映日期、演员、导演等数据。利用所获数据绘图,对国内上映电影进行定量分析

项目思路
  1. 通过 中国票房网 获得2018年大陆上映电影和每部电影票房数据
  2. 根据已有的票房数据,通过豆瓣 api 和详细页面,获得每部电影的导演,演员和豆瓣评分等详细数据
  3. 分别通过 猫眼、时光网 和 imdb,获取这三个网站的电影评分数据
  4. 新建影人条目,利用豆瓣获得的影人数据,对2018年每个演员年参演电影进行统计
  5. 根据已有数据作图,分析2018年电影票房排名、不同网站评分差异、电影票房-评分关系等
运行环境
  • Python 3.6
  • linux/windows
  • jupyter notebook
运行依赖包
  • requests
  • bs4
  • pymongo
  • numpy
  • pyecharts
文件说明
  • movies_data 文件夹: 包括了所有获取数据所需的 .py 文件

    • step0_chinamovies.py:获取中国票房网2018年所有国内上映电影及票房
    • step1_doubanmovies.py:根据中国票房网得到的电影数据,从豆瓣 api 接口中获得更详细的数据并存入数据库
    • step1_doubanmovies_supplement.py:用来寻找在 step1_doubanmovies.py 中由于名称原因没有找到的电影
    • step2_moviedetail.py:获得每部电影在不同网站的评分、演职人员等详细信息
    • step3_celebrity.py:计算每个影人(导演)2018年参(导)演电影的票房总和
  • movie_draws 文件夹

    • movie_pyecharts.ipynb
      • 为了更加直观的进行展示,数据分析和绘图的代码写在了 jupyter notebook 里面
      • 采用 pyecharts 绘图,包括“电影评分-票房”等八张图
    • 包括了HTML格式的所有 movie_pyecharts.ipynb 绘制图
  • output_data 文件夹

    • data_output.py: 从数据库导出电影和影人数据的 .py 文件
    • movie_data.csv: 抓取的2018年所有电影条目,共 522 部
    • cast_data.csv: 每个影人2018年参演电影及电影票房总和排名,共 4723 影人
一些技术细节
  • 由于要更改数据库,所有获取数据并保存数据库的操作都写成了函数形式,执行函数的代码加了注释,可根据自身需要去掉注释运行代码
  • 数据保存:数据采用mongodb保存,使用时需要安装 pymongo 第三方库
    • 连接到数据表
      client = pymongo.MongoClient()
      db = client.chinamovies # 连接到数据库
      collections = db.movies # 数据表 movies
      collections_detail = db.moviesdetail # 豆瓣数据都放入了数据表 moviesdetail 中
      
    • 写入多条数据
      collections.insert_many(data['pData'])
    • 写入一条数据
      collections_detail.insert_one(datadetail)
    • 更新数据
      # 更新数据到数据库中
      collections_detail.update({'_id': i['_id']}, {'$set': {'猫眼':{'title': movie['nm'], 'rank': movie['sc'],'id': movie['id'], 'pubDesc': movie['pubDesc']
      }}})
      
  • 数据验证
    • 本项目中,由于涉及多个网站的电影数据,因此会发生 网站A 电影上映日期或名称与 网站B 不同的情况。本项目中,电影上映日期和名称均以豆瓣网为准。利用 网站A 的电影名在 网站B 中进行搜索时,必须要保证电影名和上映年份完全一致,对于电影名不符合的电影,需要进行二次的人工判断
    • 例:
      # 必须要名称一致且2018年大陆上映才符合要求
      if movie['nm'] == i['title'] and re.findall(r'2018.*大陆上映', movie['pubDesc']):... # 符合要求
      
  • 绘图:利用 pyecharts 绘图,pyecharts 使用可见官方文档:http://pyecharts.org/
所有图表
  1. 在这里插入图片描述

  2. 在这里插入图片描述

  3. 在这里插入图片描述

  4. 在这里插入图片描述

  5. 在这里插入图片描述

  6. 在这里插入图片描述

  7. 在这里插入图片描述

  8. 在这里插入图片描述

  9. 在这里插入图片描述

完整项目代码下载地址:基于Python+pyecharts 实现国内上映电影票房评分可视化分析

这篇关于基于Python+pyecharts 实现国内上映电影票房评分可视化分析项目源码的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/302233

相关文章

C++中unordered_set哈希集合的实现

《C++中unordered_set哈希集合的实现》std::unordered_set是C++标准库中的无序关联容器,基于哈希表实现,具有元素唯一性和无序性特点,本文就来详细的介绍一下unorder... 目录一、概述二、头文件与命名空间三、常用方法与示例1. 构造与析构2. 迭代器与遍历3. 容量相关4

C++中悬垂引用(Dangling Reference) 的实现

《C++中悬垂引用(DanglingReference)的实现》C++中的悬垂引用指引用绑定的对象被销毁后引用仍存在的情况,会导致访问无效内存,下面就来详细的介绍一下产生的原因以及如何避免,感兴趣... 目录悬垂引用的产生原因1. 引用绑定到局部变量,变量超出作用域后销毁2. 引用绑定到动态分配的对象,对象

SpringBoot基于注解实现数据库字段回填的完整方案

《SpringBoot基于注解实现数据库字段回填的完整方案》这篇文章主要为大家详细介绍了SpringBoot如何基于注解实现数据库字段回填的相关方法,文中的示例代码讲解详细,感兴趣的小伙伴可以了解... 目录数据库表pom.XMLRelationFieldRelationFieldMapping基础的一些代

Java HashMap的底层实现原理深度解析

《JavaHashMap的底层实现原理深度解析》HashMap基于数组+链表+红黑树结构,通过哈希算法和扩容机制优化性能,负载因子与树化阈值平衡效率,是Java开发必备的高效数据结构,本文给大家介绍... 目录一、概述:HashMap的宏观结构二、核心数据结构解析1. 数组(桶数组)2. 链表节点(Node

Java AOP面向切面编程的概念和实现方式

《JavaAOP面向切面编程的概念和实现方式》AOP是面向切面编程,通过动态代理将横切关注点(如日志、事务)与核心业务逻辑分离,提升代码复用性和可维护性,本文给大家介绍JavaAOP面向切面编程的概... 目录一、AOP 是什么?二、AOP 的核心概念与实现方式核心概念实现方式三、Spring AOP 的关

Nginx分布式部署流程分析

《Nginx分布式部署流程分析》文章介绍Nginx在分布式部署中的反向代理和负载均衡作用,用于分发请求、减轻服务器压力及解决session共享问题,涵盖配置方法、策略及Java项目应用,并提及分布式事... 目录分布式部署NginxJava中的代理代理分为正向代理和反向代理正向代理反向代理Nginx应用场景

vite搭建vue3项目的搭建步骤

《vite搭建vue3项目的搭建步骤》本文主要介绍了vite搭建vue3项目的搭建步骤,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学... 目录1.确保Nodejs环境2.使用vite-cli工具3.进入项目安装依赖1.确保Nodejs环境

Python版本信息获取方法详解与实战

《Python版本信息获取方法详解与实战》在Python开发中,获取Python版本号是调试、兼容性检查和版本控制的重要基础操作,本文详细介绍了如何使用sys和platform模块获取Python的主... 目录1. python版本号获取基础2. 使用sys模块获取版本信息2.1 sys模块概述2.1.1

一文详解Python如何开发游戏

《一文详解Python如何开发游戏》Python是一种非常流行的编程语言,也可以用来开发游戏模组,:本文主要介绍Python如何开发游戏的相关资料,文中通过代码介绍的非常详细,需要的朋友可以参考下... 目录一、python简介二、Python 开发 2D 游戏的优劣势优势缺点三、Python 开发 3D

Python函数作用域与闭包举例深度解析

《Python函数作用域与闭包举例深度解析》Python函数的作用域规则和闭包是编程中的关键概念,它们决定了变量的访问和生命周期,:本文主要介绍Python函数作用域与闭包的相关资料,文中通过代码... 目录1. 基础作用域访问示例1:访问全局变量示例2:访问外层函数变量2. 闭包基础示例3:简单闭包示例4