数据可视化案例-基于NetworkX网络的美国飞机航线可视化

2024-03-22 21:50

本文主要是介绍数据可视化案例-基于NetworkX网络的美国飞机航线可视化,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

NetworkX网络数据可视化

我们选用美国飞机航线的数据集,包括起始机场、终点、飞行时间等
注:此处数据集下载地址为:

数据集下载地址

import pandas as pd
import numpy as np 
flights = pd.read_csv('./input/flights.csv') 
flights.shape
flights.columns
Out:(5819079, 31)Index(['YEAR', 'MONTH', 'DAY', 'DAY_OF_WEEK', 'AIRLINE', 'FLIGHT_NUMBER','TAIL_NUMBER', 'ORIGIN_AIRPORT', 'DESTINATION_AIRPORT', 'SCHEDULED_DEPARTURE', 'DEPARTURE_TIME', 'DEPARTURE_DELAY', 'TAXI_OUT','WHEELS_OFF', 'SCHEDULED_TIME', 'ELAPSED_TIME', 'AIR_TIME', 'DISTANCE','WHEELS_ON', 'TAXI_IN', 'SCHEDULED_ARRIVAL', 'ARRIVAL_TIME','ARRIVAL_DELAY', 'DIVERTED', 'CANCELLED', 'CANCELLATION_REASON','AIR_SYSTEM_DELAY', 'SECURITY_DELAY', 'AIRLINE_DELAY','LATE_AIRCRAFT_DELAY', 'WEATHER_DELAY'],dtype='object')
## 检测缺失值
flights.isnull().any() 
Out:YEAR                   FalseMONTH                  FalseDAY                    FalseDAY_OF_WEEK            FalseAIRLINE                FalseFLIGHT_NUMBER          FalseTAIL_NUMBER             TrueORIGIN_AIRPORT         FalseDESTINATION_AIRPORT    FalseSCHEDULED_DEPARTURE    FalseDEPARTURE_TIME          TrueDEPARTURE_DELAY         TrueTAXI_OUT                TrueWHEELS_OFF              TrueSCHEDULED_TIME          TrueELAPSED_TIME            TrueAIR_TIME                TrueDISTANCE               FalseWHEELS_ON               TrueTAXI_IN                 TrueSCHEDULED_ARRIVAL      FalseARRIVAL_TIME            TrueARRIVAL_DELAY           TrueDIVERTED               FalseCANCELLED              FalseCANCELLATION_REASON     TrueAIR_SYSTEM_DELAY        TrueSECURITY_DELAY          TrueAIRLINE_DELAY           TrueLATE_AIRCRAFT_DELAY     TrueWEATHER_DELAY           Truedtype: bool

比如我们想找出哪个机场是热门中转机场,或是我们想从机场A飞到机场B,如果没有直达航班,如何最优选择路线(因为数据集中没有给出费用,所以我们找到时间最短的路线)

那么我们只需要提取三列:起始机场(ORIGIN_AIRPORT),终点机场(DESTINATION_AIRPORT),飞行时间(AIR_TIME),数据集中还包括了字段"CANCELLED",反映了是否取消了航班,所以我们先删除已取消的航班。

flights1 = flights[flights['CANCELLED'] == 0]
flights2 = flights1[['ORIGIN_AIRPORT','DESTINATION_AIRPORT','AIR_TIME']].reset_index(drop=True) ## 提取三列且重新建立索引
## 删除缺失值
flight2 = flights2[flights2['AIR_TIME'].notnull()]

我们先来看看总共有多少个机场

list(set(flights2['ORIGIN_AIRPORT']))[:5]
Out:['14685', '13360', 'ECP', '12892', '12177']

我们发现起始航班中有数字(不是机场名称的缩写),我们认为其是无效的,那么先删除起始机场和到达机场中包含数字的所有行

## 先将这一列转为字符串类型,因为其中的数字有可能是int类型有可能是字符串类型
flights2['ORIGIN_AIRPORT'] = flights2['ORIGIN_AIRPORT'].astype(str)
flights3 = flights2[flights2['ORIGIN_AIRPORT'].str.contains('1|2|3|4|5|6|7|8|9|0')==False]
list(set(flights3['ORIGIN_AIRPORT']))[:5]
Out:['ECP', 'STC', 'ADQ', 'HIB', 'BTV']

现在只留下了机场名的缩写,我们再检查到达机场,看看有没有包含数字。

list(set(flights3['DESTINATION_AIRPORT']))[:5]
len(set(flights3['DESTINATION_AIRPORT']))
## 很不错,也没有,那么我们开始进行下一步处理
Out:['ECP', 'STC', 'ADQ', 'BTV', 'HIB']322

现在将起始机场和到达机场作为节点,若要选择最短时间,其实跟选择最短路径一样,我们将边的属性weight设置为每个航线之间的飞行时间。

## 给图添加边和边的属性 
G = nx.Graph()
for i in range(len(flights3)):G.add_edge(flights3.iloc[i,0],flights3.iloc[i,1],weight = flights3.iloc[i,2])
## 比如我们现在想知道从'ANC'机场取'LAR'机场,如何转机所需时间最短
print(nx.dijkstra_path(G,'ANC','LAR'))
Out:['ANC', 'DEN', 'LAR']
## 画出航线的网络图
nx.draw(G, with_labels=True)

在这里插入图片描述
这样随机分布的机场不直观,也没办法获取机场的地理位置,所以我们把他们画到美国的地图上。

from mpl_toolkits.basemap import Basemap
## 读取机场的数据,包括机场的经纬度和所属的洲
airports = pd.read_csv('./input/airports.csv').drop(['AIRPORT','CITY','COUNTRY'],axis = 1) ## 直接将一些不需要的列删除
## m为生成的美国地图,其中的参数llrnrlon到urcrnrlon是设置美国的经度和维度范围
m = Basemap(projection='merc',llcrnrlon=-150,llcrnrlat=20,urcrnrlon=-50,urcrnrlat=60,lat_0 = 40,lon_0=-100, resolution='l',suppress_ticks=True)
mx,my = m(list(airports['LONGITUDE']),list(airports['LATITUDE']))
pos = {}
for i in range(len(airports)):pos[airports.iloc[i,0]] = (mx[i],my[i])   
## 根据航线来表现节点的大小
deg = nx.degree(G)
sizes = [ 10* deg[i] for i in G.nodes]
## 如果节点过小的话,则不加标签
labels = {i: i if deg[i] >= 20 else '' for i in G.nodes}
## 根据机场所在的洲决定机场节点的颜色,故先给节点添加state属性
for i in range(len(airports)):G.nodes[airports['IATA_CODE'][i]]['state'] = airports['STATE'][i]
## 按照G.nodes中航班的顺序,将其对应的洲排列在一个列表中
state = [ G.nodes[i]['state']   for i in G.nodes]## 将字符串转为数值,因为要按照洲添加颜色
a,indices = np.unique(state,return_inverse=True)
figure = plt.figure(figsize=(30,30))
nx.draw_networkx(G, pos,font_size=16,alpha=.8,width=.075, node_size=sizes,labels=labels,node_color=indices,edge_color='#9400D3')## 绘制地图
m.drawcountries()
m.drawstates()
# m.bluemarble()
m.drawcoastlines()plt.show()

在这里插入图片描述
从图中,我们可以看到东部主要是中转机场,航线比较多,机场也比较密集。

这篇关于数据可视化案例-基于NetworkX网络的美国飞机航线可视化的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/836267

相关文章

SQL Server修改数据库名及物理数据文件名操作步骤

《SQLServer修改数据库名及物理数据文件名操作步骤》在SQLServer中重命名数据库是一个常见的操作,但需要确保用户具有足够的权限来执行此操作,:本文主要介绍SQLServer修改数据... 目录一、背景介绍二、操作步骤2.1 设置为单用户模式(断开连接)2.2 修改数据库名称2.3 查找逻辑文件名

Python实例题之pygame开发打飞机游戏实例代码

《Python实例题之pygame开发打飞机游戏实例代码》对于python的学习者,能够写出一个飞机大战的程序代码,是不是感觉到非常的开心,:本文主要介绍Python实例题之pygame开发打飞机... 目录题目pygame-aircraft-game使用 Pygame 开发的打飞机游戏脚本代码解释初始化部

canal实现mysql数据同步的详细过程

《canal实现mysql数据同步的详细过程》:本文主要介绍canal实现mysql数据同步的详细过程,本文通过实例图文相结合给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的... 目录1、canal下载2、mysql同步用户创建和授权3、canal admin安装和启动4、canal

六个案例搞懂mysql间隙锁

《六个案例搞懂mysql间隙锁》MySQL中的间隙是指索引中两个索引键之间的空间,间隙锁用于防止范围查询期间的幻读,本文主要介绍了六个案例搞懂mysql间隙锁,具有一定的参考价值,感兴趣的可以了解一下... 目录概念解释间隙锁详解间隙锁触发条件间隙锁加锁规则案例演示案例一:唯一索引等值锁定存在的数据案例二:

使用SpringBoot整合Sharding Sphere实现数据脱敏的示例

《使用SpringBoot整合ShardingSphere实现数据脱敏的示例》ApacheShardingSphere数据脱敏模块,通过SQL拦截与改写实现敏感信息加密存储,解决手动处理繁琐及系统改... 目录痛点一:痛点二:脱敏配置Quick Start——Spring 显示配置:1.引入依赖2.创建脱敏

详解如何使用Python构建从数据到文档的自动化工作流

《详解如何使用Python构建从数据到文档的自动化工作流》这篇文章将通过真实工作场景拆解,为大家展示如何用Python构建自动化工作流,让工具代替人力完成这些数字苦力活,感兴趣的小伙伴可以跟随小编一起... 目录一、Excel处理:从数据搬运工到智能分析师二、PDF处理:文档工厂的智能生产线三、邮件自动化:

Python数据分析与可视化的全面指南(从数据清洗到图表呈现)

《Python数据分析与可视化的全面指南(从数据清洗到图表呈现)》Python是数据分析与可视化领域中最受欢迎的编程语言之一,凭借其丰富的库和工具,Python能够帮助我们快速处理、分析数据并生成高质... 目录一、数据采集与初步探索二、数据清洗的七种武器1. 缺失值处理策略2. 异常值检测与修正3. 数据

pandas实现数据concat拼接的示例代码

《pandas实现数据concat拼接的示例代码》pandas.concat用于合并DataFrame或Series,本文主要介绍了pandas实现数据concat拼接的示例代码,具有一定的参考价值,... 目录语法示例:使用pandas.concat合并数据默认的concat:参数axis=0,join=

MySQL 表的内外连接案例详解

《MySQL表的内外连接案例详解》本文给大家介绍MySQL表的内外连接,结合实例代码给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考下吧... 目录表的内外连接(重点)内连接外连接表的内外连接(重点)内连接内连接实际上就是利用where子句对两种表形成的笛卡儿积进行筛选,我

C#代码实现解析WTGPS和BD数据

《C#代码实现解析WTGPS和BD数据》在现代的导航与定位应用中,准确解析GPS和北斗(BD)等卫星定位数据至关重要,本文将使用C#语言实现解析WTGPS和BD数据,需要的可以了解下... 目录一、代码结构概览1. 核心解析方法2. 位置信息解析3. 经纬度转换方法4. 日期和时间戳解析5. 辅助方法二、L