曾经我是一个只会excel的数据分析师,直到我遇到了……

2024-04-28 13:48

本文主要是介绍曾经我是一个只会excel的数据分析师,直到我遇到了……,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

我是一个数据分析师。


准确来说我是一个当年只会excel数据透视表,就天不怕地不怕地来当数据分析师的人。当年的某一天,我的老板Q我:

 

小刘啊,我小姨子给了我一个全国市委书记的名单,你帮我看看,有什么规律啊?

 

我接过老板的任务,心想:老板的小姨子在政府里混的不错啊,目标居然是市委书记。难怪老板平时这么多政府项目,我得看看什么她什么目的。

 

我迅速打开了表格。发现表格里把往期和现任的每一位市委书记信息都调查得很清楚。



既然是小姨子的要求,我先来看看市委书记里有多少女性好了:


首先我点开数据透视表,调整参数,然后进行运算得到女性市委书记的数量,写上函数,求出了女性市委书记的比例,最后我制作图表对图标参数进行调整,得出了我的第一个结论:女性市委书记的比例是:2.77%。恩,似乎比较低,小姨子要加油啊。



正当我想把这个结论先截个图给老板看看,顺便挣个表现时,老板先给我发信息了:

 

小刘啊,刚交给你的任务暂时不做了,昨天刚来公司上班的王大鹏刚看到我在看这个表,已经帮我做了一版结论了,图看着还挺专业。


突然之间没了挣表现的机会,我很郁闷。王大鹏是谁?多年来的职业敏感性告诉我,这个新来的,我得去会会!于是我拿着零食来到王大鹏的工位。半小时后,新人大鹏就已经被我掌握:

 

“你想知道我怎么这么快做分析?简单!”大鹏很热情的说。


“我就使用了几行python代码,你看。”



我:“Python?那是啥?”


大鹏:“Python本来是一门计算机程序语言,非常简单好学。目前也是做数据分析的主流语言之一,拥有非常丰富的工具包。比如我这里用到的pandas。”



“有了这些工具包,我就可以使用里面的读取(read_csv)功能,把数据加载进来.或者说叫做“提取数据字段”,比如我给你演示下把名字、省份和出生年份给提取出来。”



“然后就是尝试者先做做简单的分析了。可以调用Matplotlib和Seaborn两个工具包,前者是做图表的,后者是做图表可视化的,用熟后比excel简单多了。选择好你的数据,再调用工具包里的图表,图表就有啦,其实和excel处理好数据再选择图表的逻辑是类似的。 ”  



“我一般都是先对比两个维度,比如我尝试着分析市委书记们的出生年月和任期的关系,直接把计算的结果整理好,调用表格模板,就可以出这样的图啦。




你注意看,其实中国大部分的官员都是任期1-4年的,但是1950年-1960年出生,现在大概60岁上下的人,任期普遍要比其他年龄段的人要长几年,这里面水比较深呐: ” 



“不明觉厉!可是这张图表达得会不会太晦涩了?”我问道。

 

“没错,刘哥,看来你很有经验。我也觉得想直方图还是不清楚,但是热力图就好很多了,还能看看不同岁数不同任期的人都有多少,所以我就改了种表达。刘哥你看,看是不是好多了?”



我突然有点庆幸我没把我简陋的图发给老板,同时也不禁有一丝紧迫感。虽然说这些分析,我用excel慢慢做也能捣鼓出来,但我点来点去,每换一个数据维度就要重新做一次透视表,还要调整样式,肯定不如人家写程序快。而且大鹏用的python代码明显有更强的灵活性,如果将来老板让我做一些更难的数据分析,大鹏不就很快能取代我了?

 

不行,为了保住饭碗,我得需要迭代一下自己的技术啊!于是我继续像大鹏打探:

 

我:“那Python难学么?学到你这样要多久呢?

 

大鹏露出了有点天真的笑容:要系统的学当然没几个月是不行的,不过也有些套路,比如刘哥你本来就会excel,了解数据,再多试试用python代码完成像刚才老板给的这样的简单的统计分析,可能1周就能上手啦。

 

我:哦?这么快,那给我推荐点教程啊书什么的。

 

大鹏神秘一笑,转身就甩了我一门《Python数据分析师》训练营,限时免费。如果你想学Python数据编程,我强烈建议你从一次“要动手、有目标、有答疑”的7天《Python数据分析师训练营》开始学习。


喏,就是下面这个~


想要免费加入《Python数据分析师》训练营的小伙伴,请扫描下方二维码,进入网易云课堂微专业服务号后,根据系统提示,就可以加入数据分析师学习QQ群啦!


除了免费参与训练营外,进入数据分析师学习QQ群后还可领取一份数据分析资料包(包含房价、城市设施、人口等城市数据;知乎、淘宝等网页数据及精选电子书等)。

这篇关于曾经我是一个只会excel的数据分析师,直到我遇到了……的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/943417

相关文章

Linux下利用select实现串口数据读取过程

《Linux下利用select实现串口数据读取过程》文章介绍Linux中使用select、poll或epoll实现串口数据读取,通过I/O多路复用机制在数据到达时触发读取,避免持续轮询,示例代码展示设... 目录示例代码(使用select实现)代码解释总结在 linux 系统里,我们可以借助 select、

前端导出Excel文件出现乱码或文件损坏问题的解决办法

《前端导出Excel文件出现乱码或文件损坏问题的解决办法》在现代网页应用程序中,前端有时需要与后端进行数据交互,包括下载文件,:本文主要介绍前端导出Excel文件出现乱码或文件损坏问题的解决办法,... 目录1. 检查后端返回的数据格式2. 前端正确处理二进制数据方案 1:直接下载(推荐)方案 2:手动构造

C#利用Free Spire.XLS for .NET复制Excel工作表

《C#利用FreeSpire.XLSfor.NET复制Excel工作表》在日常的.NET开发中,我们经常需要操作Excel文件,本文将详细介绍C#如何使用FreeSpire.XLSfor.NET... 目录1. 环境准备2. 核心功能3. android示例代码3.1 在同一工作簿内复制工作表3.2 在不同

C#使用iText获取PDF的trailer数据的代码示例

《C#使用iText获取PDF的trailer数据的代码示例》开发程序debug的时候,看到了PDF有个trailer数据,挺有意思,于是考虑用代码把它读出来,那么就用到我们常用的iText框架了,所... 目录引言iText 核心概念C# 代码示例步骤 1: 确保已安装 iText步骤 2: C# 代码程

Pandas处理缺失数据的方式汇总

《Pandas处理缺失数据的方式汇总》许多教程中的数据与现实世界中的数据有很大不同,现实世界中的数据很少是干净且同质的,本文我们将讨论处理缺失数据的一些常规注意事项,了解Pandas如何表示缺失数据,... 目录缺失数据约定的权衡Pandas 中的缺失数据None 作为哨兵值NaN:缺失的数值数据Panda

C++中处理文本数据char与string的终极对比指南

《C++中处理文本数据char与string的终极对比指南》在C++编程中char和string是两种用于处理字符数据的类型,但它们在使用方式和功能上有显著的不同,:本文主要介绍C++中处理文本数... 目录1. 基本定义与本质2. 内存管理3. 操作与功能4. 性能特点5. 使用场景6. 相互转换核心区别

java读取excel文件为base64实现方式

《java读取excel文件为base64实现方式》文章介绍使用ApachePOI和EasyExcel处理Excel文件并转换为Base64的方法,强调EasyExcel适合大文件且内存占用低,需注意... 目录使用 Apache POI 读取 Excel 并转换为 Base64使用 EasyExcel 处

python库pydantic数据验证和设置管理库的用途

《python库pydantic数据验证和设置管理库的用途》pydantic是一个用于数据验证和设置管理的Python库,它主要利用Python类型注解来定义数据模型的结构和验证规则,本文给大家介绍p... 目录主要特点和用途:Field数值验证参数总结pydantic 是一个让你能够 confidentl

Python Excel 通用筛选函数的实现

《PythonExcel通用筛选函数的实现》本文主要介绍了PythonExcel通用筛选函数的实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着... 目录案例目的示例数据假定数据来源是字典优化:通用CSV数据处理函数使用说明使用示例注意事项案例目的第一

JAVA实现亿级千万级数据顺序导出的示例代码

《JAVA实现亿级千万级数据顺序导出的示例代码》本文主要介绍了JAVA实现亿级千万级数据顺序导出的示例代码,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面... 前提:主要考虑控制内存占用空间,避免出现同时导出,导致主程序OOM问题。实现思路:A.启用线程池