数据分析工具

news/2024/7/21 5:59:12 标签: 数据分析, 数据分析工具, Excel, Tableau

数据分析的工具有很多,从数据分析岗位的描述里其实就能发现企业都需要会哪些工具的人,这里我分成了4类来聊聊。分别是基础、可视化、专业的统计分析以及编程语言。

基础

说到数据分析的基础的工具,非Excel莫属。

Excel_5">Excel

微软办公系列的重要组成之一,任何办公人员都会用到的神器,不得不说它的体系太庞大了,在人力、金融、管理等多个领域都会应用,同样对数据分析人员来说,也可以进行各种数据处理和分析。

特点:

  • 表格制作:简单的表格录入、制作、美化。
  • 透视表:实现数据透视的效果,可以说学会数据透视表,基本可以解决80%的工作。
  • 公式:通过公式可以进行数学计算。
  • 统计分析Excel里的 数据分析 可以实现描述统计、假设检验、抽样等统计分析的功能,只要用的好,不逊色于专业的统计分析软件。
  • 图表:用Excel作图操作简单。简单的日报/月报中以及自己分析时Excel的图表完全可以满足我们的需求。但是当要进行专业的展示时,图表的美化就显得尤为重要,而用Excel去美化图表,也不是不行,只是要用到很多偏门的小技巧,没必要花那么多时间,现成有可用的工具。
  • VBA:还可以用VBA编程实现更高级复杂的需求。
  • 插件Excel还能承载很多有用的插件,比如PowerQuery、PowerMap、PowerView等,来辅助我们实现更为强大的数据分析功能。

总的来说,Excel可以说是数据分析基础以及必备的工具,可以不用Power BI,但你一定不能没有Excel

可视化工具

下面来说说可视化的工具

Tableau_21">Tableau

对,Tableau就是可替代Excel进行图表美化工作的一个工具。它将数据计算和美观的图表完美地融合在一起,可以在几分钟内生成美观的图表、坐标图、仪表盘与报告。是用来快速分析、可视化的强大工具,偏向商业分析。

特点:

  • 轻松整合,易上手。
  • 交互性,类似于Excel数据透视表/图的功能,可进行交互。
  • 美观的图表,轻松制作美观的仪表盘、坐标图。

Power BI

作为Excel的一个插件,后来独立门户的软件,它的可视化效果非常强大。

首先要理解什么是BI,商业智能(Business Intelligence,简称:BI),又称商业智慧或商务智能,指用现代数据仓库技术、线上分析处理技术、数据挖掘和数据展现技术进行数据分析以实现商业价值。

所以Power BI就是将数据分析的流程展示出来以便提供科学决策的工具

先用PowerQuery处理和清洗数据,再用PowerPivot建模,最后用Power BI的图表库作图。

特点:

  • Tableau一样,都是基于Excel的数据透视图的功能和效果来完成的。
  • Excel无缝对接,创建个性化的数据看板。

总的来说,BI类的工具是把将数据和业务联系在一起,为了更好的决策诞生的,这一点就和Excel非常了不同了。

统计分析

SPSS

SPSS是统计产品与服务解决方案的软件,着重在于统计分析运算、数据挖掘、预测分析等功能的实现。

SPSS可以在不需要编程语言的情况下,很好地进行回归分析、方差分析、多变量分析等的研究。

特点:

  • 界面简单,SPSS采用类似Excel表格的方式读入与管理数据。
  • 功能强大,集数据录入、整理、分析功能于一身,能够进行相关分析、回归分析、聚类分析、时间序列分析等。
  • 上手有一定的门槛,需要使用者有一些统计学基础,能够对统计分析模型有一定的理解。
  • 有专门的绘图系统,可绘制图形,但相对于其他可视化软件来说,它的图形就单调许多了。

SAS

SAS同SPSS一样,是一个做专业统计分析的软件。

特点:

  • 功能更强大,统计方法齐、全、新。相对SPSS来说,功能更强大,相对来讲,SAS比较难学些,但如果掌握了SAS会更有价值,比如离散选择模型,抽样问题,正交实验设计等还是SAS比较好用

编程语言

主流的数据分析编程语言莫过于R和Python了。和可视化工具不同的是,PB和Tableau有可视化界面,而R和Python是纯代码

R

R是用于统计分析、绘图的语言和操作环境。在数据处理、分析、计算和制图等功能上都非常优秀,可以理解为加强编程版的SPSS/SAS。

R的思想是:它可以提供一些集成的统计工具,但更大量的是它提供各种数学计算、统计计算的函数,从而使使用者能灵活机动的进行数据分析,甚至创造出符合需要的新的统计计算方法。

特点:

  • 强大的统计分析程序包,内建多种统计学及数字分析功能。R比其他统计学或数学专用的编程语言有更强的物件导向(面向对象程序设计)功能。
  • 高质量的矢量图,ggplot2可以快速创建各种统计图表。

Python

R更专注于统计数据分析领域,而Python则应用更为广泛和全面,所以Python也被称作胶水语言,学习时要有所取舍。

特点:

  • 语法简单,Python语法简单,
  • 高质量的数据科学计算包,
  • 可移植性强,由于它的开源本质,Python已经被移植在许多平台上(经过改动使它能够工作在不同平台上)。

总的来说,Excel是通用工具,而Power BI/Tableau一类如果属于初级的操作工具的话,那么SPSS/SAS就应该是中级,而R/Python属于高级,这里的级别并非是功能的强大与否,而是指学习和上手的难以程度。

更多精彩文章欢迎公众号【可乐的数据分析之路】


http://www.niftyadmin.cn/n/1517268.html

相关文章

世界淡水资源占水资源的多少_生活知识科普:我国淡水资源在全球水资源占比...

在我们的生活当中有很多的常识性的知识大多数人都是不知道的,就好比最近就有很多小伙伴咨询小编问小编关于我国淡水资源在全球水资源占比的这些知识点,这就说明了现在人们也开开渐渐关注起了我国淡水资源在全球水资源占比方面的问题了,那么既…

终于搞清楚正态分布、指数分布到底是啥了!

↑ 点击上方 “可乐的数据分析之路” 关注 星标 ~ 大概率每天早8点25更新 哈喽,大家好,我是可乐今天这篇文章接2个月以前的那篇文章 离散型随机变量的概率分布,继续来聊聊连续型随机变量的概率分布,以及用Python如何实现。并非所…

abap中读取excel中不同的sheet数据_ABAP中读取EXCEL中不同的SHEET数据

ABAP中读取EXCEL中不同的SHEET数据SAP提供了标准的读取EXCEL的函数(ALSM_EXCEL_TO_INTERNAL_TABLE),但是此标准函数无法满足对同一EXCEL进行不同SHEET的数据读取,一下方法就是教你如何通过修改程序来实现ALSM_EXCEL_TO_INTERNAL_TABLE读取多个SHEET&…

连续性变量的概率分布

前一篇文章写的是离散型随机变量的概率分布,今天我们来聊聊连续型随机变量的概率分布。 并非所有的数据都是连续的,根据数据类型的不同,有不同的求概率的方法,对于离散型随机变量的概率分布,我们关心的是取某一个特定…

能把统计学的原理和应用说明白,这本书不简单!

↑ 点击上方 “可乐的数据分析之路” 关注 星标 ~ 大概率每天早8点25更新 哈喽,大家好,我是可乐今天给大家推荐这本《深入浅出统计学》,文末有我总结的知识图谱。《深入浅出统计学》这本书我看了好几遍,一直没法下笔写它的总结&…

mysql慢查询_MySQL慢查询(一) - 开启慢查询

一、简介开启慢查询日志,可以让MySQL记录下查询超过指定时间的语句,通过定位分析性能的瓶颈,才能更好的优化数据库系统的性能。二、参数说明slow_query_log 慢查询开启状态slow_query_log_file 慢查询日志存放的位置(这个目录需要MySQL的运行…

linux操作系统总结2

GNU是为Linux提供免费软件支持的工具;红帽与乌邦图都是Linux的一个版本。Linux登入时登入名为root的是最高级别Linux系统中的文件夹: /:根目标 bin:二进制可执行文件 lib:Linux的库文件 boot&#xff…

深入浅出统计学读后感

哈喽,大家好,我是可乐 今天给大家推荐这本《深入浅出统计学》,文末有我总结的知识图谱。 《深入浅出统计学》这本书我看了好几遍,一直没法下笔写它的总结,因为感觉还没有征服它,每次感觉懂了的时候&#…