`
huang_xiaok
  • 浏览: 95677 次
  • 性别: Icon_minigender_1
  • 来自: 成都
博客专栏
90a30fc4-e2b0-37bf-a450-86cdba0caacc
Fusioncharts中...
浏览量:17085
文章分类
社区版块
存档分类

【数据可视化】基础知识贴③:错综复杂散点图

阅读更多
散点图

热门数据可视化工具下载:

散点图,如果学过我们前面创意图表系列的话,这种图表应该非常熟悉了。

散点图,在图表界有万表之王的称号。

这可不是我随便封的。

美国权威心理学专刊《Journal of the History of the Behavioral Sciences》(行为科学史杂志)在2005年一篇论文中如此评价散点图:

“Most versatile, polymorphic, and generally useful invention in the history of statistical graphics.”这是信息图表史上功能最多,形式多样,应用范围极为广阔的一个伟大发明!

散点图能获此评价,绝对不是吹出来的。

正如它的名字一样,散点图,可以一堆纷乱如麻,看似无迹可寻的数据显示出内在的关系逻辑来。

散点图已经不仅仅是一个图表了,它已经演化为一个强大的分析工具,可以这么说,散点图,就是为大数据而生的!

下面,还是让我们一起回顾一下散点图的前世今生吧。

认识散点图

散点图,是绘制在X轴和Y轴坐标系中,可以同时表述两个变量的一组数据点。这些大量的数据点组合在一起,形成了一些形状,揭示了数据背后的相关信息。

散点图

在这个散点图中,就揭示了不同系列的产品中,销售量与产品收入之间的关系模式。

散点图溯源

说起散点图的来由,如果你读过我们启视录系列前面几篇的话,一定会想到一个名字:William Playfair。这是信息图史上一个神一般的存在,他将折线图、饼图还有条状图带到了我们这个世界上。

可是,这一次你猜错了。

散点图不是普莱费尔发明的。

事实上,散点图的出现如同它的名字一样,散乱不堪,无法理出一个有序的线索出来。

其实,对于散点数据的的视觉化应用,由来已久。好几百年以来,人们一直将这些点放置在地图,或者笛卡尔坐标系中。后来人们逐渐意识到,当这些数据以不同参数,放置在直角坐标系中,很多不为人知的故事会偷偷地浮现出来。于是,散点图逐渐开始流传开来。

所以只能这么说,散点图,是广大数据民工在长期的生产实践中,通过不断的探索和研究,最终发明出来的。

而William Playfair爵士之所以会与这个伟大的发明擦肩而过,主要是因为,他发明的图表都是基于时间序列的,而散点图却不再拘泥于时间这个基本的变量。

散点图从一开始的默默无闻,到最后轰动科学界,直到最后加冕图表之王,其实也就是百十年的事。但是通过散点图带来的很多伟大的发现,则彻底改变了我们的世界观,推动了科学的发展。

1905年,丹麦科学家Danish astronomer Ejnar Hertzprung,在将一些恒星的亮度等级(绝对亮度}和他们的颜色(按光谱从蓝白到红色排列)进行对比的时候,他注意到这其中似乎有着某些相关性。但是他一直没有找到其中的奥秘。

直到1913年,美国天文学家Henry Norris Russell独立发表论文,阐述了这个改变我们认知宇宙的新发现。

散点图

没错,正是通过散点图,他将恒星的按光谱和亮度两个参数进行排列分析后发现,从高亮度低光谱(左上)到低亮度高光谱(右下)形成了一条明显的趋势线,而在左上角,还有一团比较密集的数据。

Henry意识到,这条趋势线,或许正揭示了恒星从蓝白色的新星到红色的老星的一个演变的过程,也就是说,他发现了恒星一生的秘密。而左上角的那些数据,则是由一些暮年的红巨星所集合而成。

这就是后来我们所熟知的恒星的一生:原恒星—-主序星—-红巨星—-白矮星—-黑矮星

这是重新绘制的由2200颗恒星数据所组成的Henry Norris Russell散点图,我们的太阳目前大致位于光序1(竖轴)色谱1.0左右的位置上,主序星阶段,正值壮年!

关于更多的散点图带来的伟大发现,大家可以到这里围观:http://www.datavis.ca/papers/friendly-scat.pdf我就不再多说了。

散点图的应用

显而易见,散点图是一种应用非常广泛的图表,而且具有其他图表所没有的独特优势。

不像其他图表的单一特性,散点图不光可以显示趋势,还能显示集群的形状,以及在数据云团中各数据点的关系——这在大数据应用中是极为重要的一点。

无论是探寻肺活量与自由潜水的深度的关系,还是研究地震强度与持续时间之间的关联,或者对比不同部门利润与支出的数据,我们都可以用散点图来进行不同方位解读。

下面就是散点图所经常表现出来的几种趋势:

  • 正相关
    散点图
  • 负相关
    散点图
  • 无关
    散点图
  • 线性相关
    散点图
  • 指数相关
    散点图
  • 离群值
    散点图

这里要注意的是,并不是所有的相关关系都是简单的因果关系,要注意其他变量的存在以及对数据的影响。

散点图的基本原则

对于散点图,我们现在已经有了大致的一些了解,现在让我们来看看散点图设计中的一些基本原则吧

Y轴从0开始

散点图

这个应该是我们反复强调的了,Y轴从非零开始的话会截断数据,造成误读。

包含多重变量

散点图

通过改变数据点的大小和颜色,来表示数据值的区别。

添加趋势线

散点图

趋势线可以用来显示数据变化的趋势。

不要添加两条以上的趋势线

散点图

太多趋势线,反而搅乱视线。

来源:InfoVision

分享到:
评论

相关推荐

    数据可视化基础

    1. **图表类型**:数据可视化的基础是各种图表,包括柱状图、折线图、饼图、散点图、热力图、箱型图、地理地图等。每种图表都有其特定的应用场景,例如柱状图用于比较各类别的数量,折线图展示趋势变化,饼图显示各...

    基于Echarts的可视化大屏散点图.rar

    总的来说,"基于Echarts的可视化大屏散点图"项目涵盖了Web前端开发的多个方面,包括静态页面结构、样式设计以及动态数据可视化。通过Echarts的灵活性和强大的功能,开发者可以创建出具有专业水准的数据展示界面,...

    Python数据可视化编程

    2. **Matplotlib库**:作为Python最基础的数据可视化库,Matplotlib提供了丰富的图表类型,如折线图、散点图、柱状图等,以及自定义图形样式的功能。读者将学会如何创建基本图表并调整其视觉效果。 3. **Seaborn库*...

    深入浅出 Python 机器学习:数据可视化_信息可视化_数据可视化、_数据可视化_

    本文将深入探讨如何使用Python进行数据可视化,包括信息可视化和数据可视化,以及它们在处理Excel数据时的应用。 首先,我们要了解什么是数据可视化。数据可视化是将数据转换成图形或图像的过程,使数据更易于理解...

    Python数据可视化课后习题_答案.docx

    14. **数据可视化库Matplotlib**:Matplotlib是最基础的Python绘图库,可以生成各种静态、动态和交互式图表,如折线图、散点图、直方图等。 15. **Seaborn**:Seaborn是基于Matplotlib的高级数据可视化库,提供了更...

    Python数据可视化实战全书教案1-8章全.pdf

    在《Python数据可视化实战全书》的前8章中,它详细介绍了数据可视化的基础知识、常用工具以及Python中的实现方法。以下是本教程的主要知识点: 1. **数据与数据可视化**: - 数据是现实世界中信息的量化表示,可以...

    数据可视化实战使用D3设计交互式图表.pdf+源码

    数据可视化是一种将复杂的数据集转化为易于理解的图形或图像的过程,它在数据分析、决策制定以及信息传达中扮演着至关重要的角色。本资源是关于“数据可视化实战:使用D3设计交互式图表”的教程,结合了理论知识与...

    数据可视化教学代码和案例(python+jupyter)

    包括折线图+柱状图+饼图+盒图+散点图+直方图+3d图 画布的布局、画图中中文乱码的解决、背景板的选择等 简单的数据分析和可视化案例: titanic数据的简单分析可视化 iris数据的聚类可视化 GDP数据结合pyechart的应用 ...

    基于XGBoost的数据回归预测Python代码 包含散点图和折线图可视化

    此外,我们使用散点图和折线图可视化结果。 使用命令python xgboost_regression.py运行脚本,脚本将生成两个散点图,分别对比训练集和测试集的真实值和预测值。此外,还将绘制一个折线图,显示测试集中每个样本的...

    5tableau可视化实现4:词云,散点图,气泡图.wmv

    tableau可视化应用

    数据可视化.zip

    数据可视化的方法多样,包括但不限于柱状图、折线图、饼图、散点图、热力图、力导向图等。每种图表都有其特定的用途,例如柱状图适合比较各类别的数量,折线图用于展示趋势变化,而散点图则用于揭示两个变量之间的...

    《数据可视化分析—基于R语言》(第2版)—教学大纲.pdf

    课程内容主要包括:数据可视化与 R 语言、R 语言绘图基础、类别数据可视化、分布特征可视化、变量间关系可视化、样本相似性可视化、时间序列可视化等内容。 课程教学计划分为十二周,每周教学时间为 2 课时,以课堂...

    Python数据可视化实现.zip

    首先,Matplotlib是Python中最基础的数据可视化库,它提供了丰富的图表类型,如折线图、散点图、柱状图、饼图等。Matplotlib的使用主要包括创建figure对象、添加axes子图,然后调用各种绘图函数。例如,`plt.plot()`...

    Python数据可视化任务教程(微课版)配套教案

    Matplotlib是Python最基础的数据可视化库,能够绘制各种图表,如折线图、散点图、直方图等,是初学者入门的首选。Seaborn库则基于Matplotlib,提供了更高级的接口和美观的默认样式,对于复杂图表的制作更为便捷。...

    数据可视化集.zip

    在数据可视化过程中,我们需要选择合适的图表类型,如条形图、折线图、散点图、饼图、热力图等,以有效地展示数据。此外,颜色的使用、图例的设置、数据标签的添加等都是提升可视化效果的关键因素。同时,良好的数据...

    数据可视化大屏源码(12套).zip

    数据可视化是一种将复杂的数据集通过图表、图形或其他视觉表示方式呈现出来的方法,使得非专业人员也能快速理解数据背后的含义和趋势。在这个“数据可视化大屏源码(12套).zip”压缩包中,包含了12套不同的数据可视化...

    数据分析可视化:散点图矩阵与雷达图的生成

    数据分析可视化:散点图矩阵与雷达图的生成

    Axure数据可视化图表组件库(比较全的图标库).rar

    数据可视化是现代数据驱动决策的核心部分,它通过图表将复杂的数据转化为易于理解的图形,帮助用户洞察趋势、模式和关键指标。"Axure数据可视化图表组件库(比较全的图标库).rar"是一个专门为Axure设计的资源包,包含...

    数据可视化相关书籍

    数据可视化是一种将复杂的数据集转化为易于理解的图形或图像的过程,它是数据分析的重要组成部分,能够帮助我们洞察数据背后的故事。在当今大数据时代,数据可视化技术变得越来越关键,它可以帮助专业人士、决策者...

    60套数据可视化大屏(含源码).zip

    这些实例可能包含这些基础类型的组合和创新,例如瀑布图、桑基图、雷达图等,展示了数据可视化的多样性和创新性。 6. 交互性与动态效果:现代数据可视化不仅仅是静态的图片,许多大屏包含动态效果和交互功能,如...

Global site tag (gtag.js) - Google Analytics