您当前所在位置：首页 > 网站运营 > 建站经验

建站经验

浅谈网站大数据管理的可视化及可视化优秀项目推荐

大数据可视化

佚名图表大师2016-01-13建站经验4746

这篇文章主要介绍了大数据管理的可视化及可视化优秀项目推荐,讲述了一些将数据库数据作可视化管理的常用规则与建议,需要的朋友可以参考下

可视化有许多“规则”。有的是实际的规则，有的则是帮助你做出选择的建议。如果是出于数据的要求，而且你也知道该怎么做，那么许多实际的规则也不必遵守。

但是，的确有一些规则不应该违背。这些规则通常是用于一些特定种类、几乎只能用特定方式阅读的图表。当这些规则被打破，阅读过程中，数据有可能被误读。这会有点棘手。

条形图的基线必须从零开始

条形图依赖长度来呈现数据。短的条块代表较低的值，长一些的则表示较高的值。条形图的原理就是通过比较条块的长度来比较值的大小。

当基线被改变了，视觉效果也就扭曲了。
201611394508930.jpg (567×126)

举例来说，请看上图。左边第一幅条形图比较了两个值：50和100，它有一条并且它有一条以零为起点的基线。很好。代表数值100的条块长度正好是数值50的两倍长，为100正好也是50的两倍大小。

但当你把基线变为一个更高的、非零的值时，第一个条形的长度变短了，而另外一个条形的长度却没有变。此时值为100的条形不再是值为50的条形的两倍长。以此类推，当最后左边代表数值50的条形彻底消失了，意味着100无限地大于50了。

条形图的基线必须从零开始。

例：这张条形图是经福克斯新闻准许使用的。
201611394531878.jpg (314×197)

3月31日目标的值为7,066,000，比6,000,000高17.8%，然而第二个条形几乎是第一个条形长度的三倍。

有人也许会反驳说，这张图的重点在于两个值的差而非这两个值本身。即便如此，用条形图来表示本身就是一个错误的选择。使用时间序列来呈现月累积数也许会更好。

不要过分热衷于饼图

有些人认为，应该完全避免饼图。他们也许是对的，也许又不是。有些人也许会说，使用饼图完全是一种不可原谅的错误。对此，我不同意。不管怎样，事实情况是人们仍然使用饼图，所以我们至少可以争取正确地使用它们。

避免过度切割饼图，否则最终对它的阅读将难以为继。
201611394612610.jpg (568×140)

那么多少是“太多”？这是一个判断力的问题。不过，如果已经很难从图中看出其中一块扇形是另一块两倍大，或者好几个较小的扇形区域看起来差不多大时，在扇形切割上面就该收手了。此时可以考虑把较小的类目归入一个更大的：“其他”。圆环图也是一样。

同时也考虑一下用其他种类的图表来表示比例。

不要太依赖于饼图。

例：这张饼图来自维基百科，它展示了国家的不同区域。
201611394628684.jpg (554×242)

左边这张饼图中已经切割了许多块，但旁边另分离出一张饼图，显示了左图中看不清楚的更小国家的情况，以此来提供更多的信息。有许多方式可以展示这组数据，比如树状图、按照数据比例制作的图标，或者就用普通的地图。单薄的饼图只适用于显示只有几组值的数据。

尊重部分所占整体的比例

相较于呈现数值，有些图更着重于表现部分与整体的关系，它们表现的数据是部分所占整体比例。比如，堆积式条形图，堆积区域图，树状图，马赛克图，圆环图以及饼图。在这些图表中，每一个部分都表示一个独立的、不重叠的比例。
201611394651282.jpg (558×262)

关于这一条，最常见的错误发生在调查问题允许多选时。比如说：“你上周使用了哪一种交通工具？可以多选。”这样的话，在人们多选的问题上就会出现比例的重叠，不同选项的百分比之和大于一。为了避免这种情况，你不能直接把比例做成统计图。

例：这张饼图来自福克斯新闻下属机构，它表现了三个不属于同一个整体的百分比。
201611394710061.jpg (330×253)

每一个值都是一个单独的整体，因此在这一例中，用三个堆积式条块（或普通的条块）会更直观地表现每个值的比例。

展示数据

让读者看到数据，这是可视化的重点。如果数据的呈现不够清晰，就违背了做图表的初衷。这常常是因为一张图里的数据太多，于是读者的兴趣就被分散了。
201611394736947.jpg (559×123)

这是一个经典的“绘图过度”的问题，相关的研究有很多。但是对于基本的图表，也有一些简单的解决方式。

首先是可以改变符号的大小，这样上图中的小圆点（或者是其他的符号）就不会占据太多空间。为了让数据直观清晰，主要要增加空白。

调节透明度，多层次的图案就不会被覆盖。

通过取样或者把对数据进行分类的方式，把总体分成几个更小的子群。从中，你可以采取小而多的方式，这样每张表里的信息就会少一些。

数据进行再统计及分门别类。

总而言之，更好地呈现数据。

例：这张图展示了金州勇士队在2008-09赛季的每个投篮。
201611394753787.jpg (518×487)

这张图最终形成了一个球场的形状，并得出了对于球员们投篮最多的地点的一个小结论——近框，中距离，以及三分球。但是它们之间的差距是很小的，读者并不能看清真正量级上的差距。

数据聚合法将有助于解决此类问题。

解释编码

通过一定的形状、颜色和几何图形的结合，将数据呈现出来。为了让读者能读清楚，图表设计者就要把这些图形解码回数据值。经典的例子是没有标注的坐标轴。
201611394814849.jpg (570×128)

有时编码不需要解释。比如说，读者也许知道怎样读条形图，就不必解释条的长度表示的是值的大小了。但是设计者的确应该解释数据，也就是图表的单位和主题。

所以标明坐标轴代表的含义。要给读者提供线索或图例，解释图表。

例：这个错误标注的图表来自温尼伯太阳报：
201611394829165.jpg (290×250)

我们要是能知道这是统计关于什么的问题就好了。

2015年数据可视化十佳项目
2015 年，优秀的可视化作品生机勃勃，我可以确定，明年也会有很多好作品。横跨不同主题和应用形式的项目大量涌现，但如果让我选一个年度主题的话，那一定是“教学”，不管是通过解释说明，模拟说明还是深刻分析的方式。有时候会感到可视化创作者很大胆，试着让读者们不再用惯有的思维方式来理解数据和统计学。我很喜欢这一点。

以下是我选出的 2015 最佳项目。按照惯例，排名不分先后。同时，也有很多不在这个名单上的作品，它们同样很优秀。

我们一起来看看它们。

1.亲爱的数据

这是一个值得跟踪的有趣项目，它涉及的两个话题——可视化和自我监测——引起了我的注意。
201611394849359.jpg (640×427)