提示:文章写完后,目录可以自动生成,如何生成可参考右边的帮助文档
文章目录
前言
作者水平有限,一切以作者的理解为主
一、twitter经典例子
峰值是12K QPS,作者讲述了两种方式,第一种是关系型数据库,我们叫他web模式;第二种是数据流,我们叫他大数据模式。web模式的好处是在用户刷新时才加载新的帖子,如果用户不访问就可以省下一次资源,大数据模式是实时推送缓存,不管用户刷新不刷新都是一次或多次缓存写入,也不太能保证顺序性。作者引出,如果粉丝量大或者只是达到平均75,写入压力都会比较大,不能解决大量粉丝的问题,对于这个twitter的办法是退回方法一,可能是加载一个窗口的排序好的数据。我其实有一个疑问,作者感觉一直在介绍大数据系统的好处,我不太了解其用意,后来我猜测,猜错了,想了一些没用的。

示例:pandas 是基于NumPy 的一种工具,该工具是为了解决数据分析任务而创建的。