大数据的大指大量,从先Map3时代,一个小小的MB级别的Map3就可以满足很多人的需求,然而随着时间的推移,存储单位从过去的GB到TB,乃至现在的PB、EB级别。
随着信息技术的高速发展,数据开始爆发性增长。
社交网络(微博、推特、脸书)、移动网络、各种智能工具,服务工具等,都成为数据的来源。
淘宝网近4亿的会员每天产生的商品交易数据约20TB;脸书约10亿的用户每天产生的日志数据超过300TB。
迫切需要智能的算法、强大的数据处理平台和新的数据处理技术,来统计、分析、预测和实时处理如此大规模的数据。