您好,欢迎光临本网站![请登录][注册会员]  

搜索资源列表

  1. 实验7-Spark基本操作.docx

  2. Apache Spark是一个开源集群运算框架,最初是由加州大学柏克莱分校AMPLab所开发。相对于Hadoop的MapReduce会在运行完工作后将中介数据存放到磁盘中,Spark使用了存储器内运算技术,能在数据尚未写入硬盘时即在存储器内分析运算。Spark在存储器内运行程序的运算速度能做到比Hadoop MapReduce的运算速度快上100倍,即便是运行程序于硬盘时,Spark也能快上10倍速度。Spark允许用户将数据加载至集群存储器,并多次对其进行查询,非常适合用于机器学习算法。
  3. 所属分类:spark

    • 发布日期:2019-07-27
    • 文件大小:22kb
    • 提供者:xiaotaocisoc