- 1、本文档共6页,可阅读全部内容。
- 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
查看更多
Spark简介与生态
Spark简介ApacheSpark是专门为大规模数据处理而设计的基于内存的快速通用计算平台。它是加州大学伯克利分校AMP(Algorithms,Machines,andPeopleLab)实验室开发和开源的类HadoopMapReduce的通用并行框架,可以用来构建大型的、低延迟的数据分析应用程序。
Spark计算平台Spark提供了一个全面、统一的框架,包括SparkSQL、SparkStreaming、SparkMLlib、SparkGraphX等技术组件,可以一站式地完成大数据领域的离线批处理、交互式查询分析、流计算、机器学习、图计算等常见的任务。
Spark计算平台的生态Spark生态圈以SparkCore为核心,可从HDFS、AmazonS3和HBase等持久层读取数据,以YARN、Mesos和自身携带的Standalone为ClusterManager调度任务Job完成Spark应用程序的计算。
Spark的应用场景Spark适用于计算量大、效率要求高的应用场景;基于实时数据流的数据处理,延迟性要求为数百毫秒到数秒;基于历史数据的交互式查询,要求响应较快。例如,使用大数据分析来构建推荐系统,进行个性化推荐、广告定点投放等,这种应用场景的数据量大且需要进行逻辑复杂的批数据处理,对计算效率有较高的要求。
Spark的应用场景
您可能关注的文档
- 云计算与大数据技术 验证性实验指导 实验实践1-1.Linux (CentOS)安装过程遇到的问题及解决办法.pdf
- 云计算与大数据技术 验证性实验指导 实验实践11. Flink流式计算引擎及实践.pdf
- 云计算与大数据技术 验证性实验指导汇总 实验实践1.安装虚拟机软件-VirtualBox和安装CentOS操作系统---知识补充4.Typora 工具软件简介与安装及使用.pdf
- 云计算与大数据技术 验证性实验指导 实验实践知识补充1.linux操作系统介绍;补充2.linux操作系统基本设置与XShell及Winscp工具介绍.pdf
- 云计算与大数据技术 验证性实验指导 实验实践10.Spark的安装配置及使用实践;11. Flink流式计算引擎及实践.pdf
- 云计算与大数据技术 验证性实验指导 实验实践6.Hive 数据仓库安装配置及应用;8. Sqoop的安装与配置及使用;9. Scala 编程语言学习与实践.pdf
- 云计算与大数据技术 验证性实验指导 实验实践3.Linux操作系统实践-常用指令;4.JDK 安装与配置和MySQL安装与配置;5.大数据计算框架Hadoop3.0的安装部署与配置及HDFS常用指令.pdf
- 云计算与大数据技术 验证性实验指导 实验实践1.安装虚拟机软件-VirtualBox和安装CentOS操作系统;2.Linux操作系统基本环境设置和安装配置Xshell和Winscp.pdf
- 云计算与大数据技术 课件1.1云计算-云计算简述.pptx
- 1.2云计算-云计算与大数据简史.pptx
- 11.3如何提高机械效率(1)2023-2024学年九年级物理高效课堂教学设计(沪粤版).docx
- 五年级上册综合实践活动教学设计-生活垃圾的旅行|教科版.docx
- 第26课《诗词五首》教学设计-2024-2025学年统编版语文八年级上册.docx
- 基于键合图理论的电动轮机电磁耦合特性仿真及控制研究.pdf
- 基于FOLED封装的聚合物电解质材料制备及超声辅助静电键合性能研究.pdf
- 成分和冷速对相分离合金凝固组织结构影响规律的研究.pdf
- 第三章专项突破7探究物态变化的规律教学设计-2023-2024学年人教版物理八年级上册.docx
- 基于改进深度强化学习的电动汽车充电引导与定价研究.pdf
- 风机偏航制动器摩擦振动及噪声特性研究.pdf
- 七年级下册语文第五单元大单元教学教学设计.docx
文档评论(0)