您的位置：首页 > 其它

spark take获取前n个元素

2016-05-03 23:05 393 查看

     take和 collect操作类似，都是从远程集群上获取元素，只是collect操作获取的所有数据，而take操作是获取前n个元素

直接上代码：

public static void myTake(){

       SparkConf conf=new SparkConf()

       .setMaster("local")

       .setAppName("myTake");



       JavaSparkContext sc=new JavaSparkContext(conf);

       List<Integer> numberList = Arrays.asList(1, 2, 3, 4, 5, 6, 7, 8, 9, 10);

       JavaRDD<Integer> numRdd=sc.parallelize(numberList, 2);

       List<Integer> list=numRdd.take(4);

       for(Integer i:list){

           System.out.println("i:"+i);

       }

       sc.close();



   }

结果：

i:1

i:2

i:3

i:4

内容来自用户分享和网络整理，不保证内容的准确性，如有侵权内容，可联系管理员处理

标签： spark take

相关文章推荐

Spark RDD API详解(一) Map和Reduce
使用spark和spark mllib进行股票预测
Spark随谈——开发指南（译）
Spark，一种快速数据分析替代方案
eclipse 开发 spark Streaming wordCount
Understanding Spark Caching
ClassNotFoundException:scala.PreDef$
Windows 下Spark 快速搭建Spark源码阅读环境
Spark中将对象序列化存储到hdfs
使用java代码提交Spark的hive sql任务，run as java application
Spark机器学习（一） -- Machine Learning Library (MLlib)
Spark机器学习（二）局部向量 Local-- Data Types - MLlib
Spark机器学习（三） Labeled point-- Data Types
Spark初探
Spark Streaming初探
Spark本地开发环境搭建
搭建hadoop/spark集群环境
Spark HA部署方案
Spark HA原理架构图
spark内存概述

新的分享

一次教科书级别的Redis高可用架构设计实践 - Redis
曾光：北京这次的毒株不像国内流行类型
从PRD文档到产品上线，有哪些问题需要解决？
vue3自定义指令的使用
Oracle SQL性能优化最常用的40条建议 - ORACLE
程序员翻车常见反应，你中枪了吗？ - 职场生涯
新鲜开源：基于Prometheus的企业监控平台设计与实现 - 运维
嵌入式软件开发之程序架构设计-任务调度
【Java面试】请简单说一下你对受检异常和非受检异常的理解
奇安信更新招股书：第一季亏损过5亿，齐向东持股38%
艾瑞咨询：2020年中国后智能厨房案例研究报告
艾瑞咨询：2020年中国人工智能+物流发展研究报告

章节导航