Skip to content

Latest commit

History

9 Commits

Folders and files

NameName
Last commit message
Last commit date

Repository files navigation

基于Scala实现的完全模拟Spark RDD函数接口的代码.

packageexampleimportorg.apache.spark.SparkContextobjectExample {
defmain(args: Array[String]) {
valsc=SparkContext("local[4]", "test")
println(sc.makeRDD(1 to 100).filter(_ %2==1).count())
sc.parallelize(1 to 30).groupBy(_ %5).map { case (k, it) =>s"k => sum: ${it.sum}"
}.foreach(println)
}
}

这个工程基于Apache LICENSE-2.0 协议,可以自由传播,重在学习Scala编程,从零实现Spark代码。

欢迎提交Pull Request,完善代码注释,单元测试以及多线程执行支持。

联系人:Cheng Hao

email:chhao01@gmail.com

qq:16426021

qq群:240348813

About

Simplify the Spark RDD (for Scala Learning Purpose)

Resources

Stars

0 stars

Watchers

1 watching

Forks

Releases

Packages

Contributors

Languages