words = sc.textFile("D:/workspace/spark/input.txt") .flatMap(lambda line: line.split(" ")) wordCounts = words.map(lambda word: (word, 1)) .reduceByKey(lambda a,b: a + b) wordCounts.saveAsTextFile("D:/workspace/spark/output/")