> 백엔드 개발 > 파이썬 튜토리얼 > Python을 사용하여 MapReduce 작업 작성

Python을 사용하여 MapReduce 작업 작성

高洛峰
풀어 주다: 2016-10-18 10:28:52
원래의
1403명이 탐색했습니다.

mrjob을 사용하면 Python 2.5+를 사용하여 MapReduce 작업을 작성하고 여러 플랫폼에서 실행할 수 있습니다.

순수 Python을 사용하여 다단계 MapReduce 작업 작성

이 테스트에서는 on machine

Hadoop 클러스터에서 실행

Amazon Elastic MapReduce(EMR)를 사용하여 클라우드에서 실행

pip 설치 방법은 매우 간단하며 구성이 필요하지 않습니다. 그냥 직접 실행하세요:pip install mrjob

코드 예:

from mrjob.job import MRJob
class MRWordCounter(MRJob):
    def mapper(self, key, line):
        for word in line.split():
            yield word, 1
    def reducer(self, word, occurrences):
        yield word, sum(occurrences)
if __name__ == '__main__':
    MRWordCounter.run()
로그인 후 복사


원천:php.cn
본 웹사이트의 성명
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.
최신 이슈
인기 튜토리얼
더>
최신 다운로드
더>
웹 효과
웹사이트 소스 코드
웹사이트 자료
프론트엔드 템플릿