Notice
Recent Posts
Recent Comments
Link
일 | 월 | 화 | 수 | 목 | 금 | 토 |
---|---|---|---|---|---|---|
1 | 2 | 3 | 4 | 5 | 6 | 7 |
8 | 9 | 10 | 11 | 12 | 13 | 14 |
15 | 16 | 17 | 18 | 19 | 20 | 21 |
22 | 23 | 24 | 25 | 26 | 27 | 28 |
29 | 30 | 31 |
Tags
- Apache Spark
- 딕셔너리
- 도커
- programmers
- 분산
- 아파치 스파크
- 빅데이터
- 이진탐색
- 리트코드
- 오블완
- 스파크
- 코딩테스트
- leetcode
- 알고리즘
- 아파치 하둡
- 파이썬
- 티스토리챌린지
- Apache Hadoop
- 프로그래머스
- 하둡
- Data Engineering
- 분산처리
- Python
- docker
- 우선순위큐
- Hadoop
- heapq
- Spark
- HDFS
- 데이터 엔지니어링
Archives
- Today
- Total
목록맵리듀스 (1)
래원
[Hadoop] MapReduce와 YARN
이번 글에서는 MapReduce와 YARN에 대해 알아보자 이전 글과 이어지니 보고오는 것을 추천한다.[Hadoop] HDFS란? What is MapReduce? MapReduce는 2004년 Google에서 처음 제안한 대용량 데이터 처리 모델로, 분산 환경에서 데이터 처리 작업을 쉽게 수행할 수 있도록 설계되었다. 이러한 MapReduce는 HDFS에 저장된 대규모 데이터를 효율적으로 분석하고 처리할 수 있게 도와준다. 이름에서 볼 수 있듯 Map과 Reduce라는 두 단계로 나뉘게 된다. Map입력 데이터를 키-값 쌍으로 변환하여 병렬 처리가 가능하도록 데이터 구조를 단순화 하는 작업예를 들어, 위 그림에서는 각 단어를 키로 하고, 출현 횟수를 값으로 매핑Map 단계에서 다루는 Input 데이..
Data Engineering/Hadoop
2024. 12. 2. 02:47