Notice
Recent Posts
Recent Comments
Link
일 | 월 | 화 | 수 | 목 | 금 | 토 |
---|---|---|---|---|---|---|
1 | ||||||
2 | 3 | 4 | 5 | 6 | 7 | 8 |
9 | 10 | 11 | 12 | 13 | 14 | 15 |
16 | 17 | 18 | 19 | 20 | 21 | 22 |
23 | 24 | 25 | 26 | 27 | 28 | 29 |
30 | 31 |
Tags
- k-means
- p-value
- 하둡
- DataFrame
- pig
- SPLIT
- 데이터프레임
- Python
- 결정계수
- 교차검증
- 딕셔너리
- list
- 병렬 쿼리 시스템
- 다중공선성
- hive
- T-검정
- dict
- 분산분석
- SQL on 하둡
- merge
- 밀도기반
- 가설검정
- pca
- 분포
- distribution
- DBSCAN
- cross validation
- join
- Sawzall
- 유사도
Archives
- Today
- Total
목록Hadoop (1)
one of a kind scene

분산 컴퓨팅 기술 part1_MapReduce MapReduce는 대용량 데이터를 분산 처리 하기 위한 프로그래밍 모델 1. 개념 및 특징 • MapReduce는 구글에서 분산 병렬 컴퓨팅을 이용하여 대용량 데이터를 처리하기 위한 목적으로 제작한 소프트웨어 프레임 워크 • 분할정복 방식으로 대용량 데이터를 병렬로 처리할 수 있는 프로그래밍 모델 • 분할정복(divide and conquer) : 해결하고자 하는 문제를 성질이 같은 여러 부분으로 나누어 해결한 뒤, 원래 문제의 해를 구하는 방식 • 구글 외에 아파치 하둡에서 오픈 소스 프로젝트로 시작한 자바(Java) 기반의 'Hadoop MapReduce' 프레임 워크가 동일한 기능 지원 • Client의 수행 작업 단위는 맵리듀스 잡(MapReduce..
ADP/이론
2019. 12. 16. 23:00