Recent Posts
Recent Comments
Link
일 | 월 | 화 | 수 | 목 | 금 | 토 |
---|---|---|---|---|---|---|
1 | 2 | |||||
3 | 4 | 5 | 6 | 7 | 8 | 9 |
10 | 11 | 12 | 13 | 14 | 15 | 16 |
17 | 18 | 19 | 20 | 21 | 22 | 23 |
24 | 25 | 26 | 27 | 28 | 29 | 30 |
Tags
- 튜토리얼
- DP
- docker
- 코드워
- golang
- 문제풀이
- go
- 자바
- Python
- dynamic programming
- OOM
- 스칼라
- programmers
- Go언어
- 알고리즘
- codewars
- 동적프로그래밍
- zookeeper
- scala
- gradle
- 주키퍼
- 리눅스
- 프로그래머스
- HBase
- redis
- Linux
- 파이썬
- boj
- Java
- leetcode
Archives
- Today
- Total
파이문
[Hadoop] TableReducer 로 테이블 여러개 사용하기 본문
728x90
HBase 를 대상으로 MR 어플리케이션을 개발할 때 TableMapper / TableReducer 를 사용할 때가 있다.
이 때 TableReducer 를 사용해서 데이터를 써야 하는데, 데이터를 각각 다른 테이블에 저장해야 했다.
TableMapReduceUtil 를 사용하면 하나의 테이블에 쓰는 것 밖에 안된다.
그래서 서로 다른 테이블에 데이터를 넣으려면 (TableReducer 를 상속받은) Reducer에서 아래 처럼 해 주고
Put put1 = createPut(...);
context.write(new ImmutableBytesWritable(Bytes.toBytes("table1")), put1);
Put put2 = createPut(...);
context.write(new ImmutableBytesWritable(Bytes.toBytes("table2")), put2);
Job 생성할 때 TableMapReduceUtil 대신 그냥 Reducer 로 등록해준다.
job.setReducerClass(SampleReducer.class); // Reducer 명은 예제임
job.setOutputFormatClass(MultiTableOutputFormat.class);
hbase reference guide 에서는 예제가 없어서 살짝 삽질 했다는 슬픈 이야기가..ㅠㅠ
hbase.apache.org/book.html#mapreduce.example.readwrite.multi
'TIL' 카테고리의 다른 글
TimedSemaphore 를 사용하던 멀티 쓰레드가 종료 안되던 문제 (0) | 2020.12.08 |
---|---|
Producer-Consumer 종료하기 (0) | 2020.12.03 |
셸 업그레이드 후 zsh 가 안되는 문제 (0) | 2020.11.06 |
Java ShutdownHook With Signal (0) | 2020.10.29 |
[Redis] 레디스는 싱글 쓰레드인데 어떻게 동시에 접근하지? (0) | 2020.10.27 |
Comments