R로 큰 데이터 셋을 읽고자 합니다.
글쓴이: mandugukbap / 작성시간: 일, 2009/09/27 - 11:25오후
R로 두 개의 로그파일을 이용해 그래프를 만들고자 합니다.
두 로그파일 모두 숫자로 이루어진 한 컬럼짜리 파일들입니다.
문제는 용량이 너무 큽니다.
한 파일은 약 430메가 바이트에 약 150000000라인입니다.
다른 파일은 약 2.4기가 바이트에 약 850000000라인입니다.
제 컴퓨터 (R version 2.8.1 on 윈도우즈XP, AMD 듀얼 5200, 2GB 메모리)로는 "cannot allocate vector of size 500.0 Mb"라며 파일을 읽어 들이지 못합니다.
다른 한 가지 방법으로는 분석을 하는 서버(32GB 메모리)에서는 파일을 불러 읽는게 가능할 듯 한데, 문제는 제가 CCDF, CDF, PDF, QQ-Plot 등의 여러 그래프를 출력해야 하는데 서버로 접속할 수 있는 유일한 방법은 여러대의 서버를 거쳐 SSH로 접속하는 방법 밖에는 없습니다.
질문은
(1) 제 컴퓨터에서 이 크기의 파일들을 분석할 방법이 있을까요?
(2) 분석 서버를 사용할 경우, GUI가 지원되지 않는 환경에서 얻어진 정보를 eps 그래픽 파일로 저장할 수 있는 방법이 있을까요?
(3) 혹은 다른 조언이라도 부탁 드리겠습니다.
Forums:
서버에서 처리
서버에서 처리 가능하면 서버에서 분석하시는 게 좋겠네요.
그래픽을 eps 파일로 저장하기 위해서는 postscript() 함수를
이용하세요. png(), pdf() 등도 있습니다.
====
No one asks you for change or directions.
-- Slo-Mo, J. Krokidas
====
No one asks you for change or directions.
-- Slo-Mo, J. Krokidas
댓글 달기