정규표현식 검사에서 10MB 문자 데이터를 검사한다고 했을때, 성능을 높이는 방법은?

trymp의 이미지


환경은 fedora linux 64bit 이고요.

10MB 정도 되는 문자 데이터에서 필요로 하는 정규표현식을 검출하고자 합니다.

10MB 사이즈가 커서 이것은 512kB 로 20개 만들어서 검사하는게 나을까요?

아니면 통짜로 10MB 를 할당받아서 검사하는게 빠를까요?

성능상 어떤게 더 나은지 좀 알려주세요.

고수님들의 조언 부탁드립니다.