2014년 2월 18일 화요일

[e-Discovery ⑦] 생산(Production) 과정에 대해

[e-Discovery ⑦] 생산(Production) 과정에 대해
등록 : 14-02-17 17:17 , 데일리시큐 길민권기자 , mkgil@dailysecu.com
e-Discovery 지원 업체의 아시아 언어 대응능력 면밀한 검토 필요
생산(Production)은 변호사의 검토(Review)가 완료된 문서를 소송 상대방에게 전달하기 위해 양측이 합의한 사양과 일정에 맞추어 준비하는 과정이다. e-Discovery에서는 일반적으로 양측 모두 문서의 검토를 위한 별도의 소프트웨어를 사용한다. 그래서 생산을 위해 제공되는 파일들은 소송 당사자들이 사용하는 별도의 e-Discovery시스템에 문서를 업로드(upload) 하기 위해 만들어진 로드 파일(Load File)과 그래픽 파일로 변환된(PDF, TIFF 등) 파일 또는 원본(native) 형태의 파일로 제공되는 것이 일반적이다.

ESI를 그래픽 파일(PDF, TIFF)로 형태를 바꾸어 제공하는 이유는 표면적으로는 데이터의 볼륨 줄이고, 어떠한 열람 소프트웨어 에서도 빠르게 열람이 가능하도록 위함이나, 검토 과정에서 검토되지 않은 (제출대상에 포함되지 않았던) 메타데이터의 영역을 통제할 수 있는 장점이 있어 그래픽 파일도 여전히 생산방법으로써 많이 사용되고 있다.

일반적으로 검토 과정에서의 작업은 문서의 내용(Contents)을 중심으로 이루어지고, 메타데이터 등 데이터의 속성에 대해서는 법무대리인의 확인이 어려운 경우가 많기 때문에 법무 대리인의 검토 과정에서 검토되지 않은 내용이 노출되는 과정을 막기 위해서 TIFF나 PDF(텍스트가 아닌 그래픽 파일로써의)의 형태로 전달을 하는 방식도 전략적으로 활용되곤한다.

생산 과정은 대체로 시간적인 여유 없이 타이트하게 진행되는 과정이기 때문에, 대부분의 경우 초기 협의(Meet&Confer)에서 사양(Specification)을 사전에 결정하고, 결정된 사양에 맞게 정상적으로 검토가 가능한지 표본(sample)을 먼저 제공하게 된다.

사실 이러한 과정은 e-Discovery 지원 업체의 수행 능력과 직접적으로 관련된 부분이므로 작업 시간(Lead Time)의 단축을 위한 절차의 자동화가 많은 역할을 한다. 단, 아시아 언어의 경우는 이러한 처리에서 추가적인 작업 시간을 필요로 하는 경우도 있으므로, e-Discovery 지원 업체의 아시아 언어 대응능력에 대한 면밀한 검토가 필요하다. 또한 소송 비용 관리 전략 측면에 있어 다른 과정에 비해 상대적으로 단가가 저렴한 과정에 속하기 때문에 소송 전략상 활용 가능한 측면도 고려할 필요가 있다.

제공되어야 할 자료로 제출되는 문서 내에 비닉특권(Privileged) 등의 이유로 문서의 일부에서 제외할 필요가 있는 문장이나 단어들은 열람 과정에서 편집하여 소거를 하는 과정을 거친다. 이 때 그러한 과정이 단지 이미지의 덮어쓰기 수준으로, 보이지 않게 덧씌우더라도 검색이 가능한 상태가 되는 솔루션도 여전히 존재할 수도 있으므로 주의해야 한다. 또한 해당 문장이 완전히 소거되었는지 확인도 해야 한다. 이러한 쟁점들이 최근까지 e-Discovery 지원 업체들 중에서 발생되는 경우가 있었고, 이 때 이미 소송 상대방에게 제공된 자료는 소송의 결과에 결정적인 영향을 미치는 문제로 발전된 사례들도 있으므로 품질 통제(Quality Control) 등 생산된 문서를 확인하는 과정을 철저하게 진행하여야 한다.

환수 명령(Clawback Order)은 본의 아니게 소송에서 공개되지 않아도 되는 문서가 생산 과정에서 소송 상대방 법무대리인에게 제공되는 것을 차단할 수 있는 절차이다. 물론 법원에서 그 타당성이 인정되어야만 가능한 과정이지만 수정 등이 제대로 이루어지지 않았거나, 개시문서 관리번호(Bates Number)이나 Load File등에서 발생하는 기술적인 문제로 인해 제출되게 되는 자료에 대해 돌려받을 수 있는 민사 소송 절차인만큼 반드시 인지하고 있어야 한다.

생산 과정에서 생산된 데이터는 소송이 진행되고 있는 해당 국가인 미국으로 데이터가 전달되는 경우가 많다. 생산 이전의 과정들이 대상 기업의 국가 내에서 처리를 해도 문제가 없었지만 데이터가 생산되는 시점에서는 소송 상대방이 위치한 국가인 미국으로 전달되는 것이 일반적이다. 이 때 소송 상대방도 별도의 검토 소프트웨어를 사용할 수 있으므로 보편적인 규격을 EDRM.org에서 제안하였는데 XML의 형태로 공통의 규격을 만듦으로써 호환성을 유지할수 있게 되었다.

                      <그림: 문건을 선택과 변환을 동시에 감독할 수 있도록 고안된 모듈>

미국의 e-Discovery 시장은 어느 정도 성숙 단계에 접어들고 있고, 세부적으로 분업화되어 있다. 미국에서는 EDRM의 모든 과정을 여러 업체가 분담할 만큼 세부적으로 e-Discovery 프로젝트를 진행하는 경우도 있다. 우리나라에 진출한 업체들 중에도 원-스톱 시스템을 지원한다고는 하지만 실제 자체 솔루션 내에서 일부 과정만을 처리하고, 나머지 과정을 미국에서 진행하거나 제3국에서 처리하는 업체도 있다. 이를 맹목적으로 잘못되었다고 할 수는 없지만, 이러한 부분에서 투명성이 확보되지 않은 것은 명백한 문제라고 볼 수 있다. 우리나라에서 이는 ‘재용역’으로 볼 수 있으나 이것은 분명히 전문화 / 분업화의 형태로 이루어지는 장점이 있는 동시에 고객사의 정보가 여러 업체를 통해서 작업이 이루어지면서 보안상의 취약점도 발생한다는 단점도 있으므로 충분한 확인이 필요하다.

◇Load File이란=데이터를 소송 상대방(혹은 사법기관 등)에게 전달할 때 서로 다른 종류의 검토  소프트웨어 에서 각각의 레코드를 정상적으로 연결(구조화)하기위해 레코드를 정의한 목록이다. 이미지(혹은 네이티브)파일을 데이터베이스로 가져오는데 각각의 레코드의 정의(혹은 서술)로 필요한데, 해당 검토 소프트웨어의 호환성이나 데이터를 열람하는 기관(DoJ 미사법부)에 제출되는 경우도 있는데, CSV나 엑셀 스프레드시트의 형태를 띄고 있다. 합의(Meet&Confer)로 정해진 메타 데이터들이 이 파일에 포함된다.

[필자. 박영수 (goodsped76@outlook.com)]
Catalyst Repository System 한국 지사장. 한국 Catalyst의 대표자이자 각종 E-Discovery의 안건들에 대한 전반적인 영역의 컨설팅 및 실무를 담당하고 있다. 2009년부터 현재까지 다년간에 수많은 프로젝트에 대해 실무에서부터 전반적인 프로젝트 관리에 이르는 그의 경험을 토대로, 그는 현재 Catalyst의 한국 시장 진출에 있어 가장 큰 역할을 수행하고 있다. 

2014년 2월 7일 금요일

[e-Discovery ⑥] 문서 검토(Review) 단계

출처 : http://www.dailysecu.com/news_view.php?article_id=6163

Home > 뉴스
뉴스
토픽
[e-Discovery ⑥] 문서 검토(Review) 단계
등록 : 14-02-07 08:38 , 데일리시큐 길민권기자 , mkgil@dailysecu.com
e-Discovery 과정에서 가장 많은 비용 소요되는 상당히 중요한 요소
앞장에서 언급한 처리와 분석을 거친 자료들은 소송 사안과 관련된 것들을 생산(Production)하기 위한 검토가 이루어지게 된다. 이와 더불어 상대편에서 제출된 많은 양의 자료를 검토하는 작업이 될 수도 있다.

문서 검토는 상대편에서 제출된 문서들 또는 상대편에게 제공해야 할 모든 문서들이 검토되어야 하기 때문에 e-Discovery 과정에서 가장 많은 비용이 소요되는 상당히 중요한 요소이다. 2012년 미국의 Rand Corporation 에 의해 발표된 자료 에 의하면 e-Discovey프로젝트에서 비용이 가장 많이 소요되는 부분은 수집(8%)이나 처리, 분석(19%) 단계가 아니라 검토 과정에서 가장 많은 비용(73%)이 소요되고 있는 것으로 확인되었다.

결국 검토 과정에서 전체 비용의 70% 이상이 소요된다는 것은 이 단계가 e-Discovery 비용을 절감시킬 수 있는 분명한 표적임을 알려주고 있는 것이다. 따라서 검토 비용을 감소하기 위한 기업의 끊임없는 요구 사항에 맞추어 갈수록 기술이 진화하고 있는 실정이다.

검토는 검토를 위한 전략, 예산과 기한을 결정하는 계획을 수립함으로써 시작해야 한다. 여기서 수립하는 전략들은 여러 가지가 있을 수 있지만, 공통적으로 검토의 범위를 이해하고 검토자들을 관리하는 통제와 절차가 포함되어야 하며 검토를 위한 적당한 벤더와 플랫폼 등을 선정하는 내용이 반영되어야 할 것이다.

검토 비용은 주로 두 유형의 법적 행위들로 발생하게 되는데 이러한 법적 조치는 검토 과정에서 이루어져야 하는 핵심 요소들이다.

첫 번째 법적 조치는 소송 쟁점에 관련되어 있거나(Responsive) 잠재적으로 관련이 있을 수 있는(Relevant) 문서들을 찾아 식별하는 것인데, 이러한 유형의 검토는 ‘First Pass Review’라고 불리우기도 한다.

두 번째 조치는, 관련되어 있다고 식별된 문서들에 대한 분석을 하여 소송 대응 전략 등이 포함된 비닉특권 정보(Privileged Communication)와 같은 고객의 비밀 정보를 보호하도록 그 정보를 제출 대상에서 제외하거나, 좀더 면밀한 검토를 위해 태그(Tag)하거나 또는 특정 핵심 부분을 보이지 않도록 조치(Redact)하는 것이다.

이와 동시에 기밀성(Confidentiality)에 대한 우려가 없는 특정 쟁점에 대한 세부적인 대응(Responsiveness) 표시 작업을 포함할 수 있는데, 이러한 문서들은 검토 단계를 통하여 다음의 4가지 기준들로 분류될 수 있다.

◇관련성(Relevance): 정보가 소송에서 쟁점이 되는 것과 관련이 있는지에 여부이다. 만약 관련성이 없다면 ‘First Pass Review’ 후 차후 검토에 포함되지는 않지만, 품질 보증(Quality Assurance)절차에서의 결함으로 표본화의 대상이 될 수 있으며 관련이 없다면 상대편에게 제출되어야 할 필요가 없을 것이다.

◇대응성(Responsiveness): 정보가 상대편의 개시 요구사항 또는 규제기관의 조사 요청에 호응하는지에 대한 것이다. 만약 그렇다면, 어떤 제출 요청사항에 그 정보가 호응되는지에 대한 인지를 위해 코드를 표시하여 입력하게 된다. 문서 검토자들은 소송 사안에 핵심적인 정보를 포함하고 특히 호응되는 문서들을 ‘hot’ 문서들로 태그하게 된다.

◇면책특권(Privilege): 변호사-의뢰인 특권, 변호사 Work-Product 원칙 또는 기밀 규칙과 프라이버시 보호법에 해당하는 정보에 대한 것이다. 변호사-의뢰인 특권에 해당하는 요소들로는 법적 조언을 주거나 또는 받은 목적으로, 기밀성을 예상하고 만들어진 변호사 또는 변호사 대행업자와 의뢰인 또는 의뢰인 대행업자 사이에서의 의사소통이 될 수 있다. 만약 이것에 포함된다면, 이것 또한 상대편에게 제출되지 않아도 될 것이다.

◇기밀성(Confidentiality): 기밀 문서의 경우 제출 대상에서 제외가 되어야 한다. 예를 들어, 만약 문서가 한 제과회사의 핵심 생산품인 초콜릿의 레시피와 같은 기업 비밀을 논하고 있다면 그 문서가 상대편에게 제출되어야 할 의무가 없게 되는 것이다. 문서 검토자는 그 문서가 기밀 정보를 포함하고 있는지를 결정하기 위해 그 문서에 대한 분석을 행해야 할 것이다.


만약 그렇다면, 검토자는 의뢰인의 기밀 생산품을 보호하기 위해 특정 부분을 보이지 않도록(Redact)해야 하는지 또는 전적으로 포함되지 않아야 하는지에 대해 결정해야 한다. 특정 부분을 가리는 과정(Redaction)은 원본 문서에서 행하여 지는 것이 아니라 상대편에게 제출되는 복사본에만 이루어지게 된다. 대부분의 검토 플랫폼에서 이 과정은 문서의 복사본으로 TIFF 또는 PDF 형태로 변환된 것에서 까맣게 표시하는 것으로 행해진다.

과거에 검토자들은 많은 양의 문서를 면밀히 살필 필요가 있었지만 지금은 더 이상 그럴 필요가 없어지고 있다. Predictive Coding이라고도 알려진 기술 기반의 검토(Technology-Assisted Review, TAR)는 변호사들의 전문성과 특정 사안에 관련성이 있는 정도(Responsive)에 기반하여 문서들의 검토 순위를 자동화하는 기계학습 기술을 사용하여 이 검토 과정을 자동화하는 기술이 점차 생기고 있는 추세이다.

간단 명료하게 설명하자면, TAR는 변호사가 문서들의 일부를 샘플링하여 대응성(Responsiveness)에 대한 코드를 입력하고, 전문화된 소프트웨어를 사용하여 검토되지 않은 모든 남아있는 문서들에 대해 그 샘플링한 검토 결과를 적용하는 것이다. 결국, 처음 샘플링해서 만들어진 결정에 따라 대응성이 없는(Non-Responsiveness) 것들은 제외되므로 기존보다 적은 비율의 문서들이 검토될 수 있다. 많은 e-Discovery 벤더들이 이 기술을 활용하는 추세이며 이러한 검토 소프트웨어의 역량을 잘 활용하려면 검토가 시작되기 전에 반드시 그 소프트웨어에 대한 기초적인 이해가 필요하다.

관련성, 대응성, 면책특권 및 기밀성에 대한 검토와 더불어 검토 팀은 그 핵심 문서의 정보가 소송에서 주장된 사실 또는 핵심 법적 쟁점과 연관시킬 수 있도록 분석하여야 한다. 문서 검토자들은 또한 핵심 문서들을 그것에 대해 증언하거나 다른 사안에 대한 정보를 식별할 수 있는 핵심 인물들과 연관시키도록 시도해야 한다. 수집된 문서들의 검토와 분석을 기반으로, 법무팀은 소송에서 사실에 기반을 둔 쟁점에 대한 더 많은 이해를 얻어 이것을 바탕으로 소송대응책을 만들어내고 재판에서 증언할 핵심 증인을 식별할 수 있을 것이다.

[필자. 이신형(sophie.shlee@gmail.com)]
University College London, U. of London대학에서 수학과 컴퓨터 공학을 전공하였으며, 고려대학교 정보보호 대학원 과정을 수료후 삼성SDS를 거쳐 국제적인 Risk Management 기업인 Kroll과 Kroll Ontrack에서 오랫동안 아시아 지역에서의 다양한 국제소송 대응 업무 및 국재 중재업무등 다양한 업무에 대한 경험을 가지고 있음. 현재는 한국의 대기업의 미국소송 및 미 사법부 조사등의 다양한 Legal Issue에 대한 실무중심의 연구를 진행하고 있음.

2014년 1월 27일 월요일

[e-Discovery ⑤] 처리와 분석(Processing & Analysis)

출처 : http://www.dailysecu.com/news_view.php?article_id=6103

[e-Discovery ⑤] 처리와 분석(Processing & Analysis)
등록 : 14-01-27 07:17 , 데일리시큐 길민권기자 , mkgil@dailysecu.com
법무대리인의 안건에 대한 이해를 목적으로 이루어지는 작업
처리와 분석 과정은 다소 ‘피상적’으로 관련되어 보이는 데이터만을 선정하여 다음 과정인 검토(Review)를 준비하는 과정이다. ‘피상적’이라는 표현을 하게 된 이유는 이 장에서 필자가 말하고자 하는 핵심이 될 것이다.

처리와 분석 과정에서 이루어지는 작업은 문서의 검토 과정에 앞서 합리적이고, 설명할 수 있는 방법을 통해 방대한 자료 중에서 소송과 잠재적으로 관련된 문서가 다수 존재할 것으로 여겨지는 부분을 걸러내는 작업이고, 법무대리인에 의해 실제 문서의 내용을 검토하는 과정과는 달리 법무대리인의 안건에 대한 이해를 목적으로 이루어지는 작업이다.

수집되어진 데이터는 파일 단위로 복제를 하기도 하지만, 훼손을 방지하기 위해 소송 관련자(Custodian)의 모든 데이터(때로는 삭제영역, 비할당영역 등을 아우르는 전체 데이터)가 저장된 저장장치를 보존하는 것이 일반적인데, 이러한 경우 용량이 방대하여 주어진 시간 내에 모든 문서를 검토할 수 없는 상황에 직면할 수 있으므로 안건에 맞추어 특정 조건의 데이터만을 따로 선별해서 검토할 필요가 있다.

선별 조건의 대부분은 법무대리인에 의해서 결정되는데 이러한 조건을 모든 데이터에 적용하여 열람 가능한 최소한의 데이터로 선별하는(Culling)작업이 처리와 분석 단계에서 이루어진다. 선별 조건은 다양한 것이 있지만 필자는 아래와 같은 방식을 제안한다. (순차적이나 병행 또는 순환하면서 아래와 같은 과정을 거치게 된다.) 아래 열거된 작업들은 업계에서 일반적으로 사용되는 기법인데 e-Discovery 기술 지원 업체마다 자신들만의 기술을 이용한 방법을 추가하기도 한다.


◇De-NISTing
미국 국립표준 연구소(NIST)에서 정의된 NSRL RDS(Reference Data Set)에 의해 사용자가 작성하지 않은 시스템이 자동적으로 생성한 파일이나 각종 어플리케이션에서 참조하는 파일등 불필요한 파일을 hash값을 기준으로 제외하는 과정이며, 통상 운영체제를 담고 있는 영역에서 적용하면 약 2GB정도의 데이터가 제거되는 효과가 있다. 다만 RDS가 미국 기준으로 작성되어 한국에서 사용되는 어플리케이션의 해쉬값이 포함되어 있지 않아서 큰 효과를 기대하기는 어렵다.

◇DeDuplication (Global, Custodian, Near)
한 개 부서의 다수의 대상자의 자료는 필연적으로 동일한 Hash Set을 가진 파일이 다수 발견되는데 이것을 우선순위를 지정하여 우선순위가 가장 높은 대상자의 파일을 제외한 나머지의 중복 파일을 제외한다. 통상 Global과 Custodian으로 적용범위에 따라 구분하며, Near처럼 부분적으로 중복된 것을 분석하는 기법도 사용되기도 한다.

Near DeDuplication의 경우는 한 개의 주제로 여러 번 주고받는 이메일 Thread처럼 중복 부분의 열람을 최소화 하는데 그 목적이 있다. 또한 Family Coding(주석1) 등의 Review과정에서 이뤄지는 반복되는 작업을 감소시켜주는 효과를 기대할 수 있다.

◇File Extension
문서 Review는 대개 인간의 눈으로 읽을 수 있는 문서를 대상으로 하는 경우가 일반적이다. 도면이나 영상파일등을 Review해야 할 필요가 있는 경우도 소송에 따라서는 추가적으로 필요로 하는 경우가 발생하는데 확장자를 기준으로 Review의 필요와 불필요를 사전에 결정하는 것이 일반적이다.

◇Date Filtering
각종 문서와 이메일 – ESI는 Meta Data중 TimeStamp라 하여 생성일시, 최종수정일시, 최근열람일시 등을 기준으로 파일의 속성을 이용해 제외 대상을 선정하기도 한다. 다만 Acquisition의 공정에서 Meta Data에 대한 충분한 보존절차가 수반되지 않은 경우나, DRM등의 복호화 과정을 거친경우에는 본 작업이 적절하지 않을 수도 있으며, 메일 아카이브의 경우는 아카이브 내부의 메시지는 대해서 적용되도록 주의를 기울여야한다.


◇Keyword Search
키워드는 주로 법무대리인에 의해서 주어지는 단어들을 이용해서 전체문서에 대해서 검색을 실시한다. 연관성이 높은(Responsive) 키워드들의 묶음과 공개대상이 아닌 비닉특권(Privilege)등의 이유로 인해 제외되어야할 키워드들의 묶음등 다양한 목적으로 키워드 검색을 실시하며 OR나 AND등으로 이뤄지는 단어의 조합의 검색이 이뤄진다. 좀더 정확한 검색결과를 위해서 아래의 방법들도 함께 사용되는 추세이다.

-Proximity Search(Neighborhood, 근방 검색)
Within Sentence 나 Within Word등으로 설명되어지는 근방검색은 A와 B라는 단어간의 거리가 지정된 기준(단어 혹은 간격)에 부합되는 경우만을 결과로 보는 검색방법이다. 기존의 키워드 검색에서 의도하지 않았던 검색의 오류를 개선시킨 방법이다. 다만 아시아의 2 Byte의 언어와 달리 영미권의 알파벳과의 기호학적 차이로 인해 키워드 선정시에 언어별로 거리기준을 다르게 적용해야 한다. 문법은 아래와 같은 형식으로 이용된다.
DocText near/2 (cable modem, wireless)

-Conceptual Search
실제로 키워드를 선정할 때에는 시행착오를 거치게 된다. 기본적으로 키워드의 선정은 변호사와 사내의 해당 안건의 실무자가 참여하게 되지만, 수십 수백여 개의 키워드를 준비하다보면 종종 놓치기도 한다. Concept Search라 불리우는 이 검색은 본 검색에 앞서 어떠한 키워드들이 존재하는가에 대해 특정 단위내의 문서군(群)에서 단어간의 거리나 출현 빈도 등의 분석으로 단어들의 조합이나 연관성이 있는 키워드를 제안해주는 역할을 하기도 한다.

◇Set Operation (집합 연산)
집합연산은 엄밀히 말하면 분석의 범주에 해당된다고 보기엔 다소 어려움이 있다. 교집합, 합집합 등을 이용해서 Review공정의 우선순위나 절차 등을 정하는데 이용하기도 한다. 이러한 작업을 통해 검토(Review)에 앞서서 제출(Production)되어야 할 대상과 그렇지 않은 대상을 분류하기 위한 사전 검토작업으로써 이용되기도 한다.

위의 과정들을 통해서 전제 데이터(보존된 전체 볼륨)중에서 일반적으로 약 10~20% 수준의 데이터가 최종 검토 대상으로 선별되고, TAR(Tech Assist Review)의 기능이 이 과정에서 활용되기도 한다. (일정 부분 법률 대리인에 의한 학습이 필요하므로 분석의 범주에 넣기에는 다소 애매한 부분이다.)

처리와 분석 과정에서 소송과 무관한 자료를 최대한 제외할 수 있으면 검토 과정에서의 비용을 절감할 수 있지만, 충분한 확인 작업이 이루어지지 않는다면 검토의 대상이 되는 소송과 관련된 자료까지 제외될 수 있으므로 않도록 이에 유의해야 한다. 따라서 본 과정의 기준은 가능한 e-Discovery의 경험이 많은 법무법인 변호사와 e-Discovery 기술 지원 업체, 소송 대상 기업의 관계자들의 긴밀한 협조와 논의 후에 진행되어야 한다.

[용어해설]
1. Family Coding: 메일은 통상 [본문, 첨부문서]의 구성으로 이뤄진 경우가 많고, Embeded 문서는 문서안에 문서가 존재하기도 한다. 이러한 경우 문서와 문서간의 연관관계는 다른 평행적인 관계와 달리 부자관계(Parent-Child Relationship)의 상하관계로 보고 리뷰할 필요가 있다. 대개의 리뷰 솔루션은 이러한 문서의 묶음을 모아서 코딩 할 수 있도록 제공되는 경우가 일반적이다.

1.2. Hash: 데이터의 무결성 및 메시지 인증 등에서 사용되는 함수로써 정보보호의 여러 메커니즘에 사용되는 기술이다. 해시 알고리즘은 임의의 길이의 비트열을 고정된 길이의 출력값인 Hash Code로 압축시키는 함수이며, 암호학적 측면에서 사용되는 대부분의 해시 함수는 강한 충돌 저항성을 필요로 한다. 일치할 확률이 상당히 낮기 때문에 악성코드의 검출 등에 사용되기도 한다.

[필자. 박영수 (goodsped76@outlook.com)]
Catalyst Repository System 한국 지사장. 한국 Catalyst의 대표자이자 각종 E-Discovery의 안건들에 대한 전반적인 영역의 컨설팅 및 실무를 담당하고 있다. 2009년부터 현재까지 다년간에 수많은 프로젝트에 대해 실무에서부터 전반적인 프로젝트 관리에 이르는 그의 경험을 토대로, 그는 현재 Catalyst의 한국 시장 진출에 있어 가장 큰 역할을 수행하고 있다.

2014년 1월 26일 일요일

3 Key Benefits of Email Archiving


아래 article에서는 이메일 아카이빙의 3가지 장점을 다음과 같이 말합니다.

1# Storage of Intellectual Property
#2 Preparation for Legal Discovery
#3 Mining Of Customer Insights

ery business must decide what they do with old emails. Each day most employees send and receive countless emails, some or all of which may contain important information. This information may also be needed at a later date, whether an employee is searching for old correspondence, or a court order requires the business to divulge email records. This blog will detail three key benefits of email archiving in the storage of intellectual property, preparation for legal discovery and mining of customer insights.
1# Storage of Intellectual Property
It has become standard practice in most workplaces to arrive at the office and trudge through your email inbox. Due to this dependence on email there is no doubt that some emails will contain valuable intellectual property, in fact 75% of a companies intellectual property is stored in emails.

Rather than having a filing cabinet brimming with a disarray of papers and business records, it is much better for your business to use an enterprise email archive with quick search and retrieval. This allows anyone in the business to quickly find his or her correspondence, and those in charge to easily monitor and retrieve vital documents. Keeping track of intellectual property at your company is part of insuring the company’s future.





3 Key Benefits of Email Archiving image Email Marketing resized 600

#2 Preparation for Legal Discovery
It is possible that through legal actions a large number of email messages and the data in them will be needed for investigation. This obviously necessitates easy access to employee emails of both current and historical employees. Indeed all businesses are faced with the challenge of providing on-demand access to a continuously growing set of data generated every day.
Dries Moriss an operations director at Securicom, a specialist IT services company, said, “When users can’t access this information when they need it, they can’t do their jobs. Their productivity is hampered. For business continuity, cloud-based email archiving systems must be integrated and they must give users direct access to new and archived email. It’s become expected.”
This has become the new standard for email archiving and not meeting the standard means being unable to complete your work to the best of your ability. This means falling behind both your client’s demands but also your competitors. It is also important that when an employee leaves you know how you are going to access their past emails.
#3 Mining Of Customer Insights
It is common for businesses to conduct an email archive mining process for historical customer insights. In times of urgent recovery of contracts, agreements, relationship communication or even sales rep’s promises, discovery-driven search will need to be made. At less frantic times supporting internal initiatives such as the simple filing and retrieval of client data will become the priority. In both cases the ability to easily access old emails and find crucial pieces of information is essential.

Read more at http://www.business2community.com/tech-gadgets/3-key-benefits-email-archiving-0750434#fY8RVTlrbzPe5y6K.99

2014년 1월 14일 화요일

여기에서 이메일 아카이빙의 목적을 다음과 같이 이야기하고 있습니다.

1. 많은 사용자 저장공간 제공
2. 이메일 저장의 보안
3. 보관의 안정성
4. 이메일을 필요할 때 사용하기 편함
5. 이메일 서버에 비해 보관의 경제성



 Key Features Every Email Archiving System Needs

5 Key Features Every Email Archiving System Needs image e mail archive resized 600
Many businesses and industrial sectors are finding a growing need for reliable email archive systems. As businesses move online, issues previously dealt with by a simple filing cabinet have become traps for those not up to date with current standard digital practice. Whether it is the need to comply with Australian data retention laws, eDiscovery for litigation support or simple preservation of corporate data, email archiving has become crucial for all businesses. This blog addresses 5 key features you should look for in your email archiving system.
1# Offer Unlimited Storage
One major advantage of going digital is the reduction in the need for physical storage space. On the converse, it has now become so easy to communicate by email that a lot of communication previously conducted through other methods (phone or letter) is now conducted by email. This means there is a significant increase in the amount of recorded information people send to each other but a less methodical way of categorising it. In answer to this influx of data any email archiving solution needs to offer unlimited storage.
If you use an on-premise system this could be quite costly, because you will require the expertise to build it from scratch, and then keep up with your growing need for space. Cloud based solutions fix this by offering continuous storage to match data growth. With cloud storage your required data storage space can easily grow and shrink to match your needs, and you will only ever pay for what you use. This offers you the opportunity of a limitless business email archive with an easily controlled cost.
#2 Security & Privacy
Security is a necessary feature of all email archiving systems. You need to focus on three major elements of data security.
  • Physical infrastructure
  • Data encryption
  • Application layer
These three layers of security will help protect you from physical and digital theft. For a discussion of whether cloud based systems or on-site solutions are more effective please have a look at last week’s blog.
#3 Be Robust
The email archive system needs to be robust as it is required to meet day to day use for recall but also be ready in case of litigation, or the need for quick retrieval of key documents. An on-premise email archiving system will be entirely your businesses’ responsibility to manage and maintain. It is a difficult job and for larger businesses one that can require a full-time position. The consistent update of hardware and the maintenance of archives needs attention, not only to continue efficient storage and retrieval, but also to monitor threats to the system.
Cloud based email archiving systems are built and maintained by dedicated professionals and as such are very robust. In this scenario the vendor carries all the burden of creating a robust infrastructure that can accommodate all your storage and retrieval needs.
#4 Be Easy to Use
The three key areas for ease of use are as follows
  • Initial Installation: When you first switch to a new email archiving system it should be intuitive from the start. An on-premise system is obviously more difficult in this instance as it requires installation of hardware and software. Cloud based storage excels in this area as it is conducted by experts who will easily integrate your email archive in to their tried and trusted systems.
  • In Use: This is the most important phase as it is the most common. Your day-to-day storage and retrieval should be seamlessly integrated into your other daily digital activities. This will involve an easy interface with quick search and storage.
  • Ongoing Maintenance: This is not an area of concern if you choose cloud based storage, as experts will be conducting this on a daily basis at whichever vendor you choose. For an on-site solution this will be far more difficult, as it involves employing trained IT staff and the cost of patching and upgrading servers.
#5 Be Economical
This is an obvious key consideration for any email archiving solution. It would pay to consider the price of not only installing new hardware and software systems and integrating them into your business but also the ongoing maintenance and repair costs they will incur. Furthermore, think about whether you will have consistent growth in the need for data storage space or if your business’ growth rate might fluctuate. An excellent feature of cloud based email archives is that you pay for what you use and they can easily adapt to quick growth. There is also the concern of constant servicing, something you can be assured of when using a cloud-based solution but would have to employ a specialist for with the on-site option. Overall it seems that cloud based-solutions have the edge in that they allow you to focus on managing your business without having to focus on managing your infrastructure.
If you would like to read more on cloud storage please download the full report below.

2014년 1월 7일 화요일

[법과시장]E-Discovery와 디지털 포렌식

출처 : http://news.mt.co.kr/mtview.php?no=2014010510374464420

[법과시장]E-Discovery와 디지털 포렌식

머니투데이 김승열 법무법인 양헌 대표변호사/KAIST 겸직 교수 |입력 : 2014.01.06 07:34
image
최근 미국기업이 국내기업을 상대로 낸 지식재산권침해 손해배상청구소송에서 국내기업이 변론전 전자증거조사단계에서 이메일 기록을 의도적으로 삭제했다는 사실이 밝혀졌다.

이에 미국 법원은 배심원에게 미국기업의 주장에 유리하게 증거판단을 하도록 지침을 내렸고 이후 국내기업이 엄청난 배상판결을 받게됐다. 이처럼 지식재산권소송에서 변론전 전자증거조사제도에 대한 대응여부는 기업의 존망을 좌우할 정도로 중요하다.

변론전 전자증거조사제도(E-Discovery)란 무엇일까. 미국에서 비롯된 이 제도는 변론이전에 증인신문, 석명, 문서제출요구, 감정 등 증거조사를 거쳐 변론기일에 집중심리를 유도하는 절차다. 판사앞에서 모든 증거조사가 이뤄지는 우리나라와 대비되는 제도다.

또 디스커버리(E-discovery)는 이를 전자정보에 확대적용하는 것을 말한다. 이는 2006년 12월 1일 미국의 민사소송규칙이 개정되면서 시행됐다.

이 제도의 파급효과는 엄청나다. 전자정보를 쉽게 삭제할 수 있지만 고도의 과학적인 기법을 통해 삭제나 수정여부를 밝힐 수도 있다. 따라서 지식재산권분쟁에서 전자정보를 제대로 조사·수집하고 변형된 정보를 추적하는 조사기법이 소송의 승패를 좌우할 정도로 중요하다.

이 때문에 디지털 포렌식(Digital Forensics) 기법에 관심이 집중되고 있다. 원래 포렌식이라는 용어는 범죄와 관련된 증거물을 과학적으로 찾아낸다는 의미를 가지지만 넓은 의미로는 증거를 조사해 법원에 제출하는 모든 행위를 포함한다. 즉 전자정보 등을 보관·수집·발굴하는 모든 행위를 말하는 것이다.

지식재산권 분쟁 등에서 유·불리한 전자정보를 안전하게 저장하고 이를 추적·발굴하는 것이 현실적으로 가장 중요하다. 앞으로는 디지털 포렌식 전문기법의 활용이 소송의 핵심이 될 전망이다.

이제 우리 기업들도 변론전 전자증거조사제도나 디지털 포렌식에 대하여 관심을 가져야 한다. 전자정보를 체계적으로 분류·보관·저장하고 상대방의 전자정보를 어떻게 추적·조사할 것인지에 대한 연구가 필요하다.

그간 우리나라에서는 디지털 포렌식이 주로 공정위 조사과정이나 형사사건의 조사과정에서 논의되고 활용돼 왔으나 이제는 민사소송에서 이에 대한 철저한 대비가 필요하다. 또 전자정보에 대한 증거조사 절차를 표준화하고 절차별 업무수행에 대한 가이드 라인을 설정하는 등 제도적 정비도 요구된다.

아울러 국경없는 디지털시대에 국내기업의 해외활동지원을 위해 디지털 포렌식산업을 집중 발전시키야 한다. 전문가 양산도 필수적이다. 이제는 분쟁해결절차에 있어서도 디지털 포렌식과 같은 디지털화가 요구되므로 관련 법제도 역시 정비가 절실하다.

민사 증거조사절차에서도 사립탐정을 합법화함으로써 디지털 포렌식산업발전의 원동력이 돼 창조경제의 일익을 담당하기를 기대해본다.