2014년 2월 16일 일요일
2014년 2월 7일 금요일
[e-Discovery ⑥] 문서 검토(Review) 단계
출처 : http://www.dailysecu.com/news_view.php?article_id=6163
Home > 뉴스
뉴스
토픽[e-Discovery ⑥] 문서 검토(Review) 단계 등록 : 14-02-07 08:38 , 데일리시큐 길민권기자 , mkgil@dailysecu.com - e-Discovery 과정에서 가장 많은 비용 소요되는 상당히 중요한 요소
- 앞장에서 언급한 처리와 분석을 거친 자료들은 소송 사안과 관련된 것들을 생산(Production)하기 위한 검토가 이루어지게 된다. 이와 더불어 상대편에서 제출된 많은 양의 자료를 검토하는 작업이 될 수도 있다.
문서 검토는 상대편에서 제출된 문서들 또는 상대편에게 제공해야 할 모든 문서들이 검토되어야 하기 때문에 e-Discovery 과정에서 가장 많은 비용이 소요되는 상당히 중요한 요소이다. 2012년 미국의 Rand Corporation 에 의해 발표된 자료 에 의하면 e-Discovey프로젝트에서 비용이 가장 많이 소요되는 부분은 수집(8%)이나 처리, 분석(19%) 단계가 아니라 검토 과정에서 가장 많은 비용(73%)이 소요되고 있는 것으로 확인되었다.
결국 검토 과정에서 전체 비용의 70% 이상이 소요된다는 것은 이 단계가 e-Discovery 비용을 절감시킬 수 있는 분명한 표적임을 알려주고 있는 것이다. 따라서 검토 비용을 감소하기 위한 기업의 끊임없는 요구 사항에 맞추어 갈수록 기술이 진화하고 있는 실정이다.
검토는 검토를 위한 전략, 예산과 기한을 결정하는 계획을 수립함으로써 시작해야 한다. 여기서 수립하는 전략들은 여러 가지가 있을 수 있지만, 공통적으로 검토의 범위를 이해하고 검토자들을 관리하는 통제와 절차가 포함되어야 하며 검토를 위한 적당한 벤더와 플랫폼 등을 선정하는 내용이 반영되어야 할 것이다.
검토 비용은 주로 두 유형의 법적 행위들로 발생하게 되는데 이러한 법적 조치는 검토 과정에서 이루어져야 하는 핵심 요소들이다.
첫 번째 법적 조치는 소송 쟁점에 관련되어 있거나(Responsive) 잠재적으로 관련이 있을 수 있는(Relevant) 문서들을 찾아 식별하는 것인데, 이러한 유형의 검토는 ‘First Pass Review’라고 불리우기도 한다.
두 번째 조치는, 관련되어 있다고 식별된 문서들에 대한 분석을 하여 소송 대응 전략 등이 포함된 비닉특권 정보(Privileged Communication)와 같은 고객의 비밀 정보를 보호하도록 그 정보를 제출 대상에서 제외하거나, 좀더 면밀한 검토를 위해 태그(Tag)하거나 또는 특정 핵심 부분을 보이지 않도록 조치(Redact)하는 것이다.
이와 동시에 기밀성(Confidentiality)에 대한 우려가 없는 특정 쟁점에 대한 세부적인 대응(Responsiveness) 표시 작업을 포함할 수 있는데, 이러한 문서들은 검토 단계를 통하여 다음의 4가지 기준들로 분류될 수 있다.
◇관련성(Relevance): 정보가 소송에서 쟁점이 되는 것과 관련이 있는지에 여부이다. 만약 관련성이 없다면 ‘First Pass Review’ 후 차후 검토에 포함되지는 않지만, 품질 보증(Quality Assurance)절차에서의 결함으로 표본화의 대상이 될 수 있으며 관련이 없다면 상대편에게 제출되어야 할 필요가 없을 것이다.
◇대응성(Responsiveness): 정보가 상대편의 개시 요구사항 또는 규제기관의 조사 요청에 호응하는지에 대한 것이다. 만약 그렇다면, 어떤 제출 요청사항에 그 정보가 호응되는지에 대한 인지를 위해 코드를 표시하여 입력하게 된다. 문서 검토자들은 소송 사안에 핵심적인 정보를 포함하고 특히 호응되는 문서들을 ‘hot’ 문서들로 태그하게 된다.
◇면책특권(Privilege): 변호사-의뢰인 특권, 변호사 Work-Product 원칙 또는 기밀 규칙과 프라이버시 보호법에 해당하는 정보에 대한 것이다. 변호사-의뢰인 특권에 해당하는 요소들로는 법적 조언을 주거나 또는 받은 목적으로, 기밀성을 예상하고 만들어진 변호사 또는 변호사 대행업자와 의뢰인 또는 의뢰인 대행업자 사이에서의 의사소통이 될 수 있다. 만약 이것에 포함된다면, 이것 또한 상대편에게 제출되지 않아도 될 것이다.
◇기밀성(Confidentiality): 기밀 문서의 경우 제출 대상에서 제외가 되어야 한다. 예를 들어, 만약 문서가 한 제과회사의 핵심 생산품인 초콜릿의 레시피와 같은 기업 비밀을 논하고 있다면 그 문서가 상대편에게 제출되어야 할 의무가 없게 되는 것이다. 문서 검토자는 그 문서가 기밀 정보를 포함하고 있는지를 결정하기 위해 그 문서에 대한 분석을 행해야 할 것이다.
만약 그렇다면, 검토자는 의뢰인의 기밀 생산품을 보호하기 위해 특정 부분을 보이지 않도록(Redact)해야 하는지 또는 전적으로 포함되지 않아야 하는지에 대해 결정해야 한다. 특정 부분을 가리는 과정(Redaction)은 원본 문서에서 행하여 지는 것이 아니라 상대편에게 제출되는 복사본에만 이루어지게 된다. 대부분의 검토 플랫폼에서 이 과정은 문서의 복사본으로 TIFF 또는 PDF 형태로 변환된 것에서 까맣게 표시하는 것으로 행해진다.
과거에 검토자들은 많은 양의 문서를 면밀히 살필 필요가 있었지만 지금은 더 이상 그럴 필요가 없어지고 있다. Predictive Coding이라고도 알려진 기술 기반의 검토(Technology-Assisted Review, TAR)는 변호사들의 전문성과 특정 사안에 관련성이 있는 정도(Responsive)에 기반하여 문서들의 검토 순위를 자동화하는 기계학습 기술을 사용하여 이 검토 과정을 자동화하는 기술이 점차 생기고 있는 추세이다.
간단 명료하게 설명하자면, TAR는 변호사가 문서들의 일부를 샘플링하여 대응성(Responsiveness)에 대한 코드를 입력하고, 전문화된 소프트웨어를 사용하여 검토되지 않은 모든 남아있는 문서들에 대해 그 샘플링한 검토 결과를 적용하는 것이다. 결국, 처음 샘플링해서 만들어진 결정에 따라 대응성이 없는(Non-Responsiveness) 것들은 제외되므로 기존보다 적은 비율의 문서들이 검토될 수 있다. 많은 e-Discovery 벤더들이 이 기술을 활용하는 추세이며 이러한 검토 소프트웨어의 역량을 잘 활용하려면 검토가 시작되기 전에 반드시 그 소프트웨어에 대한 기초적인 이해가 필요하다.
관련성, 대응성, 면책특권 및 기밀성에 대한 검토와 더불어 검토 팀은 그 핵심 문서의 정보가 소송에서 주장된 사실 또는 핵심 법적 쟁점과 연관시킬 수 있도록 분석하여야 한다. 문서 검토자들은 또한 핵심 문서들을 그것에 대해 증언하거나 다른 사안에 대한 정보를 식별할 수 있는 핵심 인물들과 연관시키도록 시도해야 한다. 수집된 문서들의 검토와 분석을 기반으로, 법무팀은 소송에서 사실에 기반을 둔 쟁점에 대한 더 많은 이해를 얻어 이것을 바탕으로 소송대응책을 만들어내고 재판에서 증언할 핵심 증인을 식별할 수 있을 것이다.
[필자. 이신형(sophie.shlee@gmail.com)]University College London, U. of London대학에서 수학과 컴퓨터 공학을 전공하였으며, 고려대학교 정보보호 대학원 과정을 수료후 삼성SDS를 거쳐 국제적인 Risk Management 기업인 Kroll과 Kroll Ontrack에서 오랫동안 아시아 지역에서의 다양한 국제소송 대응 업무 및 국재 중재업무등 다양한 업무에 대한 경험을 가지고 있음. 현재는 한국의 대기업의 미국소송 및 미 사법부 조사등의 다양한 Legal Issue에 대한 실무중심의 연구를 진행하고 있음.
2014년 1월 27일 월요일
[e-Discovery ⑤] 처리와 분석(Processing & Analysis)
출처 : http://www.dailysecu.com/news_view.php?article_id=6103
법무대리인의 안건에 대한 이해를 목적으로 이루어지는 작업 처리와 분석 과정은 다소 ‘피상적’으로 관련되어 보이는 데이터만을 선정하여 다음 과정인 검토(Review)를 준비하는 과정이다. ‘피상적’이라는 표현을 하게 된 이유는 이 장에서 필자가 말하고자 하는 핵심이 될 것이다.
처리와 분석 과정에서 이루어지는 작업은 문서의 검토 과정에 앞서 합리적이고, 설명할 수 있는 방법을 통해 방대한 자료 중에서 소송과 잠재적으로 관련된 문서가 다수 존재할 것으로 여겨지는 부분을 걸러내는 작업이고, 법무대리인에 의해 실제 문서의 내용을 검토하는 과정과는 달리 법무대리인의 안건에 대한 이해를 목적으로 이루어지는 작업이다.
수집되어진 데이터는 파일 단위로 복제를 하기도 하지만, 훼손을 방지하기 위해 소송 관련자(Custodian)의 모든 데이터(때로는 삭제영역, 비할당영역 등을 아우르는 전체 데이터)가 저장된 저장장치를 보존하는 것이 일반적인데, 이러한 경우 용량이 방대하여 주어진 시간 내에 모든 문서를 검토할 수 없는 상황에 직면할 수 있으므로 안건에 맞추어 특정 조건의 데이터만을 따로 선별해서 검토할 필요가 있다.
선별 조건의 대부분은 법무대리인에 의해서 결정되는데 이러한 조건을 모든 데이터에 적용하여 열람 가능한 최소한의 데이터로 선별하는(Culling)작업이 처리와 분석 단계에서 이루어진다. 선별 조건은 다양한 것이 있지만 필자는 아래와 같은 방식을 제안한다. (순차적이나 병행 또는 순환하면서 아래와 같은 과정을 거치게 된다.) 아래 열거된 작업들은 업계에서 일반적으로 사용되는 기법인데 e-Discovery 기술 지원 업체마다 자신들만의 기술을 이용한 방법을 추가하기도 한다.
◇De-NISTing
미국 국립표준 연구소(NIST)에서 정의된 NSRL RDS(Reference Data Set)에 의해 사용자가 작성하지 않은 시스템이 자동적으로 생성한 파일이나 각종 어플리케이션에서 참조하는 파일등 불필요한 파일을 hash값을 기준으로 제외하는 과정이며, 통상 운영체제를 담고 있는 영역에서 적용하면 약 2GB정도의 데이터가 제거되는 효과가 있다. 다만 RDS가 미국 기준으로 작성되어 한국에서 사용되는 어플리케이션의 해쉬값이 포함되어 있지 않아서 큰 효과를 기대하기는 어렵다.
◇DeDuplication (Global, Custodian, Near)
한 개 부서의 다수의 대상자의 자료는 필연적으로 동일한 Hash Set을 가진 파일이 다수 발견되는데 이것을 우선순위를 지정하여 우선순위가 가장 높은 대상자의 파일을 제외한 나머지의 중복 파일을 제외한다. 통상 Global과 Custodian으로 적용범위에 따라 구분하며, Near처럼 부분적으로 중복된 것을 분석하는 기법도 사용되기도 한다.
Near DeDuplication의 경우는 한 개의 주제로 여러 번 주고받는 이메일 Thread처럼 중복 부분의 열람을 최소화 하는데 그 목적이 있다. 또한 Family Coding(주석1) 등의 Review과정에서 이뤄지는 반복되는 작업을 감소시켜주는 효과를 기대할 수 있다.
◇File Extension
문서 Review는 대개 인간의 눈으로 읽을 수 있는 문서를 대상으로 하는 경우가 일반적이다. 도면이나 영상파일등을 Review해야 할 필요가 있는 경우도 소송에 따라서는 추가적으로 필요로 하는 경우가 발생하는데 확장자를 기준으로 Review의 필요와 불필요를 사전에 결정하는 것이 일반적이다.
◇Date Filtering
각종 문서와 이메일 – ESI는 Meta Data중 TimeStamp라 하여 생성일시, 최종수정일시, 최근열람일시 등을 기준으로 파일의 속성을 이용해 제외 대상을 선정하기도 한다. 다만 Acquisition의 공정에서 Meta Data에 대한 충분한 보존절차가 수반되지 않은 경우나, DRM등의 복호화 과정을 거친경우에는 본 작업이 적절하지 않을 수도 있으며, 메일 아카이브의 경우는 아카이브 내부의 메시지는 대해서 적용되도록 주의를 기울여야한다.
◇Keyword Search
키워드는 주로 법무대리인에 의해서 주어지는 단어들을 이용해서 전체문서에 대해서 검색을 실시한다. 연관성이 높은(Responsive) 키워드들의 묶음과 공개대상이 아닌 비닉특권(Privilege)등의 이유로 인해 제외되어야할 키워드들의 묶음등 다양한 목적으로 키워드 검색을 실시하며 OR나 AND등으로 이뤄지는 단어의 조합의 검색이 이뤄진다. 좀더 정확한 검색결과를 위해서 아래의 방법들도 함께 사용되는 추세이다.
-Proximity Search(Neighborhood, 근방 검색)
Within Sentence 나 Within Word등으로 설명되어지는 근방검색은 A와 B라는 단어간의 거리가 지정된 기준(단어 혹은 간격)에 부합되는 경우만을 결과로 보는 검색방법이다. 기존의 키워드 검색에서 의도하지 않았던 검색의 오류를 개선시킨 방법이다. 다만 아시아의 2 Byte의 언어와 달리 영미권의 알파벳과의 기호학적 차이로 인해 키워드 선정시에 언어별로 거리기준을 다르게 적용해야 한다. 문법은 아래와 같은 형식으로 이용된다.
DocText near/2 (cable modem, wireless)
-Conceptual Search
실제로 키워드를 선정할 때에는 시행착오를 거치게 된다. 기본적으로 키워드의 선정은 변호사와 사내의 해당 안건의 실무자가 참여하게 되지만, 수십 수백여 개의 키워드를 준비하다보면 종종 놓치기도 한다. Concept Search라 불리우는 이 검색은 본 검색에 앞서 어떠한 키워드들이 존재하는가에 대해 특정 단위내의 문서군(群)에서 단어간의 거리나 출현 빈도 등의 분석으로 단어들의 조합이나 연관성이 있는 키워드를 제안해주는 역할을 하기도 한다.
◇Set Operation (집합 연산)
집합연산은 엄밀히 말하면 분석의 범주에 해당된다고 보기엔 다소 어려움이 있다. 교집합, 합집합 등을 이용해서 Review공정의 우선순위나 절차 등을 정하는데 이용하기도 한다. 이러한 작업을 통해 검토(Review)에 앞서서 제출(Production)되어야 할 대상과 그렇지 않은 대상을 분류하기 위한 사전 검토작업으로써 이용되기도 한다.
위의 과정들을 통해서 전제 데이터(보존된 전체 볼륨)중에서 일반적으로 약 10~20% 수준의 데이터가 최종 검토 대상으로 선별되고, TAR(Tech Assist Review)의 기능이 이 과정에서 활용되기도 한다. (일정 부분 법률 대리인에 의한 학습이 필요하므로 분석의 범주에 넣기에는 다소 애매한 부분이다.)
처리와 분석 과정에서 소송과 무관한 자료를 최대한 제외할 수 있으면 검토 과정에서의 비용을 절감할 수 있지만, 충분한 확인 작업이 이루어지지 않는다면 검토의 대상이 되는 소송과 관련된 자료까지 제외될 수 있으므로 않도록 이에 유의해야 한다. 따라서 본 과정의 기준은 가능한 e-Discovery의 경험이 많은 법무법인 변호사와 e-Discovery 기술 지원 업체, 소송 대상 기업의 관계자들의 긴밀한 협조와 논의 후에 진행되어야 한다.
[용어해설]
1. Family Coding: 메일은 통상 [본문, 첨부문서]의 구성으로 이뤄진 경우가 많고, Embeded 문서는 문서안에 문서가 존재하기도 한다. 이러한 경우 문서와 문서간의 연관관계는 다른 평행적인 관계와 달리 부자관계(Parent-Child Relationship)의 상하관계로 보고 리뷰할 필요가 있다. 대개의 리뷰 솔루션은 이러한 문서의 묶음을 모아서 코딩 할 수 있도록 제공되는 경우가 일반적이다.
1.2. Hash: 데이터의 무결성 및 메시지 인증 등에서 사용되는 함수로써 정보보호의 여러 메커니즘에 사용되는 기술이다. 해시 알고리즘은 임의의 길이의 비트열을 고정된 길이의 출력값인 Hash Code로 압축시키는 함수이며, 암호학적 측면에서 사용되는 대부분의 해시 함수는 강한 충돌 저항성을 필요로 한다. 일치할 확률이 상당히 낮기 때문에 악성코드의 검출 등에 사용되기도 한다.
[필자. 박영수 (goodsped76@outlook.com)]
Catalyst Repository System 한국 지사장. 한국 Catalyst의 대표자이자 각종 E-Discovery의 안건들에 대한 전반적인 영역의 컨설팅 및 실무를 담당하고 있다. 2009년부터 현재까지 다년간에 수많은 프로젝트에 대해 실무에서부터 전반적인 프로젝트 관리에 이르는 그의 경험을 토대로, 그는 현재 Catalyst의 한국 시장 진출에 있어 가장 큰 역할을 수행하고 있다.
| [e-Discovery ⑤] 처리와 분석(Processing & Analysis) |
| 등록 : 14-01-27 07:17 , 데일리시큐 길민권기자 , mkgil@dailysecu.com |
처리와 분석 과정에서 이루어지는 작업은 문서의 검토 과정에 앞서 합리적이고, 설명할 수 있는 방법을 통해 방대한 자료 중에서 소송과 잠재적으로 관련된 문서가 다수 존재할 것으로 여겨지는 부분을 걸러내는 작업이고, 법무대리인에 의해 실제 문서의 내용을 검토하는 과정과는 달리 법무대리인의 안건에 대한 이해를 목적으로 이루어지는 작업이다.
수집되어진 데이터는 파일 단위로 복제를 하기도 하지만, 훼손을 방지하기 위해 소송 관련자(Custodian)의 모든 데이터(때로는 삭제영역, 비할당영역 등을 아우르는 전체 데이터)가 저장된 저장장치를 보존하는 것이 일반적인데, 이러한 경우 용량이 방대하여 주어진 시간 내에 모든 문서를 검토할 수 없는 상황에 직면할 수 있으므로 안건에 맞추어 특정 조건의 데이터만을 따로 선별해서 검토할 필요가 있다.
선별 조건의 대부분은 법무대리인에 의해서 결정되는데 이러한 조건을 모든 데이터에 적용하여 열람 가능한 최소한의 데이터로 선별하는(Culling)작업이 처리와 분석 단계에서 이루어진다. 선별 조건은 다양한 것이 있지만 필자는 아래와 같은 방식을 제안한다. (순차적이나 병행 또는 순환하면서 아래와 같은 과정을 거치게 된다.) 아래 열거된 작업들은 업계에서 일반적으로 사용되는 기법인데 e-Discovery 기술 지원 업체마다 자신들만의 기술을 이용한 방법을 추가하기도 한다.
◇De-NISTing
미국 국립표준 연구소(NIST)에서 정의된 NSRL RDS(Reference Data Set)에 의해 사용자가 작성하지 않은 시스템이 자동적으로 생성한 파일이나 각종 어플리케이션에서 참조하는 파일등 불필요한 파일을 hash값을 기준으로 제외하는 과정이며, 통상 운영체제를 담고 있는 영역에서 적용하면 약 2GB정도의 데이터가 제거되는 효과가 있다. 다만 RDS가 미국 기준으로 작성되어 한국에서 사용되는 어플리케이션의 해쉬값이 포함되어 있지 않아서 큰 효과를 기대하기는 어렵다.
◇DeDuplication (Global, Custodian, Near)
한 개 부서의 다수의 대상자의 자료는 필연적으로 동일한 Hash Set을 가진 파일이 다수 발견되는데 이것을 우선순위를 지정하여 우선순위가 가장 높은 대상자의 파일을 제외한 나머지의 중복 파일을 제외한다. 통상 Global과 Custodian으로 적용범위에 따라 구분하며, Near처럼 부분적으로 중복된 것을 분석하는 기법도 사용되기도 한다.
Near DeDuplication의 경우는 한 개의 주제로 여러 번 주고받는 이메일 Thread처럼 중복 부분의 열람을 최소화 하는데 그 목적이 있다. 또한 Family Coding(주석1) 등의 Review과정에서 이뤄지는 반복되는 작업을 감소시켜주는 효과를 기대할 수 있다.
◇File Extension
문서 Review는 대개 인간의 눈으로 읽을 수 있는 문서를 대상으로 하는 경우가 일반적이다. 도면이나 영상파일등을 Review해야 할 필요가 있는 경우도 소송에 따라서는 추가적으로 필요로 하는 경우가 발생하는데 확장자를 기준으로 Review의 필요와 불필요를 사전에 결정하는 것이 일반적이다.
◇Date Filtering
각종 문서와 이메일 – ESI는 Meta Data중 TimeStamp라 하여 생성일시, 최종수정일시, 최근열람일시 등을 기준으로 파일의 속성을 이용해 제외 대상을 선정하기도 한다. 다만 Acquisition의 공정에서 Meta Data에 대한 충분한 보존절차가 수반되지 않은 경우나, DRM등의 복호화 과정을 거친경우에는 본 작업이 적절하지 않을 수도 있으며, 메일 아카이브의 경우는 아카이브 내부의 메시지는 대해서 적용되도록 주의를 기울여야한다.
◇Keyword Search
키워드는 주로 법무대리인에 의해서 주어지는 단어들을 이용해서 전체문서에 대해서 검색을 실시한다. 연관성이 높은(Responsive) 키워드들의 묶음과 공개대상이 아닌 비닉특권(Privilege)등의 이유로 인해 제외되어야할 키워드들의 묶음등 다양한 목적으로 키워드 검색을 실시하며 OR나 AND등으로 이뤄지는 단어의 조합의 검색이 이뤄진다. 좀더 정확한 검색결과를 위해서 아래의 방법들도 함께 사용되는 추세이다.
-Proximity Search(Neighborhood, 근방 검색)
Within Sentence 나 Within Word등으로 설명되어지는 근방검색은 A와 B라는 단어간의 거리가 지정된 기준(단어 혹은 간격)에 부합되는 경우만을 결과로 보는 검색방법이다. 기존의 키워드 검색에서 의도하지 않았던 검색의 오류를 개선시킨 방법이다. 다만 아시아의 2 Byte의 언어와 달리 영미권의 알파벳과의 기호학적 차이로 인해 키워드 선정시에 언어별로 거리기준을 다르게 적용해야 한다. 문법은 아래와 같은 형식으로 이용된다.
DocText near/2 (cable modem, wireless)
-Conceptual Search
실제로 키워드를 선정할 때에는 시행착오를 거치게 된다. 기본적으로 키워드의 선정은 변호사와 사내의 해당 안건의 실무자가 참여하게 되지만, 수십 수백여 개의 키워드를 준비하다보면 종종 놓치기도 한다. Concept Search라 불리우는 이 검색은 본 검색에 앞서 어떠한 키워드들이 존재하는가에 대해 특정 단위내의 문서군(群)에서 단어간의 거리나 출현 빈도 등의 분석으로 단어들의 조합이나 연관성이 있는 키워드를 제안해주는 역할을 하기도 한다.
◇Set Operation (집합 연산)
집합연산은 엄밀히 말하면 분석의 범주에 해당된다고 보기엔 다소 어려움이 있다. 교집합, 합집합 등을 이용해서 Review공정의 우선순위나 절차 등을 정하는데 이용하기도 한다. 이러한 작업을 통해 검토(Review)에 앞서서 제출(Production)되어야 할 대상과 그렇지 않은 대상을 분류하기 위한 사전 검토작업으로써 이용되기도 한다.
위의 과정들을 통해서 전제 데이터(보존된 전체 볼륨)중에서 일반적으로 약 10~20% 수준의 데이터가 최종 검토 대상으로 선별되고, TAR(Tech Assist Review)의 기능이 이 과정에서 활용되기도 한다. (일정 부분 법률 대리인에 의한 학습이 필요하므로 분석의 범주에 넣기에는 다소 애매한 부분이다.)
처리와 분석 과정에서 소송과 무관한 자료를 최대한 제외할 수 있으면 검토 과정에서의 비용을 절감할 수 있지만, 충분한 확인 작업이 이루어지지 않는다면 검토의 대상이 되는 소송과 관련된 자료까지 제외될 수 있으므로 않도록 이에 유의해야 한다. 따라서 본 과정의 기준은 가능한 e-Discovery의 경험이 많은 법무법인 변호사와 e-Discovery 기술 지원 업체, 소송 대상 기업의 관계자들의 긴밀한 협조와 논의 후에 진행되어야 한다.
[용어해설]
1. Family Coding: 메일은 통상 [본문, 첨부문서]의 구성으로 이뤄진 경우가 많고, Embeded 문서는 문서안에 문서가 존재하기도 한다. 이러한 경우 문서와 문서간의 연관관계는 다른 평행적인 관계와 달리 부자관계(Parent-Child Relationship)의 상하관계로 보고 리뷰할 필요가 있다. 대개의 리뷰 솔루션은 이러한 문서의 묶음을 모아서 코딩 할 수 있도록 제공되는 경우가 일반적이다.
1.2. Hash: 데이터의 무결성 및 메시지 인증 등에서 사용되는 함수로써 정보보호의 여러 메커니즘에 사용되는 기술이다. 해시 알고리즘은 임의의 길이의 비트열을 고정된 길이의 출력값인 Hash Code로 압축시키는 함수이며, 암호학적 측면에서 사용되는 대부분의 해시 함수는 강한 충돌 저항성을 필요로 한다. 일치할 확률이 상당히 낮기 때문에 악성코드의 검출 등에 사용되기도 한다.
[필자. 박영수 (goodsped76@outlook.com)]
2014년 1월 26일 일요일
3 Key Benefits of Email Archiving
아래 article에서는 이메일 아카이빙의 3가지 장점을 다음과 같이 말합니다.
1# Storage of Intellectual Property
#2 Preparation for Legal Discovery
#3 Mining Of Customer Insights
ery business must decide what they do with old emails. Each day most employees send and receive countless emails, some or all of which may contain important information. This information may also be needed at a later date, whether an employee is searching for old correspondence, or a court order requires the business to divulge email records. This blog will detail three key benefits of email archiving in the storage of intellectual property, preparation for legal discovery and mining of customer insights.
1# Storage of Intellectual Property
It has become standard practice in most workplaces to arrive at the office and trudge through your email inbox. Due to this dependence on email there is no doubt that some emails will contain valuable intellectual property, in fact 75% of a companies intellectual property is stored in emails.
Rather than having a filing cabinet brimming with a disarray of papers and business records, it is much better for your business to use an enterprise email archive with quick search and retrieval. This allows anyone in the business to quickly find his or her correspondence, and those in charge to easily monitor and retrieve vital documents. Keeping track of intellectual property at your company is part of insuring the company’s future.
#2 Preparation for Legal Discovery
It is possible that through legal actions a large number of email messages and the data in them will be needed for investigation. This obviously necessitates easy access to employee emails of both current and historical employees. Indeed all businesses are faced with the challenge of providing on-demand access to a continuously growing set of data generated every day.
Dries Moriss an operations director at Securicom, a specialist IT services company, said, “When users can’t access this information when they need it, they can’t do their jobs. Their productivity is hampered. For business continuity, cloud-based email archiving systems must be integrated and they must give users direct access to new and archived email. It’s become expected.”
This has become the new standard for email archiving and not meeting the standard means being unable to complete your work to the best of your ability. This means falling behind both your client’s demands but also your competitors. It is also important that when an employee leaves you know how you are going to access their past emails.
#3 Mining Of Customer Insights
It is common for businesses to conduct an email archive mining process for historical customer insights. In times of urgent recovery of contracts, agreements, relationship communication or even sales rep’s promises, discovery-driven search will need to be made. At less frantic times supporting internal initiatives such as the simple filing and retrieval of client data will become the priority. In both cases the ability to easily access old emails and find crucial pieces of information is essential.
Read more at http://www.business2community.com/tech-gadgets/3-key-benefits-email-archiving-0750434#fY8RVTlrbzPe5y6K.99
2014년 1월 14일 화요일
여기에서 이메일 아카이빙의 목적을 다음과 같이 이야기하고 있습니다.
1. 많은 사용자 저장공간 제공
2. 이메일 저장의 보안
3. 보관의 안정성
4. 이메일을 필요할 때 사용하기 편함
5. 이메일 서버에 비해 보관의 경제성
1. 많은 사용자 저장공간 제공
2. 이메일 저장의 보안
3. 보관의 안정성
4. 이메일을 필요할 때 사용하기 편함
5. 이메일 서버에 비해 보관의 경제성
Key Features Every Email Archiving System Needs
By Russell de Vries, Published January 14, 2014
Be the first to comment!
Many businesses and industrial sectors are finding a growing need for reliable email archive systems. As businesses move online, issues previously dealt with by a simple filing cabinet have become traps for those not up to date with current standard digital practice. Whether it is the need to comply with Australian data retention laws, eDiscovery for litigation support or simple preservation of corporate data, email archiving has become crucial for all businesses. This blog addresses 5 key features you should look for in your email archiving system.
1# Offer Unlimited Storage
One major advantage of going digital is the reduction in the need for physical storage space. On the converse, it has now become so easy to communicate by email that a lot of communication previously conducted through other methods (phone or letter) is now conducted by email. This means there is a significant increase in the amount of recorded information people send to each other but a less methodical way of categorising it. In answer to this influx of data any email archiving solution needs to offer unlimited storage.
If you use an on-premise system this could be quite costly, because you will require the expertise to build it from scratch, and then keep up with your growing need for space. Cloud based solutions fix this by offering continuous storage to match data growth. With cloud storage your required data storage space can easily grow and shrink to match your needs, and you will only ever pay for what you use. This offers you the opportunity of a limitless business email archive with an easily controlled cost.
#2 Security & Privacy
Security is a necessary feature of all email archiving systems. You need to focus on three major elements of data security.
- Physical infrastructure
- Data encryption
- Application layer
These three layers of security will help protect you from physical and digital theft. For a discussion of whether cloud based systems or on-site solutions are more effective please have a look at last week’s blog.
#3 Be Robust
The email archive system needs to be robust as it is required to meet day to day use for recall but also be ready in case of litigation, or the need for quick retrieval of key documents. An on-premise email archiving system will be entirely your businesses’ responsibility to manage and maintain. It is a difficult job and for larger businesses one that can require a full-time position. The consistent update of hardware and the maintenance of archives needs attention, not only to continue efficient storage and retrieval, but also to monitor threats to the system.
Cloud based email archiving systems are built and maintained by dedicated professionals and as such are very robust. In this scenario the vendor carries all the burden of creating a robust infrastructure that can accommodate all your storage and retrieval needs.
#4 Be Easy to Use
The three key areas for ease of use are as follows
- Initial Installation: When you first switch to a new email archiving system it should be intuitive from the start. An on-premise system is obviously more difficult in this instance as it requires installation of hardware and software. Cloud based storage excels in this area as it is conducted by experts who will easily integrate your email archive in to their tried and trusted systems.
- In Use: This is the most important phase as it is the most common. Your day-to-day storage and retrieval should be seamlessly integrated into your other daily digital activities. This will involve an easy interface with quick search and storage.
- Ongoing Maintenance: This is not an area of concern if you choose cloud based storage, as experts will be conducting this on a daily basis at whichever vendor you choose. For an on-site solution this will be far more difficult, as it involves employing trained IT staff and the cost of patching and upgrading servers.
#5 Be Economical
This is an obvious key consideration for any email archiving solution. It would pay to consider the price of not only installing new hardware and software systems and integrating them into your business but also the ongoing maintenance and repair costs they will incur. Furthermore, think about whether you will have consistent growth in the need for data storage space or if your business’ growth rate might fluctuate. An excellent feature of cloud based email archives is that you pay for what you use and they can easily adapt to quick growth. There is also the concern of constant servicing, something you can be assured of when using a cloud-based solution but would have to employ a specialist for with the on-site option. Overall it seems that cloud based-solutions have the edge in that they allow you to focus on managing your business without having to focus on managing your infrastructure.
If you would like to read more on cloud storage please download the full report below.
2014년 1월 7일 화요일
2014년 1월 2일 목요일
[e-Discovery ④] 수집과 보존 절차에 대해
출처 : http://www.dailysecu.com/news_view.php?article_id=5947
ESI 보존과 수집 절차는 e-Discovery에 있어 매우 중요한 역할 앞서 3장에서 e-Discovery의 기본 모델 중 하나인 EDRM 모델에서 식별(Identification)까지 다루었고 이제 4장에서는 수집과 보존에 대해서 알아보고자 한다.
1. 보존 (Preservation)
미국법에서 e-Discovery제도에서 적절한 증거수집이 가능하도록하는 절차로써 Litigation Hold를 관련자와 정보관리 부서에 우선적으로 통지하는 과정을 거친다. Litigation Hold에 대한 정의는 e-Discovery에 이르러 좀더 구체적인 내용을 담고 있다.
◇민사소송에서의 Litigation Hold
A notice issues in anticipation of a lawsuit or investigation, ordering employees to
preserve documents and other materials relevant to that lawsuit or investigation
◇e-Discovery에서의 Litigation hold
An order issued by an attorney to a client telling that client’s employees and
associates to stop the routine handling of all ESI, especially as that routine involves
the deletion of ESI.
Litigation Hold는 소송에 대해 인지한 순간 혹은 소송에 관련될 것이 합리적으로 예상 가능해진 시점부터 가능한 신속하게 실시되어야 한다. 이렇게 증거에 대한 보존의 의무(Duty of Preserve)가 발생하게 되면 그 즉시 증거의 보존을 위한 최대한의 노력을 다해야 한다.
이런 최대한의 노력을 인정받기 위해서 소송 당사자(회사)는 사건과 관련될 수 있는 자료를 보유하고 있거나 또는 그러한 자료에 접근할 수 있는 권한을 가진 구성원들에게 아래와 같은 내용으로 고지가 이뤄져야한다.
1) (어떤 이슈로 인하여)소송이 발생하였거나 또는 발생할 가능성이 있다는 점
2) 소송과 관련된 자료의 보존이 필요하다는 점
3) 보존이 필요한 대상 자료의 범위
4) 보존이 필요한 대상 자료의 변경 또는 파기가 중단되어야 한다는 점
이 때 ‘자료’는 종이 문서뿐만 아니라 ESI(Electronically Stored Information)로써 이메일, 문서 파일 데이터 베이스 등을 포함한다.
특히 주의할 사항은 회사의 정보 관리 시스템에 따라 순차적, 그리고 정기적으로 오래된 전자 문서 및 이메일 등이 자동으로 파기 되는 경우가 발생하는데, 증거 보존의 의무가 발생하면 보존해야 할 자료에 대해서는 즉각적으로 자동 파기정책 등을 중단해야한다.
이렇게 ESI의 보존 절차는 e-Discovery 제도에 있어 증거의 보존이라는 매우 중요한 역할을 하고 있다. 이런 보전 의무을 제대로 수행하지 못한 경우 실제 소송에서 유리한 증거로써 채택되지 않을 수도 있으며, 고의로 증거를 인멸한 혐의로 소송에서 벌금 등의 제재를 받을 수 있고, 보존의 의무를 게을리 한 것으로 제재를 받을 수도 있으며 나아가 소송에 불리한 결과로 작용할 수 있다.
2. 수집 (Collection)
이렇게 e-Discovery에서 Litigation Hold에 따라 잠재적으로 소송과 관련된 증거들에 대한 보존 의무를 수행하고 해당 ESI로 소송에 대응할 수 있도록 e-Discovery 절차에 준해 사용할 수 있는 완벽한 사본을 생성하는 단계를 말한다.
수집단계에서는 소송 당사자(회사)에서 관리하는 다양한 형태로 이뤄진 ESI를 증거로서의 효력을 가질 수 있도록 사전에 이뤄진 협의(Meet&Confer)를 통해 결정된 방식으로 수집을 진행한다. 일반적으로 연방 증거 규칙에 명시된 증거의 가용성에 부합하기 위해 원본을 보존하고, 포렌식 복제를 통해 사본을 생성하여 분석을 한다.
수집은 예전에는 소송 당사자(회사)에서 다루는 모든 ESI를 수집하는 형태였지만 최근에는 소송 당사자(회사)의 정보 유출 위험 및 비용 절감을 위해 사전에 필요한 자료의 수집대상을 정하고, 그렇게 정해진 ESI만 수집하는 형태로 발전하고 있다.
수집 단계에서 사용하는 포렌식 복제를 사용하는 이유는
1. 복제된 ESI가 원본과 동일함을 증명하여 증거로서의 효력을 가질 수 있게 한다.
2. 수집된 대상의 저장 매체에 삭제(또는 비할당) 영역까지 수집하여 필요시에는 제공할 수 있는 수준이 되어야한다.
이상 2가지이다. 이런 수집 단계의 수행은 소송 당사자(회사)가 직접하기 보다는 e-Discovery 업무를 수행하는 전문 회사에서 주로 하는 것이 일반적이다. 이런 전문 회사에서 하게 되는 이유는 다양하지만, 가장 결정적인 이유는 소송에서의 디지털 증거의 증거 능력을 확보하며 활용하기 위함이다.
그리고 이렇게 수집된 ESI 자료를 증거로써의 무결성을 유지하고 있음을 증명하기 위해 수집, 보관, 전송, 분석 등의 절차들에 대해 문서로 유지하여 함께 보관하게 된다.
이렇게 수집된 ESI 자료는 EDRM 모델에서 다음 절차인 처리와 분석의 단계를 거쳐 Review로 넘어가게 된다.
[필자. 이태용 (aqumalee@gmail.com)]
현재 삼정 KMPG에서 eDiscovery 전문가로 재직중이며, 다양한 업계 경험을 통해 고객사의 환경에 맞는 최적의 디스커버리 전략을 제안하는 컨설턴트로서 그는 종래의 Paper Discovery부터 Legal Translation등 eDiscovery Project Managing에 대한 전반적인 경험을 바탕으로 고객사의 Legal Risk의 측면에서 발생가능한 이슈에 대한 컨설팅을 해오고 있다. 한국에서의 이디스커버리 업계의 활동은 약 2년여 정도의 짧은 기간이지만, 여러 eDiscovery Solution을 통해 한국의 IT환경에 맞는 데이터 처리에 대한 해박한 지식을 가지고 있다.
1. 보존 (Preservation)
미국법에서 e-Discovery제도에서 적절한 증거수집이 가능하도록하는 절차로써 Litigation Hold를 관련자와 정보관리 부서에 우선적으로 통지하는 과정을 거친다. Litigation Hold에 대한 정의는 e-Discovery에 이르러 좀더 구체적인 내용을 담고 있다.
◇민사소송에서의 Litigation Hold
A notice issues in anticipation of a lawsuit or investigation, ordering employees to
preserve documents and other materials relevant to that lawsuit or investigation
◇e-Discovery에서의 Litigation hold
An order issued by an attorney to a client telling that client’s employees and
associates to stop the routine handling of all ESI, especially as that routine involves
the deletion of ESI.
Litigation Hold는 소송에 대해 인지한 순간 혹은 소송에 관련될 것이 합리적으로 예상 가능해진 시점부터 가능한 신속하게 실시되어야 한다. 이렇게 증거에 대한 보존의 의무(Duty of Preserve)가 발생하게 되면 그 즉시 증거의 보존을 위한 최대한의 노력을 다해야 한다.
이런 최대한의 노력을 인정받기 위해서 소송 당사자(회사)는 사건과 관련될 수 있는 자료를 보유하고 있거나 또는 그러한 자료에 접근할 수 있는 권한을 가진 구성원들에게 아래와 같은 내용으로 고지가 이뤄져야한다.
1) (어떤 이슈로 인하여)소송이 발생하였거나 또는 발생할 가능성이 있다는 점
2) 소송과 관련된 자료의 보존이 필요하다는 점
3) 보존이 필요한 대상 자료의 범위
4) 보존이 필요한 대상 자료의 변경 또는 파기가 중단되어야 한다는 점
이 때 ‘자료’는 종이 문서뿐만 아니라 ESI(Electronically Stored Information)로써 이메일, 문서 파일 데이터 베이스 등을 포함한다.
특히 주의할 사항은 회사의 정보 관리 시스템에 따라 순차적, 그리고 정기적으로 오래된 전자 문서 및 이메일 등이 자동으로 파기 되는 경우가 발생하는데, 증거 보존의 의무가 발생하면 보존해야 할 자료에 대해서는 즉각적으로 자동 파기정책 등을 중단해야한다.
이렇게 ESI의 보존 절차는 e-Discovery 제도에 있어 증거의 보존이라는 매우 중요한 역할을 하고 있다. 이런 보전 의무을 제대로 수행하지 못한 경우 실제 소송에서 유리한 증거로써 채택되지 않을 수도 있으며, 고의로 증거를 인멸한 혐의로 소송에서 벌금 등의 제재를 받을 수 있고, 보존의 의무를 게을리 한 것으로 제재를 받을 수도 있으며 나아가 소송에 불리한 결과로 작용할 수 있다.
2. 수집 (Collection)
이렇게 e-Discovery에서 Litigation Hold에 따라 잠재적으로 소송과 관련된 증거들에 대한 보존 의무를 수행하고 해당 ESI로 소송에 대응할 수 있도록 e-Discovery 절차에 준해 사용할 수 있는 완벽한 사본을 생성하는 단계를 말한다.
수집단계에서는 소송 당사자(회사)에서 관리하는 다양한 형태로 이뤄진 ESI를 증거로서의 효력을 가질 수 있도록 사전에 이뤄진 협의(Meet&Confer)를 통해 결정된 방식으로 수집을 진행한다. 일반적으로 연방 증거 규칙에 명시된 증거의 가용성에 부합하기 위해 원본을 보존하고, 포렌식 복제를 통해 사본을 생성하여 분석을 한다.
수집은 예전에는 소송 당사자(회사)에서 다루는 모든 ESI를 수집하는 형태였지만 최근에는 소송 당사자(회사)의 정보 유출 위험 및 비용 절감을 위해 사전에 필요한 자료의 수집대상을 정하고, 그렇게 정해진 ESI만 수집하는 형태로 발전하고 있다.
수집 단계에서 사용하는 포렌식 복제를 사용하는 이유는
1. 복제된 ESI가 원본과 동일함을 증명하여 증거로서의 효력을 가질 수 있게 한다.
2. 수집된 대상의 저장 매체에 삭제(또는 비할당) 영역까지 수집하여 필요시에는 제공할 수 있는 수준이 되어야한다.
이상 2가지이다. 이런 수집 단계의 수행은 소송 당사자(회사)가 직접하기 보다는 e-Discovery 업무를 수행하는 전문 회사에서 주로 하는 것이 일반적이다. 이런 전문 회사에서 하게 되는 이유는 다양하지만, 가장 결정적인 이유는 소송에서의 디지털 증거의 증거 능력을 확보하며 활용하기 위함이다.
그리고 이렇게 수집된 ESI 자료를 증거로써의 무결성을 유지하고 있음을 증명하기 위해 수집, 보관, 전송, 분석 등의 절차들에 대해 문서로 유지하여 함께 보관하게 된다.
이렇게 수집된 ESI 자료는 EDRM 모델에서 다음 절차인 처리와 분석의 단계를 거쳐 Review로 넘어가게 된다.
[필자. 이태용 (aqumalee@gmail.com)]
피드 구독하기:
글 (Atom)
