1. 보고서의 목적과 내용이 보고서는 정보통신윤리위원회 기술지원팀이 작성한 [인터넷 등급제 기술계획서 v 0.2](2000년 6월. 이하 [계획서])에 대한 기술적 반론을 담고 있습니다. 이 보고서의 핵심적인 내용은 "[계획서]의 내용 가운데 5장 1절 '로봇 에이전트 및 관리 서버'에 포함된 '자동등급분류 시스템'이란, 그럴듯하게 설명되어있기는 하지만, 절대로 실현될 수 없다"는 것을 논증하는 것이며, 인터넷 등급제가 안고 있는 윤리적, 사회적 문제에 대한 입장은 보고서의 목적상 일정한 수준 안에서만 다루어질 것입니다. 이 보고서는 다음과 같은 흐름으로 서술됩니다: 2. [계획서] 5장 1절 내용 개괄아래의 내용은 [계획서]의 5장 '시스템 구축 명세' 가운데 1절 '로봇 에이전트 및 관리 서버' 부분을 발췌한 것입니다. [계획서]는 전체 7장으로 이루어져있으며, 이 가운데 5장은 등급제 시행을 위해 필요한 전체 시스템을 각 부분으로 나누어 그 구현방법을 자세하게 설명하고 있습니다.
위의 내용에 따르면, '로봇 에이전트'란 특정 홈페이지의 내용을 텍스트(글)와 이미지(그림) 양쪽의 측면에서 자동으로 등급을 매겨주는 시스템을 말합니다. 로봇 에이전트는 홈페이지에 포함된 텍스트에 '고등학생 관람가' 등급의 단어가 들어가있는지, 이미지에 '중학생 관람가' 등급의 내용이 들어가있는지를 판단해서 일단 홈페이지들을 분류해놓습니다. 이렇게 사전분류된 홈페이지들을 시스템관리자가 최종적으로 등급을 매기게 됩니다.
3. 자동등급분류시스템이 불가능한 이유 첫 번째: 자료의 무한성3.1. 패턴인식기술의 적용분야제가 [계획서]의 내용에 결정적인 의구심을 품게 된 부분은 위의 내용가운데 "이미지를 분류하기 위해서는..."으로 시작해 "...분류한다"고 쓰여있는 '이미지 자동등급부여 시스템'에 대한 설명 부분이었습니다. 제가 아는 한, 패턴인식기술의 현재 발전수준이라는 것이, 한 장의 사진을 입력하면 "이 사진은 무슨 장면을 담고 있는 사진이고, 중학생까지는 볼 수 있는 수준의 사진이다"라는 판단을 내려줄 수 있는 수준이 되기에는 너무나 낮기 때문입니다. 현재 우리나라에서 실제로 사용되고 있는 분야는 문자인식, 지문인식, 얼굴인식, 숫자인식 정도인 것으로 알고 있습니다. (그리고, 자동차번호판 인식이 숫자인식의 특수한 분야로 존재하고 있습니다) 먼저, 문자인식은 [글눈](하이아트), [아르미](합산정보기술) 등, 문자인식을 전문으로 다루는 프로그램들이 현재 일반인에게 판매되고 있을 정도로 발전한 상태입니다. 지문인식은 요새들어서 많이들 찾는 분야이기도 하지요.
3.2. 이미지분석에 대한 간략한 설명목원대학교 전자공학과 통신및신호처리연구실의 고대식 교수에 의하면, 이미지를 분석하기 위해서는 아래와 같은 6가지 단계가 필요합니다. - 포맷팅(formatting): 원 이미지의 디지털화 이 가운데, 우리가 직접적으로 관심을 가져야 할 부분은 5번째의 '특징추출'과 6번째의 '매칭'입니다. 5번째 단계에서 실제로 특정한 그림에서 특정한 '패턴'을 뽑아내게 되고, 6번째 단계에서 그 패턴을 다른 패턴들과 비교하여 이 패턴이 어떤 그림에 해당하는지를 판단하게 되기 때문입니다. 5번째 단계에서 널리 사용하는 방법은 경계인식(edge detection)입니다. 간단한 설명을 위해서, 포토샵을 사용하여 '경계'라는 게 무엇인지 보여드리도록 하겠습니다. 포토샵 메뉴에서 Filter > Stylize > Find Edges를 선택하면 원본이미지가 아래와 같이 변화하게 됩니다. 즉, '경계'(edge)란 인접한 점(픽셀. pixel)들의 색상값(RGB의 3가지 요소로 이루어진)이 현격하게 차이가 나는 경우 이 점들을 이어놓은 것으로, 이 '경계'를 통해 사람을 배경으로부터 구별해낼 수 있습니다. 아래의 두 그림을 비교해보시면, 어떻게 컴퓨터가 하나의 '객체'를 배경으로부터 분리할 수 있을지 아실 수 있을 것입니다.
이렇게 원본이미지로부터 어떠한 특징, 즉 패턴을 뽑아내고 나면, 현재 데이터베이스에 저장되어있는 여러 가지 패턴들과 이 패턴을 비교하게 됩니다. 하나씩 비교해서 그 가운데 가장 유사성이 높은 패턴―위의 예의 경우, '사람이 폴짝 뛰는 장면'―이 있다면, 원본이미지는 그 패턴에 해당하는 그림이었다고 판정하게 되는 것입니다.
3.3. 이미지 자동등급분류시스템이 구현불가능한 이유그렇다면, 이렇게 컴퓨터에 의해 특정한 그림으로부터 일정한 '패턴'을 뽑아내는 것이 가능한데, 그리고 이 패턴을 다른 패턴과 비교판정할 수 있는데, 이미지 자동등급분류시스템이 과연 불가능한 것일까요? 게다가 이미 패턴인식기술은 글자인식, 얼굴인식, 지문인식 등의 분야에서 실용화되어있는 상황인데 말입니다. 그것은, 이미 패턴인식기술이 실용화되어있는 분야와 이미지 자동등급분류시스템 사이에는 결코 무시할 수 없는 결정적인 차이가 있기 때문입니다. 실용화된 영역의 경우에는 입력되는 이미지가 가질 수 있는 경우의 수가 '유한'인데 반해, 자동등급분류시스템의 경우에는 입력되는 이미지가 가질 수 있는 경우의 수가 '무한'이라는 점입니다. 가령 숫자인식의 경우를 예로 들어보겠습니다. 숫자인식이 비교해야 하는 패턴은 기껏해야 0∼9까지의 숫자 10개에 불과합니다. 글자인식도 마찬가지입니다. 한글의 경우 11,172가지까지 늘어나기는 하겠지만, 기본적으로 원본이미지가 취할 수 있는 경우의 수는 역시 유한합니다. 이와는 약간 성격을 달리 하는 얼굴인식 역시 마찬가지입니다. 가령 카메라에 비친 화상을 통해 출입을 허가하는 연구소가 있다면, 이 연구소의 모든 연구원들은 자신들의 사진을 연구소에 제출해서 '연구원 얼굴' 데이터베이스에 자신을 등록시켜놓게 될 것입니다. 그리고 임의의 방문자가 연구소를 찾아온 경우, 출입허가시스템은 이 방문자의 얼굴을 '연구원 얼굴' 데이터베이스에서 찾아보게 될 것입니다. 결국 이 때 중요한 점은 "원본그림으로부터 추출한 패턴을 비교할 대상이 이미 데이터베이스에 전부 저장되어있어야 비교가 가능하다"는 점입니다. 즉, 번호판의 숫자, 한글 글자 하나하나, 출입자들의 지문정보, 홍채의 생김새 등이 이미 데이터베이스에 들어있기 때문에 비교가 가능하단 얘깁니다. 그런데, 정보통신윤리위원회의 목표, 즉 임의의 이미지에 등급을 설정하는 문제의 경우는 문제가 전혀 달라집니다. 왜냐하면 이 경우에는 가능한 패턴의 종류가 무한대로 발산하기 때문이죠. (음란물의 경우에만 국한시켜서 이야기해봅시다. 만일 전세계의 모든 음란물 사진을 '옷벗고 똑바로 서서 왼다리에 손을 얹고 정면을 바라보는 단발머리 여자의 사진', '바닥에 엎드려 양손을 턱에 괴고 오른다리를 왼다리위에 꼬아놓은 상태에서 정면의 허공을 응시하는 모자쓴 남자', '첫 번째 인물 머리긴 여자는 화면 왼쪽 상단에 서서 벽을 쳐다보고있고, 두 번째 인물 다리긴 남자는 화면 아래쪽 1/3을 차지하고 있으며, 세번째 인물 키작은 남자는 화면 오른쪽 하단부터 중앙까지 45도 각도로 누워있는 사진'... 이런식으로 하나하나 분류체계를 만든다면 문제는 조금 달라질 것입니다. 대신에 이번에는 분류체계 자체가 무한대로 늘어나겠지만.) 음란물의 패턴이 무한대로 발산하는데 이를 전부 데이터베이스에 저장한다는 것은 불가능합니다. 그 패턴 하나하나와 실제 입력받은 패턴을 일일이 비교하는 건 더욱 불가능하고, 홈페이지 하나에 수십개씩 들어있는 그림들을 다 비교하는 건 더욱 불가능하고, 매일매일 홈페이지 목록을 추가하고 있는 서치엔진들도 전체의 10%밖에는 목록을 갖고있지 않은 웹세계 전체의 모든 문서를 다 비교하는 것은 더욱 불가능하구요. 이것이 '이미지에 대한 자동등급분류 시스템'이 불가능한 이유입니다,
4. 자동등급분류시스템이 불가능한 두 번째 이유: 사회적 맥락에 대한 학습불가능성제가 3장에서 논증하고자 했던 것은, 인터넷상에서 구할 수 있는 사진에 담긴 이미지의 모양과 종류는 무한대로 발산하기 때문에, 유한한 데이터베이스 내에서의 비교만이 가능한 현재의 패턴인식기술로는, 그 모든 이미지를 '식별'할 수 없다는 것이었습니다. 그러나, 만일 패턴인식기술이 너무나도 발전하여 그 모든 이미지를 '식별'할 수 있는 시대가 되었다면, 제 주장은 한낱 허튼소리가 되는 것일까요? 그리고 이미지보다 훨씬 식별하기 쉬운 텍스트에 대해서는 등급제가 시행되어도 아무런 문제가 없는 것일까요? 저는 아니라고 생각합니다. 그 이야기를 들어가기 전에 먼저 정보통신윤리위원회의 인터넷 내용등급체계에 대해 말씀드리고 넘어가겠습니다. 정보통신윤리위원회의 인터넷 내용등급체계는 크게 3가지 범주―음란퇴폐, 폭력혐오, 언어―에 대해 세부범주를 두고―가령, 음란퇴폐의 경우에는 노출, 섹스, 퇴폐―있으며, 모두 합쳐서 9개의 세부범주에 대해 각각 0∼4까지의 등급을 매기게 되어있습니다. 이때 등급이 높아질수록 더 '심한' 장면이 나온다고 생각하시면 됩니다. 즉, 어떤 하나의 홈페이지는 노출 3등급, 섹스 2등급, 퇴폐 0등급, 폭력 4등급, 혐오 0등급... 이런 식으로 모두 9개의 등급을 갖게 된다는 것입니다. (이 등급분류기준의 정확한 내용은 http://www.rating.or.kr/tiral/ICEC9901.hwp에서 다운받을 수 있는 정보통신윤리위원회의 [인터넷 내용등급제의 국내 도입방안에 관한 연구] 43페이지부터 45페이지에 걸쳐 나와있습니다. 반드시 다운받아서 읽어보시기 바랍니다.) 그런데, 문제는 우리가 주변에서 볼 수 있는 대부분의 매체들은, 정도의 차이는 있겠지만, 위의 등급대로 분류하는 것만으로는 포착할 수 없는 성격을 갖고 있다는 것입니다. 그 성격이란, 다름아닌 사회구성원들, 즉 바로 우리들이 사회적으로 합의한 맥락입니다. 긴말씀 드릴 것 없이 바로 실제사례들과 함께 이야기를 풀어나가도록 하겠습니다.
1. 먼저 위의 유명한 사진들을 예로 들어보겠습니다. 왼쪽 사진과 가운데 사진은 '폭력' 범주의 3등급(둔기를 사용한 격투내용)에 해당합니다. 한 사람이 다른 사람을 둔기로 구타하는 장면이 명확하게 포착되지요? 그나마 이 사진만으로는 살인이 일어났는지 아닌지를 판정할 수 없기 때문에, '폭력' 범주의 4등급(살인, 린치 또는 가학이 실현되는 과정을 묘사한 내용)에까지 해당되지는 않을 것 같습니다. 그러나 오른쪽의 이한열 열사 사진은 '폭력' 범주의 4등급에 무난하게 해당될 것 같습니다.
2. 왼쪽의 사진은 아무리 어린아이라고는 하지만 여성의 성기가 그대로 드러났으니, '음란퇴폐' 범주의 4등급(성기의 노출)에 해당합니다. (이런 사진이 퓰리처상을 받다니, 정보통신윤리위원회로서는 이해할 수가 없겠군요) 오른쪽의 종군위안부 할머니 사진은 '혐오' 범주의 2등급(문신, 낙인의 모습)에 해당합니다.
3. 왼쪽과 가운데 두 장의 사진에 생생하게 묘사되어있는, 관군에 의해 처형된 동학농민군의 모습은 '혐오' 부문의 4등급(신체절제 / 신체적 기형, 참수, 교수묘사 내용)에 해당되어, 역시 청소년들에게는 함부로 보여줄 수 없는 사진이 되고 맙니다. 그리고 오른쪽의 그림은 안중근 의사가 이토 히로부미(이등박문)을 저격하는 장면을 묘사한 것인데, 정보통신윤리위원회의 등급제 기준에 따르면, '폭력' 부문의 4등급(.총포도검에 의한 육체 손괴, 파손, 절단)에 해당합니다. (이 사진들은 국가정보원 홈페이지의 '대한민국 50년 구국운동' 기획사진전에서 가져온 것들이며, 당연히 '사상적'으로 아무런 문제도 없을 것입니다. 청소년들이 이런 사진으로부터 차단당한다는 것은 '비극'입니다)
게다가, 다시 한 번 강조하지만, 정보통신윤리위원회의 등급제기준은 이미지와 텍스트 양쪽에 모두 동일하게 적용되는 기준이라는 점입니다. 따라서, 다음과 같은 글들 역시 '폭력물', 혹은 '음란퇴폐물'로 지정되어야 합니다.
1. 미셸 푸코의 [감시와 처벌]은 다음과 같은 표현에 의해 '폭력' 부문에서 4등급(위협적 기구를 이용한 고문, 위협)과 '혐오' 부문에서 4등급(신체적 기형, 참수, 교수 묘사)을 받음으로써, '요주의도서'가 되었습니다. 청소년들은 서점에서 아무런 제약도 받지 않고 구입할 수 있는 이 책을 더 이상 인터넷에서는 볼수도 들을수도 없게 될 것입니다: "대역죄인 다미앵은 파리 성당의 정문 앞에서 공개 사죄를 하라는 판결을 받고, 속옷만 입은채 2파운드의 뜨거운 밀랍횃불을 들고 사형수 호송차에 실려갔다. 그레브 광장에 도착하여 그곳에 마련된 처벌대 위에서 그의 젖가슴, 팔, 넓적다리, 종아리 등이 벌겋게 달궈진 집게로 지져졌고, 왕을 내리쳤을 때 사용했던 칼이 들려진 오른손은 유황불에 태워졌으며, 살점이 찢겨나간 그 신체부위들에는 끓는 납, 끓는 기름, 타는 송진, 그리고 유황과 밀랍의 혼합물이 뿌려졌다. 그리고 나서 그의 몸은 네 마리 말에 사지가 묶이는 차열형(車裂刑)에 처해져 사방으로 찢겨졌으며, 이어서 그 조각난 사지와 몸이 불에 태워 재가 되었고, 그 재는 바람에 뿌려졌다"
2. 다음과 같은 글을 실어놓은 한국 정신대문제 대책협의회의 홈페이지는 '섹스'의 4등급(정사, 구강성교, 성기애무 등 노골적인 성행위)과 '혐오'의 4등급(대변, 오줌, 정액을 신체에 접촉 및 먹는 내용)에 해당하게 되어, 청소년들의 접근이 불가능하게 되었습니다. 대책협의회는 자신의 홈페이지에서 증언부분을 삭제하고 홈페이지를 청소년들이 접근할 수 있는 사이트가 될 것인지 아니면 증언을 유지하고 성인들만 접근할 수 있는 사이트가 될 것인지를 선택해야 할 것입니다: "일본인 군인 중 못되게 구는 사람도 많았다. 자신의 성기를 빨라는 것은 보통 흔히 있는 일이고 서서 하자는 놈도 있고 별놈이 다 있었다. 이루 다 말로 형용할 수 없다. 군인들은 그 당시에 일본에서 출판된 {욘주 핫타이}(48體)라는 책을 가지고 와서 나에게 그 책에 나온 체위대로 하자고 했다. 그러면 나는 조선말로 욕을 해댔다. 지금도 나는 우유를 못 먹는다. 우유를 보면 남자 정액 생각이 나기 때문이다."
이런 식으로 말씀드리게 되니 당황스러우시죠? 그러나 우리들 가운데 어느 누구도 위에서 다루어진 매체를 '혐오물', '폭력물', '음란퇴폐물'로 간주하고 청소년들에게 위 매체를 볼 수 없게 하지 않을 것임은 명백합니다. 그리고 우리가 위 매체를 '혐오물' 등으로 판단하지 않는 이유는, 매체에 대한 사회적인 판단―이 매체는 '혐오물'이 아니라는―이 존재하고, 우리 스스로 역시 그러한 맥락과 배경지식을 체득/학습해왔기 때문일 것입니다. 그러나, 자동화된 시스템은, 아무리 비싼 예산을 들여서 아무리 최첨단의 기술로 무장시킨다 해도, 절대로 그러한 사회적 맥락을 체득/학습할 수 없습니다. (만일 컴퓨터 시스템이 그런 맥락을 체득/학습할 수 있다면, 그건 사회적 커뮤니케이션이 가능하다는 의미일테니, '그/그녀'에게도 시민권을 부여하고 정식으로 사회구성원의 일원으로 인정해야 할 것입니다) 이것이 패턴인식기술의 발전여부와 무관하게, 인터넷 자동등급부여시스템의 실현불가능성을 증명하는 두 번째 근거입니다.
5. 결론: 인터넷 등급제 시행이 철회되어야 하는 이유5.1. 인터넷 등급제와 자동등급분류시스템의 관계인터넷의 바다는 넓고 또 깊습니다. 손으로 꼽을 수 있는 수효를 갖는 영화에 대한 심의과정에도 인력과 자원문제가 존재하는데, 포탈사이트들도 전체의 10%밖에는 포괄하지 못하는 인터넷 홈페이지들에 대한 심의과정에 소요되는 자원은 비교할 수 없을 정도로 어마어마할 것입니다. 따라서 자동등급분류시스템은 인터넷 등급제의 필수적인 구성요소입니다. 시장규모가 매년 90%씩 성장하고, 12∼18개월마다 두배씩 호스트수자가 늘어나고있는 인터넷 세계에 등급을 부여하는 것은, 기계(컴퓨터)의 힘을 빌지 않고서는 절대로 불가능하기 때문입니다.
5.2. 컴퓨터에게 인간세계에 대한 판단을 맡길 수 없다아마도 정보통신윤리위원회는 저의 주장을 이렇게 반박하려 할 것입니다: "우리도 위와 같은 문제를 알고 있다. 세상에 어떤 기계가 완벽할 수 있느냐. 그래서 자동분류기계에는 '예비분류'만을 맡긴 것 아니냐. 지금 우리의 계획에 나와있듯이, 최종판단은 사람이 하게 되어있다. 그렇게 되면 아무런 문제도 없는 것 아니냐?" 그러나 저는 컴퓨터에게 '예비분류'라는 임무를 맡길 수 있다는 발상 자체가 황당한 발상이라고 생각합니다. 우리는 지금, 컴퓨터가 잘못해봤자 글자 하나가 틀리고 마는 글자인식 프로그램에 대한 이야기를 하고 있는 것이 아닙니다. 우리는 지금, 컴퓨터가 잘못한다면 우리가 만든 홈페이지에 대한 타인의 접근 자체가 봉쇄되어버리는 인터넷 등급제에 대한 이야기를 하고 있습니다. 저는 4장에서, 그 '자동분류시스템'이라는 것이 인간의 창작물에 대한 판단―그것이 음란물인지, 폭력물인지 등의 아주 협소한 분야에 국한되더라도―을 내릴 수 없는 이유를 논증하였습니다. '판단력' 자체가 존재하지 않는 '자동시스템'에게는 '예비분류'이든 '최종분류'든 어느쪽도 맡길 수 없다는 것이 저의 생각입니다. 마치 사법기관에서 대법관이 '최종판결'을 내리게 된다고 해서 고등법관의 역할을 '판례 데이터베이스에 기반한 자동시스템'에게 맡길 수 없는 것과 마찬가지로 말입니다.
5.3. 인터넷 등급제 도입계획의 철회를 주장하며따라서 저의 결론은 인터넷 등급제 도입계획 자체가 철회되어야 한다는 것입니다. 인터넷 등급제 시행은, 사람이 감당하기에는 일의 규모 자체가 너무나 거대하고, 자동화된 시스템이 감당하기에는 일의 성격 자체가 적절하지 않기 때문입니다. 게다가, 정보통신윤리위원회가 추진하는 등급제는, 모든 권력의 중심에 정보통신윤리위원회 자신을 위치지운다는 점에서, 민주주의와 역행하는 것입니다. 오직 정보통신윤리위원회만이 등급의 기준, 부여, 표시방법을 결정하고(통신질서확립법 30조), 등급을 조정할 수 있는 권한을 가질 수 있습니다(33조). 저는 바람직한 정보통신문화를 만들어나간다는 정보통신윤리위원회가 자신의 임무라고 생각해낸 것이 겨우 이런 수준인가에 대해 실망을 금할 수 없습니다. 그것은 마치 개개인들 사이의 모든 문제에 국가가 사사건건 개입해야 한다는 생각과 다를 바 없습니다. 개개인들 사이의 문제를 알아낼 수 있는 기술적인 준비가 갖추어지는 것과, 그 기술을 사용하여 실제로 개개인들 사이의 문제를 낱낱이 알아내는 것은 전혀 다른 문제이기 때문입니다.
|