고대 히브리어로 기록된 성경 본문을 어떻게 번역하고 해석해야 할지는 늘 명확하지 않다. 그래서 성경의 한 구절마다 수없이 많은 번역본과 주석이 존재한다. 신학자 크리스티안 에르비흐(Christiaan Erwich)는 컴퓨터가 객관적인 분석에 도달하는 데 도움을 줄 수 있다고 말한다.
설교에서 성경 구절을 해석해야 하는 목회자에게 이는 결코 쉬운 일이 아니다. 한 본문에 대해 아홉 개, 열 개의 주석을 쉽게 찾을 수 있지만, 그 내용은 모두 제각각이다. 시편 75편의 "내가 심판하리라"라는 구절을 보라. 어떤 학자는 여기 말하는 자가 왕이라 하고, 또 어떤 학자는 선지자라고 주장한다. 그리고 이런 논쟁은 끝이 없다. 에르비흐는 "특히 '누가 누구인가'라는 질문이 수많은 번역자들에게 골칫거리"라고 말한다.
에르비흐는 히브리어로 전해진 성경의 가장 오래된 부분인 구약성서를 전공하는 신학자다. 이 부분은 기독교 시대 이전부터 기원한 만큼 본문이 너무 오래되어 의미를 파악하기가 쉽지 않다. 게다가 구약의 최소 3분의 1은 시(詩)로 이루어져 있어 해석의 난이도는 더욱 높아진다. 그렇기에 상이한 해석이 난무하는 것이다.
그것들은 모두 개인적인 가정에 기반한 주관적 해석들이다. 그러나 에르비흐에 따르면, 본문 자체만을 들여다봄으로써 객관적인 해석에 도달할 수도 있다. 그래서 박사과정 학생이던 그는 순수하게 본문만을 근거로 판단을 내리는 컴퓨터 모델을 개발했다. 그는 이 모델의 이름을 히브리어로 '누가 누구'라는 뜻의 미미(MiMi)로 지었다. 미미의 도움으로 그는 앞서 언급한 시편 75편 구절의 '나'가 하나님을 가리킨다는 사실을 밝혀낼 수 있었다.
모호한 언어의 벽
미미를 개발하기 위해 에르비흐는 계산언어학(computational linguistics) 방법론을 깊이 공부했다. 이 분야의 핵심 질문은 컴퓨터를 인간의 언어를 이해하고 생성할 만큼 지능적으로 만드는 방법이다. 그러나 컴퓨터는 아직 모호한 지시어를 다루는 데 능숙하지 못하다.
다음 문장을 보라. "시의원들은 시위대의 허가를 거부했다. 그들이 폭력을 두려워했기 때문이다." 이는 컴퓨터 과학자들이 컴퓨터의 지능을 시험하기 위해 즐겨 쓰는 예시 문장이다. 인간이라면 이 문장에서 인칭대명사 '그들'이 누구를 가리키는지 충분히 추론할 수 있지만, 컴퓨터에게는 아직 넘기 어려운 산이다. 오래된 성경 본문에는 이런 모호한 지시어가 워낙 많아서, 이 본문들은 소위 알고리즘이라 불리는 컴퓨터 프로그램을 시험하기에 더없이 좋은 재료가 된다.
본문 속 지시어를 해석하는 알고리즘을 갖추기 전에 먼저 컴퓨터를 훈련시켜야 한다. 에르비흐는 "가까이 있고 문법적으로 유사한 두 대명사는 서로를 지칭한다"와 같은 언어학적 규칙을 시스템에 가르치는 방식으로 훈련을 진행했다. 이 규칙에 근거해 컴퓨터는 "그가 그의 백성에게 말한다"라는 문장에서 '그가'와 '그의'가 서로 연관되어 있음을 알 수 있다. 둘 다 '3인칭', '단수', '남성'이라는 문법적 특징을 공유하기 때문이다.
150편의 시편 파헤치기
이러한 규칙을 바탕으로 에르비흐는 먼저 150편의 시편을 직접 라벨링했다. 사람을 가리키는 단어마다 그 단어가 어떤 다른 단어와 연결되는지 표시한 것이다. 과학자들은 이렇게 텍스트에 추가하는 정보를 '주석(annotation)'이라고 부른다. 자신이 세운 규칙이 모호하지 않은지 검증하기 위해 동료에게도 일부 시편의 라벨링을 맡겼다. 컴퓨터가 두 사람의 주석을 비교한 결과, 일치율은 82퍼센트에 달했다.
이번에는 컴퓨터 알고리즘 미미의 차례였다. 그러나 주석 간 일치율은 40퍼센트로 훨씬 낮았다. 그럼에도 연구자는 이것이 단순히 나쁜 점수만은 아니라고 설명한다. 텍스트 속 인물 분석은 실제로 두 단계로 이루어지기 때문이다. 첫째는 대명사처럼 인물을 가리키는 단어를 탐지하는 것이고, 둘째는 그 단어들을 서로 연결하는 것이다. 컴퓨터는 전자에서 놀라울 정도로 뛰어난 능력을 보였는데, 심지어 연구자보다도 정확했다. 반면 단어들을 서로 연결짓는 작업은 미미에게 훨씬 복잡한 과제였다.
"미미는 바로 앞뒤의 본문에서만 정보를 얻지만, 저는 시편 전체 코퍼스와 히브리어 성경 전체에서 추가 정보를 얻을 수 있고, 무엇보다 이 세상을 살아온 인간으로서의 경험이 있습니다. 저는 그 모든 지식을 동원해 지시어를 해석하죠. 컴퓨터에는 그런 배경지식이 없으니 점수가 낮은 것은 당연합니다. 그런 점에서 이번 연구는 '모호한 데이터'를 해석하는 일에서 컴퓨터가 인간을 대신해 어떤 과업을 수행할 수 있는지 탐색하는 실험이기도 했습니다."
목회자를 위한 앱까지
알고리즘은 아직 더 발전시켜야 하지만, 에르비흐는 컴퓨터가 이 분야에 큰 변화를 가져올 것으로 기대한다. 현재의 주석들은 흔히 본문 안에서가 아니라 본문 밖의 지식에서 출발하기 때문이다. "사람들은 예컨대 어떤 시편이 이스라엘 성전에서 어떤 기능을 했는지 알고, 그 근거로 화자인 '나'가 반드시 왕이나 제사장일 것이라고 가정합니다. 이 알고리즘은 오직 본문만을 봅니다."
그렇다고 해서 사람이 더 이상 관여하지 않는다는 뜻은 아니다. "기존 주석들을 가설로 삼아, 알고리즘으로 그 가설을 반증하거나 입증할 수 있습니다. 그 과정에서 근거 없는 이론은 걸러낼 수 있겠죠."
에르비흐는 이미 목회자용 앱에의 응용도 구상하고 있다. "훈련된 목회자라면 설교에서 성경 구절을 설명할 때 두 권의 주석을 나란히 펴놓곤 합니다. 그 주석들을 평가할 때 미미 같은 컴퓨터 알고리즘이 훌륭한 길잡이가 되어줄 수 있습니다. 본문을 더 깊이 이해하기 위한 도구인 셈입니다."