튜링 테스트 (Turing Test)

철학
한 줄 정의: 대화만으로 기계와 사람을 구별할 수 없다면 그 기계가 생각한다고 볼 수 있는지 판정하려는 시험입니다.

쉽게 풀면

심사자가 보이지 않는 상대 두 명(사람과 기계)과 글로 대화한 뒤, 누가 기계인지 맞히는 방식입니다. 심사자가 잘 구별하지 못하면 기계가 시험을 통과한 것으로 봅니다. 1950년 앨런 튜링이 논문 「계산 기계와 지능」에서 "모방 게임"이라는 이름으로 제안했습니다.

왜 중요한가

"기계가 생각할 수 있는가"라는 모호한 질문을 관찰 가능한 행동 기준으로 바꾼 시도로 심리철학과 인공지능 논의의 출발점이 되었습니다. 대형 언어모델 시대에 지능 평가 기준을 논할 때 다시 자주 인용됩니다.

논문에서는 이렇게 쓰입니다

"연구진은 대형 언어모델이 튜링 테스트류 대화 과제에서 인간과 구별되지 않았다는 결과가 곧 이해 능력을 뜻하지는 않는다고 논의하였다."

튜링 테스트 통과의 의미를 신중하게 해석한 예문입니다.

조금 더 깊게 보면

튜링 테스트는 내면 상태가 아니라 겉으로 드러난 행동만으로 판단한다는 점에서 행동주의적 기준이라는 평가를 받습니다. 설의 중국어 방 논증은 기호를 잘 다루는 것과 의미를 이해하는 것은 다르다며 이 기준을 비판했습니다. 대화 시간, 심사자의 전문성 등 구체적 조건이 정해져 있지 않아 "통과"를 주장하는 사례마다 기준이 달랐습니다. 튜링 자신은 논문에서 여러 예상 반론에 답하는 형식으로 논의를 전개했습니다.

주의할 점

튜링 테스트는 지능을 판정하는 기준에 관한 사고실험이고, 튜링 기계는 계산 가능성을 정의하는 수학적 모형입니다. 둘 다 튜링의 업적이지만 다루는 문제가 전혀 다릅니다.

관련 용어