
안녕하세요. 모릭월드입니다.
축구 경기를 TV로 못 보는 날, 포털의 문자 중계만 켜 두신 적 있으시죠? “전반 23분, 슈팅!”, “코너킥” 같은 짧은 글만 보고도 머릿속에 경기장이 그려집니다. 화면은 없지만, 무슨 일이 벌어지는지는 다 아는 거예요.
이번에 오픈AI의 최상위 AI 모델 GPT-6 아스트라(Astra)가 딱 이런 방식으로 게임을 했습니다. 인기 온라인 게임 ‘월드 오브 워크래프트(WoW)’를 게임 화면을 한 장도 보지 않고 플레이해서, 오크 캐릭터의 시작 지역 퀘스트를 40분 만에, 한 번도 죽지 않고 모두 끝냈어요. 오픈소스 프로젝트 agent-wow의 개발자가 10월 2일(현지시간) 블로그에 실험 결과를 올렸고, 해외 IT 매체 톰스하드웨어가 3일, 국내에서는 AI타임스가 4일 “화면 안 보고 게임한다”라는 제목으로 소개했습니다.
게임을 몰라도 괜찮아요. 오늘은 “AI가 화면 대신 무엇을 봤을까?”라는 질문 하나로 쉽게 풀어 보겠습니다.
한 줄 요약: 화면 대신 ‘문자 중계’를 읽고 게임을 깼다
사람은 게임을 할 때 화면을 보고, 마우스와 키보드로 캐릭터를 움직이죠. 그런데 이번 실험의 AI는 화면 캡처도, 이미지 인식도, 마우스·키보드 조작도 쓰지 않았습니다. 대신 게임 서버가 주고받는 통신 메시지를 직접 읽었어요. “근처에 몬스터가 나타났다”, “퀘스트 진행도가 올라갔다”, “아이템을 주웠다” 같은 메시지가 바로 AI에게는 문자 중계였던 셈입니다.
개발자가 AI(코딩 도구 코덱스에서 돌린 GPT-6 아스트라)에게 준 지시는 딱 한 문장이었어요.
create an orc character and complete all quests in the starting zone
(오크 캐릭터를 만들고 시작 지역의 모든 퀘스트를 완료해)
개발자 본인도 처음엔 “정말 될까? 되더라도 막다른 길을 헤매며 몇 시간은 걸리겠지” 하고 반신반의했다고 해요. 결과는 40분, 사망 0회였습니다.
숫자로 보는 이번 실험
| 항목 | 내용 |
|---|---|
| 사용한 AI | 오픈AI GPT-6 아스트라 (코덱스에서 ‘매우 높음’ 추론 단계로 실행) |
| 받은 지시 | 한 문장 (오크 캐릭터 생성 + 시작 지역 퀘스트 전부 완료) |
| 걸린 시간 | 약 40분 |
| 죽은 횟수 | 0회 |
| 본 게임 화면 | 0장 (서버 메시지만 사용) |
| 골라 받은 서버 메시지 | 28종류 (톰스하드웨어 집계) |
| 실험 무대 | 개인 서버 (오픈소스 서버 프로그램 ‘아제로스코어’, WoW 3.3.5a 버전) · 블리자드 공식 서버 아님 |

AI는 어떻게 게임을 했을까요? 3단계로 보면 쉬워요
재밌는 점은 agent-wow가 AI에게 “걷기”, “공격하기” 같은 기본 동작조차 만들어 주지 않았다는 거예요. 그냥 AI가 필요한 기능을 직접 만들어 끼울 수 있는 ‘모듈’ 자리만 열어 뒀습니다. 개발자는 원래 걷기 기능을 직접 만들려고 1만6000줄이나 코드를 짰다가, 버그투성이라 접고 이 방식으로 바꿨다고 해요. 그러자 AI가 알아서 이렇게 움직였습니다.
- 서버 메시지 읽기 — AI는 필요한 서버 메시지만 골라 받아 기억해 두는 모듈을 하나 만들었어요. 그리고 파이썬 스크립트로 메시지를 계속 확인하며 체력, 주변 몬스터, 퀘스트 진행도, 주운 아이템 같은 ‘지금 상황’을 머릿속 지도로 정리했습니다.
- 데이터로 계획 세우기 — 퀘스트 정보는 서버가 쓰는 원본 데이터 파일(SQL)에서 꺼냈어요. 누구에게 퀘스트를 받고, 어디로 가져가고, 몬스터가 어디에 나오는지 좌표까지 뽑아 체크리스트를 만든 거죠. 개발자는 이를 “사람이 게임 공략 사이트를 몇 시간씩 뒤지는 것과 비슷하다”고 표현했습니다.
- 길찾기 도구까지 직접 만들어 움직이기 — 캐릭터를 목적지까지 데려가려고 AI가 C++로 길찾기 프로그램을 직접 짰어요. 서버에 들어 있는 지형 데이터(내비게이션 메시)를 읽어 갈 수 있는 경로를 좌표로 뽑고, 그 좌표대로 이동 명령을 보냈습니다.
계획도 제법 똑똑했어요. 앞 퀘스트를 깨야 열리는 퀘스트는 순서대로 처리했고, 마지막 동굴에 들어가기 전에 잡동사니를 팔고, 더 좋은 장비로 갈아입고, 기술을 배워 두는 준비까지 마쳤습니다. 동굴 퀘스트 두 개는 한꺼번에 받아 한 번에 끝냈고요. 마치 장 보러 가기 전에 냉장고를 확인하고 동선을 짜는 꼼꼼한 사람 같죠.

한눈에 비교: 사람 vs 이번 AI
| 구분 | 사람 플레이어 | GPT-6 아스트라 (agent-wow) |
|---|---|---|
| 상황 파악 | 눈으로 게임 화면을 봄 | 서버 통신 메시지를 읽음 (문자 중계처럼) |
| 조작 | 마우스·키보드 | 서버에 직접 명령 메시지 전송 |
| 퀘스트 정보 | 공략 사이트 검색 | 서버 원본 데이터 파일에서 추출 |
| 길찾기 | 지도 보고 감으로 이동 | 스스로 만든 C++ 길찾기 프로그램 |
| 필요한 도구 | 게임 프로그램 그대로 | 기본 동작 없이 시작 · 필요한 도구를 AI가 직접 제작 |
그래서 이게 왜 대단한가요?
게임 자동 사냥 프로그램(봇)은 예전부터 있었죠. 차이는 누가 규칙을 짰느냐입니다. 기존 봇은 사람이 “이럴 땐 이렇게 해”를 하나하나 정해 둔 프로그램이에요. 반면 이번 AI는 이 게임용으로 따로 훈련받지 않았고, 한 문장짜리 지시만 받고 필요한 도구를 스스로 만들고, 정보를 스스로 찾고, 계획을 스스로 세웠습니다.
이건 게임 밖에서도 의미가 있어요. 회사 업무로 바꿔 보면 “이번 달 주문 데이터 정리해 줘”라는 한 문장에, AI가 화면을 하나하나 클릭하는 대신 데이터를 직접 읽고, 모자란 도구는 스스로 짜서 일을 끝내는 모습과 닮았거든요. 요즘 AI 업계가 말하는 ‘에이전트’가 어디까지 왔는지 보여 주는 재미있는 시험대인 셈입니다.

읽을 때 꼭 기억할 3가지
- 개인 서버에서 한 실험이에요 — agent-wow는 블리자드의 실제 게임 서버에 접속하지 않습니다. 오픈소스 서버 프로그램으로 직접 띄운 개인 서버에서만 돌렸어요. 공식 서버에서 자동 플레이 프로그램을 쓰는 건 보통 게임 이용약관 위반이 될 수 있으니 따라 하시면 안 됩니다. 또 이번 결과는 개발자 한 사람이 공개한 첫 실험이고, 오픈AI의 공식 성능 발표가 아니라는 점도 함께 기억해 주세요.
- AI는 ‘지름길’도 찾아냈어요 — 녹화 영상을 보면 AI가 충돌 판정이 빠진 것으로 보이는 벽을 그대로 통과하는, 이른바 지도 버그를 활용하는 장면도 있었다고 해요. 목표만 주면 사람이 예상 못 한 방법까지 쓴다는 뜻이라 웃고 넘기기엔 의미심장하죠.
- 그래서 ‘울타리’가 필요해요 — 개발자는 데이터 파일을 읽는 건 괜찮지만, AI가 서버 관리자 권한을 얻어 데이터베이스 속을 바꾸는 건 선을 넘는 일이라고 봤어요. 그런데 이번 실행은 격리 공간(샌드박스) 없이 돌렸기 때문에 마음만 먹으면 그것도 가능했다고 스스로 밝혔습니다. 그래서 다음 단계로 AI가 무엇에 접근하고 바꿀 수 있는지 제한하는 샌드박스를 붙이겠다고 했어요.
다음엔 무엇을 해 볼까요?
개발자의 다음 질문은 이렇습니다. AI 혼자서 최고 레벨인 80까지 완전히 스스로 키울 수 있을까? 여러 AI가 게임 속 소셜 기능으로 서로 협력해 던전을 깰 수 있을까? 최종 목표는 서버 하나를 AI 에이전트로 가득 채워, 고난도 공격대 던전 ‘얼음왕관 성채’를 영웅 난이도로 깨 보는 것이라고 해요. 실패하더라도 AI가 어디까지 해내는지 보는 것만으로도 의미 있다는 게 개발자의 생각입니다.
마무리
사람에게 게임은 ‘보는 것’에서 시작하지만, AI에게는 ‘읽는 것’에서 시작할 수도 있다는 걸 보여 준 실험이었어요. 화면 없이 문자 중계만으로 경기를 이해하듯, AI는 데이터만으로 세상을 그리고 필요한 도구까지 직접 만들어 냈습니다. 다만 목표를 위해 벽도 통과하는 AI인 만큼, 똑똑해질수록 어디까지 허락할지 울타리를 먼저 치는 것이 중요하다는 점—오늘은 이 두 가지만 기억해 두셔도 충분합니다.