전화로 AI와 이야기할 때, 상대가 한 박자만 늦어도 “여보세요?”가 나오기 쉽습니다. AI 스타트업 인셉션(Inception)이 2026년 9월 29일(현지시간) 기업용으로 정식 공개한 머큐리 보이스(Mercury Voice)는 바로 그 응답 속도를 겨냥한 음성 전용 AI예요. AI타임스 등 보도를 바탕으로, 어려운 용어는 줄이고 초보 기준으로 같이 살펴볼게요.

머큐리 보이스가 뭐예요? ‘말 잘 듣는’ 것보다 ‘빨리 받아치는’ AI
핵심은 단순합니다. 챗봇처럼 글로만 답하는 모델이 아니라, 음성 에이전트—전화·드라이브스루·고객센터처럼 말로 주고받는 장면에 맞춰 만든 확산(Diffusion) 기반 언어모델이에요.
기존에 많이 쓰이던 방식은 글자를 한 토큰씩 순서대로 이어 붙이는 오토레그레시브(Autoregressive)입니다. 긴 지시문이나 도구 호출이 붙으면 첫 말이 나오기까지 시간이 확 늘어날 수 있어요. 음성 대화에서는 그 짧은 침묵이 곧 “끊긴 느낌”이 됩니다.
머큐리 보이스는 확산 모델 구조로 문맥과 토큰을 병렬로 다루도록 설계됐다고 합니다. 비유하면, 한 줄씩 베끼는 필기보다 스케치를 한꺼번에 다듬어 가는 그림에 가깝습니다. 그래서 긴 시스템 프롬프트나 복잡한 도구 호출이 있어도 응답 속도를 유지하려 한다는 설명이에요.
왜 0.5초가 중요할까요?
사람끼리 말할 때, 상대 답이 약 0.5초(500ms)를 넘기면 대화가 어색해지기 쉽다는 기준이 자주 이야기됩니다. 인셉션 측 테스트에서 머큐리 보이스는 첫 응답 토큰이 나오기까지의 시간(TTFAT) 중앙값이 320ms 미만이었다고 합니다. 자연스러운 대화 기준선보다 빠른 편이에요.

더 눈에 띄는 점은 늦게 나오는 날입니다. 응답이 가장 느린 상위 5%(95번째 백분위수)도 약 750ms 수준에 머물렀다고 해요. “평소엔 빠른데 가끔 한참 멈춘다”는 체감을 줄이려는 쪽입니다. 회사는 GPT-6 루나, 젬마 4 31B, 클로드 하이쿠 4.5 등보다 지연이 2배 이상 낮으면서도 음성 관련 벤치에서 대등하거나 앞섰다고 밝혔습니다. (벤치 숫자는 시험 조건에 따라 달라질 수 있으니, “속도 + 품질을 같이 본다” 정도로 기억하면 충분합니다.)
어디에 쓰이나요? 현장 예시 세 가지
발표·보도에 나온 도입 사례를 초보 시나리오로 옮기면 이렇습니다.

- 드라이브스루 — 오디오비 AI는 주문 자동화에 머큐리 보이스를 넣어, 실시간으로 주문을 바꾸고 추가 메뉴를 안내하는 흐름을 처리한다고 합니다. “콜라 빼 주세요”처럼 말이 바뀌는 순간에 속도가 중요해요.
- 금융 전화 — 알터는 결제 협상·이의 제기처럼 말의 흐름이 긴 금융 음성 에이전트에 도입했다고 합니다. 고객이 설명을 이어 가는 동안 AI가 한 박자씩 늦으면 신뢰가 떨어지기 쉽습니다.
- 전화 업무 — 오픈콜은 전화 응답 지연시간 중앙값을 약 170ms까지 낮췄다고 전합니다. 콜센터·예약 안내처럼 “빨리 받아 주는 느낌”이 서비스 품질로 이어지는 장면이에요.
개발자가 붙이는 법 — 익숙한 자리에 꽂기
머큐리 보이스는 인셉션 API로 제공되고, 오픈AI API와 호환되는 엔드포인트도 지원한다고 합니다. LiveKit, Pipecat, Vapi, Retell처럼 이미 쓰는 음성 프레임워크의 언어모델 슬롯에 갈아 끼우는 그림에 가깝습니다. “새 전화 시스템을 처음부터 짓기”보다 “말 생성 엔진만 바꾸기”로 이해하면 초보에게도 충분해요.
가격은 입력 토큰 100만 개당 0.40달러, 출력 100만 개당 1.50달러로 안내됐고, 출시 프로모션 기간에는 50% 할인(0.20 / 0.75달러)이 적용된다고 합니다. 대화 1분당 약 0.009달러 수준으로 GPT-4.1 대비 약 5배 저렴하다는 설명도 나왔어요. (요금·프로모션은 공식 안내를 한 번 더 확인하세요.)
초보 독자가 지금 기억할 팁 3가지

- 말에 끊기지 않게 — 음성 AI 뉴스를 볼 때 “똑똑한가?”만 보지 말고, 첫 답이 얼마나 빨리·일정하게 나오는지(0.5초 기준)를 같이 보세요. 전화·드라이브스루에서는 속도가 곧 사용성입니다.
- 기존 음성틀에 꽂기 — 기업이라면 전화 인프라 전체를 갈아엎기보다, LiveKit·Vapi 같은 틀의 모델 슬롯만 교체하는 경로가 현실적일 때가 많아요. “호환 API” 이야기가 그래서 나옵니다.
- 비용·지연 함께 보기 — 싸기만 하거나 빠르기만 한 모델보다, 우리 통화량·평균 대화 길이·허용 지연을 맞춰 보는 게 안전합니다. 프로모션 기간·토큰 단가도 공식 콘솔에서 직접 확인하세요.
한 줄로 정리하면 머큐리 보이스는 인셉션이 음성 에이전트용으로 낸 확산 기반 언어모델이고, 첫 응답을 빠르게·일정하게 내면서 드라이브스루·금융 전화·콜 업무에 붙이는 쪽입니다. “또 하나의 챗봇”보다 말의 리듬을 지키는 AI로 보면 초보에게도 충분합니다.
참고: AI타임스 (2026-10-01) — 인셉션, 음성 에이전트 ‘머큐리 보이스’ 출시. 수치·요금은 보도·회사 안내 시점 기준이며 이후 달라질 수 있습니다.