새벽 2시, 내 목소리가 내 책을 읽고 있었다 — 무료 AI 오디오북 제작기
새벽 2시, 나는 주방 식탁에 앉아 있었다. 노트북 화면에는 300페이지 원고가 떠 있고, 스피커에서는 내 목소리가 책을 읽고 있었다. 물론 내가 실시간으로 읽은 건 아니다. 몇 시간 전에 1분짜리 음성 샘플을 올렸더니, AI가 내 말투를 학습해서 원고를 쭉 읽어주고 있었다. 옆에는 식은 커피와 윌라에서 듣던 오디오북이 재생 중이었다. 그날 밤, "이거 진짜 되네?"라는 생각에 잠이 안 왔다.
오디오북 시장은 커졌지만, 녹음실을 빌리고 성우를 섭외하는 비용은 여전히 부담이다. 그런데 요즘은 무료 음성 복제와 무료 TTS 덕분에 작가 혼자서도 충분히 들을 만한 오디오북을 만들 수 있다. 문제는 어디서부터 손대야 하느냐다. 나도 처음엔 헤맸다. 그래서 내가 실제로 해본 순서를 그대로 풀어본다.
1단계: 눈으로 읽는 글을 귀로 듣는 글로 바꾸기
원고를 그대로 붙여넣으면 안 된다. 활자와 목소리는 호흡이 다르다. "아래 그림에서 보듯이" 같은 문장은 오디오에서 순간적으로 멍하게 만든다. 표나 각주도 마찬가지다.
- 그림, 표, 페이지 번호를 가리키는 문장은 과감히 지운다.
- 긴 문단은 두세 문장으로 쪼갠다. 숨 쉴 틈이 생긴다.
- 쉼표와 마침표를 다시 본다. AI는 이 부호를 호흡으로 해석한다.
- 외래어와 고유명사는 발음대로 적어본다. "챗GPT"를 "챗지피티"로 바꾸면 훨씬 자연스럽다.
내가 쓰는 꿀팁 하나. 원고를 소리 내어 한 번 읽어보라. 내가 읽다가 걸리는 문장은 AI도 똑같이 걸린다. 이 작업만 30분 투자해도 결과물이 확 달라진다.
2단계: 목소리 고르기 — 내 목소리 복제 vs 기본 AI 음성
여기서 갈린다. 기본 제공되는 AI 음성 무료 목소리를 쓸 것인지, 아니면 내 목소리 복제를 할 것인지.
내 이름을 걸고 책을 낸다면 후자를 추천한다. 무료 음성 복제 도구에 1분 정도의 음성 샘플을 올리면, 내 톤과 말투를 살린 모델이 만들어진다. 음성 복제 온라인으로 이렇게 간단하게 되는 줄 몰랐다. 물론 완벽하진 않다. 웃음소리나 한숨 같은 건 잘 못 살린다. 그래도 "내가 읽은 것 같은" 느낌은 확실히 난다.
반대로 내 목소리를 쓰기 부담스럽다면 무료 TTS 사이트에서 한국어 목소리를 골라보자. 차분한 남성, 밝은 여성, 낮은 톤 등 선택지가 꽤 많다. 오디오북은 몇 시간씩 듣기 때문에 너무 튀는 목소리보다는 안정적인 쪽이 낫다. 처음엔 귀에 익지 않아도 10분만 들으면 적응된다.
3단계: 텍스트를 음성으로 변환하기
목소리가 정해졌으면 원고를 넣고 돌린다. 한 번에 다 하지 말고 챕터별로 나눠서 하는 게 정신 건강에 좋다. 중간에 오타를 발견하면 그 챕터만 다시 만들면 되니까.
- 한 챕터 분량을 복사해서 생성기에 붙여넣는다.
- 속도와 톤을 조절한다. 오디오북은 약간 느리게가 이해하기 좋다.
- 전체를 돌리기 전에 30초만 미리 들어본다.
- 만족하면 오디오를 내려받는다.
여기서 가입 없이 음성 합성을 할 수 있다는 게 크다. 회원가입, 이메일 인증, 카드 등록 같은 관문이 없으니 부담이 없다. 텍스트 음성 변환 무료 기능을 이렇게 써도 되나 싶을 정도다. 음성 합성 무료 도구를 여러 개 비교해보고 싶다면 브라우저만 열면 된다. 나는 보통 무료 TTS 사이트에서 목소리 두세 개를 테스트한 뒤에 본 작업에 들어간다.
4단계: 편집과 조립
AI가 뽑아준 오디오는 깨끗하지만, 그대로 올리면 어설픈 티가 난다. 편집은 생각보다 간단하다. 무료 프로그램으로 충분하다.
- 챕터 사이에 1~2초 정도 무음을 넣는다. 이게 은근히 분위기를 만든다.
- 파일 앞뒤의 잡음이나 딱딱 끊기는 부분을 잘라낸다.
- 볼륨을 맞춘다. 챕터마다 소리가 들쭉날쭉하면 피로해진다.
- 인트로를 짧게 넣는다. 책 제목, 내 이름, 그리고 저작권 걱정 없는 잔잔한 음악.
Audacity나 CapCut 정도면 된다. MP3 192kbps 이상으로 내보내면 대부분 플랫폼에서 문제없다. 여기서 "오디오북 음성 만들기"의 8할이 끝난다. 나머지 2할은 배포다.
5단계: 어디에 올릴까 — 배포와 주의사항
완성된 파일을 어디에 풀어놓을지 정하자. 선택지는 크게 셋이다.
- 내 블로그나 뉴스레터: 수익은 없지만 팬과 직접 연결된다.
- 오디오북 플랫폼: 윌라, 밀리의 서재, 스토리텔 같은 곳. 플랫폼마다 파일 규격과 메타데이터 요구사항이 다르니 업로드 전에 확인해야 한다.
- 유튜브, 인스타그램 릴스, 틱톡: 짧은 오디오 클립은 홍보용으로 효과가 좋다. 영상 내레이션 AI로 활용하기도 쉽다.
중요한 건 권리다. AI 더빙 무료 도구로 만들었다고 해서 저작권이 사라지는 건 아니다. 원고가 내 것이거나 사용 허락을 받은 것이어야 하고, 복제한 목소리도 내 목소리이거나 동의를 받은 것이어야 한다. 한국은 개인정보보호법과 저작권법이 꽤 엄격하다. 타인의 음성을 무단으로 복제하면 큰일 난다. 플랫폼마다 AI 생성 콘텐츠 정책이 다르니 업로드 전에 약관을 읽어보자.
자주 묻는 질문
무료로 내 목소리를 복제해 오디오북을 만들 수 있나요?
가능하다. 무료 음성 복제 도구에 1분 내외의 음성 샘플을 올리면 된다. 조용한 방에서 평소 말투로 또박또박 읽으면 품질이 좋아진다. 복제된 목소리로 원고 전체를 변환하면 녹음실에 가지 않고도 내 스타일을 유지할 수 있다.
AI 오디오북, 저작권이나 개인정보 문제는 없나요?
원고와 목소리 권리가 내게 있으면 문제없다. 남의 책을 AI로 읽히거나, 동의 없이 타인 목소리를 복제하면 안 된다. 특히 한국에서는 개인정보보호법 위반 소지가 있다. 플랫폼별 AI 콘텐츠 정책도 확인해야 한다. 윌라나 밀리의 서재 같은 곳은 AI 생성 음성에 대한 가이드라인을 따로 두고 있다.
한국어 텍스트 음성 변환 무료 품질은 어느 정도인가요?
요즘 AI 음성은 꽤 자연스럽다. 특히 한국어는 받침과 억양 처리가 많이 좋아졌다. 품질을 높이려면 문장을 너무 길게 붙이지 말고, 쉼표와 마침표를 정확히 찍고, 여러 목소리를 비교해보는 게 좋다. 다국어 음성 합성 무료 기능을 쓰면 영어 원문 일부를 한국어로 섞어 읽힐 수도 있다. 다만 감정 연기는 아직 한계가 있으니 과한 기대는 금물.
마무리 대신: 오늘 밤 1분만 녹음해보세요
거창하게 시작할 필요 없다. 스마트폰 음성 메모를 켜고, 좋아하는 문장 하나를 1분 동안 읽어보라. 그 파일을 무료 음성 복제 도구에 올려보면, 내일 아침에는 내 목소리가 다른 문장을 읽고 있을지도 모른다. 나는 그 경험이 꽤 묘했다. 무서우면서도 신기했다. 오디오북 제작은 더 이상 특별한 장비나 돈의 문제가 아니다. 문제는 시작하느냐 마느냐다. 더 자세한 활용법이 궁금하다면 더 많은 튜토리얼을 참고해보자.