
설교 원고는 눈으로 읽을 때와 귀로 들을 때 다르게 보인다.
문법상 맞지만 한 호흡에 담기 어려운 문장, 같은 접속어가 되풀이되는 대목, 설명 없이 건너뛴 논리가 소리에서는 금세 드러난다.
음성합성은 설교자의 목소리를 대신 만드는 기술보다, 원고를 낯선 목소리로 되돌려 듣는 퇴고 도구로 쓸 때 위험이 낮고 효용이 분명하다.
핵심은 자연스러운 음성을 얻는 데 있지 않다.
회중이 한 번 듣고 따라갈 수 있는 언어인지 점검하는 데 있다.
음성합성을 '낭독 거울'로 둔다

묵독은 이미 알고 있는 뜻을 문장에 보충한다. 작성자는 생략된 주어도 알아보고 긴 문장의 구조도 기억한다.
그러나 회중은 설교를 뒤로 넘겨 다시 읽기 어렵다.
합성 음성으로 들으면 세 가지가 드러난다. 한 문장에 주장과 예외와 적용이 겹친 곳, 인용과 설교자의 설명이 구별되지 않는 곳, 성경 인명과 신학 용어가 발음 때문에 흐려지는 곳이다.
이 작업에서 AI의 역할은 "더 감동적으로 말하기"가 아니다. 원고를 일정한 속도로 읽게 하고, 사람이 막힘을 표시하도록 돕는 것이다.
합성 음성이 감정을 과장하거나 반대로 평평하게 읽더라도 곧바로 원고의 결함이라고 단정하지 않는다. 표시할 것은 이 세 가지면 충분하다.
· 한 번에 뜻이 잡히지 않는 문장
· 앞 문장과 연결이 끊기는 전환
· 귀로는 출처가 모호한 인용
설교의 신학적 판단과 목회적 어조는 목회자가 원문과 본문을 다시 살펴 결정한다.
낮은 위험의 도구부터 고른다
가장 단순한 출발은 Word의 '소리 내어 읽기'다.
Microsoft 공식 지원 문서는 Windows와 macOS의 Word에서 문서 전체나 일부를 읽고, 읽기 속도와 음성을 바꿀 수 있다고 설명한다. 별도 음원 제작보다 원고 편집 중 빠르게 들어 보는 데 적합하다.
다만 이용 가능한 기능은 Office 버전과 장치에 따라 다를 수 있으므로, 실제 교회 환경에서 메뉴와 언어를 먼저 확인해야 한다.
반복 가능한 음원이나 세밀한 발화 조정이 필요하면 Azure AI Speech 같은 음성합성 서비스를 검토할 수 있다. 2026년 9월 14일 확인한 공식 언어표에는 한국어 ko-KR 음성들이 제시되어 있다.
SSML 문서는 음성·언어를 지정하고 말하기 속도, 높낮이, 음량, 강조 등을 조절할 수 있다고 안내한다. 긴 문장을 천천히 듣거나 소제목 앞에 쉼을 두는 시험에 유용하다.
다만 설정을 많이 손보면 원고가 아니라 낭독 연출만 좋아질 수 있다.
ElevenLabs 공식 문서도 텍스트를 음성으로 바꾸는 기능과 다국어 모델의 한국어 지원을 밝힌다. 자연스러움은 검토 피로를 줄일 수 있으나, 특정 서비스의 홍보 표현을 곧 품질 보증으로 받아들여서는 안 된다.
이 글은 세 서비스의 공식 문서에서 기능 존재를 확인했을 뿐,
한국어 설교 원고로 정확도·가격·보존 정책을 직접 시험하지 않았다.
요금제와 데이터 정책은 바뀔 수 있으므로 도입일에 다시 확인한다.
원고 한 편을 점검하는 8단계

공개 전 원고의 복사본을 만들고, 성도 이름·상담 사례·기도 제목·건강 정보 등 식별 가능한 내용을 제거한다. 익명화가 어려운 사례는 아예 입력하지 않는다.
목표를 하나로 정한다. "25분 원고에서 한 번에 이해하기 어려운 문장을 찾는다"면 충분하다.
원고를 도입·본문 설명·적용·결론으로 나누고 문단 번호를 붙인다. 오류를 들은 뒤 원문 위치로 돌아가기 위해서다.
처음에는 기본 음성과 일정한 속도로 합성한다. 연기하듯 감정을 넣거나 설교자의 목소리를 복제하지 않는다.
화면을 보지 않고 들으며, 이해가 끊기는 곳에 시각과 문단 번호만 적는다. 즉시 고치면 뒤 문맥을 놓친다.
표시한 곳을 원고와 대조해 문장을 짧게 나누고, 대명사의 대상을 밝히며, 인용의 시작과 끝을 말로도 구분한다.
수정본을 설교자 자신의 평소 속도로 직접 읽어 본다. 기계가 매끄럽게 읽어도 사람이 숨 쉬기 어려울 수 있다.
동료 검토자 한 명이 원고를 보지 않고 핵심 논지를 두세 문장으로 말하게 한다. 요약이 크게 빗나가면 원고의 논리부터 다시 점검한다.
최종 산출물은 합성 음원이 아니라, 검토를 마친 원고다.
실무에서는 40분 원고 전체보다 5분 분량 한 구간으로 시작하는 편이 좋다.
첫 번째 듣기에는 긴 문장만, 두 번째에는 논리 전환만, 세 번째에는 낯선 용어만 표시한다. 체크표에는 문단 번호, 들린 문제, 수정 내용, 근거 확인, 최종 승인 다섯 칸을 둔다.
한 달 동안 원고 네 편을 시험한 뒤 발견한 중대한 오류 수, 검토 시간, 실제 설교에서 숨이 찼던 문장 수를 비교한다. "목소리가 사람 같다"보다 회중이 따라가기 쉬운 원고가 되었는지가 채택 기준이다.
팀 작업이라면 파일 이름에 원고 버전과 검토 날짜를 넣고, 합성 전 원문과 수정본의 차이를 남긴다. 음원만 전달하면 어느 문장을 들은 것인지 알 수 없다.
중단 조건도 미리 적어 둔다. 민감정보가 발견되거나, 출처가 확인되지 않거나, 음성 파일의 저장 위치를 설명할 수 없으면 합성을 멈춘다. 이 세 가지면 충분하다.
발음은 고치되 뜻은 맡기지 않는다
성경의 인명·지명, 헬라어·히브리어 음역, 교단 용어는 합성 음성이 틀리게 읽을 수 있다.
표기를 임의로 바꾸기보다 먼저 서비스의 발음 사전이나 SSML 지원 범위를 확인한다. 임시로 한글 발음 표기를 넣었다면 배포용 원고에 남지 않도록 작업본과 최종본을 분리한다.
합성 음성이 장절을 이상하게 읽는다고 성경 표기를 바꾸어서는 안 된다. 듣기 좋다는 이유로 의미가 다른 쉬운 단어로 교체하는 것도 마찬가지다.
속도와 쉼도 절제해 사용한다. 짧은 쉼을 넣어야만 이해되는 문장은 문장 구조 자체를 다시 보는 편이 낫다. 반대로 시, 기도문, 반복을 의도한 대목은 기계의 단조로운 낭독만으로 삭제하지 않는다.
목적은 기계가 잘 읽는 글이 아니라,
사람이 말하고 공동체가 듣는 설교다.
윤리와 목회적 주의점

음성합성 서비스에 올린 원고는 외부 처리와 저장의 대상이 될 수 있다.
계정 종류별 데이터 이용, 보존 기간, 삭제 방법, 처리 지역을 최신 약관과 관리 화면에서 확인하고, 확인할 수 없으면 공개가 확정된 비민감 원고만 사용한다.
간증과 사례는 이름을 지워도 사건·직분·시점의 조합으로 알아볼 수 있다. 최소 입력 원칙을 지키고 제한 자료는 제외한다. 생성된 시험 음원에도 접근 권한과 삭제 기한을 둔다.
목소리 복제는 별도의 경계가 필요하다. 설교자나 다른 사람의 음성을 명시적 동의 없이 복제하지 않고, 고인의 목소리나 유명인의 음색을 권위를 빌리는 장치로 사용하지 않는다.
합성 음원을 공개한다면 실제 낭독으로 오해하지 않도록 표시하고, 음성에 포함된 성경 번역문·인용문·음악의 이용 권한을 확인한다.
무엇보다, 음성합성 결과는 설교 승인자가 아니다.
성경 해석, 교리적 정확성, 고통받는 이를 향한 표현, 적용의 적절성은 원문과 공동체의 맥락 안에서 사람이 검토한다. 오류를 발견하면 원고를 고치고 다시 듣되, 도구가 제안한 문장을 근거 없이 받아들이지 않는다.
AI는 영적 분별과 강단의 책임, 회중과의 돌봄 관계를 대신할 수 없다.
좋은 합성음보다, 잘 들리는 설교
음성합성은 설교자의 목소리를 복제할 때보다, 작성자가 자기 문장을 낯설게 듣도록 할 때 더 건강한 도구가 된다.
기본 낭독으로 작게 시작하고, 문단 번호와 시각을 남기며, 원문 근거와 실제 발화를 차례로 검토하면 눈으로 놓친 문제를 줄일 수 있다. 개인정보와 저작권의 경계를 먼저 세우고, 사람의 최종 승인을 고정해야 한다.
목표는 완벽한 기계 음성이 아니다. 한 번 듣는 회중을 배려해 더 짧고 분명하며 책임 있게 다듬은 설교 원고다.
참고 자료
· Listen to your Word documents — Microsoft Support (확인 2026-09-14)
· Language and Voice Support for Azure Speech — Microsoft Learn (확인 2026-09-14)
· Voice and sound with SSML — Microsoft Learn (확인 2026-09-14)
· Text to Speech — ElevenLabs Documentation (확인 2026-09-14)
이 글은 손하람 목사의 창가에 2026. 9. 15에 올린 글을 옮긴 것입니다.