말은 짧게 자막은 또렷하게

지난 글에서 15초 안에 끝나는 대본을 만들었다. 그런데 대본을 소리 내어 읽어보니 어? 분명 짧게 썼는데도 무슨 말인지 한 번에 안 들어왔다. 문장은 빠르게 지나가고, 자막은 화면을 덮고, 정작 보여줘야 할 상품은 가려져 있었다.

개발할 때도 기능을 많이 넣었다고 사용하기 쉬운 건 아니었다. 쇼츠도 비슷하다. 내가 하고 싶은 말을 다 담는 것보다, 보는 사람이 바로 알아듣게 만드는 게 먼저다. 이번에는 대본을 새로 쓰기보다 목소리와 자막을 손보자.

목소리·자막·화면은 같은 말을 해야 한다

목소리와 자막, 화면이 한 메시지를 전하는 구조
쇼핑 쇼츠에서 목소리는 설명하고, 자막은 핵심을 붙잡아주고, 화면은 그 말을 확인시켜준다. 셋이 서로 다른 이야기를 하면 보는 사람은 바빠진다. 귀로는 설치법을 듣는데 자막에는 가격이 뜨고, 화면에는 포장 상자만 보인다고 생각해보자. 나라도 잠깐 멈칫할 것 같다.

그래서 편집을 시작하기 전에 이 장면에서 전달할 말을 하나씩 정한다. 예를 들어 싱크대 아래 수납 문제를 보여준다면 이렇게 맞출 수 있다.

  • 목소리: “안쪽 물건 꺼낼 때마다 번거롭죠?”
  • 자막: “안쪽 물건, 꺼내기 번거롭죠?”
  • 화면: 손을 깊이 넣어 물건을 꺼내는 모습

자막이 목소리를 글자 그대로 따라갈 필요는 없다. 다만 의미가 달라지면 안 된다. 해결 장면에서도 “앞으로 당겨 꺼내요”라고 말한다면 실제로 선반을 당기는 모습을 보여준다. 이 간단한 짝 맞추기만 해도 영상이 훨씬 덜 산만해진다.

빨리 말하기보다, 한 번에 들리게 읽기

대본을 또렷하게 읽기 위한 네 단계
15초 대본을 만들었다고 해서 빈틈없이 꽉 채워 읽을 필요는 없다. 솔직히 말하면 나도 녹음할 때 시간이 모자라 보이면 말부터 빨라진다. 그러면 꼭 중요한 단어가 뭉개진다. 특히 상품 이름이나 사용 전 주의할 점처럼 놓치면 안 되는 말은 더 그렇다.

내가 녹음할 때는 다음 순서로 확인한다.

  1. 문장을 짧게 나눈다. 쉼표가 여러 개 필요한 문장이라면 두 문장으로 바꾼다.
  2. 한 문장씩 읽는다. 문장 끝을 삼키지 않고, 다음 문장 전에 잠깐 숨을 둔다.
  3. 헷갈리는 말을 바꾼다. 입에 잘 안 붙는 전문 표현은 평소 쓰는 말로 고친다.
  4. 화면을 보며 들어본다. 목소리와 보여주는 동작이 어긋나면 읽는 시점이나 화면 순서를 조정한다.

예를 들어 “간편한 설치로 효율적인 수납이 가능합니다”보다 “선반을 당기면 안쪽 물건도 꺼내기 쉬워요”가 장면에 붙이기 편하다. 단, 실제로 보여줄 수 있는 기능만 말해야 한다. 말이 잘 들려도 화면과 다른 약속을 하면 신뢰가 깨진다.

직접 녹음이 부담스러워 음성 합성을 쓴다면 결과물을 꼭 들어보자. 띄어쓰기나 숫자 읽기가 어색할 수 있다. 설정을 이것저것 바꾸기 전에 대본을 읽기 쉬운 문장으로 고치는 편이 간단할 때도 많다.

자막은 받아쓰기가 아니라 길잡이다

긴 자막과 짧은 자막의 차이
음소거로 보는 사람도 있으니 자막은 필요하다. 하지만 목소리로 말한 모든 글자를 화면에 빼곡히 옮기면 상품을 볼 자리가 없어진다. 내 자막이 한때 그랬다. 편집할 땐 친절해 보였는데 휴대폰으로 보니 작은 글씨가 화면을 점령하고 있더라. 음... 친절이 아니라 독해 시험이었다.

자막을 만들 때는 지금 장면을 이해하는 데 필요한 말만 남긴다. 앞의 수납 예시라면 긴 설명 대신 이렇게 써볼 수 있다.

  • 불편 장면: “안쪽 물건 꺼내기 번거롭다면”
  • 사용 장면: “당겨서 꺼내요”
  • 확인 장면: “설치 전 너비 확인”

강조도 한 장면에 여러 군데 주지 않는다. 모든 단어가 크고 화려하면 무엇을 먼저 봐야 할지 모르니까. ‘당겨서’, ‘너비 확인’처럼 동작이나 주의 사항에만 힘을 주면 충분하다.

배치는 실제 화면을 기준으로 잡는다. 상품을 손으로 사용하는 장면이라면 자막이 손과 상품을 가리지 않는 곳에 놓고, 플랫폼의 버튼이나 계정 정보가 겹칠 만한 자리도 피한다. 편집 화면에서 괜찮아 보여도 게시 화면에서는 다를 수 있으니, 마지막엔 휴대폰 크기로 확인하자.

올리기 전, 소리와 화면을 따로 확인한다

쇼핑 쇼츠 게시 전 목소리와 자막 점검표
편집을 끝내면 나는 영상을 두 번 본다. 한 번은 소리를 들으며, 한 번은 소리를 끄고 본다. 둘을 동시에 점검하려고 하면 의외로 놓치는 게 있다.

소리를 들을 때는 첫 문장이 또렷한지, 배경음악 때문에 말이 묻히지 않는지, 상품 이름이나 주의 사항이 제대로 들리는지 확인한다. 음악을 넣었다면 목소리를 방해하지 않을 만큼만 쓰고, 사용할 수 있는 음원인지도 챙긴다.

소리를 끄고 볼 때는 자막만으로 문제 장면과 사용 장면이 이어지는지 살핀다. 글자가 상품을 가리거나 너무 빨리 사라지지는 않는지도 본다. 마지막으로 화면을 잠깐 멈춰 자막을 읽어보자. 멈춰야 겨우 이해되는 문장이라면 줄일 여지가 있다.

여기서 완벽한 목소리나 화려한 자막을 만들겠다고 며칠씩 붙잡을 필요는 없다. 핵심은 내가 만든 영상을 처음 보는 사람도 한 번에 따라올 수 있느냐다. 주변 사람에게 보여줄 수 있다면 “어땠어?”보다 “어느 부분이 안 들리거나 읽기 어려웠어?”라고 물어보는 편이 수정할 곳을 찾기 쉽다.

잘 들리게 만들었다면, 이제 보여줄 장면을 챙기자

이번 글의 점검은 간단하다. 짧은 문장으로 또렷하게 말하고, 자막에는 핵심만 남기고, 상품과 사용 동작을 가리지 않는다. 15초 대본을 통째로 다시 쓰기 전에 이 세 가지만 손봐도 전달이 막히는 지점을 찾을 수 있다.

그런데 목소리와 자막을 맞추다 보면 다음 문제가 보인다. “당겨서 꺼내요”라고 말하는데 정작 당기는 장면을 안 찍은 거다. 아, 이건 자막 효과로 해결할 일이 아니다. 다음 글에서는 촬영할 때 헤매지 않도록 영상 소스 부족을 해결하는 촬영 목록을 만들어보자.

AIWD 소모임AI 자동화 오픈톡