본문으로 건너뛰기
Kamply

Kamply의 음성 생성

실제 목소리 타이밍에 그대로 맞는 TTS 음성

Kamply는 대본을 ElevenLabs로 읽고, 그 결과물을 Whisper로 전사한 다음, 모든 컷과 자막을 그 대본에서 끌어옵니다. 60초 릴스 제작에는 측정 기준으로 약 1시간이 걸립니다.

무료입니다. 파일은 그대로 가져가시면 됩니다. Akash가 가능한 시간을 회신합니다.

  1. 01 타이밍 전에 테이크부터

    타이밍을 맞추기 전에 보이스오버 오디오가 먼저 존재해야 합니다.

  2. 02 스크립트에서 나오는 타이밍

    컷과 자막은 그 오디오의 스크립트에서 도출되며, 손으로 입력하지 않습니다.

  3. 03 드래프트를 직접 지켜보기

    영상 전체가 하나의 시퀀스로 재생되고, 마스터 전에 사용자가 승인합니다.

  4. 04 파일 자체를 점검

    결과물을 만든 계획이 아니라 렌더링된 MP4 파일 자체를 검사합니다.

손으로 입력한 자막 타이밍은 실제 음성과 어긋나기 마련입니다. 실제로 렌더링된 오디오의 스크립트에서 타이밍을 뽑아내는 이유가 여기에 있습니다. 자막이 정확히 그 단어에 맞춰집니다. 마지막 관문은 완성된 파일 자체를 읽으므로, 계획은 맞았지만 렌더링이 잘못된 영상은 통과할 수 없습니다.

실제로 하는 일

Kamply는 완성된 MP4 릴스를 만드는 Mac 앱입니다. 음성은 그 제작 과정의 한 단계입니다. 대본을 문서로 승인하면 Kamply가 ElevenLabs로 그 대본을 읽고, 오디오에 Whisper를 돌려 나온 타이밍대로 영상을 편집합니다. 자막도 같은 타이밍에 맞춰집니다.

이건 아닙니다

이 음성 생성 기능은 Mac 앱 안에서 영상 타이밍을 맞추기 위한 것입니다. 문단을 붙여넣는 웹 화면도 없고, API도 없습니다.

실행 과정, 처음부터 끝까지

앱이 실제로 수행하는 순서 그대로, 세 단계입니다.

  1. 대본 확정

    AI 팀원이 인터뷰를 진행한 뒤 그 결과를 확정된 브리프에 대본으로 적어 넣습니다. 음성을 입히기 전에 그 문장을 직접 읽고 승인합니다. 승인되지 않은 초안으로는 음성이 생성되지 않습니다.

  2. 음성 렌더링

    ElevenLabs가 확정된 대본을 읽습니다. 이 오디오 파일은 플랜 페이지가 렌더링되기 전부터 이미 존재하므로, 이후 모든 타이밍 수치는 직접 들어볼 수 있는 음성 파일에서 나온 값입니다.

  3. 모든 컷 도출

    Whisper가 그 음성을 전사합니다. 컷 지점과 자막 구간은 대본의 단어별 타이밍에서 나오므로, 대사를 한 줄 바꾸면 편집도 그에 맞춰 다시 도출되고 어긋나지 않습니다.

수치와 근거

이 페이지의 모든 수치는 공개된 출처나 Kamply 자체 측정값에서 나옵니다. 추정치는 없습니다.

음성 엔진
ElevenLabs
Mac 앱에 내장되어 있으며, 계정은 사용자를 위해 미리 준비되어 있습니다.
타이밍 출처
렌더링된 음성의 Whisper 대본
수작업으로 입력한 음성 타이밍은 최종 점검에서 통과되지 않습니다.
제작 시간
60초 릴스당 약 1시간
Kamply 자체 제작 기록에 근거한 측정 시간입니다.
출력 형식
9:16, 1:1, 4:5 중 MP4
완성된 파일이 디스크에 저장되며, 업로드는 직접 합니다.
대행사 비교
영상 1편당 300~1,500달러
Vidico와 D-MAK가 공개한 제작 비용 기준입니다.

자주 묻는 질문

여기 없는 질문이라면 라이브 데모에서 물어보시면 됩니다. 아래 양식은 실제 사람에게 전달됩니다.

문단만 붙여넣고 오디오만 받을 수 있나요?

Kamply는 완성된 영상을 중심으로 설계되어 있어서, 음성은 릴스 제작 과정 안의 한 단계이지 별도의 다운로드 화면이 아닙니다. 문단 하나를 MP3로만 받고 싶다면 전용 TTS 서비스가 더 빠른 방법입니다.

자막은 음성과 어떻게 맞춰지나요?

같은 출처에서 나옵니다. Whisper가 렌더링된 ElevenLabs 음성을 전사하고, 자막 구간과 컷 지점 모두 그 대본에서 타이밍을 읽어옵니다. 시작·종료 시간을 직접 입력하는 사람이 없으니 어긋날 일도 없습니다.

대본 한 줄을 바꾸면 어떻게 되나요?

음성이 다시 렌더링되고 다시 전사되며, 편집도 새 단어 타이밍에서 다시 도출됩니다. 키프레임을 손으로 미세 조정하지 않습니다. 다른 방식으로 타이밍을 입력하면 렌더링을 검사하는 최종 점검을 통과하지 못합니다.

음성을 직접 고를 수 있나요?

가능합니다. Kamply는 기본 내레이터를 제공하며, 프로젝트마다 다른 ElevenLabs 음성을 지정할 수 있습니다. 음성 선택은 대본, 비율, 룩과 함께 승인하는 브리프의 일부입니다.

Kamply는 아바타나 립싱크도 지원하나요?

지원하지 않습니다. 말하는 얼굴도, 페이스 스왑도, 디지털 발표자도 없습니다. 음성은 앱 안에서 만든 푸티지, 스톡 이미지, 제품 사진, 모션 위에 얹힙니다. 카메라 앞에 등장하는 인물이 핵심이라면 이 도구는 맞지 않습니다.

완성된 릴스를 대신 게시해 주나요?

아닙니다. Kamply에는 게시 기능도, 예약 기능도, 소셜 계정 연동도 없습니다. 선택한 비율로 완성된 MP4를 Mac에 저장할 뿐이며, 어디에 올릴지는 직접 정합니다.

브리프 하나면 충분합니다. 첫 캠페인이 만들어지는 과정을 직접 확인해 보십시오.

라이브 데모 동안 브랜드에 맞춰 첫 방향을 함께 만듭니다. 끝날 때쯤이면 Kamply가 다음에 무엇을 만들지 정확히 알게 됩니다.

Kamply를 만든 Akash가 가능한 시간을 회신합니다. 라이브 데모는 무료입니다. 브랜드에 맞춰 첫 캠페인 방향을 직접 만들어 드리고, 파일은 그대로 가져가시면 됩니다.