BillionVerify 소개: 수십억 개의 이메일을 1% 비용으로 검증하세요. BillionVerify 사용해 보기

transcript.im
← 블로그

틱톡 자막 추출 다운로더: 말을 파일로 저장

작성자 Leo전사

틱톡 자막 추출 도구는 말한 내용을 TXT·SRT·VTT로 저장합니다. 화면 자막은 파일이 아니며 TikTok은 내보내기를 제공하지 않습니다.

틱톡 자막 추출 다운로더: 말을 파일로 저장

틱톡 자막 추출 도구는 틱톡 영상에서 말한 내용을 계속 보관할 수 있는 파일로 저장해 줍니다. 하지만 틱톡은 그런 파일을 주지 않습니다. 제작자가 자막을 만들어 둔 영상이라면 앱에서 자막을 보여 주고, 일부 버전에서는 시청 중에 Captions 또는 CC 컨트롤을 제공하기도 하지만, 그 자막은 화면 위에 겹쳐 그려지는 오버레이일 뿐입니다. 내보낼 수 있는 자막 파일이 아니고, 컨트롤 위치도 앱 버전과 기기, 지역에 따라 제각각입니다. 제작자가 자막을 아예 넣지 않았다면 읽을 것이 전혀 없는 경우도 많습니다.

그래서 이 페이지에서 말하는 '다운로드'는 영상이 아니라 텍스트를 뜻합니다. MP4를 저장하는 것은 틱톡 영상 다운로드가 할 일입니다. 사람들이 틱톡 자막 추출을 찾을 때 원하는 것은 결국 문장입니다. 확인하고 싶은 인용문, 편집에 쓸 자막 파일, 또는 다른 사람에게 그대로 건넬 수 있는 깔끔한 사본이죠. 화면에 보이는 글자를 긁어 복사하는 것과 파일로 내보내는 것은 전혀 다른 단계입니다.

복사와 내보내기

복사는 틱톡 앱 안에서 할 수 있는 모든 행위를 말합니다. 내보내기는 앱을 나간 뒤에도 남아 있는 파일입니다.

TikTok 앱 안에서 자막을 복사하는 방법과 스크립트를 파일로 내보내는 방법의 비교

복사 과정은 보통 이렇습니다:

  1. 틱톡에서 영상을 엽니다.
  2. 자막이 있는 영상이라면 재생 화면이나 공유·더 보기 메뉴 안에서 Captions 또는 CC 컨트롤을 찾아봅니다. 일부 계정은 접근성(Accessibility) 설정에 자막 환경설정이 있기도 합니다. 라벨과 메뉴 위치는 버전마다 달라지므로, 확실한 버튼이라기보다 재생 컨트롤을 뒤져 보는 탐색이라고 생각해야 합니다.
  3. 영상이 재생되는 동안 오버레이를 읽습니다. 필요한 문장이 나오면 일시정지합니다.
  4. 그 흐름에는 '자막 전체 복사'나 '자막 다운로드' 같은 공식 기능이 없습니다. 꼼꼼히 복사하려면 직접 다시 입력하거나, 그 화면에서 실제로 텍스트 선택이 허용될 때만 선택해야 합니다. 많은 자막은 영상 위에 그려져 있어 선택할 수 없습니다.

이 방식은 예상 가능한 지점에서 무너집니다. 제작자가 자막을 꺼 버렸거나 아예 만들지 않았을 수 있습니다. 화면의 글자가 대사가 아니라 텍스트 스티커나 타이틀 카드일 수도 있습니다. 두 사람이 트랙 위에서 겹쳐 말하면 오버레이는 일부만 잡습니다. 클립의 핵심이 음악이라 복사할 대사가 거의 없는 경우도 있습니다. 영상을 열 번 봐도 문서는 남지 않습니다.

내보내기는 오버레이가 아니라 공개 링크에서 시작합니다.

  1. 공개된 틱톡 URL을 복사합니다. 비공개 계정, 친구 공개 게시물, 또는 소유자로 로그인했을 때만 재생되는 링크는 공개 URL이 아닙니다.
  2. 그 URL을 transcript.im에 붙여 넣습니다. 영상 파일을 먼저 카메라 롤에 저장하지 않고도 그 링크에서 틱톡 자막 추출을 할 수 있습니다.
  3. 영상에 이미 자막 트랙이 있으면 도구가 그것을 읽습니다. 대부분의 틱톡 영상에는 없기 때문에 대신 음성을 받아쓰기합니다. 문장은 말소리에 맞춰 정렬된 타임스탬프와 함께 돌아옵니다.
  4. 브라우저에서 텍스트를 읽고 검색합니다. 그다음 내보냅니다.

틱톡 자막 추출 도구는 이 마지막 단계를 반복 가능하게 만든 것입니다. 문장이 TXT, SRT, VTT 형태로 앱 밖으로 나옵니다. 화면 오버레이는 자막이 완벽해 보이는 영상에서도 그렇게 할 수 없습니다. 오버레이는 보기 위한 것이고, 파일은 다시 쓰기 위한 것이기 때문입니다.

제작자 자막과 시청자 자막은 서로 다른 문입니다. 틱톡의 자동 자막 도입 글에 따르면 제작자는 편집 페이지에서 자막을 켜고 생성된 텍스트를 편집할 수 있으며, 그 자막은 영상의 일부가 됩니다. 같은 2021년 글은 자막을 끄고 싶은 시청자에게 공유 패널을 열고 자막 버튼을 누르라고 안내합니다. 그 버튼은 내보내기가 아닙니다. 이후 업데이트에서는 시청자가 일부 영상의 자막을 켤 수도 있게 했지만, 여전히 오버레이입니다. 앱 버전이 바뀌면 컨트롤 위치도 바뀌고, 시청자는 제작자의 편집기를 절대 가질 수 없습니다. 파일을 얻기 위해 시청자가 넣을 수 있는 것은 공개 링크뿐입니다. 제작자가 진짜 자막 트랙을 붙였다면 transcript.im이 그것을 읽습니다. 프레임 위에 글자만 그려 넣었다면 트랙은 비어 있고, 음성을 받아쓰기하게 됩니다.

화면에 새겨진 자막(burned-in)은 따로 주의가 필요합니다. 제작자가 그림 안에 자막을 직접 입력했다면 그 픽셀은 자막 트랙이 아닙니다. 기존 트랙만 가져오는 다운로더는 아무것도 보지 못합니다. 받아쓰기는 오디오를 듣습니다. 말로 한 단어를 얻고 싶을 때 맞는 방식이고, 타이틀 카드를 OCR하지는 않습니다. 소리 내어 말한 적 없는 문장은 자막에 들어가지 않습니다.

TXT, SRT, VTT

자막이 만들어진 뒤에는 형식이 다음 도구에 관한 선택이지, 틱톡에 관한 선택이 아닙니다.

TXT, SRT, VTT 비교: 메모용 일반 텍스트, 번호가 붙은 시간 큐, 웹 플레이어용 WebVTT 큐

형식얻는 것쓰기 좋은 경우
TXT일반 텍스트로 된 문장메모, 인용, 초안, 다른 앱에 붙여 넣기
SRT시작 시간과 종료 시간이 붙은 번호 매김 큐SubRip을 요구하는 영상 편집기나 자막 도구
VTT타임스탬프가 있는 WebVTT 큐VTT를 요구하는 웹 플레이어나 자막 작업 흐름

TXT는 읽기용 사본입니다. 문구 자체가 목적일 때 문서에 붙여 넣는 것이 바로 TXT입니다. SRT와 VTT는 시간 범위를 유지하므로, 한 줄이 문단처럼 떠다니지 않고 타임라인 위에 자리 잡을 수 있습니다. transcript.im은 같은 자막에서 세 형식을 모두 내보냅니다. 지원하는 다른 언어로 각 줄을 번역하면서 타임스탬프까지 함께 유지할 수도 있는데, 번역된 텍스트가 느슨한 문단이 아니라 자막이 되어야 할 때 이 점이 중요합니다.

이 앱은 TXT, SRT, VTT 중 무엇을 고르라고 요구하지 않습니다. 애초에 단어를 파일로 제공하지 않기 때문입니다. 단어가 오버레이 밖으로 나오기 전에는 고를 것이 없습니다. 틱톡 자막 추출 도구에서야 이 세 형식이 실제 선택지가 됩니다.

몇 가지 한계는 파일 확장자가 아니라 오디오 자체의 속성입니다. 시끄러운 노래 위에 얹은 20초짜리 말은 조용한 내레이션보다 전사 품질이 떨어집니다. 화자가 겹치면 녹음이 실제로 분리해 주지 않는 한 하나의 줄 흐름으로 뭉개집니다. 속어, 브랜드 이름, 사용자 이름은 흔한 오류입니다. TXT를 SRT로 바꾼다고 잘못된 단어가 바로잡히지 않습니다. 그 줄을 읽고, 타임스탬프로 그 초를 다시 듣고, 자막을 게시하기 전에 고치세요.

말이 없는 클립의 자막을 기대하지 마세요. 상업용 트랙에 맞춘 댄스, 사진 슬라이드쇼, 화면에 뜬 텍스트로 만든 농담은 거의 빈 결과로 돌아올 수 있습니다. 그것이 올바른 결과입니다. 다운로더가 숨겨진 자막 파일을 놓친 것이 아닙니다. 받아 적을 말이 없었습니다.

공개 접근은 또 다른 확실한 한계입니다. 틱톡이 공개 링크로 영상을 재생하지 못하면, 그 링크를 붙여 넣어도 자막이 나오지 않습니다. 지역 제한과 삭제된 게시물도 같은 방식으로 실패합니다. 남은 선택지는 스크린샷 OCR과 직접 타이핑뿐인데, 클립이 한 문장보다 길어지면 보기보다 훨씬 느립니다.

틱톡 자막 재활용하기

파일은 어떤 사본을 믿으려는지 알 때만 쓸모가 있습니다. 세 가지 버전을 구분해 두세요. 오버레이는 시청자가 본 것입니다. 자막은 오디오(또는 캡션 트랙)에 담긴 내용입니다. 편집본은 읽고 나서 당신이 바꾼 것입니다. 정확한 단어가 중요할 때는 자막을 인용하고 타임스탬프를 확인하세요. 제목 스티커를 마치 그 사람이 말한 것처럼 인용하지 마세요.

TikTok 스크립트를 재활용하는 방법: 타임스탬프가 있는 인용, 자막 파일, 다음 스크립트, AI 어시스턴트, 타임스탬프가 있는 번역

사람들이 실제로 하는 순서대로 흔한 재활용은 다음과 같습니다.

  1. 타임스탬프가 있는 인용. 자막에서 해당 문구를 검색하고, 그 줄을 복사하고, 옆에 타임스탬프를 남기세요. 당신의 작업을 검토하는 사람은 그 초에 영상을 열 수 있습니다.
  2. 새 편집본을 위한 자막 파일. SRT나 VTT를 내보내 편집기에 가져오세요. 시간은 출발점일 뿐입니다. 클립을 잘라내면 큐도 화면과 함께 움직여야 합니다.
  3. 다음 게시물을 위한 스크립트. 자막은 가공되지 않은 말입니다. 더 짧은 스크립트, 고정 댓글, 화면 텍스트로 다시 쓰세요. 원래 줄은 무엇이 말해졌는지에 대한 기록으로 남습니다.
  4. 어시스턴트를 위한 소스. 텍스트를 Google NotebookLM, ChatGPT, Claude, Gemini, Kimi, Manus에 붙여 넣으세요. 이 도구들은 당신이 준 단어로 작업합니다. 틱톡 캡션 트랙을 스스로 가져오지는 않습니다.
  5. 시간이 유지되는 번역. 자막에서 번역하고 타임스탬프를 유지한 다음, 번역이 영상 위에 올라가야 한다면 SRT나 VTT를 내보내세요.

파일을 넘기기 전에 타임스탬프 세 개를 확인하세요. 첫 줄을 재생해 목소리와 맞는지 확인합니다. 중간쯤의 줄, 특히 이름이나 숫자가 들어간 줄을 재생합니다. 마지막 줄을 재생해, 잘린 녹음이 짧은 스크립트로 통과하지 않게 합니다. 이 세 개가 맞으면 그 파일은 인용하거나 가져올 만합니다. 잘못된 이름은 그 줄에서 고칩니다. TXT를 SRT로 바꾼다고 고쳐지지 않습니다.

transcript.im 안에서는 내보내기 전에 같은 텍스트로 요약, 핵심 포인트, 마인드맵을 실행할 수도 있습니다. 긴 스티치나 토킹헤드 시리즈를 위한 읽기 보조 기능입니다. 자막을 대체하지는 않습니다. 인용하는 것은 여전히 전체 줄입니다.

파일을 영상 메타데이터로 취급하면 재활용이 어긋납니다. 틱톡 자막 다운로드에는 조회수, 댓글, 듀엣, 사운드 이름이 포함되지 않습니다. 어떤 단어가 화면 텍스트였는지도 알려주지 않습니다. 노트에 사운드 출처나 화면 속 농담이 필요하다면, 영상에서 직접 적어 자막 안이 아니라 옆에 두세요.

팀들이 두 번째로 걸려 넘어지는 지점은, 영상을 다운로드하고 오디오를 추출하고도 아무나 검색할 수 있는 문서는 없다는 사실입니다. 영상 파일은 화면입니다. 자막 파일은 단어입니다. 인용, 자막 달기, 다시 쓰기가 목적일 때 필요한 것은 두 번째입니다. 누군가 읽어야 할 때는 틱톡 자막 내보내기로 TXT를 만들고, 편집자가 큐를 필요로 할 때는 SRT나 VTT를 만드세요. 공개 링크에서 시작하고, 화면 자막은 영상이 열려 있는 동안 따라가는 용도로만 사용하세요.

전사 생성기

어떤 영상이든 텍스트로

YouTube, TikTok, Instagram 링크를 붙여넣으면 각 줄에 타임스탬프가 붙은 전사 텍스트를 읽을 수 있습니다.

TXT, SRT, VTT로 내보낼 수 있습니다.