오늘의 영상 4편 · 누적: 팁 331개 / 다룬 영상 75편(후보 등재 332편)
이 보고서가 원장 300건 동안 한 번도 열지 않은 축, 음성이다. TTS·음성복제·더빙·팟캐스트 음성. 후보 32편의 업로드 날짜를 전수 확인해 21편을 6개월 컷오프 밖으로 걸렀고, 남은 것 중 네 편의 자막을 읽었다.
ref_audio(내 목소리 파일)와 ref_text(그 녹음에서 실제로 말한 문장)를 함께 넘긴다.Voice(“Add your voice to the mix”) → 녹음 또는 파일 업로드 → 본인 인증 문구 낭독 → 이름·이미지 붙여 저장. 업로드는 앞 4분까지만 학습된다(10분짜리를 올려도 4분에서 잘렸다).연결 드롭다운 → 런타임 유형 변경 → GPU 선택 (무료)!pip install로 Qwen3-TTS와 soundfile 설치 (셀 앞 ! = 셸 명령)import torch 후 torch.cuda.is_available()로 GPU가 실제로 잡혔는지 확인 — 이 확인을 건너뛰면 CPU로 조용히 돌아가 느려진다from google.colab import files; files.upload() → 3초 이상(화자는 10초) 녹음 파일 업로드. 폰 기본 녹음기면 충분text, language(“Korean”), ref_audio, ref_textsoundfile로 wav 저장, IPython.display.Audio로 그 자리에서 재생·다운로드허용을 누르면 셀에 반영된다. 셀 내용을 모르겠으면 코드 설명 버튼.deep dive 포맷 · 기본 길이(약 20분)로 생성된다.debate 포맷 + short로 약 5분짜리를 뽑았고 진행자 목소리가 실제로 달랐다.convert to script 옵션이 그 자리였다(이걸 켜야 목소리 교체도 열린다). 리뷰어는 문장을 다시 쓰고, 둘째 화자의 “Mhm”을 “Yeah, that’s crazy, right?”로 바꿨다.