콘텐츠로 이동

파일 전사

경로: 설정 → 파일 전사(사이드바에 같은 이름의 항목).

  1. 오디오 또는 비디오를 드롭 영역으로 끌어다 놓습니다(클릭해서 파일을 고를 수도 있습니다).
  2. 현재 구성된 파일 전용 입력 모델을 사용합니다(실시간 음성 입력과 다른 모델을 지정할 수 있습니다).
  3. 완료되면 텍스트를 복사할 수 있고, 결과는 히스토리에 기록됩니다.

파일 전사 페이지에서 모델 선택을 엽니다. 실시간 음성 입력과 키 체계를 공유하지만, 카탈로그 항목은 독립적으로 구성할 수 있습니다.

런타임에도 여전히 isASRProviderAllowed를 따릅니다:

  • Free: Apple / Doubao / 내장 온디바이스 4종(SenseVoice, Whisper Turbo, Fun-ASR-Nano, Parakeet TDT)
  • 체험 / Pro: 전체 엔진 목록

데모 모드에서는 실제 ASR을 호출하지 않고 고정된 데모 텍스트를 반환할 수 있습니다.

실시간 음성 입력과 동시 사용 불가

섹션 제목: “실시간 음성 입력과 동시 사용 불가”

음성 입력 / 명령 / 번역 파이프라인이 녹음, 인식, 다듬기 또는 결과 오버레이를 사용 중이면 파일 전사는 시작을 거부합니다(pipelineBusy). 파일을 끌어다 놓기 전에 현재 세션을 종료하거나 취소하세요.

클라우드 파일 ASR은 차단됩니다. Apple, 내장 온디바이스 4종, 또는 Base URL이 루프백인 엔진(플랜 요건 충족 필요)을 대신 사용하세요.