오디오 텍스트 변환기

오디오 파일을 간편하게 텍스트로 변환합니다. 다양한 형식 지원 및 정확한 전사 기능으로 음성 내용을 쉽게 기록하세요.


오디오나 동영상 파일을 고르세요

MP3, WAV, M4A, OGG, FLAC, WEBM, MP4, MOV 등

파일당 20MB, 15분까지.

100% 무료 가입 불필요 처리 직후 파일 삭제
언어를 직접 지정하는 편이 자동 감지보다 확실합니다. 짧거나 잡음이 있는 녹음에서 특히 그렇습니다.

파일이 어떻게 처리되나요

파일은 저희 서버로 전송되어 그곳에서 변환되고, 결과가 나오는 즉시 삭제됩니다. 보관하지 않고 백업에도 남기지 않으며 사람이 듣는 일도 없습니다. 계정이나 이메일 주소를 요구하지 않으므로 녹음과 사용자를 잇는 정보 자체가 없습니다. 변환된 텍스트는 돌려드리는 페이지에만 표시되므로, 그 페이지를 닫으면 저희 쪽에서도 사라집니다.

  • 업로드된 파일은 텍스트가 만들어지는 순간 삭제됩니다.
  • 계정도 이메일도 없고, 무엇을 변환했는지 기록하지 않습니다.
  • 변환은 저희 자체 장비에서 실행되므로 오디오가 외부 서비스로 넘어가지 않습니다.

오디오를 텍스트로 바꾸는 방법

  1. 오디오나 동영상 파일을 선택합니다.
  2. 말하는 언어를 알면 지정하고, 모르면 자동으로 두세요.
  3. 텍스트로 변환을 누르고 기다립니다. 짧은 녹음은 몇 초, 15분이면 약 1분 걸립니다.
  4. 텍스트를 복사하거나 TXT, SRT, VTT 자막으로 내려받습니다.

지원 형식

오디오 파일과 동영상 파일 모두 됩니다. 흔히 쓰이는 것은 다음과 같습니다.

종류 형식
오디오 MP3, WAV, M4A, AAC, OGG, OPUS, FLAC, WMA, WEBM
동영상 MP4, MOV, WEBM, MKV, AVI, 3GP (오디오 트랙을 사용)
내보내기 TXT 일반 텍스트, SRT 자막, VTT 웹 자막

짧은 답변

오디오를 무료로 텍스트로 바꾸려면 위에서 MP3, WAV, M4A, MP4 파일을 고르고 말하는 언어를 지정한 뒤 텍스트로 변환을 누르세요. 짧은 녹음이면 몇 초 만에 결과가 나오며 TXT, SRT, VTT로 내려받을 수 있습니다. 계정은 필요 없고 파일은 결과가 나오는 즉시 삭제됩니다.

오디오 텍스트 변환기란

오디오 텍스트 변환기는 녹음을 듣고 말한 내용을 받아 적습니다. 사람이 하는 속기와 같은 일을 음성 인식 모델이 훨씬 짧은 시간에 해내는 것입니다. 인터뷰, 강의, 팟캐스트, 음성 메모, 회의 녹음, 동영상 자막 등에 쓰입니다.

제한과 속도

파일은 20MB, 15분까지 가능합니다. 15분짜리 녹음은 약 1분이면 돌아오고 짧은 음성 메모는 몇 초면 끝납니다. 인터뷰가 길다면 자연스러운 쉼에서 나눠 처리하는 편이 큰 파일 하나를 밀어 넣는 것보다 낫습니다.

정확도는 어느 정도인가

배경 소음이 적고 또렷한 말은 매우 잘 옮겨집니다. 여러 사람이 겹쳐 말하거나 억양이 강하거나 목소리 아래에 음악이 깔리거나 전화 품질의 녹음이면 정확도가 떨어집니다. 숫자, 고유명사, 전문 용어는 직접 확인하는 편이 좋습니다. 결과물은 완성된 문서가 아니라 완성도 높은 초안으로 다루세요.

더 나은 결과를 얻으려면

  • 자동으로 두지 말고 말하는 언어를 지정하세요.
  • 말하는 사람에게 최대한 가까이서 녹음하세요. 파일 형식보다 마이크 거리가 더 중요합니다.
  • 목소리 아래에 음악이나 잡음이 있으면 변환 전에 정리하세요.
  • 긴 녹음은 자연스러운 쉼에서 나눠 문장이 중간에 끊기지 않게 하세요.
  • 조용한 방이 비싼 마이크보다 낫습니다. 방부터 손보세요.

자주 묻는 질문

네, 계정도 체험 기간도 없고 결과물에 워터마크도 없습니다. 외부 업체에 분당 요금을 내는 대신 음성 모델을 저희 서버에서 직접 돌리고 있으며, 그래서 요금이나 가입 장벽 없이 제공할 수 있습니다.

업로드되어 변환된 뒤 곧바로 삭제됩니다. 보관하지 않고 백업에도 남기지 않으며 아무도 듣지 않습니다. 계정이 없기 때문에 애초에 녹음과 사용자를 잇는 정보가 없습니다. 변환된 텍스트는 돌려드리는 페이지에만 있으므로 그 페이지를 닫으면 그것으로 끝입니다.

파일당 20메가바이트, 15분입니다. 여러 파일을 연달아 보내면 짧은 대기 시간이 생기는데, 모두가 빠르게 쓸 수 있도록 하기 위해서입니다. 긴 녹음은 나눠서 차례로 처리하세요.

약 90개로 한국어, 영어, 스페인어, 포르투갈어, 프랑스어, 독일어, 이탈리아어, 네덜란드어, 폴란드어, 러시아어, 터키어, 일본어, 중국어, 태국어, 베트남어, 인도네시아어, 카탈루냐어 등이 포함됩니다. 특히 짧은 음성에서는 자동 감지보다 직접 언어를 고르는 편이 결과가 좋습니다.

네. MP4, MOV, WEBM 등을 올리면 그 안의 오디오 트랙을 읽습니다. 영상 자체는 무시되므로 미리 소리를 추출할 필요가 없습니다.

SRT나 VTT 파일을 내려받으세요. 두 형식 모두 같은 내용을 시간이 붙은 줄로 나눠 담고 있으며, 영상 편집 프로그램과 재생기가 기대하는 형태입니다. SRT는 대부분의 편집 소프트웨어에, VTT는 웹 영상에 알맞습니다.

1분짜리 음성 메모는 몇 초, 15분이면 약 1분 걸립니다. 기다리는 시간의 대부분은 변환 자체이므로 빠른 인터넷은 업로드에는 도움이 되지만 처리 속도는 바꾸지 못합니다.

음성 인식은 목소리가 겹칠 때, 억양이 강할 때, 배경 음악이 있을 때, 품질이 낮은 통화 녹음일 때 어려움을 겪습니다. 대개 가장 도움이 되는 것은 자동 감지에 맡기지 않고 말하는 언어를 직접 설정하는 것입니다. 고유명사와 숫자는 음질과 무관하게 직접 확인할 가치가 있습니다.

짧은 답변

오디오를 무료로 텍스트로 바꾸려면 위에서 MP3, WAV, M4A, MP4 파일을 고르고 말하는 언어를 지정한 뒤 텍스트로 변환을 누르세요. 짧은 녹음이면 몇 초 만에 결과가 나오며 TXT, SRT, VTT로 내려받을 수 있습니다. 계정은 필요 없고 파일은 결과가 나오는 즉시 삭제됩니다.