지원 형식 및 제한
XMOX는 직접 업로드를 위해 다음 파일 유형을 허용합니다:
- 오디오: MP3, WAV, M4A, FLAC, OGG, OPUS
- 비디오 컨테이너 (오디오 트랙 자동 추출): MP4, MOV, WEBM, MKV
최대 파일 크기는 500MB입니다. 더 긴 녹음의 경우 파일을 분할하거나 소스에서 직접 스트리밍하는 클라우드 통합(Zoom, Google Meet, Teams)을 사용하는 것을 고려하세요.
단계별 가이드: 파일 업로드
1
XMOX 워크스페이스를 열고 + 새 작업 버튼(또는 도구 모음의 업로드 아이콘)을 클릭합니다.
2
소스 선택기에서 "오디오/비디오 파일"을 선택합니다.
3
"파일 선택"을 클릭하거나 파일을 업로드 영역에 드래그 앤 드롭합니다. 업로드 진행 표시줄이 즉시 나타납니다.
4
업로드 후 XMOX가 자동으로 전사를 시작합니다. 목록의 작업 카드에는 AI가 작업하는 동안 처리 중 상태 배지가 표시됩니다.
5
상태가 준비됨으로 변경되면 작업을 클릭하여 전사본을 엽니다. 이제 콘텐츠를 읽고, 검색하고, 질문할 수 있습니다.
처리 시간 이해
처리 속도는 파일 길이와 현재 서버 부하에 따라 다릅니다. 대략적인 기준:
- 10분 녹음은 일반적으로 1분 이내에 완료됩니다.
- 1시간 녹음은 보통 3–5분 이내에 준비됩니다.
- 매우 긴 녹음(3시간 이상)은 10–15분이 걸릴 수 있습니다.
페이지를 열어둘 필요가 없습니다 — XMOX는 백그라운드에서 처리합니다. 돌아올 때 작업 목록을 새로 고침하세요.
전사 후 질문하기
작업이 준비되면 오른쪽의 AI 채팅 패널에서 자연어로 전사본을 쿼리할 수 있습니다. 시도해볼 효과적인 프롬프트:
- "이 회의의 핵심 사항을 요약해 주세요."
- "언급된 모든 행동 항목을 나열해 주세요."
- "처음 15분 동안 어떤 주제가 논의되었나요?"
- "'마감일'이라는 단어가 사용된 모든 경우를 찾아 주세요."
- "누가 가장 많이 말했고 무엇에 집중했나요?"
전사본의 아무 줄이나 클릭하면 오디오 플레이어의 정확한 해당 순간으로 이동할 수 있습니다 — 특정 답변 주변의 맥락을 확인하는 데 유용합니다.
최상의 전사 품질 얻기
XMOX는 전사에 Gemini AI를 사용하며, 억양이 있는 발음과 기술 용어도 매우 정확합니다. 최적의 결과를 위해:
- 가까운 마이크로 조용한 방에서 녹음하면 오류가 가장 적게 발생합니다.
- 가능하다면 업로드 전에 배경 소음을 줄이세요(Audacity의 노이즈 감소 같은 도구가 잘 작동합니다).
- 별도 채널에 여러 화자가 있는 스테레오 녹음은 자동으로 처리됩니다 — 전사본이 화자를 구별합니다.
- 특정 단어가 지속적으로 잘못 전사되는 경우 인라인으로 수정할 수 있으며, 수정된 버전은 모든 내보내기에 보존됩니다.
매우 낮은 품질의 녹음(심각한 압축 아티팩트, 심한 배경 소음 또는 매우 작은 음성)은 정확도가 낮은 전사본을 생성할 수 있습니다. AI는 여전히 최선을 다하겠지만 일부 단어는 불확실로 표시될 수 있습니다.
첫 번째 오디오 파일을 업로드할 준비가 되셨나요? XMOX 워크스페이스를 열고 몇 초 만에 시작하세요.
워크스페이스 열기 →