VoxForge  ·  macOS  ·  후보 출시

녹음하세요.
음성으로 녹음하세요.
나만의 것으로 만드세요.

녹음 및 스크립트를 편집 가능한 스크립트, 복제된 음성 클립, 다중 음성 팟캐스트로 변환하세요. 호환 모델은 다운로드하기로 선택한 후 Mac에서 실행됩니다.

macOS 14 Sonoma 이상  ·  Apple Silicon 권장  ·  공개 약관 보류 중

VoxForge Voice Lab showing a generated local voice-clone preview ready to play

한눈에 보기

무엇입니까? VoxForge?

VoxForge은 로컬 전사, 참조 음성 복제, 스크립트 음성 변환 생성 및 다중 음성 팟캐스트 제작을 위한 기본 Mac 작업 공간입니다. 호환 가능한 음성 및 텍스트 모델은 다운로드 후 Mac에서 실행됩니다.

플랫폼
macOS 14 Sonoma 이상; Apple 실리콘 권장
최적
스크립트 작성, 음성 복제, 내레이션 동영상 및 팟캐스트 제작
처리
스크립트 작성 및 음성 합성에 로컬 모델 사용
가용성
출시 유효성 검사; 공개 빌드 및 상용 약관 보류 중

제품 정보는 . 확인 방법 및 수정 정책을 확인하세요.

99
기록된 언어
복제
참조 음성
로컬
음성 처리
RC
릴리스 상태

대본, 음성 및 팟캐스트를 위한 하나의 기본 Mac 스튜디오.

VoxForge는 다음을 위한 기본 macOS 애플리케이션입니다. 음성-텍스트, 스크립트-음성, 참조 음성 복제 및 다중 음성 팟캐스트 제작. 선택된 로컬 WhisperKit 모델은 단어 수준의 타임스탬프와 화자 라벨을 생성할 수 있습니다. 호환 가능한 설치 모델은 음성 생성, 음성 복제 및 로컬 내레이션 초안 작성을 지원합니다.

Podcast Studio는 음성을 한 줄씩 할당하고 타임라인에 따라 대화를 구성하며 선택한 음성과 모델에서 프로젝트를 렌더링합니다. 음성 처리 및 지원되는 텍스트 초안 작성은 로컬에서 실행됩니다. 모델 다운로드, 적용 가능한 자격 확인 및 명시적인 직접 빌드 미디어 가져오기에는 연결이 필요합니다. VoxForge은(는) HighRoad Software에 의해 빌드되었으며 릴리스 검증 상태로 유지됩니다.

실제 제품 화면

동일한 Mac 앱에서 스크립트를 작성하고 편집하고 말할 수 있습니다.

아래 스크립트 편집기, 음성 스튜디오 및 내레이션 작업 공간은 현재 VoxForge 빌드에서 가져온 것입니다.

VoxForge Voice Lab with a local cloned-voice preview ready to play
편집 파형에 고정된 상태를 유지하면서 스크립트를 작성합니다.
VoxForge script-to-speech workspace with generated waveform and playback
로컬 음성을 선택하고 렌더링하기 전에 미리 봅니다.
VoxForge Podcast Studio with two assigned voices and four rendered blocks
도구 간에 내보내기 없이 긴 내레이션 프로젝트를 빌드합니다.

모든 음성을 하나의 시스템에서

기본 Mac 워크플로용으로 설계된 스크립트 작성, 음성 생성 및 제작 도구입니다.

01 — 음성 텍스트 변환

99개 언어로 무엇이든 텍스트로 변환

오디오 또는 비디오 파일을 드래그하거나 마이크에서 실시간으로 텍스트로 변환하세요. VoxForge은 선택된 로컬 WhisperKit 모델을 사용하여 단어 수준 타임스탬프가 있는 기록을 생성합니다. 정확도는 모델, 언어, 녹음 품질, 스피커 및 도메인에 따라 다릅니다. 보편적인 단어 오류율은 주장되지 않습니다.

  • 언어 자동 감지 또는 99개 중에서 선택(선택적으로 영어로 번역 포함)
  • 화자 분할로 모든 음성에 라벨 지정(SpeakerKit / Pyannote v4)
  • Mac's에 맞게 소형에서 대형 v3까지 모델 크기 선택 RAM
  • 전체 폴더에 대한 라이브 스트리밍 텍스트 변환 및 일괄 대기열
02 — 텍스트 음성 변환

스크립트를 음성 트랙으로 전환

텍스트를 입력하거나 붙여넣고, 호환되는 설치된 음성 모델을 선택하고, 결과를 미리 보고, 오디오를 내보낼 수 있습니다. 음성 가용성, 언어 적용 범위 및 전달 제어는 선택한 모델에 따라 다릅니다.

  • 호환 모델을 사용하여 참조 오디오에서 음성 프로필 생성 및 저장
  • 완전한 스크립트를 하나의 트랙으로 생성하거나 한 줄씩 음성 할당
  • 프로덕션 오디오를 내보내기 전에 음성 미리보기
  • 모든 스크립트를 소리내어 읽기 손을 사용하지 않고 교정
03 — 편집 및amp; 내보내기

타임라인에 다중 음성 팟캐스트 구축

대화를 작성하고, 저장된 음성이나 내장된 음성을 각 캐릭터에 할당하고, 타이밍을 조정하고, Podcast Studio에서 렌더링하세요. 내레이션 작업공간에서는 호환되는 로컬 텍스트 모델을 사용하여 음성 생성 전에 장면 노트에서 스크립트 초안을 작성할 수도 있습니다.

  • TXT, SRT, VTT, JSON, CSV, DOCX 및 PDF 내보내기
  • 대본 요약, 번역 및 로컬 내레이션 초안
  • 라인별 음성 할당 및 타임라인 제어 기능이 있는 Podcast Studio
  • 모든 항목에 대한 전체 텍스트 검색 기능이 있는 프로젝트 라이브러리

녹화부터 결과까지 3단계

미디어 또는 스크립트를 작성하고 필요한 모델을 선택한 다음 결과를 형성하고 내보냅니다.

1

가져오기 또는 녹음

오디오 또는 비디오 파일을 드래그하거나, 마이크에서 녹음하거나, VoxForge Pro에서 비디오 URL을 붙여넣습니다. 모델은 처음 사용할 때 한 번 다운로드되고 로컬에 캐시된 상태로 유지됩니다.

2

스크립트 작성 또는 합성

화자 레이블을 사용하여 스크립트를 작성하거나, 스크립트에서 음성을 생성하거나, 호환 가능한 설치된 모델을 사용하여 참조 오디오에서 음성 프로필을 생성하세요.

3

편집 및amp; 내보내기

대본을 다듬고, 팟캐스트 음성을 할당하고, 타임라인을 조정하고, 자막, 문서, 오디오 또는 나레이션 비디오를 내보냅니다.

클라우드에 오디오를 보낼 수 없는 사람들을 위해 제작되었습니다

🎙️

팟캐스터 및amp; 크리에이터

인터뷰 녹취, 화자 라벨 지정, YouTube용 SRT 자막 내보내기, 음성 B-롤 내레이션 — 4개가 아닌 하나의 앱.

🔬

연구원

정성적 분석을 위한 안정적인 분할, 일괄 처리 및 구조화된 내보내기를 통해 정확한 다국어 녹취가 가능합니다. 분석.

⚖️

법률 및amp; 의료

기밀 녹음, 구조화된 검토 및 제어된 내보내기를 위해 Mac에서 음성 처리를 유지하세요.

접근성 사용자

전체 VoiceOver 지원과 키보드 우선 탐색 기능을 통해 고품질 로컬 음성으로 문서를 소리내어 읽어줍니다.

🎓

학생 & 언론인

강의와 인터뷰를 몇 분 만에 검색 및 편집 가능한 텍스트로 변환한 다음 다시 읽어서 놓친 부분을 파악하세요.

🌍

다국어 팀

99개 전사 언어와 20개 이상의 출력 언어에 대한 자연스러운 음성 - 영어 번역 기능이 내장되어 있습니다.

그리드를 벗어난 음성

음성 처리, 지원되는 텍스트 초안 작성 및 프로젝트 저장은 로컬입니다. 네트워크 액세스는 귀하가 다운로드하도록 선택한 모델, 해당되는 경우 권한 확인 및 직접 구성에서 제공한 URL에서만 미디어를 가져오는 데 사용됩니다.

🔒
클라우드 추론 없음
호환되는 음성 및 텍스트 모델은 Mac에서 실행됩니다.
🚫
제로 원격 측정
분석, 추적, 사용 핑이 없습니다.
👤
계정이 없습니다
가입할 항목이 없습니다. 열어서 사용하세요.
🗄️
로컬 저장소
프로젝트는 앱의 샌드박스 컨테이너에 있습니다.

STT + TTS를 한 곳에서 — 마침내

VoxForge는 텍스트 변환 및 음성 생성을 하나의 로컬 우선 Mac 작업 공간으로 가져왔습니다. 경쟁사 기능 및 상업적 조건은 변경될 수 있으므로 선택하기 전에 직접 확인하세요.

기능 VoxForge MacWhisper Speechify 설명
음성-텍스트
텍스트-음성
화자 분할일부
파형 동기화 편집
로컬 음성 추론공급업체 확인공급업체 확인
오프라인으로 작동
상용 약관출시 대기 중공급업체 확인공급업체 확인공급업체 확인
계정 필요 없음

7월 14일 비교 검토 2026. 각 공급업체의 공식 제품 페이지에서 현재 기능과 조건을 확인하세요. 제품 이름은 해당 소유자의 상표입니다.

유효성 검사 중인 출시 채널

저장소에는 Store 및 직접 빌드 구성이 포함되어 있습니다. 공개 가격 및 구매 링크는 해당 엔드포인트가 활성화된 후에만 표시됩니다.

스토어 빌드
보류 중 릴리스
샌드박스 구성
  • 99년에 음성 텍스트 변환 언어
  • 화자 분할 및amp; 타임스탬프
  • 스크립트 음성 변환 및 참조 음성 복제
  • 다중 음성 Podcast Studio 및 로컬 내레이션 초안 작성
  • 파형 동기화 스크립트 편집
  • 로컬 오디오 및amp; 동영상 파일
  • 자막, 문서 및amp; 오디오 내보내기
  • 전체 텍스트 검색 기능이 있는 프로젝트 라이브러리
스토어 가용성 확인
가장 뛰어난 기능
직접 빌드
보류 중 출시
개발자 ID 서명 및amp; 공증됨
  • 샌드박스 스토어 구성의 모든 것
  • 1,500개 이상의 사이트에서 비디오-URL 가져오기
  • 재생목록 다운로드 및amp; 일괄 스크립트 작성
  • 확장 형식: WebM, MKV, AVI, OGG
  • 우선순위 기능 요청
직접 빌드 가용성 확인

음성 추론은 두 구성 모두에서 로컬입니다. 직접 구성은 명시적으로 요청한 미디어를 가져올 수 있습니다. 모델 제공 및 권한 확인에도 네트워크가 사용됩니다.

질문 및 답변

음성-텍스트 및 텍스트-음성 변환은 Mac에서 로컬 모델을 사용합니다. 네트워크 액세스는 URL을 제공한 경우에만 다운로드, 구매 또는 라이센스 검증을 위해 선택한 모델에 사용되며 링크를 지원하고 URL을 제공할 때만 미디어 직접 가져오기를 지원합니다.

WhisperKit을 통해 99개 언어 — OpenAI의 Whisper와 동일한 적용 범위(영어, 프랑스어, 독일어, 스페인어, 이탈리아어, 포르투갈어, 아랍어, 중국어, 일본어, 한국어, 러시아어, 힌디어. 언어는 자동 감지되거나 수동으로 설정될 수 있으며, 텍스트 변환 중에 음성이 영어로 번역될 수 있습니다.

예. VoxForge은 SpeakerKit(Pyannote v4 기반)을 사용하여 화자 분할을 수행하여 누가 무엇을 말했는지 자동으로 분리하고 라벨을 지정합니다. 스피커 이름을 변경할 수 있으며, 라벨은 파형 및 단어 수준 타임스탬프와 동기화되어 오디오의 어느 순간으로든 이동할 수 있습니다.

VoxForge은 하나의 Mac 작업 공간에 전사, 로컬 음성 생성, 화자 레이블 및 파형 동기화 편집을 결합합니다. 경쟁사 기능, 데이터 흐름 및 가격이 변경됩니다. 현재 공식 페이지에서 확인하세요.

VoxForge에는 앱에 내장되어 있고 다운로드 가능한 음성 옵션이 나와 있습니다. 음성 가용성, 모델 크기, 언어 적용 범위 및 전달 제어는 현재 빌드 및 선택한 모델에 따라 다릅니다. 프로젝트에 참여하기 전에 대표 텍스트를 미리 보세요.

예. VoxForge은 타임스탬프와 함께 오디오 및 비디오를 기록하고 자막 및 문서 형식을 내보낼 수 있습니다. 샌드박스 구성은 로컬 파일을 가져옵니다. 직접 구성을 사용하면 출시 여부와 제3자 조건에 따라 제공한 URL에서 미디어를 가져올 수도 있습니다.

최종 상업 조건은 아직 공개되지 않았습니다. 모든 가격, 갱신 모델, 포함된 기능 및 환불 경로는 구매 전 확인된 결제 시 표시됩니다.

저장소에는 샌드박스 스토어 구성과 명시적 URL 가져오기 및 확장 형식을 추가할 수 있는 직접 구성이 포함되어 있습니다. 최종 채널 가용성과 기능 경계는 출시 시 확인됩니다. 음성 추론은 두 구성 모두에서 로컬로 유지됩니다.

macOS 14 Sonoma 이상(Apple Silicon Mac). 저장 및 메모리 요구 사항은 설치하기로 선택한 음성 및 텍스트 모델에 따라 다릅니다.

VoxForge 앱 아이콘

원하는 방식으로 음성

로컬 모델을 사용하여 음성을 텍스트로 기록하고, 편집하고, 합성하세요. 공개 빌드는 아직 출시 검증 중입니다.

macOS 14세 이상 · Apple Silicon 권장 · 상용 약관 보류 중