VoxForge  ·  macOS  ·  Releasevalidatie

Uw stem.
Uw machine.
Uw regels.

Transcribeer audio en video, bewerk de golfvorm en genereer spraak met modellen die draaien op uw Mac. Modellen worden gedownload wanneer u ze kiest; projecten blijven in de lokale app-opslag.

macOS 14 Sonoma of hoger  ·  Apple Silicon aanbevolen  ·  Openbare voorwaarden in behandeling

VoxForge macOS interface: interactieve golfvorm gesynchroniseerd met een transcript met de labels Spreker 1 en Spreker 2, TTS-stemkiezer en zijbalk van het project

In één oogopslag

Wat is VoxForge?

VoxForge is een native Mac-werkruimte voor lokale spraak-naar-tekst, golfvorm-gesynchroniseerde transcriptiebewerking en tekst-naar-spraak. Het downloadt modellen die de gebruiker kiest, transcribeert en synthetiseert vervolgens spraak lokaal in de gedocumenteerde workflow.

Platform
macOS 14 Sonoma of hoger; Apple silicium aanbevolen
Beste voor
Privétranscriptie, ondertitelwerk, transcriptiebewerking en lokale vertelling
Verwerking
Transcriptie en spraaksynthese maken gebruik van lokale modellen
Beschikbaarheid
Releasevalidatie; openbare build en commerciële voorwaarden in behandeling

Productfeiten beoordeeld aan de hand van de huidige applicatierepository op . Bekijk de verificatiemethode en het correctiebeleid.

99
Getranscribeerde talen
12+
Lokale TTS-engines
Lokaal
Spraakverwerking
RC
Releasestatus

Eén native Mac app voor transcriptie en spraak - volledig offline.

VoxForge is een native macOS applicatie die de eenheid verenigt spraak-naar-tekst (STT), tekst-naar-spraak (TTS) en mediatranscriptie in één tool die volledig op uw Mac draait. Transcriptie wordt mogelijk gemaakt door WhisperKit — Apple-Silicon-geoptimaliseerde Whisper die 99 talen beslaat, produceert tijdstempels op woordniveau en labels wie spreekt met SpeakerKit dagboekvorming. Voor spraakuitvoer levert VoxForge meer dan een dozijn lokale TTS-engines — inclusief Qwen3-TTS, Kokoro-82M en Piper — zodat u elke tekst of transcriptie hardop kunt voorlezen met natuurlijke, meertalige stemmen.

VoxForge brengt transcriptie, golfvormgesynchroniseerde bewerking, lokale spraakgeneratie, een doorzoekbare projectbibliotheek, batchverwerking, export van ondertitels en een verhaaleditor met meerdere sporen in één Mac app. Spraakmodellen worden lokaal uitgevoerd, terwijl geselecteerde modeldownloads en het expliciet ophalen van media het netwerk gebruiken. De huidige repository heeft geen VoxForge account of analyses. VoxForge is gebouwd door HighRoad Software en bevindt zich in de releasevalidatiefase.

Echte productschermen

Transcribeer, bewerk en spreek vanuit dezelfde Mac app.

De transcripteditor, stemstudio en vertelwerkruimte hieronder zijn van de huidige VoxForge-build.

VoxForge golfvorm-gesynchroniseerde transcripteditor
Bewerken een transcript terwijl u verankerd blijft aan de golfvorm.
VoxForge stemstudio
Kies een lokale stem en bekijk een voorbeeld ervan voordat u deze weergeeft.
VoxForge werkruimte voor vertelproject
Bouw langere vertelprojecten zonder tussen tools te exporteren.

Alles wat spraak is, op één machine

Transcriptie op productieniveau en natuurlijke spraaksynthese, ontworpen om aan te voelen dat het eigen is aan macOS en om te werken zonder een netwerkverbinding.

01 — Spraak-naar-tekst

Transcribeer alles, in 99 talen

Sleep een audio- of videobestand binnen - of transcribeer live via uw microfoon - en VoxForge maakt een transcript met tijdstempels op woordniveau met behulp van een geselecteerd lokaal WhisperKit-model. Nauwkeurigheid is afhankelijk van het model, de taal, de opnamekwaliteit, de sprekers en het domein; Er wordt geen universeel percentage woordfouten geclaimd.

  • Taal automatisch detecteren of kiezen uit 99, met optionele vertaling naar het Engels
  • Spreekdagboekregistratie labelt elke stem (SpeakerKit / Pyannote v4)
  • Kies de modelgrootte van klein tot groot-v3 die bij uw past Mac's RAM
  • Live streaming transcriptie en batchwachtrijen voor hele mappen
02 — Tekst-naar-spraak

Twaalf lokale spraakengines, jouw keuze

Typ of plak tekst en VoxForge spreekt het met natuurlijke stemmen: geen cloud-TTS, geen facturering per teken. Blader door zoekmachines op kwaliteit, grootte en taal, bekijk een voorbeeld voordat u downloadt en stream het afspelen zodat u de eerste woorden vrijwel onmiddellijk hoort.

  • Qwen3-TTS (10 talen, optionele emotie-/stijlcontrole)
  • Kokoro-82M — compact lokaal stemmodel; verifieer de huidige modelgrootte en taalondersteuning in de build
  • Piper — honderden stemmen in meer dan 20 talen
  • Lees elk transcript voor voor handsfree proeflezen
03 — Bewerken & export

Golfvormgesynchroniseerd bewerken, beschrijvende stijl

Klik op de golfvorm om naar het transcript te springen; klik op het transcript om de audio te scrubben. Hernoem sprekers, corrigeer woorden inline en exporteer vervolgens naar wat uw workflow nodig heeft. Met een verhaaleditor met meerdere sporen kunt u verhalen en clips samenvoegen tot een voltooid stuk.

  • Exporteer TXT, SRT, VTT, JSON, CSV, DOCX en PDF
  • Transcriptiesamenvattingen en vertalingen, gegenereerd op het apparaat
  • Inbranden van ondertitels en tijdlijn met meerdere sporen
  • Projectbibliotheek met zoeken in volledige tekst in alles

Van opname tot resultaat in drie stappen

Geen setup-gymnastiek. Open de app, richt hem op je audio en alles draait lokaal.

1

Importeer of neem op

Sleep een audio- of videobestand naar binnen, neem op vanaf je microfoon of plak een video-URL in VoxForge Pro. Modellen worden één keer gedownload bij het eerste gebruik en blijven lokaal in de cache.

2

Transcriberen of synthetiseren

WhisperKit transcribeert met sprekerlabels en tijdstempels, of kies een TTS-engine om tekst in spraak om te zetten. Alles draait op de Neural Engine en GPU.

3

Bewerken & export

Verfijn het transcript aan de hand van de golfvorm, vat het samen of vertaal het en exporteer vervolgens ondertitels, documenten of audio - allemaal zonder internetverbinding.

Gebouwd voor mensen die geen audio naar de cloud kunnen sturen

🎙️

Podcasters & makers

Transcribeer interviews, label sprekers, exporteer voor YouTube geschikte SRT-ondertitels en gesproken B-roll-vertelling: één app in plaats van vier.

🔬

Onderzoekers

Nauwkeurige meertalige transcriptie met betrouwbare dagboekregistratie, batchverwerking en gestructureerde export voor kwalitatieve analyse.

⚖️

Juridisch & medical

Voer spraakverwerking lokaal uit. Jij blijft verantwoordelijk voor het vastleggen van toestemming, beroepsgeheim, veilige opslag en alle downloads van modellen of media die je start.

Toegankelijkheidsgebruikers

Lokale stemmen van hoge kwaliteit lezen documenten voor, met volledige VoiceOver-ondersteuning en navigatie via het toetsenbord.

🎓

Studenten enamp; journalisten

Zet lezingen en interviews binnen enkele minuten om in doorzoekbare, bewerkbare tekst en lees deze vervolgens terug om te zien wat je hebt gemist.

🌍

Meertalige teams

99 transcriptietalen plus natuurlijke stemmen in meer dan 20 uitvoertalen - met ingebouwde vertaling naar het Engels.

Spraak buiten het netwerk

Spraakinferentie en projectopslag zijn lokaal. Er is geen VoxForge account of analyse-SDK in de huidige opslagplaats. Netwerktoegang wordt gebruikt voor modellen die u wilt downloaden, kopen of licentievalidatie waar van toepassing, en media worden alleen opgehaald van een URL die u opgeeft in de directe configuratie.

🔒
Geen gevolgtrekking uit de cloud
STT en TTS draaien op de Apple Neural Engine & GPU.
🚫
Geen telemetrie
Geen analyses, geen tracking, geen gebruikspings.
👤
Geen account
Niets om u voor aan te melden. Gewoon openen en gebruiken.
🗄️
Lokale opslag
Projecten live in de sandbox-container van de app.

STT + TTS op één plek – eindelijk

VoxForge brengt transcriptie en spraakgeneratie in één local-first Mac werkruimte. De mogelijkheden en commerciële voorwaarden van concurrenten kunnen veranderen, dus verifieer ze direct voordat u een keuze maakt.

Mogelijkheid VoxForge MacWhisper Speechify Beschrijving
Spraak-naar-tekst
Tekst-naar-spraak
SpraakdialoogGedeeltelijk
Waveform-gesynchroniseerd bewerken
Lokale spraakinferentieControleer leverancierControleer leverancier
Werkt offline
Commerciële voorwaardenIn behandeling releaseControleer leverancierControleer leverancierControleer leverancier
Geen account vereist

Vergelijking beoordeeld op 14 juli 2026. Controleer de huidige mogelijkheden en voorwaarden op elk officiële productpagina van de leverancier. Productnamen zijn handelsmerken van hun respectievelijke eigenaren.

Vrijgavekanalen in validatie

De repository bevat Store- en direct-build-configuraties. Openbare prijzen en aankooplinks worden pas weergegeven nadat deze eindpunten live zijn.

Winkelopbouw
In behandeling vrijgave
Sandbox-configuratie
  • Spraak-naar-tekst in 99 talen
  • Luidsprekerdialoog & tijdstempels
  • 12+ lokale tekst-naar-spraak-engines
  • Wavevorm-gesynchroniseerde bewerking van transcripties
  • Importeer lokale audio enamp; videobestanden
  • Ondertiteling, document & audio-export
  • Projectbibliotheek met zoeken in volledige tekst
Check winkelbeschikbaarheid
Meest capabele
Directe build
In behandeling vrijgave
Ontwikkelaars-ID ondertekend & notarieel
  • Alles in de sandbox-winkelconfiguratie
  • Video-URL import van meer dan 1.500 sites
  • Afspeellijst downloaden & batch transcriberen
  • Uitgebreide formaten: WebM, MKV, AVI, OGG
  • Prioriteitsfunctieverzoeken
Beschikbaarheid van directe build controleren

Spraakinferentie is lokaal in beide configuraties. De directe configuratie kan media ophalen waar u expliciet om vraagt; modellevering en rechtencontroles maken ook gebruik van het netwerk.

Vragen, beantwoord

Spraak-naar-tekst en tekst-naar-spraak gebruiken lokale modellen op de Mac. Netwerktoegang wordt alleen gebruikt voor modellen die u wilt downloaden, kopen of licentievalidatie indien van toepassing, ondersteuningslinks en direct ophalen van media alleen als u een URL opgeeft.

99 talen via WhisperKit — dezelfde dekking als OpenAI's Whisper — inclusief Engels, Frans, Duits, Spaans, Italiaans, Portugees, Arabisch, Chinees, Japans, Koreaans, Russisch en Hindi. De taal kan automatisch worden gedetecteerd of handmatig worden ingesteld, en spraak kan tijdens transcriptie naar het Engels worden vertaald.

Ja. VoxForge voert sprekerdialogen uit met SpeakerKit (gebaseerd op Pyannote v4), waarbij automatisch wordt gescheiden en gelabeld wie wat heeft gezegd. Je kunt de naam van de sprekers wijzigen en de labels blijven gesynchroniseerd met de golfvorm en tijdstempels op woordniveau, zodat je naar elk moment in de audio kunt springen.

VoxForge combineert transcriptie, lokale spraakgeneratie, sprekerlabels en golfvormgesynchroniseerd bewerken in één Mac werkruimte. Kenmerken van concurrenten, gegevensstromen en prijzen veranderen; verifieer ze op hun huidige officiële pagina's.

De repository documenteert meerdere lokale spraak-engines, waaronder Qwen3-TTS, Kokoro-82M, Piper en Apple systeemstemmen. Beschikbaarheid van de engine, modelgrootte, talen en stijlcontroles zijn afhankelijk van de huidige build en gekozen download. Bekijk een voorbeeld van een stem in representatieve tekst voordat u deze voor een project selecteert.

Ja. VoxForge transcribeert audio en video met tijdstempels en kan ondertitel- en documentformaten exporteren. De sandbox-configuratie importeert lokale bestanden; de directe configuratie kan ook media ophalen van een URL die u opgeeft, afhankelijk van de beschikbaarheid van de release en voorwaarden van derden.

De definitieve commerciële voorwaarden zijn nog niet van kracht. Elke prijs, verlengingsmodel, inbegrepen functies en terugbetalingsroute worden vóór aankoop getoond bij de geverifieerde kassa.

De repository bevat een winkelconfiguratie in een sandbox en een directe configuratie die expliciete URL-ophaalservice en uitgebreide formaten kan toevoegen. De definitieve kanaalbeschikbaarheid en functiegrenzen worden bij de release bevestigd. Spraakinferentie blijft lokaal in beide configuraties.

macOS 14 Sonoma of hoger. Apple Silicon (M-serie) wordt sterk aanbevolen omdat transcriptie en synthese worden uitgevoerd op de Neural Engine en GPU. Modellen worden één keer gedownload en lokaal in de cache opgeslagen. Het aanbevolen Whisper Turbo-model en de Kokoro-stem zijn een kleine download, en u kunt lichtere modellen kiezen van 8 GB Macs.

VoxForge app-pictogram

Spraak, op uw voorwaarden

Spraak transcriberen, bewerken en synthetiseren met lokale modellen. De openbare build bevindt zich nog in de releasevalidatiefase.

macOS 14+ · Apple Silicon aanbevolen · Commerciële voorwaarden in behandeling