Uw stem.
Uw machine.
Uw regels.
Transcribeer audio en video, bewerk de golfvorm en genereer spraak met modellen die draaien op uw Mac. Modellen worden gedownload wanneer u ze kiest; projecten blijven in de lokale app-opslag.
macOS 14 Sonoma of hoger · Apple Silicon aanbevolen · Openbare voorwaarden in behandeling
In één oogopslag
Wat is VoxForge?
VoxForge is een native Mac-werkruimte voor lokale spraak-naar-tekst, golfvorm-gesynchroniseerde transcriptiebewerking en tekst-naar-spraak. Het downloadt modellen die de gebruiker kiest, transcribeert en synthetiseert vervolgens spraak lokaal in de gedocumenteerde workflow.
- Platform
- macOS 14 Sonoma of hoger; Apple silicium aanbevolen
- Beste voor
- Privétranscriptie, ondertitelwerk, transcriptiebewerking en lokale vertelling
- Verwerking
- Transcriptie en spraaksynthese maken gebruik van lokale modellen
- Beschikbaarheid
- Releasevalidatie; openbare build en commerciële voorwaarden in behandeling
Productfeiten beoordeeld aan de hand van de huidige applicatierepository op . Bekijk de verificatiemethode en het correctiebeleid.
Eén native Mac app voor transcriptie en spraak - volledig offline.
VoxForge is een native macOS applicatie die de eenheid verenigt spraak-naar-tekst (STT), tekst-naar-spraak (TTS) en mediatranscriptie in één tool die volledig op uw Mac draait. Transcriptie wordt mogelijk gemaakt door WhisperKit — Apple-Silicon-geoptimaliseerde Whisper die 99 talen beslaat, produceert tijdstempels op woordniveau en labels wie spreekt met SpeakerKit dagboekvorming. Voor spraakuitvoer levert VoxForge meer dan een dozijn lokale TTS-engines — inclusief Qwen3-TTS, Kokoro-82M en Piper — zodat u elke tekst of transcriptie hardop kunt voorlezen met natuurlijke, meertalige stemmen.
VoxForge brengt transcriptie, golfvormgesynchroniseerde bewerking, lokale spraakgeneratie, een doorzoekbare projectbibliotheek, batchverwerking, export van ondertitels en een verhaaleditor met meerdere sporen in één Mac app. Spraakmodellen worden lokaal uitgevoerd, terwijl geselecteerde modeldownloads en het expliciet ophalen van media het netwerk gebruiken. De huidige repository heeft geen VoxForge account of analyses. VoxForge is gebouwd door HighRoad Software en bevindt zich in de releasevalidatiefase.
Transcribeer, bewerk en spreek vanuit dezelfde Mac app.
De transcripteditor, stemstudio en vertelwerkruimte hieronder zijn van de huidige VoxForge-build.
Alles wat spraak is, op één machine
Transcriptie op productieniveau en natuurlijke spraaksynthese, ontworpen om aan te voelen dat het eigen is aan macOS en om te werken zonder een netwerkverbinding.
Transcribeer alles, in 99 talen
Sleep een audio- of videobestand binnen - of transcribeer live via uw microfoon - en VoxForge maakt een transcript met tijdstempels op woordniveau met behulp van een geselecteerd lokaal WhisperKit-model. Nauwkeurigheid is afhankelijk van het model, de taal, de opnamekwaliteit, de sprekers en het domein; Er wordt geen universeel percentage woordfouten geclaimd.
- Taal automatisch detecteren of kiezen uit 99, met optionele vertaling naar het Engels
- Spreekdagboekregistratie labelt elke stem (SpeakerKit / Pyannote v4)
- Kies de modelgrootte van klein tot groot-v3 die bij uw past Mac's RAM
- Live streaming transcriptie en batchwachtrijen voor hele mappen
Twaalf lokale spraakengines, jouw keuze
Typ of plak tekst en VoxForge spreekt het met natuurlijke stemmen: geen cloud-TTS, geen facturering per teken. Blader door zoekmachines op kwaliteit, grootte en taal, bekijk een voorbeeld voordat u downloadt en stream het afspelen zodat u de eerste woorden vrijwel onmiddellijk hoort.
- Qwen3-TTS (10 talen, optionele emotie-/stijlcontrole)
- Kokoro-82M — compact lokaal stemmodel; verifieer de huidige modelgrootte en taalondersteuning in de build
- Piper — honderden stemmen in meer dan 20 talen
- Lees elk transcript voor voor handsfree proeflezen
Golfvormgesynchroniseerd bewerken, beschrijvende stijl
Klik op de golfvorm om naar het transcript te springen; klik op het transcript om de audio te scrubben. Hernoem sprekers, corrigeer woorden inline en exporteer vervolgens naar wat uw workflow nodig heeft. Met een verhaaleditor met meerdere sporen kunt u verhalen en clips samenvoegen tot een voltooid stuk.
- Exporteer TXT, SRT, VTT, JSON, CSV, DOCX en PDF
- Transcriptiesamenvattingen en vertalingen, gegenereerd op het apparaat
- Inbranden van ondertitels en tijdlijn met meerdere sporen
- Projectbibliotheek met zoeken in volledige tekst in alles
Van opname tot resultaat in drie stappen
Geen setup-gymnastiek. Open de app, richt hem op je audio en alles draait lokaal.
Importeer of neem op
Sleep een audio- of videobestand naar binnen, neem op vanaf je microfoon of plak een video-URL in VoxForge Pro. Modellen worden één keer gedownload bij het eerste gebruik en blijven lokaal in de cache.
Transcriberen of synthetiseren
WhisperKit transcribeert met sprekerlabels en tijdstempels, of kies een TTS-engine om tekst in spraak om te zetten. Alles draait op de Neural Engine en GPU.
Bewerken & export
Verfijn het transcript aan de hand van de golfvorm, vat het samen of vertaal het en exporteer vervolgens ondertitels, documenten of audio - allemaal zonder internetverbinding.
Gebouwd voor mensen die geen audio naar de cloud kunnen sturen
Podcasters & makers
Transcribeer interviews, label sprekers, exporteer voor YouTube geschikte SRT-ondertitels en gesproken B-roll-vertelling: één app in plaats van vier.
Onderzoekers
Nauwkeurige meertalige transcriptie met betrouwbare dagboekregistratie, batchverwerking en gestructureerde export voor kwalitatieve analyse.
Juridisch & medical
Voer spraakverwerking lokaal uit. Jij blijft verantwoordelijk voor het vastleggen van toestemming, beroepsgeheim, veilige opslag en alle downloads van modellen of media die je start.
Toegankelijkheidsgebruikers
Lokale stemmen van hoge kwaliteit lezen documenten voor, met volledige VoiceOver-ondersteuning en navigatie via het toetsenbord.
Studenten enamp; journalisten
Zet lezingen en interviews binnen enkele minuten om in doorzoekbare, bewerkbare tekst en lees deze vervolgens terug om te zien wat je hebt gemist.
Meertalige teams
99 transcriptietalen plus natuurlijke stemmen in meer dan 20 uitvoertalen - met ingebouwde vertaling naar het Engels.
Spraak buiten het netwerk
Spraakinferentie en projectopslag zijn lokaal. Er is geen VoxForge account of analyse-SDK in de huidige opslagplaats. Netwerktoegang wordt gebruikt voor modellen die u wilt downloaden, kopen of licentievalidatie waar van toepassing, en media worden alleen opgehaald van een URL die u opgeeft in de directe configuratie.
STT + TTS op één plek – eindelijk
VoxForge brengt transcriptie en spraakgeneratie in één local-first Mac werkruimte. De mogelijkheden en commerciële voorwaarden van concurrenten kunnen veranderen, dus verifieer ze direct voordat u een keuze maakt.
| Mogelijkheid | VoxForge | MacWhisper | Speechify | Beschrijving |
|---|---|---|---|---|
| Spraak-naar-tekst | ✓ | ✓ | — | ✓ |
| Tekst-naar-spraak | ✓ | — | ✓ | ✓ |
| Spraakdialoog | ✓ | Gedeeltelijk | — | ✓ |
| Waveform-gesynchroniseerd bewerken | ✓ | — | — | ✓ |
| Lokale spraakinferentie | ✓ | ✓ | Controleer leverancier | Controleer leverancier |
| Werkt offline | ✓ | ✓ | — | — |
| Commerciële voorwaarden | In behandeling release | Controleer leverancier | Controleer leverancier | Controleer leverancier |
| Geen account vereist | ✓ | ✓ | — | — |
Vergelijking beoordeeld op 14 juli 2026. Controleer de huidige mogelijkheden en voorwaarden op elk officiële productpagina van de leverancier. Productnamen zijn handelsmerken van hun respectievelijke eigenaren.
Vrijgavekanalen in validatie
De repository bevat Store- en direct-build-configuraties. Openbare prijzen en aankooplinks worden pas weergegeven nadat deze eindpunten live zijn.
- Spraak-naar-tekst in 99 talen
- Luidsprekerdialoog & tijdstempels
- 12+ lokale tekst-naar-spraak-engines
- Wavevorm-gesynchroniseerde bewerking van transcripties
- Importeer lokale audio enamp; videobestanden
- Ondertiteling, document & audio-export
- Projectbibliotheek met zoeken in volledige tekst
- Alles in de sandbox-winkelconfiguratie
- Video-URL import van meer dan 1.500 sites
- Afspeellijst downloaden & batch transcriberen
- Uitgebreide formaten: WebM, MKV, AVI, OGG
- Prioriteitsfunctieverzoeken
Spraakinferentie is lokaal in beide configuraties. De directe configuratie kan media ophalen waar u expliciet om vraagt; modellevering en rechtencontroles maken ook gebruik van het netwerk.
Vragen, beantwoord
Spraak-naar-tekst en tekst-naar-spraak gebruiken lokale modellen op de Mac. Netwerktoegang wordt alleen gebruikt voor modellen die u wilt downloaden, kopen of licentievalidatie indien van toepassing, ondersteuningslinks en direct ophalen van media alleen als u een URL opgeeft.
99 talen via WhisperKit — dezelfde dekking als OpenAI's Whisper — inclusief Engels, Frans, Duits, Spaans, Italiaans, Portugees, Arabisch, Chinees, Japans, Koreaans, Russisch en Hindi. De taal kan automatisch worden gedetecteerd of handmatig worden ingesteld, en spraak kan tijdens transcriptie naar het Engels worden vertaald.
Ja. VoxForge voert sprekerdialogen uit met SpeakerKit (gebaseerd op Pyannote v4), waarbij automatisch wordt gescheiden en gelabeld wie wat heeft gezegd. Je kunt de naam van de sprekers wijzigen en de labels blijven gesynchroniseerd met de golfvorm en tijdstempels op woordniveau, zodat je naar elk moment in de audio kunt springen.
VoxForge combineert transcriptie, lokale spraakgeneratie, sprekerlabels en golfvormgesynchroniseerd bewerken in één Mac werkruimte. Kenmerken van concurrenten, gegevensstromen en prijzen veranderen; verifieer ze op hun huidige officiële pagina's.
De repository documenteert meerdere lokale spraak-engines, waaronder Qwen3-TTS, Kokoro-82M, Piper en Apple systeemstemmen. Beschikbaarheid van de engine, modelgrootte, talen en stijlcontroles zijn afhankelijk van de huidige build en gekozen download. Bekijk een voorbeeld van een stem in representatieve tekst voordat u deze voor een project selecteert.
Ja. VoxForge transcribeert audio en video met tijdstempels en kan ondertitel- en documentformaten exporteren. De sandbox-configuratie importeert lokale bestanden; de directe configuratie kan ook media ophalen van een URL die u opgeeft, afhankelijk van de beschikbaarheid van de release en voorwaarden van derden.
De definitieve commerciële voorwaarden zijn nog niet van kracht. Elke prijs, verlengingsmodel, inbegrepen functies en terugbetalingsroute worden vóór aankoop getoond bij de geverifieerde kassa.
De repository bevat een winkelconfiguratie in een sandbox en een directe configuratie die expliciete URL-ophaalservice en uitgebreide formaten kan toevoegen. De definitieve kanaalbeschikbaarheid en functiegrenzen worden bij de release bevestigd. Spraakinferentie blijft lokaal in beide configuraties.
macOS 14 Sonoma of hoger. Apple Silicon (M-serie) wordt sterk aanbevolen omdat transcriptie en synthese worden uitgevoerd op de Neural Engine en GPU. Modellen worden één keer gedownload en lokaal in de cache opgeslagen. Het aanbevolen Whisper Turbo-model en de Kokoro-stem zijn een kleine download, en u kunt lichtere modellen kiezen van 8 GB Macs.