Open-sourcefork · Lokale spraakherkenning

WhisperDictation: Nederlands dicteren op macOS

Een bestaande dicteerapp voor macOS uitbreiden met Nederlandse spraakherkenning, meertalige modellen en een Nederlandse interface, met lokale verwerking van audio.

De vraag

Ik wilde Nederlandse tekst direct kunnen dicteren in mijn dagelijkse Mac-applicaties. Het bestaande WhisperDictation-project bood een bruikbaar vertrekpunt, maar de Engelstalige modellen en tekstverwerking vroegen om een uitbreiding die rekening houdt met de gekozen taal.

De aanpak

Ik maakte een fork van sam-pop/WhisperDictation en breidde de Swift-applicatie en whisper.cpp-integratie uit. De app ondersteunt Nederlands, Engels en automatische taaldetectie, met meertalige modellen voor Nederlandse spraak. Gesproken taal en interfacetaal zijn afzonderlijk instelbaar, terwijl bestaande Engelse instellingen en correcties behouden blijven.

De uitdaging

Nederlands toevoegen is meer dan de interface vertalen. Modelcompatibiliteit, Nederlandse getalwoorden, decimale komma's, leestekens en technische termen beïnvloeden allemaal de uitvoer. Automatische detectie kiest bovendien één taal per opname of livefragment, waardoor gemengde Nederlandse en Engelse spraak een praktische uitdaging blijft.

Wat ik heb toegevoegd

De uitbreiding richt zich op bruikbaar Nederlands dicteren binnen de bestaande lokale workflow.

  • Nederlandse, Engelse en automatische taalprofielen, met geschikte meertalige Base-, Small- en Medium-modellen en checksumcontrole.
  • Een Nederlandse en Engelse interface, plus verwerking van Nederlandse getalwoorden, decimale komma's, leestekenspatiëring en persoonlijke of technische termen.
  • Optionele gesproken leestekens en regeleinden, standaard uitgeschakeld, naast regressietests en een Nederlands evaluatieprotocol.

Validatie en huidige grenzen

De repository documenteert een geslaagde universele macOS-build, 149 Swift-tests en zeven toolingtests, plus een DMG voor praktijktests. Die controles toetsen codegedrag en het installatiepakket; ze bewijzen geen Nederlandse herkenningsnauwkeurigheid. Er is een evaluatieset met 55 zinnen, maar gemeten herkenningskwaliteit en vertraging zijn nog niet gerapporteerd. Er is geen gepubliceerde stabiele release of door Apple genotariseerde installer.

Wat het opleverde

De Nederlandse uitbreiding is samengevoegd in de main-branch van mijn fork en beschikbaar als openbare broncode. Ze biedt lokaal Nederlands dicteren na het downloaden van een model, met taalafhankelijke tekstverwerking en hulpmiddelen voor testbuilds. De oorspronkelijke dicteerapplicatie en herkenningsengine blijven het werk van de upstreamprojecten; mijn bijdrage is de Nederlandse en meertalige uitbreiding.

Inzichten

Taalondersteuning raakt het model, de instellingen, de interface, tekstverwerking en tests. Geslaagde automatische tests zijn een andere mijlpaal dan meten hoe goed een app echte spraak herkent en in een andere applicatie invoegt.

Bewijs & materiaal

Een idee om te bespreken?

Laten we kennismaken.

Over data, AI, tuinbouw of een product dat je wilt bouwen.

Neem contact op