@WoutF Naar aanleiding van dictatiesoftware:
Ik heb offline dicteren inmiddels zeer praktisch ingericht door faster-whisper lokaal op mijn desktop te draaien. Het model draait direct op de GPU en via een lichte tray-app kan ik met een instelbare sneltoets tekst inspreken en automatisch laten plakken op de plek waar mijn cursor staat.
Dit werkt verrassend efficiënt. Ik doe bijna niet anders meer. Vooral voor prompts maar ook voor berichten, e-mails en zoekopdrachten. Het werkt bijzonder snel en accuraat. Tik op de sneltoets, spreken en nog een tik. Vervolgens staat je gesproken tekst binnen 100ms in beeld, inclusief leestekens en nette zinsopbouw.
Opvallend vind ik hoe goed hij correcties, pauzes en rommelwoordjes zoals “uh” feilloos verwerkt. Ook woorden die heel specifiek zijn, kun je via een initial prompt meegeven, zodat hij ze beter oppakt.
Probeer hem vooral zelf eens uit:
github.com/MIOsystems/fastwhisper-desktop
De faster-whisper modellen staan hier:
huggingface.co/collections/Systran/faster-whisper
Disclaimer: het is nog echt een prototype app en alleen getest op mijn eigen desktop. De modellen moet je zelf downloaden en de CUDA/NVIDIA-runtime moet lokaal goed staan. Maar je AI agent helpt je vast verder met het implementeren