Transcriptie & AI
Autorec transcribeert opnames lokaal met whisper.cpp en maakt desgewenst AI-samenvattingen via een willekeurige OpenAI-compatibele API.
Zo werkt transcriptie
- Als een opname klaar is, haalt autorec het audiospoor eruit. Dat gebeurt vanzelf als Opnames automatisch transcriberen aanstaat (standaard staat het uit); anders start je het vanuit het venster na de opname of vanuit de bibliotheek.
- Het gekozen Whisper-model verwerkt de audio volledig op je eigen computer
- Naast de video komen twee bestanden te staan:
.txt— transcript als platte tekst.srt— ondertitelbestand met tijdcodes (uit te zetten in Instellingen)
Tijdens de transcriptie gaat er geen audio of video van je computer af. De transcriptie draait op de GPU als die er is (Vulkan op Linux en Windows, Metal op macOS) en anders op de CPU; met Altijd CPU gebruiken in Instellingen sla je de GPU over.
Talen
Autorec transcribeert meetings in het Nederlands en in 16 andere talen: Engels, Duits, Spaans, Frans, Italiaans, Portugees, Pools, Zweeds, Turks, Russisch, Oekraïens, Arabisch, Hindi, Chinees, Japans en Koreaans. Autorec herkent de gesproken taal aan de eerste seconden audio, dus voor de meeste gesprekken hoef je niets in te stellen. Voer je je gesprekken altijd in dezelfde taal, stel die dan in bij Gesproken taal onder Instellingen > Transcriptie. Met een vaste taal voorkom je een verkeerde gok bij korte of rumoerige audio, of bij een gesprek dat begint met een paar woorden in een andere taal.
Alle vijf de modellen begrijpen al deze talen. Voor alles behalve Engels zijn medium en large merkbaar nauwkeuriger dan de kleinere modellen.
Whisper-modellen
Modellen worden niet automatisch gedownload; je kiest er zelf een en downloadt het in Instellingen. Ze worden opgeslagen in ~/.local/share/autorec/models/ (Linux en macOS) of %LOCALAPPDATA%\autorec\models\ (Windows).
| Model | Grootte | Snelheid | Nauwkeurigheid | Geschikt voor |
|---|---|---|---|---|
| tiny | ~75 MB | Snelst | Basis | Snelle notities, minder krachtige computers |
| base | ~142 MB | Snel | Goed | Standaard — aanbevolen voor de meeste gebruikers |
| small | ~466 MB | Gemiddeld | Beter | Als nauwkeurigheid belangrijker is dan snelheid |
| medium | ~1,5 GB | Langzaam | Hoog | Andere talen dan Engels, lastige audio |
| large | ~3 GB | Langzaamst | Best | Maximale nauwkeurigheid, krachtige hardware |
Modellen downloaden
- Open Instellingen, het tandwielpictogram in het autorec-venster
- Ga naar het onderdeel Transcriptie
- Kies een modelgrootte
- Klik op Downloaden — het model wordt één keer gedownload en daarna voor alle volgende transcripties gebruikt
AI-samenvattingen
AI-samenvattingen gebruiken een cloud-API om uit de tekst van het transcript een titel en een samenvatting te maken. Alleen de tekst wordt verstuurd — geen audio of video.
Instellen
- Open Instellingen > AI-samenvatting
- Kies een Provider, die de basis-URL invult en modellen voorstelt, of kies Custom en vul de API-basis-URL in (bijv.
https://api.openai.com/v1) - Vul je API-sleutel in
- Kies een Model (standaard is dat
gpt-4o-mini) - Zet Automatisch samenvatten na transcriptie aan
De Prompt voor samenvatting kun je aanpassen, zodat je in plaats van een algemene samenvatting kunt vragen om besluiten, actiepunten of deadlines.
Compatibele diensten
Elke dienst met een OpenAI-compatibel endpoint voor chat completions werkt:
- OpenAI —
https://api.openai.com/v1 - OpenRouter —
https://openrouter.ai/api/v1 - Lokale modellen (Ollama, LM Studio enz.) — gebruik je lokale endpoint
Wat er wordt gemaakt
Voor elke getranscribeerde opname maakt autorec:
- Titel — een korte, beschrijvende titel voor de meeting
- Samenvatting — een beknopte samenvatting van de belangrijkste besproken punten
Beide staan in de videobibliotheek en in de detailweergave van de video, zodat je de meeting die je zoekt snel terugvindt zonder hem opnieuw te bekijken.