Transcriptie & AI

Autorec transcribeert opnames lokaal met whisper.cpp en maakt desgewenst AI-samenvattingen via een willekeurige OpenAI-compatibele API.

Zo werkt transcriptie

  1. Als een opname klaar is, haalt autorec het audiospoor eruit. Dat gebeurt vanzelf als Opnames automatisch transcriberen aanstaat (standaard staat het uit); anders start je het vanuit het venster na de opname of vanuit de bibliotheek.
  2. Het gekozen Whisper-model verwerkt de audio volledig op je eigen computer
  3. Naast de video komen twee bestanden te staan:
    • .txt — transcript als platte tekst
    • .srt — ondertitelbestand met tijdcodes (uit te zetten in Instellingen)

Tijdens de transcriptie gaat er geen audio of video van je computer af. De transcriptie draait op de GPU als die er is (Vulkan op Linux en Windows, Metal op macOS) en anders op de CPU; met Altijd CPU gebruiken in Instellingen sla je de GPU over.

Talen

Autorec transcribeert meetings in het Nederlands en in 16 andere talen: Engels, Duits, Spaans, Frans, Italiaans, Portugees, Pools, Zweeds, Turks, Russisch, Oekraïens, Arabisch, Hindi, Chinees, Japans en Koreaans. Autorec herkent de gesproken taal aan de eerste seconden audio, dus voor de meeste gesprekken hoef je niets in te stellen. Voer je je gesprekken altijd in dezelfde taal, stel die dan in bij Gesproken taal onder Instellingen > Transcriptie. Met een vaste taal voorkom je een verkeerde gok bij korte of rumoerige audio, of bij een gesprek dat begint met een paar woorden in een andere taal.

Alle vijf de modellen begrijpen al deze talen. Voor alles behalve Engels zijn medium en large merkbaar nauwkeuriger dan de kleinere modellen.

Whisper-modellen

Modellen worden niet automatisch gedownload; je kiest er zelf een en downloadt het in Instellingen. Ze worden opgeslagen in ~/.local/share/autorec/models/ (Linux en macOS) of %LOCALAPPDATA%\autorec\models\ (Windows).

ModelGrootteSnelheidNauwkeurigheidGeschikt voor
tiny~75 MBSnelstBasisSnelle notities, minder krachtige computers
base~142 MBSnelGoedStandaard — aanbevolen voor de meeste gebruikers
small~466 MBGemiddeldBeterAls nauwkeurigheid belangrijker is dan snelheid
medium~1,5 GBLangzaamHoogAndere talen dan Engels, lastige audio
large~3 GBLangzaamstBestMaximale nauwkeurigheid, krachtige hardware

Modellen downloaden

  1. Open Instellingen, het tandwielpictogram in het autorec-venster
  2. Ga naar het onderdeel Transcriptie
  3. Kies een modelgrootte
  4. Klik op Downloaden — het model wordt één keer gedownload en daarna voor alle volgende transcripties gebruikt

AI-samenvattingen

AI-samenvattingen gebruiken een cloud-API om uit de tekst van het transcript een titel en een samenvatting te maken. Alleen de tekst wordt verstuurd — geen audio of video.

Instellen

  1. Open Instellingen > AI-samenvatting
  2. Kies een Provider, die de basis-URL invult en modellen voorstelt, of kies Custom en vul de API-basis-URL in (bijv. https://api.openai.com/v1)
  3. Vul je API-sleutel in
  4. Kies een Model (standaard is dat gpt-4o-mini)
  5. Zet Automatisch samenvatten na transcriptie aan

De Prompt voor samenvatting kun je aanpassen, zodat je in plaats van een algemene samenvatting kunt vragen om besluiten, actiepunten of deadlines.

Compatibele diensten

Elke dienst met een OpenAI-compatibel endpoint voor chat completions werkt:

  • OpenAIhttps://api.openai.com/v1
  • OpenRouterhttps://openrouter.ai/api/v1
  • Lokale modellen (Ollama, LM Studio enz.) — gebruik je lokale endpoint

Wat er wordt gemaakt

Voor elke getranscribeerde opname maakt autorec:

  • Titel — een korte, beschrijvende titel voor de meeting
  • Samenvatting — een beknopte samenvatting van de belangrijkste besproken punten

Beide staan in de videobibliotheek en in de detailweergave van de video, zodat je de meeting die je zoekt snel terugvindt zonder hem opnieuw te bekijken.