Funkcje

Wszystko, czego potrzebujesz, żeby nagrywać, porządkować i przeglądać spotkania, jest wbudowane. Bez wtyczek, a nic nie opuszcza twojego komputera.

Podstawy

To dostajesz od pierwszego dnia. Wykryj spotkanie, nagraj je, przepisz, podsumuj i znajdź później bez szukania.

Automatyczne wykrywanie

Obserwuje uruchomione aplikacje pod kątem Zoom, Teams, Google Meet, Proton Meet i Jitsi, a mikrofon pod kątem Signala, Elementa i Telegrama. Gdy spotkanie się zaczyna, autorec daje ci 10 sekund uprzedzenia. Nagrywanie rusza, gdy czas minie, wcześniej, jeśli się zgodzisz, albo wcale, jeśli odmówisz. Kończy się razem ze spotkaniem. Ten komunikat możesz wyłączyć.

Silnik nagrywania

Lekki, wbudowany silnik nagrywania, który korzysta z karty graficznej, jeśli jest dostępna, a w przeciwnym razie przechodzi na kodowanie programowe. Na wyjściu dostajesz standardowy plik .mp4 w 1080p, 720p lub 480p. Nic więcej nie trzeba instalować.

Nagrywanie wybranego okna

Nagrywa tylko okno spotkania, a nie cały ekran. Prywatne czaty, e-maile i inne okna nie trafiają do nagrania. Pliki zostają na twoim dysku. Bez chmury, bez telemetrii.

Osobne przełączniki dla źródeł dźwięku

Mikrofon i dźwięk pulpitu mają każdy własny przełącznik, wybór urządzenia, suwak wzmocnienia i wskaźnik poziomu na żywo. Wybierz tryb całego pulpitu albo tylko wybranych aplikacji i ustaw przyciszanie dwustronne lub z priorytetem mikrofonu, żeby żadna strona nie zginęła w tle.

Automatyczna transkrypcja

Przy włączonej automatycznej transkrypcji autorec uruchamia lokalnie whisper.cpp na każdym zakończonym nagraniu i zapisuje transkrypcję jako zwykły tekst oraz plik napisów (.srt). Działa w 17 językach, w tym po polsku, niemiecku, hiszpańsku, japońsku i arabsku, i sam rozpoznaje, w jakim języku toczy się rozmowa. Jeśli twoje rozmowy są zawsze w jednym języku, ustaw go na stałe w Ustawieniach. Wybierasz rozmiar modelu, pobierasz go raz i korzystasz bez końca. Dźwięk zostaje na twoim komputerze.

Podsumowania AI

Opcjonalnie. Podaj własny klucz API do dowolnej usługi zgodnej z OpenAI (OpenAI, Anthropic, OpenRouter albo lokalny serwer Ollama lub llama.cpp), a autorec wygeneruje tytuły i podsumowania. Wysyłany jest wyłącznie tekst transkrypcji. Dźwięk i obraz nigdy nie opuszczają komputera.

Gotowe ustawienia dostawców

Jedna lista rozwijana przełącza między OpenAI, Anthropic, Google Gemini, Mistral, DeepSeek, OpenRouter, Groq, Cerebras i kilkunastoma innymi, a także serwerami lokalnymi (Ollama, LM Studio, LocalAI, llama.cpp, vLLM). Wybierz jednego, a bazowy URL i rozsądny model domyślny uzupełnią się same.

Edytowalny prompt podsumowania

Dopasuj prompt systemowy, który steruje każdym podsumowaniem AI. Poproś o decyzje, zadania do wykonania, ryzyka, terminy — cokolwiek twój zespół naprawdę czyta. Domyślny prompt zwraca czysty JSON, więc biblioteka nadal sama dostaje tytuły spotkań.

Wbudowana biblioteka wideo

Przeglądaj nagrania jako kafelki lub tabelę z automatycznie tworzonymi miniaturami. Szukaj w tytułach i podsumowaniach, sortuj według daty, nazwy, długości lub rozmiaru. Nagrania odtwarzasz we wbudowanym odtwarzaczu, bez otwierania czegokolwiek innego.

Kolejka przetwarzania z postępem na żywo

Każda transkrypcja, podsumowanie i kompresja trafia na jedną listę przetwarzania, z postępem, stanem i przyciskiem anulowania dla każdego zadania. Filtruj według aktywnych, ukończonych lub nieudanych. Zamknij okno, a kolejka pracuje dalej w tle.

Podgląd i edycja transkrypcji

Czytaj transkrypcję obok wideo, z klikalnymi znacznikami czasu. Przeskakuj do dowolnego momentu nagrania. Poprawiaj tekst bezpośrednio w aplikacji i zapisuj zmiany z powrotem do pliku .txt na dysku.

Przycinanie i kompresja

Utnij martwy czas z początku i końca nagrania. Kompresuj pliki, żeby zaoszczędzić miejsce, wybierając gotowy procent albo własny docelowy rozmiar. Każde zadanie trafia do jednej kolejki przetwarzania.

Integracja z zasobnikiem systemowym

Siedzi w zasobniku systemowym i nie przeszkadza. Kliknij prawym przyciskiem, żeby wymusić nagrywanie całego ekranu, wstrzymać, wznowić lub zatrzymać nagranie albo otworzyć folder z nagraniami.

Uczciwa licencja shareware

Trzy darmowe nagrania co 24 godziny, każde do 40 minut, z ostrzeżeniem pięć minut przed automatycznym zatrzymaniem. Zapłać raz, a limit znika; jeden klucz aktywuje do pięciu urządzeń. Żadnego DRM poza uprzejmym przypomnieniem.

Rozbudowane ustawienia

Folder wyjściowy, szablony nazw plików, ustawienia jakości, przełączniki dla poszczególnych aplikacji, model transkrypcji, konfiguracja usługi AI. Wszystko w przejrzystym panelu ustawień. Ustawienia zapisują się jako zwykły JSON w katalogu konfiguracji, więc możesz je samodzielnie przejrzeć lub edytować.

Zaawansowane opcje dla wymagających

Osiem dodatkowych pokręteł dla tych, którzy chcą dostroić autorec, zautomatyzować pracę wokół niego albo wpiąć go w większy proces.

🔧

Własne reguły wykrywania

Dopasuj dowolną aplikację lub kartę przeglądarki, także taką, której autorec jeszcze nie zna. Dodaj własne reguły dla Discorda, huddle w Slacku, Whereby, Webex albo dowolnego okna czy adresu URL, które chcesz nagrywać.

For power users: Wyzwalacz na tytuł okna, adres URL w przeglądarce, użycie mikrofonu lub samo uruchomienie aplikacji. Wzorce dokładne, glob lub regex, a przycisk „Dodaj aplikację” sam uzupełnia nazwę procesu. Priorytety dla każdej reguły oraz import/eksport w JSON, żeby dzielić się regułami między komputerami lub w zespole.

🎙️

Profesjonalna kontrola dźwięku

Wybierz osobne urządzenia wejściowe dla mikrofonu i dźwięku systemowego. Reguluj wzmocnienie, wyciszenie i redukcję szumów niezależnie dla każdego źródła. Wskaźniki poziomu pokazują, co naprawdę jest nagrywane.

For power users: Zmiana urządzenia dla każdego źródła w trakcie nagrywania, wzmocnienie ±24 dB w krokach co 0,5 dB, łańcuch RNNoise plus systemowa redukcja szumów. Gdy urządzenie się odłączy, nagrywanie działa dalej bez awarii.

🎚️

Inteligentne przyciszanie dźwięku

Automatycznie przycisza drugą stronę, gdy ktoś mówi, żeby obie połowy rozmowy się nie zagłuszały. Ustaw je pod rozmowy dwustronne albo pod priorytet mikrofonu w stylu podcastu.

For power users: Tryb dwustronny lub z priorytetem mikrofonu. Wyzwalanie obwiednią RMS albo detekcją aktywności głosu RNNoise. Konfigurowalny próg, atak, zwolnienie i głębokość.

🔊

Dźwięk pulpitu tylko z wybranych aplikacji

Nagrywaj dźwięk z konkretnych aplikacji zamiast każdego dźwięku na pulpicie. Muzyka, powiadomienia i inne okna nie trafiają do nagrania spotkania.

For power users: Wybór per proces na Linuxie (routing ujść PipeWire/PulseAudio) i Windowsie (WASAPI loopback). Na żądanie ponownie wyszukuje nowo uruchomione aplikacje.

Sprzętowa akceleracja kodowania

Korzysta z kodera wideo w karcie graficznej, jeśli jest dostępny, więc nagrywanie prawie nie obciąża procesora. Jeśli przy starcie nagrywania nie da się otworzyć kodera sprzętowego, autorec używa kodera programowego.

For power users: NVENC (NVIDIA), VideoToolbox (macOS) lub Media Foundation (Windows), a dalej programowy libopenh264. Sprzętowe kodowanie Intel i AMD na Linuxie nie jest jeszcze obsługiwane. Wszystkie ścieżki są zgodne z LGPL.

🪝

Webhooki i automatyzacja

Wyślij POST z powiadomieniem (i opcjonalnie samym plikiem) na dowolny URL, gdy skończy się nagranie, transkrypcja lub podsumowanie. Podepnij autorec do Notion, Obsidiana, Zapiera, n8n albo własnych skryptów.

For power users: Wysyłanie przez HTTP multipart lub SFTP, własne szablony JSON z podstawianiem pól, ponawianie z wykładniczym opóźnieniem i łańcuchy zdarzeń (np. webhook B odpala się dopiero po udanym webhooku A).

🧰

Jedna kolejka przetwarzania

Każda transkrypcja, pobieranie modelu, przycinanie, kompresja i podsumowanie w jednym miejscu. Anuluj trwające zadania, ponów te nieudane i wykonuj akcje zbiorcze na wielu nagraniach naraz.

For power users: Historia zadań przetrwa restart aplikacji (~/.local/share/autorec/tasks.json). Anulowanie zadania sprząta podprocesy i pliki tymczasowe. Plakietka na pasku bocznym pokazuje liczbę aktywnych zadań.

⏸️

Pauza, wznowienie i ręczne sterowanie

Wstrzymaj nagrywanie w trakcie spotkania i wznów, gdy wrócisz. Wymuś start lub stop z zasobnika, gdy automatyczne wykrywanie nie robi tego, czego chcesz.

For power users: Czas pauzy nie wlicza się do licznika. Menu w zasobniku pozwala wymusić start (cały ekran), wstrzymać, wznowić i zatrzymać, a na pasku stanu możesz w trakcie nagrywania zmienić nagrywane okno. Zmiana urządzenia audio też działa podczas nagrywania.

Zobacz w akcji

Krótki przegląd całego procesu: wykrycie, nagranie, transkrypcja, biblioteka.