Jedna apka — 1000 platform, dowolny język, całość lokalnie
Silnik OpenAI Whisper uruchamiany na twoim Macu. Materiał pobierany przez yt-dlp, obrazy z karuzeli czytane przez natywne macOS Vision Framework. Nic nie leci do chmury.
~1000 platform
YouTube, Instagram, TikTok, Twitter/X, Facebook, Reddit, Vimeo, SoundCloud, podcast RSS i wszystko co obsługuje yt-dlp.
100% lokalnie
Po pobraniu materiału całe rozpoznawanie mowy dzieje się na twoim procesorze. Audio nigdy nie opuszcza Maca.
Karuzele Instagram
Pobiera cały post (zdjęcia + wideo naraz). Obrazy przez macOS Vision OCR, wideo przez Whisper — wszystko w jednym pliku .txt.
Modele do wyboru
Whisper tiny / base / small / medium / large — sam decydujesz kompromis szybkość vs jakość. Modele lazy-download przy pierwszym użyciu.
Polski + 90 języków
Auto-detekcja języka. Polski, angielski, niemiecki, hiszpański, japoński, chiński i wszystko co Whisper obsługuje out-of-the-box.
Zorganizowane pliki
Każda transkrypcja w osobnym folderze: audio, tekst, metadane. Jedno kliknięcie w Finderze — widzisz wszystko razem.
Opcjonalne LLM
Post-processing przez lokalną Ollamę, LM Studio albo sesję webową (ChatGPT, Claude, Gemini) — do streszczeń i tłumaczeń.
Zero konfiguracji
Pierwszy start sam pobiera Pythona i zależności (~2-3 min). Bez ręcznego brew, uv, whisper.
Dla kogo — dla każdego kto pracuje z materiałem wrażliwym
Dziennikarze, badacze, prawnicy, twórcy — każdy kto potrzebuje transkrypcji z gwarancją prywatności. Chmurowe rozwiązania (Otter, Rev, Descript) wysyłają twoje audio na cudze serwery — YT Whisper nigdy tego nie robi.
Jeśli pracujesz z wywiadami, konsultacjami, materiałem pod NDA — to jest jedyna sensowna droga.
Pobierz — 3 kroki, ~5 minut
DMG z aplikacją + skryptem instalacyjnym. Podpisany ad-hoc — skrypt sam odblokuje Gatekeepera.
Install.command który skopiuje appkę, usunie flagę quarantine i uruchomi ją.Zamontuj DMG
Kliknij pobrany plik YT-Whisper.dmg. Otworzy się okno instalatora.
Uruchom Install.command
W oknie DMG kliknij 2× w plik Install.command. Skrypt skopiuje aplikację do folderu Applications, usunie flagę quarantine Gatekeepera i uruchomi apkę.
Poczekaj na pierwszy start (~2–3 min)
Apka sama pobiera środowisko Pythona (Whisper + yt-dlp). Widać pasek postępu. Potem startuje normalnie.
Częste pytania
Wszystko czego nie napisałem wyżej — a warto wiedzieć zanim klikniesz „pobierz".
Czy naprawdę nic nie wychodzi na zewnątrz?
Do internetu apka wychodzi tylko po to, żeby pobrać materiał z URL który wkleisz (yt-dlp) i przy pierwszym starcie, żeby zainstalować Pythona/Whisper/model. Samo rozpoznawanie mowy jest 100% lokalne — możesz odciąć internet po pobraniu materiału i transkrypcja i tak zadziała.
Dlaczego macOS mówi „aplikacja jest uszkodzona"?
Bo apka jest podpisana ad-hoc (bez płatnego certyfikatu Apple Developer $99/rok). Dlatego w DMG jest Install.command — skrypt uruchamia komendę xattr -cr która usuwa flagę quarantine i apka działa normalnie.
Jakie języki obsługuje?
Wszystko co Whisper — 90+ języków z auto-detekcją. Polski, angielski, niemiecki, hiszpański, francuski, włoski, japoński, chiński, arabski itd. Model large daje najlepszą jakość, medium jest sensownym kompromisem dla języków innych niż angielski.
Ile trwa transkrypcja?
Zależy od modelu i procesora. Na Apple Silicon (M1/M2/M3): tiny ~10× realtime, small ~3× realtime, medium ~1× realtime, large ~0.5× realtime (30-minutowy podcast = ~60 min). Na Intelach wolniej.
Czy będzie wersja na Windows / Linux?
Windows w planach. Linux — jeśli będzie zainteresowanie. Napisz na hello@lucdoro.design.
Ile kosztuje?
Aplikacja jest darmowa. Jeśli chcesz wesprzeć rozwój, informacje o donacjach będą w apce. Aktywacja przez kod LUCDORO-INVITE-XXXX-XXXX (14 dni triala od pierwszego uruchomienia).