Zamień wiadomość głosową z WhatsAppa na tekst

Przeczytaj wiadomość głosową zamiast jej słuchać. Upuść plik .opus lub .ogg: zostanie transkrybowany na twoim urządzeniu, nigdy nie trafi na serwer.

🔒 Rozpoznawanie mowy działa w przeglądarce. Pobierane jest tylko raz; twoje nagranie nigdzie nie jest wysyłane.

Transkrybuj wiadomość głosową bez wychodzenia z WhatsAppa

Zainstaluj AnyFileFormat jako aplikację, a pojawi się w menu Udostępnij telefonu. Wiadomość głosowa jest transkrybowana na urządzeniu i nigdzie nie jest wysyłana.

  1. Zainstaluj aplikację (raz).
  2. W WhatsAppie lub Telegramie przytrzymaj wiadomość głosową i stuknij Udostępnij.
  3. Wybierz AnyFileFormat: transkrypcja uruchomi się sama.

Jak to zrobić

  1. Zapisz wiadomość głosową z WhatsAppa (jak, patrz niżej).
  2. Upuść tutaj plik .opus, .ogg lub .m4a.
  3. Przeczytaj tekst kilka sekund później, skopiuj go lub pobierz.

Upuść nagranie wiadomość głosowa z WhatsAppa powyżej, a dostaniesz jego tekst w kilka sekund lub minut. Rozpoznawanie mowy działa w przeglądarce: dźwięk nigdy nie jest wysyłany, bez limitu długości i bez konta.

Co otrzymujesz

  • To rozpoznawanie mowy, nie zmiana formatu: słucha nagrania i zapisuje, co zostało powiedziane, z interpunkcją i wielkimi literami.
  • Tekst jest dzielony na akapity w miejscach przerw. Znaczniki czasu pozostają na ekranie oraz w eksportach SRT i VTT.
  • Około stu języków, wykrywanych automatycznie. Może też przetłumaczyć mowę na angielski.
  • Wyraźna mowa wychodzi niemal bezbłędnie. Szum w tle, ludzie mówiący jednocześnie i rzadkie nazwy powodują błędy, które możesz poprawić na miejscu przed pobraniem.
  • Mówcy nie są oznaczani: tekst mówi, co powiedziano, a nie kto to powiedział.

Do czego służy

Użyj zwykłego tekstu do notatek, protokołów, cytatów z wywiadu, wiadomości głosowej, której nie możesz teraz odsłuchać, albo czegokolwiek, co chcesz przeszukiwać, kopiować lub tłumaczyć.

Ponieważ nic nie jest wysyłane, nadaje się do poufnych nagrań: medycznych, prawnych, rozmów rekrutacyjnych czy prywatnych notatek głosowych.

Najczęstsze pytania

Jak wyciągnąć plik wiadomości głosowej z WhatsAppa?

Na iPhonie: przytrzymaj wiadomość głosową, wybierz Przekaż, stuknij ikonę udostępniania, a potem Zachowaj w Plikach. Na Androidzie: przytrzymaj wiadomość, stuknij Udostępnij (albo trzy kropki, a potem Udostępnij) i zapisz ją w plikach; odebrane wiadomości leżą też w folderze WhatsApp/Media/WhatsApp Voice Notes. W WhatsAppie na komputer lub WhatsApp Web: najedź na wiadomość, otwórz jej menu i wybierz Pobierz.

W jakim formacie są wiadomości głosowe z WhatsAppa?

Dźwięk Opus, zwykle zapisany jako .opus lub .ogg. Oba są tu odczytywane bezpośrednio, podobnie jak .m4a i .mp3, jeśli wcześniej przekonwertowałeś wiadomość.

Czy mogę transkrybować wiadomość głosową prosto z WhatsAppa?

Na Androidzie tak: zainstaluj AnyFileFormat jako aplikację (przycisk na tej stronie), a potem w WhatsAppie lub Telegramie przytrzymaj wiadomość głosową, stuknij Udostępnij i wybierz AnyFileFormat. Transkrypcja uruchomi się sama, na twoim telefonie. iPhone nie pozwala jeszcze aplikacjom webowym odbierać udostępnionych plików, więc tam najpierw zapisz wiadomość w Plikach.

Czy nadawca wie, że zrobiłem transkrypcję?

Nie. Nic nie jest wysyłane do WhatsAppa ani nikogo innego: plik jest odczytywany i transkrybowany w twojej przeglądarce.

Czy mój plik wiadomość głosowa z WhatsAppa jest wysyłany?

Nie. Rozpoznawanie mowy jest raz pobierane do przeglądarki i tam działa. Samo nagranie nigdy nie opuszcza urządzenia: po załadowaniu możesz przejść w tryb offline i nadal działa.

Jak jest dokładna?

Przy wyraźnym głosie Accurate popełnia bardzo mało błędów; Fast popełnia ich więcej, ale działa na każdym telefonie, a Balanced jest pośrodku. Każdy wiersz można poprawić przed pobraniem.

Ile to trwa?

Na nowym komputerze minuta mowy zajmuje kilka sekund w trybie Fast lub Accurate i nieco dłużej w Balanced. Telefony są wolniejsze. Cisza jest pomijana, więc długie nagranie z przerwami idzie szybciej, niż sugeruje jego długość.

Dlaczego za pierwszym razem coś się pobiera?

Rozpoznawanie mowy na urządzeniu oznacza pobranie samego rozpoznawania: 80 MB dla Fast, 245 MB dla Balanced, 545 MB dla Accurate. Zostaje w przeglądarce, więc kolejne transkrypcje ruszają od razu.

Jakie języki są obsługiwane?

Około stu, w tym angielski, francuski, hiszpański, niemiecki, włoski, portugalski, niderlandzki, arabski, chiński, japoński i rosyjski. Język jest wykrywany automatycznie; możesz też ustawić go samodzielnie.

Czy to jest darmowe? Czy jest limit długości?

Za darmo, bez konta i bez limitu minut: pracę wykonuje twoje urządzenie, więc nie ma czego liczyć. Bardzo długie nagrania ogranicza jedynie pamięć twojego urządzenia.