Generatory podcastów oparte na sztucznej inteligencji (AI) stały się niezwykle przydatne w ciągu ostatnich kilku lat. Jako fotograf i ekspert techniczny w FixThePhoto, prowadzę podcast o wykorzystaniu sztucznej inteligencji (AI) w fotografii i wideografii. Odkąd sztuczna inteligencja zyskała na popularności, testuję wszelkie możliwe, przydatne lub popularne narzędzia AI, które są istotne w branżach, w których działam.
Przez lata moim ulubionym rozwiązaniem był Adobe Podcast. Nadal często z niego korzystam, a ostatnio korzystam z opartego na sztucznej inteligencji narzędzia Enhance Speech, aby skrócić czas edycji, ponieważ automatycznie usuwa ono pogłos i szum tła oraz poprawia ogólną jakość dźwięku z mikrofonu.
Jednak w końcu moja ciekawość wzięła górę, więc chciałem zobaczyć, jak wygląda w pełni zautomatyzowany proces produkcji podcastu. Postanowiłem przetestować rozwiązania, które mogą przekształcić skrypt lub podpowiedź w kompletny, w pełni udźwiękowiony odcinek. Moim celem było sprawdzenie, czy generator podcastów może stać się realną alternatywą dla prawdziwego nagrania.
Aby poznać szerszy zakres opinii, przejrzałem mnóstwo wątków na Reddicie, recenzji YouTube, Discordów niezależnych podcasterów i artykułów z rekomendacjami. Następnie, współpracując z moimi współpracownikami FixThePhoto, przez kilka tygodni przetestuj ponad 20 generatorów podcastów AI, korzystając z tych samych skryptów, podpowiedzi i rzeczywistych scenariuszy produkcyjnych.
Niektóre programy zostały od razu zdyskwalifikowane, a inne wydawały się zbyt sztuczne, ale pojawiło się też kilka imponujących propozycji. Niniejsza recenzja odzwierciedla wyniki naszych badań, oparte na rzeczywistych eksperymentach, a nie na pustych obietnicach marketingowych. Zanim jednak przejdziemy do szczegółów, oto aspekty, które priorytetowo traktowaliśmy, oceniając różne narzędzia do tworzenia podcastów oparte na sztucznej inteligencji:
Sztuczna inteligencja radykalnie zmieniła proces produkcji podcastów, zarówno dla początkujących, jak i profesjonalistów. Według najnowszych statystyk, około 40% podcasterów wprowadziło już funkcjonalność AI do swojego procesu pracy, a 15% regularnie publikuje treści generowane przez AI, odnotowując wzrost liczby słuchaczy nawet o 45% dzięki rekomendacjom opartym na AI.
Statystyki te pokrywają się z tym, co sam obserwuję w branży – większa częstotliwość publikacji odcinków, czystszy dźwięk i różnorodność nowych formatów podcastów.
Zarówno płatne, jak i darmowe generatory podcastów oparte na sztucznej inteligencji (AI) mogą być świetnym rozwiązaniem dla początkujących podcasterów. Pomogą Ci osiągnąć świetne rezultaty bez konieczności posiadania specjalistycznego sprzętu czy zaawansowanych umiejętności edycji dźwięku. Dla wielu naszych obserwatorów i innych twórców sama ta zaleta sprawia, że interesują się narzędziami opartymi na AI.
Mimo to, po poświęceniu kilku tygodni na testy, mogę stanowczo stwierdzić:
Gdzie sztuczna inteligencja osiąga szczyt swoich możliwości:
Gdzie sztuczna inteligencja zawodzi:
Wprowadzamy podobne monity na wszystkich testowanych platformach. Oto przykład opisu, którego użyłem:
„Stwórz 6-8-minutowy odcinek podcastu w spokojnym, profesjonalnym tonie. Temat: jak sztuczna inteligencja zmienia fotografię i montaż wideo. Grupa docelowa: twórcy na poziomie średnio zaawansowanym. Dołącz wstęp, 3 kluczowe punkty z przykładami i krótkie zakończenie. Unikaj modnych słów, brzmij naturalnie i utrzymuj spokojne tempo.”
Rezultaty są niesamowicie różne. Niektóre platformy miały poprawną strukturę, ale brzmiały sztywno. Inne generowały naturalne głosy, ale scenariuszowi brakowało logiki. Najlepsze rezultaty osiągnąłem, wykorzystując sztuczną inteligencję jako asystenta, a nie jako jej całkowite zastąpienie, skupiając się na generowaniu szkiców, wstępów lub segmentów, które później ręcznie ulepszałem.
Jedna zaskakująca wada: nadmierna pewność siebie. Podcasty generowane przez sztuczną inteligencję brzmią zazwyczaj na tyle dopracowane, że użytkownicy unikają niezbędnej weryfikacji faktów lub zmiany tonu. To niebezpieczne, ponieważ choć sztuczna inteligencja może brzmieć przekonująco, nie oznacza to, że jest poprawna.
Chociaż proces tworzenia jest ważny, odpowiednie planowanie jest również niezbędne do osiągnięcia sukcesu. Gorąco polecam następujące Narzędzia AI do zarządzania mediami i planowania odcinków:
Hootsuite. Nadaje się do promocji podcastów na wielu platformach.
Bufor. Minimalistyczny interfejs użytkownika i wygodne planowanie
Notion + przypomnienia AI. Idealne do planowania odcinków.
Spotify dla podcasterów (wgląd w sztuczną inteligencję). Przydatne do pomiaru czasu i analiz.
Mój najostrzejszy werdykt oparty na wszystkich testach: sztuczna inteligencja nie zabije podcastów – ale zdemaskuje leniwych twórców. W świecie, w którym każdy może szybko tworzyć podcast za podcastem, ludzie zaczną bardziej niż kiedykolwiek skłaniać się ku autentyczności, świeżym pomysłom i ciekawym perspektywom.
Jeśli jest używany mądrze, generator podcastów oparty na sztucznej inteligencji jest o wiele cenniejszym asystentem niż bezmyślny zamiennik ludzkiej kreatywności.
Najlepiej dla: twórców ulepszających dźwięk podcastów za pomocą sztucznej inteligencji
Cennik: Bezpłatny (ograniczona liczba generacji); od 4,99 USD/miesiąc, 59,99 USD/rok
Często korzystam Filmy generowane przez Firefly w Photoshop i Illustrator, ale dopiero niedawno zacząłem korzystać z Generatora efektów dźwiękowych. Nie jest on reklamowany jako generator podcastów głosowych oparty na sztucznej inteligencji, więc zacząłem się zastanawiać, czy nadal można go używać w tym celu.
Firefly nie potrafi generować całych odcinków podcastów ani głosów. Jest to jednak najlepszy Generator efektów dźwiękowych AI, który przekształca komunikaty tekstowe w dźwięk, co może być niezwykle przydatne dla podcasterów, którzy chcą poprawić jakość swoich produkcji.
Na potrzeby mojego testu stworzyłem dźwięki wprowadzające, dźwięki tła, subtelne przejścia, kliknięcia w stylu interfejsu użytkownika na potrzeby demonstracji technologicznych oraz kilka „cyfrowych” tekstur, których użyłem w odcinkach poświęconych tematyce sztucznej inteligencji.
Na przykład napisałem temat „łagodne, futurystyczne intro, szum, minimalizm, spokój, 3 sekundy” i otrzymałem klip audio, który świetnie pasował do marki mojego podcastu, bez konieczności przeglądania bibliotek zasobów stockowych.
Firefly to niezastąpiony element mojego przepływu pracy opartego na technologii Adobe. Zazwyczaj mój proces produkcyjny wygląda tak: nagrywam głos → porządkuję go w Adobe Podcast AI Enhance → tworzę przejścia i efekty dźwiękowe w Firefly → łączę wszystkie elementy w Premiere Pro lub Audition. Wszystkie te funkcje uzupełniają się, zamiast ze sobą konkurować.
Jednak Firefly nie jest rozwiązaniem uniwersalnym. Jeśli szukasz kompletnego narzędzia AI do konwersji tekstu na podcast, musisz poszukać gdzie indziej. Nie potrafi też generować muzyki – oferuje jedynie efekty dźwiękowe.
Moja rada: korzystaj z Firefly jako kreatywnego projektanta dźwięku, a nie prowadzącego podcast. Trzymaj się opisowych podpowiedzi, generuj kilka wariantów i staraj się oszczędnie korzystać ze sztucznej inteligencji, aby zachować autentyczność treści.
Najważniejsze cechy:
Najlepiej nadaje się do: produkcji skryptowanych podcastów z wykorzystaniem sztucznej inteligencji
Cennik: Bezpłatny (ograniczona liczba eksportów); od 19 dolarów miesięcznie, 180 dolarów rocznie
Wondercraft polecił mi kolega z FixThePhoto. Reklamował go jako coś najbardziej zbliżonego do pełnoprawnego oprogramowania do podcastów opartego na sztucznej inteligencji, a moje osobiste doświadczenia potwierdzają to stwierdzenie.
Został stworzony specjalnie do konwersji skryptów na w pełni udźwiękowione odcinki podcastów. Zapewnia narrację, a jednocześnie pozwala dostosować tempo, muzykę w tle i ogólny przepływ. To właśnie wyróżnia go spośród standardowych rozwiązań syntezy mowy.
Na potrzeby mojego testu dodałem własne skrypty do Wondercraft, w tym samouczki technologiczne, recenzje wiadomości ze świata sztucznej inteligencji i krótkie odcinki skupione na opiniach. Uwielbiam podejście redakcyjne oferowane przez to narzędzie. To najlepszy generator podcastów oparty na sztucznej inteligencji, jeśli chcesz dopracować ton, styl lektora, ścieżkę dźwiękową w tle i ogólną narrację.
Po testach to Narzędzie audio AI pozostało w moim użyciu, za każdym razem, gdy musiałem szybko dostarczyć nowy odcinek lub miałem pomysł, z którym chciałem poeksperymentować przed rozpoczęciem nagrywania ręcznego. Wondercraft można wykorzystać do tworzenia szkiców przed ponownym nagraniem wersji finalnej własnym głosem.
Wady? Głosy brzmią wiarygodnie, ale wypadają słabiej w porównaniu z ElevenLabs. Dodatkowo, jeśli Twój scenariusz nie jest wystarczająco interesujący, to oprogramowanie tego nie naprawi. Wreszcie, nie nadaje się do tworzenia angażujących emocjonalnie narracji ani wywiadów ze względu na neutralny ton generowanych głosów.
Moja rada: poświęć wystarczająco dużo czasu na dopracowanie scenariusza, trzymaj się krótkich akapitów i nie dodawaj zbyt wiele treści do jednego pokolenia. Polecam wykorzystać go jako asystenta produkcji, a nie cudotwórcę, który zrobi wszystko za ciebie.
Najważniejsze cechy:
Najlepiej do: przekształcania dokumentów w podcasty oparte na sztucznej inteligencji
Cennik: Bezpłatny okres próbny; Acrobat Studio od 24,99 USD/miesiąc
Kiedyś tworzyłem efekty dźwiękowe do przejść i wstępów do podcastów w Adobe Firefly, ale Adobe Acrobat oferuje teraz bardziej kompleksowe funkcje podcastów. Jego asystent AI potrafi analizować pliki PDF, adresy URL i inne pliki projektu, podsumowywać ich zawartość i przekształcać ważne szczegóły w podcast tworzony przez sztuczną inteligencję.
Podczas testu dodałem kilka dokumentów do przestrzeni PDF i poprosiłem Asystenta AI o zaznaczenie najważniejszych szczegółów. Mogłem szybko zrozumieć kluczowe punkty, słuchając utworzonego nagrania audio, zamiast czytać każdą stronę. Prace badawcze, raporty, transkrypcje wywiadów i inne obszerne dokumenty bardzo na tym skorzystały.
Dodatkowo Acrobat oferuje cytowania, podsumowania, ważne spostrzeżenia i zalecane dalsze kroki. Mogłem udostępniać ukończoną przestrzeń roboczą innym osobom, zadawać dodatkowe pytania i gromadzić kilka źródeł w jednym pliku PDF. W porównaniu z Firefly, który po prostu generuje pojedyncze efekty dźwiękowe, jest on zatem bardziej przydatny w podcastach opartych na badaniach.
Moja rada: użyj programu Acrobat, gdy potrzebujesz przekonwertować raporty, pliki PDF lub materiały badawcze na szybki przegląd audio. Jeśli szukasz markowych odcinków podcastów z niestandardowymi głosami i muzyką, wybierz dedykowaną platformę podcastową AI.
Najważniejsze cechy:
Najlepiej nadaje się do: skryptów podcastów opartych na badaniach
Cennik: Bezpłatny (z limitami użytkowania); od ~20 USD/miesiąc (Google One AI)
Jeśli chodzi o podcasty poświęcone badaniom, edukacji i innym podobnym treściom, najczęściej polecanym przeze mnie był NotebookLM. Jego największą zaletą jest to, jak „inteligentny” jest ten podcast.
To narzędzie do tworzenia podcastów oparte na sztucznej inteligencji (AI) opiera się wyłącznie na dostarczonych przez Ciebie źródłach – dokumentach, artykułach, transkrypcjach, notatkach lub linkach, ponieważ AI koncentruje się wyłącznie na tej bazie danych. Kiedy użyłem go do stworzenia podcastu, byłem zadowolony, widząc, jak świetnie radzi sobie z utrzymaniem aktualności i opieraniem całej treści na faktach, ponieważ wiele ogólnych narzędzi AI stale zawiera błędne informacje i nierzetelne źródła.
Pomogło mi to stworzyć kilka odcinków o trendach w dziedzinie sztucznej inteligencji w fotografii. Zaimportowałem artykuły badawcze, własne przemyślenia, wewnętrzną dokumentację FixThePhoto, a nawet kilka transkrypcji wywiadów. Następnie poleciłem NotebookLM podsumowanie, uporządkowanie tematów i przygotowanie wyjaśnień w formie mówionej. Chociaż nie generuje pełnego odcinka audio, tworzy imponujące skrypty zoptymalizowane pod kątem podcastów.
To doskonały asystent produkcji podcastów oparty na sztucznej inteligencji (AI) do treści edukacyjnych lub analitycznych. Chociaż nie można go używać jako Oprogramowanie do klonowania głosu AI, doskonale spełnia swoje główne zadanie, czyli ulepszanie skryptów. Można go używać przed nagraniem podcastu w Adobe Podcast lub wprowadzeniem skryptu do Wondercraft.
Wadą jest to, że trzeba go używać w połączeniu z innymi narzędziami, ponieważ nie oferuje muzyki, narracji ani efektów dźwiękowych. Jest też nastawiony na treści edukacyjne i naukowe, a nie na emocjonalne historie fikcyjne.
Moja rada: użyj NotebookLM jako asystenta badawczego. Uzupełnij go o wiarygodne źródła, zadawaj bardzo szczegółowe pytania i poproś o „podsumowania w formie mówionej”, aby poprawić jakość wyników.
Najważniejsze cechy:
Najlepiej dla: początkujących i szybkich testów podcastów
Cennik: Bezpłatny (znaki wodne, limity); od 15 dolarów miesięcznie, 144 dolarów rocznie
Jellypod to platforma podcastowa oparta na sztucznej inteligencji, która stawia na łatwość obsługi i wydajność. Wybierasz format, wprowadzasz komunikat, wybierasz głos i czekasz, aż oprogramowanie wygeneruje podcast w stylu podcastu, bez zakładanie domowego studia podcastów. To rozwiązanie jest znacznie bardziej usprawnione i zautomatyzowane w porównaniu z innymi opcjami opisanymi powyżej.
To, co wyróżnia Jellypod, nawet na tle narzędzi Adobe AI do podcastów, to intuicyjność. Nie musisz studiować skomplikowanych menu ani zajmować się dziesiątkami parametrów. Generowane głosy brzmią w większości naturalnie, a sztuczna inteligencja całkiem dobrze radzi sobie z utrzymaniem struktury podcastu. Priorytetem jest dla niego szybkość, a nie wyrafinowanie, więc dostosuj swoje oczekiwania.
Czy Jellypod stał się częścią mojego codziennego procesu pracy? Nie, rzadko go używam do podcastów. Przydaje się jednak zawsze, gdy w mojej głowie kiełkuje jakiś pomysł i chcę stworzyć jego szkic, żeby sprawdzić, czy ma potencjał, bez konieczności przechodzenia przez cały proces w studiu.
Uproszczona struktura wiąże się z mniejszą głębią. Długie epizody mają tendencję do powtarzalności, a personalizacja wydaje się bardzo ograniczona w porównaniu z Wondercraft czy Descript.
Moja rada: trzymaj się krótkich odcinków (3–6 minut), przepisz temat tak, aby brzmiał swobodnie i nie korzystaj Jellypod w przypadku scenariuszy, które mają dawać silny ładunek emocjonalny.
Najważniejsze cechy:
Najlepiej nadaje się do: porządkowania prawdziwych nagrań podcastów
Cennik: Bezpłatny (z limitami); od 9,99 USD/miesiąc, 119 USD/rok
Jak już wspomniałem, Adobe od lat jest częścią mojego procesu pracy i chociaż nie można używać tego rozwiązania jako generatora podcastów opartego na sztucznej inteligencji, to i tak jest ono niezwykle przydatne, jeśli chodzi o ulepszanie treści.
Głównym powodem, dla którego tak bardzo polegam na Adobe Podcast AI jest funkcja Enhance Speech. Doskonale radzi sobie z usuwaniem szumów tła i przekształcaniem dźwięku, sprawiając, że brzmi on jak nagrany wysokiej jakości mikrofonem w profesjonalnym studiu.
Używam go do edycji notatek, rozmów na Zoomie, nagrań z pokoju hotelowego, a nawet improwizowanych odcinków nagranych mikrofonem w laptopie. Ulepszenia wprowadzone przez narzędzie Adobe Podcast Enhance są zazwyczaj na tyle znaczące, że mogę przygotować nagrania do publikacji bez konieczności wprowadzania dodatkowych zmian.
Doceniam również przyjazność tego oprogramowania dla użytkownika. W przeciwieństwie do DAW-ów, które przytłaczają pokrętłami i wtyczkami, to rozwiązanie koncentruje się wyłącznie na mowie.
W swojej pracy importuję nagrania do Adobe Podcast, aby je oczyścić przed wprowadzeniem ostatecznych poprawek w Premiere Pro lub Audition. To naturalne dopasowanie do ekosystemu Adobe i znaczne ułatwienie pracy. Niestety, aplikacja ta nie oferuje zbyt wielu opcji sterowania ręcznego, ponieważ nie można ręcznie dostosować korekcji dźwięku ani kompresji.
Moja rada: korzystaj z narzędzi Adobe Podcast AI na wczesnym etapie procesu, a nie dopiero, gdy przygotowujesz się do publikacji. Uporządkuj ścieżkę audio, a następnie zbuduj wokół niej odcinek.
Najważniejsze cechy:
Najlepiej nadaje się do: naturalnie brzmiących głosów w podcastach AI
Cennik: Bezpłatny (limitowane środki); od 5 dolarów miesięcznie, 55 dolarów rocznie
Dodałam ElevenLabs do listy po tym, jak kolega z pracy ciągle mnie o to nękał i teraz rozumiem dlaczego. Jeśli chodzi o naturalnie brzmiące głosy, to bez wątpienia najlepszy generator podcastów oparty na sztucznej inteligencji na rynku, nawet jeśli reszta jego funkcjonalności jest dość ograniczona.
ElevenLabs koncentruje się wyłącznie na dostarczaniu realistycznych, konfigurowalnych głosów, umożliwiając dostosowanie tonu, stabilności, tempa i przekazu emocjonalnego, czego nie znajdziesz w innym oprogramowaniu wymienionym powyżej.
Użyłem tego narzędzia do tworzenia segmentów z narracją, wstępów i eksperymentalnych głosów lektorskich do odcinków o tematyce sztucznej inteligencji. Niektóre z nich były tak realistyczne, że widzowie pytali nawet, skąd wziąłem tego lektora.
Ten Tłumacz wideo AI jest szczególnie przydatny w przypadku podcastów solo, filmów wyjaśniających i wielojęzycznych wersji tych samych treści. Nadal mam ElevenLabs w swoim zestawie narzędzi, ale używam go głównie do wstępów, tłumaczeń lub w sytuacjach wymagających neutralnego, profesjonalnego głosu, który nie kłóci się z moją osobowością.
Największą wadą tej platformy jest to, że obsługuje wyłącznie głos. Nie zapewnia struktury nagrania, nie oferuje narzędzi do edycji i nie pozwala na dodawanie muzyki w tle. Aby korzystać z tych funkcji, konieczne będzie skorzystanie z innego rozwiązania.
Moja rada: unikaj nadmiernej edycji dźwięku z ElevenLabs. Trzymaj się konwersacyjnych skryptów, dodawaj pauzy ręcznie i korzystaj z Adobe Podcast, aby dopracować efekt przed publikacją.
Najważniejsze cechy:
Najlepiej do: efektywnej edycji podcastów
Cennik: Bezpłatny (znaki wodne, limity); od 15 dolarów miesięcznie, 144 dolarów rocznie
Znalazłem Descript na Reddicie, ponieważ wiele osób polecało go jako przydatne narzędzie do tworzenia podcastów z wykorzystaniem sztucznej inteligencji dla każdego, kto chce poprawić efektywność edycji, zamiast używać go do generowania nagrań od podstaw.
Szczególnie podoba mi się funkcjonalność tego rozwiązania oparta na tekście. Pracujesz nad transkrypcją, a nie nad przebiegiem. Usuń fragment skryptu, a ta część audio również zostanie usunięta. Możesz wygodnie zmieniać kolejność różnych segmentów w o wiele wygodniejszy sposób, niż gdybyś musiał ich słuchać.
W moim teście wykorzystałem to Oprogramowanie do dubbingu AI, aby uporządkować nagrania podcastów i wyciąć fragmenty, które wydawały się zbyt długie i niepotrzebne. Sama funkcja usuwania słów-wypełniaczy potrafi zdziałać cuda, oszczędzając czas na edycji dźwięku.
Nie jest to narzędzie, którego potrzebuję do wszystkich moich podcastów, ale jeśli czuję, że struktura odcinka wymaga dopracowania, Descript jest pierwszym rozwiązaniem, które przychodzi mi do głowy. Niestety, brakuje mu najbardziej zaawansowanych narzędzi do edycji. Można jednak skorzystać z funkcji dogrywania, o ile dostarczy się mu czyste, spójne próbki audio.
Moja rada: użyj Descript po oczyszczeniu dźwięku w innym narzędziu. To bardziej inteligentny edytor niż realizator dźwięku.
Najważniejsze cechy:
Najlepiej nadaje się do: podcastów z wywiadami zdalnymi
Cennik: Bezpłatny (eksport ze znakiem wodnym); od 19 dolarów miesięcznie, 180 dolarów rocznie
To świetna opcja dla podcastów w stylu wywiadów. Już podczas mojej pierwszej sesji stało się jasne, że to oprogramowanie do nagrywania podcastów ma na celu przede wszystkim poprawę jakości nagrań zdalnych, a nie oferowanie dziesiątek zaawansowanych funkcji. To narzędzie do edycji podcastów oparte na sztucznej inteligencji zdobyło miejsce na tej liście, oferując profesjonalną jakość nagrań i funkcje czyszczenia oparte na sztucznej inteligencji.
Riverside może lokalnie przechwytywać dźwięk i obraz na urządzeniu każdego uczestnika przed przesłaniem, zapewniając, że nie zostanie on poddany kompresji online, która zazwyczaj obniża jakość dźwięku. Następnie do akcji wkracza sztuczna inteligencja, redukując szumy, równoważąc poziomy dźwięku i wprowadzając szereg subtelnych korekt.
Główną wadą jest brak elastyczności. Riverside nie dorównuje swobodzie, jaką daje dedykowane oprogramowanie DAW, a ponadto nie potrafi generować głosu za pomocą sztucznej inteligencji.
Moja rada: nagrywaj pojedyncze ścieżki i powierz Riverside czyszczenie nagrań przed zaimportowaniem ich do głównego programu do edycji.
Najważniejsze cechy:
Najlepiej nadaje się do: społecznego wykorzystania podcastów
Cennik: Bezpłatny (znaki wodne); od $12/miesiąc, $120/rok
Odkryłem VEED po tym, jak zobaczyłem jego recenzję na Reddicie – to świetne rozwiązanie do przekształcania tekstu w treści w stylu podcastu, szczególnie jeśli używasz również materiałów wideo. To wieloplatformowy generator podcastów oparty na sztucznej inteligencji, który znacznie ułatwia publikowanie treści w dowolnym miejscu.
To rozwiązanie fantastycznie łączy dźwięk, tekst i wideo. VEED pomógł mi stworzyć wiele krótkich fragmentów podcastów z tekstu, a także przekonwertować je na pionowe filmy z napisami, co jest kluczowym formatem dla łatwości wyszukiwania.
VEED nie jest wystarczająco rozbudowany dla mojego głównego podcastu, ale przydaje się podczas pracy nad klipami promocyjnymi i eksperymentowania z krótkimi filmami do mediów społecznościowych. Niestety, nie można dopracować różnych aspektów nagrań, co zmusza do korzystania z innego oprogramowania, jeśli szukasz dopracowanego dźwięku.
Moja rada: trzymaj się krótkich scenariuszy i treści zawierających elementy wizualne. VEED świetnie radzi sobie z materiałami wideo, a nie tylko czystymi podcastami audio.
Najważniejsze cechy:
Wypróbowanie wszystkich tych generatorów i edytorów audio podcastów opartych na sztucznej inteligencji zajęło dużo czasu i wysiłku – zarówno ode mnie, jak i od całego Zespół FixThePhoto. Aktywnie angażowałem współpracowników w testy poprawności, pętle sprzężenia zwrotnego i testy w warunkach rzeczywistych. W ciągu kilku tygodni sprawdziliśmy ponad 20 rozwiązań.
Stworzyliśmy naszą listę narzędzi AI, przeglądając setki wątków na Reddicie, recenzje YouTube, profile niezależnych podcastów na Discordzie i newslettery. Osobiście wybrałem opcje, które otrzymały liczne rekomendacje od rzeczywistych użytkowników i nie były tylko intensywnie promowane przez deweloperów. Następnie moi współpracownicy pomogli skrócić listę, eliminując wszystkie rozczarowujące platformy.
Zrezygnowaliśmy z kilku popularnych opcji, w tym Podcastle, Play.ht, Lovo, Soundraw i Speechify. Niektóre z nich wyeliminowały generatory podcastów oparte na sztucznej inteligencji (AI), które zapewniały dość naturalne głosy, ale miały słabą strukturę. Inne przypominały nijakie rozwiązania z zamianą tekstu na mowę, a nie pełnoprawne kreatory podcastów oparte na sztucznej inteligencji. Wyeliminowałem również opcje, które nakładały skąpe limity na eksport lub płatne, podstawowe narzędzia w ramach drogich planów.
Każde rozwiązanie zostało poddane zestawowi identycznych testy:
Moi koledzy pomagali mi w rozwiązywaniu problemów skrajnych – dłuższych skryptów, innego tonu głosu, tekstów w językach innych niż angielski oraz treści dostosowanych do mediów społecznościowych.
Dodatkowo zauważyliśmy punkty sporne: rejestrację konta, zawiły interfejs użytkownika, ukryte ograniczenia, błędy i awarie. Jeśli generator podcastów spowalniał nas lub miał wiele problemów technicznych, jego „przełomowa funkcjonalność oparta na sztucznej inteligencji” nie miała już znaczenia.
Ostatni wybór zawiera rozwiązania, które mogą stać się wartościowym elementem Twojego procesu pracy, i które nie ograniczają się tylko do imponującej strony docelowej.