Ana içeriğe geç

Podcast’i metne dönüştürme ve bölüm notları hazırlama

Yazar: Yayınlandı: Son inceleme:

Bir podcast transkripti, karşılığını iki kez alır. Bu, bölümü dinlemek yerine okuyan dinleyiciler için aranabilir ve erişilebilir hale getirir ve tüm kaydı tekrar oynatmadan size bölüm notları, kısa alıntılar ve altyazılar için ham materyal sağlar. Platform desteği teorik değil somuttur: Apple Podcasts, içerik oluşturucular için transkriptleri ve bölüm gezinmelerini belgeler. Bu kılavuzda bir bölümün yazıya geçirilmesi, her sunucu ve konuğun etiketlenmesi ve çıktının kullanılabilir bir bölüm notları belgesine dönüştürülmesi açıklanmaktadır.

En çok zaman kazandıran kısım konuşmacı ayırmadır. Bölünmemiş bir metin bloğu olarak okunan bir transkriptin kullanılması neredeyse sesin kendisi kadar zahmetlidir. Hushscript her sesi otomatik olarak etiketler ve bunu her metne ücretsiz olarak ekler, böylece konuşma bir sohbet olarak geri döner.

Başlamadan önce ihtiyacınız olan şey

Bölümün herhangi bir yaygın ses veya video formatındaki kaydı. Düzenleyicinizden düz bir ses dosyasını (MP3, WAV, M4A) dışa aktardıysanız, bu doğrudan işe yarar. Elinizdeki tek kopya Zoom, Riverside veya Ecamm’dan alınan video kaydıysa bu da işe yarar ve ses tarayıcınızdan alınır, böylece video hiçbir zaman yüklenmez.

Temiz kaynak ses her şeyden daha çok yardımcı olur. Konuşmacı etiketleri, her sesin farklı olduğu ve insanların sürekli olarak birbirleriyle konuşmadığı durumlarda en iyi sonucu verir. Her katılımcıyı ayrı bir kanala kaydettiyseniz zaten mümkün olan en temiz girdiye sahip olursunuz. Tek bir karma parça hala çalışıyor; sesleri birbirinden ayırmak için ayrıştırmaya daha çok önem veriyor. Yapabiliyorsanız, sesleri kuru olarak kaydedin ve daha sonra düzenleyicinize müzik yatağını ekleyin; çünkü sürekli konuşma altında çalışan bir jingle, doğruluğu güvenilir şekilde azaltan tek şeydir.

Bölümün tamamını yazıya dökmek için bir hesaba ihtiyacınız olacak. 30 saniyelik ön izleme hesapsız bir adımdır, dolayısıyla herhangi bir şeye kaydolmadan önce gerçek dosyanızdaki konuşmacı etiketlerini ve metin kalitesini kontrol edebilirsiniz.

Bölümü metne dönüştürün

Akış gerçek dönüşüm hunisi sırasını takip eder: önce önizleme yapın, sonra kaydolun, sonra gerisini metne dönüştürün.

  1. Bölümü bırakın /podcast-transcription adresindeki dosya. Hushscript tarayıcınızda ilk 30 saniyeyi kırpar ve konuşmacı etiketli bir önizleme döndürür. Bu adım için herhangi bir hesaba gerek yoktur. Sunucu ve misafirin nasıl bölündüğünü ve metnin kendi sesinizde ne kadar temiz okunduğunu tam olarak göreceksiniz.
  2. Geri kalanını yazıya dökmek için kaydolun. E-postanızı girip oturum açtıktan sonra bölümün tamamını yüklersiniz. Yeni hesaplara, bir defaya mahsus olmak üzere, deneme için 30 ücretsiz dakika verilir. Bunları talep etmenin en hızlı yolu, yetkilendirilen ve hemen serbest bırakılan, hiçbir ücret alınmayan 1 dolarlık bir kart çekidir. Ülkenizde mevcut olan alternatif bir ödeme yöntemini tercih ederseniz, bunun yerine ilk satın alma işleminizde 30 dakika gelir; kart gerekli değildir.
  3. Transkripsiyonun çalışmasına izin verin, ardından dışa aktarın. Transkript, her ifadede bir etiket ve zaman damgasıyla birlikte geri gelir. Düzenleyeceğiniz bir belge için DOCX’i bölüm notlarına, CMS’nize yapıştıracağınız temiz bir blok için TXT’ye, bir video sürümündeki altyazılar için SRT’ye veya podcast sunucunuz konuşma düzeyinde transkript yüklemelerini kabul ediyorsa JSON’a dışa aktarın.

30 ücretsiz dakika, kısa bir bölümü veya daha uzun bir bölümün temsili bir bölümünü kapsayabilir. 60 dakikalık bir bölüm, bakiyenizin 60 dakikasını kullanır, bu nedenle deneme ödeneğinden sonra yükleme yapılması gerekir.

Her toplantı sahibini ve konuğu etiketleyin

konuşmacı ayrıştırma otomatik olarak çalışır, böylece hiçbir şeyi açmazsınız. İki kişilik bir bölüm için (bir sunucu, bir konuk), transkript, her satır iki etiketten birine atfedilerek temiz bir şekilde bölünmüş olarak geri gelir. Bir panel için Hushscript, konuşmacı kapağı olmadan, duyduğu kadar farklı sesi ayırır.

Genel etiketleri gerçek adlarla değiştirmek için:

  1. Düzenleyicide herhangi bir Konuşmacı A örneğini tıklayın.
  2. “Alex” veya gibi bir ad yazın. “Ana Bilgisayar”.
  3. Bu etiketin her örneği, transkript boyunca aynı anda güncellenir.

Her sesi satır satır değil, bir kez yeniden etiketlersiniz. İki kişilik bir bölüm yaklaşık bir dakika sürer; dört kişilik bir panel birkaç kişi alır. Yeniden etiketlemeden sonra transkripsiyonun bir kısmı şu şekilde okunur:

Alex [00:03:12]: Yani o noktada şirketi sen yönetiyordun. İlk işaretler nelerdi?
Jamie [00:03:19]: Dürüst olmak gerekirse, rakamlardı. Bir çeyrekte %40'lık bir düşüş yaşadık.
Alex [00:03:27]: Ve o zaman bunu açıklayamadın mı?
Jamie [00:03:35]: Haftalardır değil. Beni ayakta tutan kısım buydu.

Alıntıları almak ve zaman damgalı bölümler yazmak için ihtiyacınız olan yapı budur. Etiketler dosyanın tamamını taşıdığı için uzun bir bölüm tam olarak bir kez etiketlenir. Ses ayırmanın ardındaki mekanizmalar için konuşmacı ayrıştırmanın nasıl çalıştığını inceleyin.

Etiketlerin düzeltilmesi gerektiğinde

ayrıştırma temiz kayıtlarda doğrudur ancak hatasız değildir ve bunları hızlı bir şekilde düzeltebilmeniz için birkaç modeli bilmeye değerdir.

Eğer iki taneyse Konukların sesleri çok benzer olduğundan ara sıra yanlış konuşmacıya ulaşılabiliyor. Metni ses açıkken tarayın ve yanlış atanmış birkaç satırı elle yeniden atayın. Bu, konuşmacı adlarını sıfırdan yazmaktan çok daha hızlıdır, çünkü yalnızca istisnaları düzeltirsiniz.

Çok az konuşan sessiz bir yardımcı sunucu başka bir plak şirketiyle birleştirilirse, önce ana konuşmacılara gerçek adlarını verin, ardından sessiz sese ait olması gereken bir avuç satırı tarayın. İyi ayrılmış bir kayıtta her iki duruma da nadiren rastlarsınız; bu nedenle kişi başına ayrı bir parça, rekor sürede küçük bir ekstra ayarlamaya değer.

Yaygın sorunlar ve bunlara gerçekte ne sebep olur?

Çeşitleme sorunlarının çoğu araçtan değil, kayda dayanır. Bir programı yayınlamadan önce birkaç tanesini planlamaya değer.

Karışık konuşma ve insanların birbirleriyle konuşması. Bu, herhangi bir konuşmacı ayırma sistemi için en zor şeydir çünkü iki ses aynı anda temiz bir şekilde bölünemez. Metin genellikle okunabilir durumda kalır, ancak yoğun bir örtüşme anı konuşmacılardan birinin üzerine düşebilir veya dikiş yeri bulanıklaşabilir. İyi bir podcast hijyeni burada zaten yardımcı oluyor: misafirlerin bitirmesine izin veren bir sunucu, yan etki olarak daha temiz bir transkript üretiyor. Böyle bir durum meydana geldiğinde, bu birkaç satırı sesin karşısında elle düzeltin.

Uzak misafirler tek bir parçaya kaydedilir. Tek bir karışık dosya olarak kaydedilen bir çağrıyı ayırmak, katılımcı başına bir parça olarak kaydedilen aynı çağrıyı ayırmaktan daha zordur. Aracınız katılımcı başına yerel kaydı destekliyorsa onu kullanın; Yalnızca karışık dosyanız varsa, transkript yine de gelir, yalnızca ayrıştırmaya daha çok dayanır. Her iki durumda da ses aynı yükleme olduğundan, transkripsiyon sırasında yapılacak farklı bir şey yoktur.

Güçlü aksanlar ve kod değiştirme. Hushscript, dili otomatik olarak algılar ve yaklaşık 99 dili, bunların on sekizinde üst düzey doğrulukla metne dönüştürür; böylece, desteklenen bir dilde belirgin aksanı olan bir konuk iyi bir şekilde işlenir. Cümlenin ortasında iki dil arasında geçiş yapan bir konuk gerçekten zor bir durumdur; Değiştirilen cümleleri elle temizlemeyi bekliyoruz. Desteklenen dillerin tam listesi için diller sayfasına bakın.

Giriş müziği ve iğneleyiciler. Bölümler arasındaki müzik yatağı genellikle saçma olarak yazıya geçirilmek yerine atlanır. Sorun yalnızca müzik uzun bir süre boyunca sürekli konuşma altında yürütüldüğünde başlar. Temiz düzeltme editoryaldir: Sesleri kuru olarak kaydedin ve müziği daha sonra yerleştirin, böylece transkripsiyon yalnızca konuşmayı görür.

Adlar, jargon ve marka yazılışları. Uzman bir konuk, modelin fonetik olarak oluşturabileceği terimleri ve ürün adlarını kullanacaktır. Tekrarlandıkları için bunları düzeltmek hızlıdır ve dışa aktarılan belgedeki ara ve değiştir işlemi, yinelenen yazım hatalarını tek geçişte giderir.

Doğrulukla ilgili birkaç ipucu

En büyük kaldıraç kayıt kalitesidir; bu nedenle mikrofonlara ve sessiz bir odaya harcanan çaba, transkripsiyon zamanında karşılığını verir. Bunun ötesinde, sistem hiçbir zaman iki sesi bir dalga biçiminden ayırmak zorunda kalmadığından, konuşmacı başına bir parça hem en temiz metni hem de en temiz konuşmacı etiketlerini verir. Konuğun mikrofonunu sürüklenmek yerine yakın ve tutarlı tutarsanız, düzenleme zamanınızı onarımlar yerine içerik üzerinde harcarsınız.

Prova okuması yaptığınızda, ses açıkken okuyun ve geçişleri düzeltin: önce konuşmacı etiketleri, sonra yanlış duyulan isimler ve jargon, ardından ara sıra örtüşme. Kategoriye göre çalışmak, yukarıdan aşağıya okumaktan daha hızlıdır ve elinizde yayınlanacak kadar temiz bir belge bırakır.

Transkriptten bölüm notları

Notları göster, söylenen her şeyin özeti değildir. Dinleyiciler için bir navigasyon yardımcısı ve henüz oynat tuşuna basmamış kişiler için bir arama yüzeyidirler. Çoğu röportaj ve konuşma şovunda işe yarayan bir yapı:

Bölüm özeti, iki ila dört cümle. Ana konuyu transkriptten çıkarın. Ana argüman, hikaye veya çıkarım nedir? Dinleyip dinlemeyeceğine karar veren biri için bunu yazın.

Zaman damgalı bölümler. Konu değişikliklerini görmek için metni tarayın. Konuşma yeni bir konuya geçtiğinde, zaman damgasını not edin ve tek satırlık bir açıklama yazın. Zaman damgaları doğrudan transkriptten gelir, bu nedenle onları bulmak için asla tekrar dinlemezsiniz.

[00:02:15] Şirketi pazarlama bütçesi olmadan kurmak
[00:14:30] %40'lık gelir düşüşü ve buna sebep olan şey
[00:28:44] Yeniden oluşturma: dahili olarak ne değişti
[00:51:00] Aynı pozisyondaki kurucular için tavsiyeler

Anahtar alıntılar. Bölümün ana iddialarını veya en alıntı yapılan anlarını yakalayan iki veya üç satır çekin. Transkriptten kelimesi kelimesine alıntı yapın ve her birini konuşmacıya ismine göre verin. Bir alıntıyı aynen söylendiği gibi yayınlamak veya daha temiz bölüm notları için dolguyu ve yanlış başlangıçları kırpmak, bilerek yapılmaya değer bir çağrıdır ve temiz deşifre ve birebir deşifre her ikisini de ele alır. Metin aranabilir olduğundan, yarım yamalak hatırladığınız bir satırın tam metnini bulmak birkaç saniye sürer.

Konuk bağlantıları ve kaynakları. Konuğun bahsettiği her şeyi ekleyin. Sözlü URL’leri hızlı bir şekilde bulmak için, transkriptte “nokta com” veya “eğik çizgi” gibi parçaları arayın; insanlar web adreslerini beklediğinizden daha sık yüksek sesle söylüyor ve kelimesi kelimesine bir transkript bunları yakalıyor.

Tam transkript, isteğe bağlı ancak değerli. Tam metni notların altına yapıştırın veya ayrı bir transkript sayfasına bağlantı verin. Arama değerinin yaşadığı yer burasıdır çünkü konuşulan içerik dizine eklenebilir hale gelir. Barındırıcı platformunuz transkript yüklemelerini kabul ediyorsa JSON dışa aktarma işlemi, konuşma düzeyindeki verileri taşır; aksi takdirde düz metin yeterlidir.

Çalışılmış bir örnek

Diyelim ki 58 dakikalık bir kurucu röportajını iki parça olarak kaydettiniz ve bunları bir MP3’te karıştırdınız. MP3’ü /podcast-transcription’a bırakın, 30 saniyelik önizlemenin sunucuyu ve konuğu doğru şekilde ayırmasını izleyin, kaydolun ve tüm dosyayı yükleyin. Transkript Konuşmacı A ve Konuşmacı B ile geri döner; iki tıklamayla onları “Alex” ve “Jamie” olarak yeniden adlandırabilirsiniz. Buradan özet, açılıştan iki dakika sonra gelir, yukarıdaki dört bölüm konu değişikliklerini tarayarak gelir ve iki alıntı alıntı, hatırladığınız anları bulmak için metinde arama yaparken gelir. bölüm notlarının başlangıcından bitişine kadar olan süre yaklaşık on beş dakikadır ve bu sürenin çoğunu beklemek veya metne dönüştürmek yerine kendi düzenlemeniz yapar.

Alt yazı veya alt yazı ekleyin

Bölümün video versiyonunu video sunucusu, Spotify videosu veya LinkedIn gibi bir platformda yayınlarsanız SRT dışa aktarımı, yüklenmeye hazır, zamanlanmış bir altyazı dosyasıdır. Zaten oluşturduğunuz transkript zamanlama verilerini taşıdığı için ekstra bir adım yoktur. Yan dosyalar ve yardımcı dosyalar da dahil olmak üzere bir klibe altyazı alma konusunda daha geniş iş akışı için bir videoya altyazı nasıl eklenir konusuna bakın.

Başlangıç ​​noktanız ses dışa aktarımı yerine video kaydıysa süreç aynıdır; ses önce tarayıcınızda çıkarılır. videodan metne sayfası bu yolu tam olarak kapsar.

Uzun ve çok parçalı bölümler

Uzun metrajlı bir bölüm veya canlı kayıt için Hushscript, dosya boyutu sınırı olmaksızın 10 saate kadar yüklemeler alır. Dört saatlik bir panel veya belgesel formatındaki bir bölüm, parçalara bölünmek yerine tek bir dosya olarak ilerler; bu da iki nedenden dolayı önemlidir. konuşmacı etiketleri dosyanın tamamında tutarlı kalır, böylece bir kez yeniden etiketleyebilirsiniz. Ve zaman damgaları sürekli olduğundan, ikinci bölümde sıfırdan başlamak yerine üç saatlik işaretteki bir bölümde [03:12:40] okunur.

Bir oturumda çok parçalı bir dizi kaydederseniz, tüm oturumu tek bir dosya olarak yazıya dökün ve daha sonra bölüm notlarını bölümlere ayırın. Önce sesi kesmek yalnızca yeniden etiketleme işini artırır.

Bu neden hızlanıyor

Haftalık veya haftada iki kez düzenli bir yayınlama temposu için, bölüm notları dönüştürme rutini, bunu birkaç kez yaptıktan sonra bölüm başına dakikalara sıkıştırılır: dosyayı bırakın, konuşmacıları yeniden etiketleyin, bölümleri tarayın, alıntıları alın, dışa aktarın. Atıf işlemini ücretsiz yapan konuşmacı etiketleri sıkıcı kısmı ortadan kaldırıyor. Zamanınızı kimin ne söylediğini bulmaya değil, notların gerçekten ihtiyaç duyduğu editoryal değerlendirmeye harcarsınız.

Bağımsız kaynaklar ve standartlar

Hushscript bu bağımsız ve rakip olmayan kaynaklara başvurmuştur. Bu kaynaklar araştırmaları, standartları veya platformların çalışma biçimini açıklar; Hushscript’i destekledikleri anlamına gelmez.

Kaynakların incelenme tarihi:

Sıkça sorulan sorular

Transkriptteki sunucuyu ve her konuğu nasıl etiketleyebilirim?

Hushscript, konuşmacıları 'Konuşmacı A' ve 'Konuşmacı B' gibi etiketlerle otomatik olarak ayırır. Transkripsiyondan sonra düzenleyicideki herhangi bir etikete tıklayın, gerçek adı yazın; konuşmacının göründüğü her yerde güncellenir. İki kişilik bir bölümün yeniden etiketlenmesi yaklaşık bir dakika sürer; dört sesli bir panel birkaç dakika sürer.

konuşmacı etiketleri ekstra ücrete tabi midir?

Hayır. Konuşmacı etiketleri, Hushscript'in ürettiği her transkripte ücretsiz olarak dahil edilir; konuşmacı başına ücret alınmaz ve ses sayısında sınır yoktur. Pek çok araç bunu daha yüksek bir seviyenin arkasına yerleştirir; işte standart çıktının bir parçası.

Podcast'in video kaydını yazıya dökebilir miyim?

Evet. MP4, MOV veya MKV gibi bir video dosyanız varsa herhangi bir şey yüklenmeden önce ses tarayıcınıza çıkarılır, böylece video cihazınızda kalır. Sunucuya yalnızca çıkarılan ses ulaşır ve bu da büyük bir video dosyasının bağlantınızı tıkamasını engeller.

Bir bölümü tek seferde ne kadar süreyle metne dönüştürebilirim?

Dosya boyutu sınırı olmaksızın yükleme başına 10 saate kadar. 60 dakikalık bir bölüm, iki saatlik ayrıntılı inceleme veya dört saatlik canlı kayıt tek bir dosya olarak gerçekleştirilir; böylece parçaları birleştirmek yerine konuşmacıları bir kez yeniden etiketlersiniz.

Hushscript hangi dışa aktarma formatlarını üretir?

TXT, SRT, VTT, CSV, TSV, Markdown, HTML, RTF, XML, JSON, DOCX, PDF ve şifre korumalı .husharchive, filigransız. bölüm notları için DOCX, doğrudan düzenlemeniz için size biçimlendirilmiş bir belge sunar. Bir video versiyonunu yayınlarsanız SRT size zamanlanmış altyazılar verir. Transkript yüklemelerini kabul eden bir podcast sunucusunu beslerseniz JSON size konuşma düzeyinde veri sağlar.

bölüm notları yazmak için tüm bölümü metne dönüştürmem gerekir mi?

Doğru zaman damgaları ve kelimesi kelimesine alıntılar için, evet. Hafızanızdan kaba notlar alabilirsiniz, ancak bölüm işaretleri, tam alıntılar ve aranabilir tam bir transkripsiyonun tümü tam metinden gelir. 30 saniyelik ön izleme, bölümün tamamına başlamadan önce size kaliteyi gösterir.

Arka plan müziği veya giriş müziği, transkripsiyonu karıştırır mı?

Bölümler arasındaki müzik genellikle atlanır veya yazıya geçirilmeden bırakılır ve bir sesin altındaki kısa bir müzik nadiren sorunlara neden olur. Bir müzik yatağı sürekli konuşma altında çalışıyorsa, bu alandaki doğruluk düşebilir. Sesleri temiz bir şekilde kaydetmek ve daha sonra düzenleyicinize müzik eklemek en iyi transkripti verir.

Net bir şekilde kaydedilmiş bir podcast'in transkripti ne kadar doğrudur?

Çok az karışma içeren iki mikrofonlu temiz bir kayıtta, metin hızlı bir düzeltme okumasından sonra yayınlanacak kadar doğrudur. Doğruluk, yüklediğiniz dosya biçimine değil, çoğunlukla kayıt kalitesine, aksanlara ve konukların birbirleriyle ne sıklıkta konuştuğuna bağlıdır.

30 ücretsiz dakikayla başlayın

Başlayın – 30 ücretsiz dakika