Terjemahan langsung berbilang penutur melakukan dua tugas serentak: ia melabelkan setiap suara dalam bilik dan menterjemahkan setiap giliran ke dalam bahasa anda semasa orang masih bercakap. MirrorCaption mengendalikan kedua-duanya dalam pelayar, dalam 50+ bahasa yang boleh dipilih, tanpa bot menyertai panggilan. Anda melihat siapa berkata apa ketika ia sedang dikatakan, bukan sepuluh minit selepas mesyuarat tamat.

Bayangkan panggilan empat orang. Seorang PM berbahasa Inggeris di London, seorang pembangun di Shanghai yang bercakap Mandarin, seorang klien di Tokyo yang bercakap Jepun, dan seorang pereka yang bertukar antara dua daripada mereka. Semua orang bercakap. Transkrip anda ialah dinding teks tanpa atribusi dalam tiga bahasa. Anda tahu sesuatu yang penting telah dikatakan, tetapi bukan siapa yang mengatakannya, atau tepat apa maksudnya.

Itulah jurang yang ditutup oleh panduan ini. Terjemahan tanpa label penutur memberitahu anda apa yang dikatakan. Terjemahan langsung berbilang penutur memberitahu anda siapa yang mengatakannya, dalam bahasa anda, secara masa nyata. Di bawah, kami terangkan apa itu, mengapa label penting, cara ia berfungsi dalam MirrorCaption, di mana teknologi ini benar-benar sukar, dan cara menjalankannya merentas platform tanpa bot.

Pengambilan Utama

Apa Itu Terjemahan Langsung Berbilang Penutur?

Terjemahan langsung berbilang penutur ialah sistem masa nyata yang memisahkan dan melabelkan setiap suara dalam perbualan serta menterjemahkan setiap giliran ke dalam bahasa pilihan anda semasa orang masih bercakap. Ia menggabungkan dua tugas, pengesanan penutur dan terjemahan, ke dalam satu aliran langsung supaya anda boleh mengikuti perbualan berbilang bahasa dan berbilang orang ketika ia berlaku.

Kebanyakan alat hanya melakukan satu bahagian dengan baik. Kapsyen platform menterjemah tetapi jarang mengaitkan giliran dengan jelas merentas bahasa. Alat transkripsi pembangun memisahkan suara tetapi berfungsi pada rakaman yang dimuat naik, dalam bahasa Inggeris dahulu, selepas kejadian. Tugas gabungan, label ditambah terjemahan ditambah semasa panggilan, ialah bahagian yang hampir tiada siapa selesaikan. Jika anda mahukan pandangan yang lebih luas tentang kategori ini, rumusan kami tentang alat penterjemah mesyuarat masa nyata terbaik merangkumi keseluruhan bidang.

Label penutur vs. diarization penutur

Anda akan melihat dua istilah digunakan secara longgar. Diarization penutur ialah proses teknikal membahagikan audio mengikut "siapa bercakap bila," satu tugas yang diterangkan dalam penilaian Rich Transcription NIST. Label penutur ialah hasil yang menghadap pengguna: tag yang anda benar-benar baca, seperti Speaker 1 dan Speaker 2, yang boleh anda namakan semula kepada "Priya" atau "Kenji."

Diarization ialah enjin. Label ialah papan pemuka. Untuk mesyuarat, yang penting bagi anda ialah papan pemuka: rekod setiap giliran yang bersih dan mudah dibaca, dengan atribusi dan terjemahan. Menambah identiti penutur pada kapsyen juga merupakan amalan terbaik kebolehcapaian, seperti yang dinyatakan dalam panduan W3C tentang kapsyen untuk penonton yang tidak boleh bergantung pada suara sahaja untuk membezakan orang.

Mengapa Label Penutur Penting Apabila Anda Menterjemah Mesyuarat

Dalam mesyuarat satu bahasa, anda selalunya boleh membezakan suara sendiri. Dalam mesyuarat berbilang bahasa, anda sudah pun berusaha membaca terjemahan, jadi atribusi ialah perkara pertama yang mudah terlepas. Itulah saat ia paling penting.

Label mengubah tiga perkara. Pertama, pembuatan keputusan: mengetahui siapa yang membangkitkan bantahan memberitahu anda kebimbangan siapa yang perlu ditangani dan sejauh mana beratnya. Kedua, rekod yang boleh dicari: transkrip siapa berkata apa membolehkan anda melompat ke "semua yang klien katakan tentang garis masa." Ketiga, penyerahan yang kemas: pasukan jualan dan undang-undang rentas sempadan memerlukan petikan verbatim yang beratribusi, bukan kabur yang diparafrasa.

Mahu melihat giliran yang dilabel dan diterjemah pada panggilan anda sendiri? Cuba MirrorCaption secara percuma, satu jam, tiada kad kredit, tiada apa-apa untuk dipasang.

Masalah dengan transkrip terjemahan tanpa atribusi

Inilah sebab transkrip tanpa label gagal dalam amalan. Katakan Speaker 2, yang bercakap Mandarin, mengatakan harga itu membimbangkan, pada masa yang sama Speaker 3 sedang menghabiskan ayat dalam bahasa Inggeris tentang garis masa. Dalam transkrip rata, dua baris itu bertindan bersama dan kebimbangan harga kelihatan seolah-olah datang daripada orang yang bercakap tentang tarikh.

Dengan label, saat yang sama dibaca dengan jelas:

Speaker 2 (中文): 这个价格我们还要再商量。
Terjemahan: Kami masih perlu membincangkan harga ini.
Speaker 3 (English): Right, and the timeline works for our Q4 launch.

Sekarang kebimbangan harga itu jelas diatribusi kepada orang yang membangkitkannya, dan anda boleh menjawab isu yang betul dengan orang yang betul. Atribusi bukan sekadar perkara kecil di sini. Ia mengubah apa yang anda katakan seterusnya.

Cara Terjemahan Langsung Berbilang Penutur Berfungsi dalam MirrorCaption

MirrorCaption berjalan sebagai aplikasi web, jadi tiada klien untuk dipasang dan tiada bot mesyuarat untuk diluluskan. Aliran untuk panggilan berbilang penutur adalah ringkas:

  1. Buka MirrorCaption dalam Chrome desktop atau Microsoft Edge dan mulakan mod Meet.
  2. Kongsi tab mesyuarat supaya MirrorCaption menangkap audio panggilan (serta mikrofon anda sendiri).
  3. Pengesanan penutur memisahkan suara dan menandainya Speaker 1, Speaker 2, Speaker 3.
  4. Setiap giliran muncul dengan teks asal di sebelah terjemahannya dalam bahasa pilihan anda.
  5. Namakan semula penutur kepada nama sebenar, kemudian cari, eksport, atau ringkaskan transkrip.

Pengesanan penutur automatik (Speaker 1, Speaker 2, namakan semula mereka)

Lapisan transkripsi langsung mengenal pasti suara yang berbeza dan melabelkannya secara automatik. Anda tidak perlu menandakan sesiapa terlebih dahulu. Apabila anda mengenali sesuatu suara, klik label itu dan namakan semula, dan nama itu digunakan pada keseluruhan transkrip. Selepas itu, setiap giliran daripada orang itu diatribusi kepada mereka dengan nama.

Asal dan terjemahan bersebelahan, bagi setiap penutur

MirrorCaption mengekalkan teks asal dan terjemahan bersama-sama dan bukannya menggantikan satu dengan yang lain, jadi nuansa tidak pernah hilang. Ambil contoh dwibahasa klasik: seorang klien Jepun berkata 「ちょっと難しいです」. Terjemahan literal berbunyi "sedikit sukar," yang betul dari segi linguistik dan secara komersial ialah penolakan lembut. Oleh sebab sumber berada di sebelah terjemahan, anda boleh mengetik mana-mana perkataan untuk melihat asal dan membaca situasi dengan tepat. Untuk lebih lanjut tentang sejauh mana ketepatan terjemahan ini, lihat penerangan kami tentang sejauh mana tepatnya terjemahan masa nyata.

Speak Translations pilihan, balas dengan suara merentas bahasa

Membaca tidak selalu mencukupi. Dengan Speak Translations, MirrorCaption boleh membacakan pertuturan terjemahan anda dengan kuat dalam bahasa sasaran dengan pemasaan hampir masa nyata. Bercakap dalam bahasa Inggeris, dan pihak satu lagi mendengar bahasa Jepun; bercakap Mandarin, dan mereka mendengar bahasa Inggeris. Audio boleh dimainkan melalui pembesar suara komputer riba anda, pembesar suara telefon yang dipasangkan, atau, pada klien Mac, mikrofon maya yang menghala masuk ke Zoom, Meet, atau Teams. Itu menukar transkrip berlabel menjadi pertukaran dua hala yang sebenar di mana setiap pihak terus bercakap dalam bahasa sendiri.

Sudah bersedia untuk menguji perbezaannya pada panggilan berbilang bahasa yang sebenar? Mula percuma dan labelkan mesyuarat pertama anda dalam beberapa minit.

Di Mana Pengesanan Penutur Menjadi Sukar (Had yang Jujur)

Tiada sistem langsung yang memisahkan suara dengan sempurna pada audio yang bersepah, dan adalah tidak jujur untuk mendakwa sebaliknya. Beberapa situasi memang benar-benar sukar.

Gangguan silang. Apabila dua orang bercakap serentak, audio bertindih dan sempadan antara giliran menjadi kabur. Label mungkin lewat atau bergabung sehingga satu suara selesai.

Suara yang hampir serupa. Dua penutur dengan nada dan loghat yang serupa, pada mikrofon yang sama, sukar dibezakan, untuk perisian dan kadangkala untuk manusia.

Persediaan mikrofon yang lemah. Satu mikrofon komputer riba yang menangkap seluruh bilik mesyuarat memberi pengesan kurang bahan untuk bekerja berbanding peranti berasingan.

Yang membantu dalam amalan: biarkan giliran selesai daripada memotong, gunakan mikrofon berasingan jika boleh, dan bergantung pada audio tab mesyuarat yang bersih dan bukannya mikrofon bilik. Ini ialah keadaan yang sama yang meningkatkan ketepatan bagi mana-mana alat, seperti yang dihuraikan dengan lebih terperinci dalam panduan transkripsi berbilang bahasa kami.

Terjemahan Berbilang Penutur Merentas Platform, Tanpa Bot

Oleh sebab MirrorCaption menangkap audio pelayar dan bukannya menyertai mesyuarat, ia berfungsi bersama alat yang hos anda sudah pilih. Dalam Chrome atau Edge desktop, mod Meet menangkap tab mesyuarat untuk panggilan Zoom, Microsoft Teams, Google Meet, dan Webex berasaskan pelayar. Tiada siapa perlu menerima bot, dan tiada audio mesyuarat disimpan pada pelayan, hanya transkrip yang anda pilih untuk simpan secara setempat.

Untuk perbualan bersemuka berbilang pihak, mod Talk pada telefon berjalan sebagai satu sesi berterusan. Anda memulakannya sekali dan membiarkan orang bercakap secara bergilir; ia bukan tekan-untuk-cakap dan tidak menetap semula selepas setiap ayat. Itu menjadikannya sesuai untuk perbincangan meja bulat di meja, bukan sekadar carian frasa satu ungkapan.

Berikut ialah perbandingan pendekatan biasa untuk tugas khusus melabel suara dan menterjemahkan giliran secara langsung:

Pendekatan Label penutur Terjemahan langsung Semasa panggilan Tanpa bot Bahasa
Kapsyen asli platform (Zoom, Teams, Meet) Bergantung pada platform Selalunya bergantung pada tahap pelan Ya, dalam kapsyen Terbina dalam, tetapi terkunci pada platform itu Ditentukan oleh vendor dan pelan
API STT / diarization (alat pembangun) Ya, kukuh Bergantung pada penyedia Langsung atau pasca-pemprosesan, bergantung pada pelaksanaan N/A, memerlukan kod Bergantung pada penyedia dan model
MirrorCaption Ya, automatik dan boleh dinamakan semula Ya, bersebelahan Ya, semasa ia dituturkan Ya, tangkapan tab pelayar 50+ boleh dipilih

Tujuannya bukan untuk mengatakan alat lain buruk. Kapsyen platform memang mudah dalam lingkungan mereka sendiri, dan API diarization sangat baik untuk membina saluran paip tersuai. MirrorCaption mengisi jurang khusus bagi giliran yang dilabel dan diterjemah, secara langsung, merentas apa sahaja alat berasaskan pelayar yang digunakan oleh pasukan anda.

Situasi Sebenar Di Mana Ia Berbaloi

Berikut ialah aliran kerja ilustratif, bukan testimoni pelanggan.

Mesyuarat seluruh pasukan berbilang bahasa. Bayangkan sebuah pasukan teragih di mana Maria di São Paulo, Wei di Shenzhen, dan Anna di Berlin semuanya menyertai standup. Daripada memaksa semua orang menggunakan bahasa Inggeris, setiap orang membaca mesyuarat dalam bahasa mereka sendiri, dengan setiap giliran diatribusi. Mereka yang masuk lewat membuka ringkasan yang sedang berjalan dan mengejar dalam satu bacaan. Ini ialah kes harian untuk terjemahan masa nyata untuk pasukan jauh.

Rundingan rentas sempadan. Pertimbangkan panggilan pembekal dengan dua orang di pihak vendor bercakap Mandarin dan dua pembeli bercakap Inggeris. Apabila Speaker 2 menandakan risiko penghantaran sementara Speaker 1 masih bercakap tentang terma, label memastikan dua aliran itu berasingan, jadi pembeli menjawab risiko itu kepada orang yang betul dan bukannya bercakap melepasi isu tersebut.

Bilik darjah berbilang bahasa. Bayangkan seminar dalam talian di mana seorang pelajar berbahasa Korea bertanya soalan semasa kuliah dalam bahasa Inggeris. Transkrip yang dilabel dan diterjemah membolehkan pengajar melihat siapa bertanya apa dan membalas dengan tepat, dan pelajar itu menyimpan rekod bersebelahan untuk belajar kemudian.

Soalan Lazim

Apa itu terjemahan langsung berbilang penutur?

Terjemahan langsung berbilang penutur ialah sistem masa nyata yang melakukan dua tugas serentak: ia memisahkan dan melabelkan setiap suara dalam perbualan, dan ia menterjemahkan setiap giliran ke dalam bahasa pilihan anda semasa orang masih bercakap, supaya anda boleh melihat siapa berkata apa ketika ia berlaku.

Bolehkah saya menterjemah mesyuarat dengan beberapa penutur tanpa bot?

Ya. MirrorCaption berjalan dalam tab pelayar anda dan menangkap audio mesyuarat secara langsung dalam Chrome desktop atau Microsoft Edge, jadi tiada bot menyertai panggilan. Ia melabelkan setiap suara dan menterjemahkan setiap giliran semasa mesyuarat, dan tiada audio mesyuarat disimpan pada pelayan.

Bagaimana pengesanan penutur membezakan suara?

Pengesanan penutur memisahkan suara yang berbeza dalam audio dan melabelkannya sebagai Speaker 1, Speaker 2, dan seterusnya, yang boleh anda namakan semula. Ia berfungsi paling baik dengan audio yang jelas dan mikrofon berasingan. Gangguan silang yang berat atau suara yang hampir serupa menyukarkan tugas ini.

Bolehkah pihak satu lagi mendengar terjemahan, bukan sekadar membacanya?

Ya. Speak Translations boleh membacakan pertuturan terjemahan anda dengan kuat dalam bahasa sasaran dengan pemasaan hampir masa nyata, melalui pembesar suara komputer riba, pembesar suara telefon yang dipasangkan, atau mikrofon maya Mac, supaya pertukaran terus bergerak tanpa menunggu transkrip selepas mesyuarat.

Berapa banyak bahasa yang disokong oleh terjemahan langsung berbilang penutur?

MirrorCaption menawarkan 50+ bahasa yang boleh dipilih, dua hala, termasuk Mandarin, Jepun, Korea, Sepanyol, Perancis, Jerman, dan banyak lagi. Setiap giliran yang dilabel muncul bersebelahan dengan terjemahannya, dan anda boleh mengetik mana-mana perkataan untuk melihat asal.

Kesimpulan

Terjemahan langsung berbilang penutur ialah tugas gabungan: labelkan setiap suara, terjemahkan setiap giliran, dan lakukan kedua-duanya semasa perbualan masih berlangsung. Terjemahan sahaja memberitahu anda apa yang dikatakan. Menambah label penutur memberitahu anda siapa yang mengatakannya, yang sebenarnya membolehkan anda membalas, memetik, dan membuat keputusan pada saat itu juga.

Untuk mencapainya, gunakan audio tab mesyuarat dalam Chrome atau Edge, biarkan pengesanan penutur menandakan suara, namakan semula mereka, dan baca asal di sebelah terjemahan. Apabila membaca tidak mencukupi, hidupkan Speak Translations supaya pihak satu lagi boleh mendengar mesej dan terus bercakap. Dan apabila audionya bersepah, ingat bahawa mikrofon yang lebih bersih dan giliran yang tidak tergesa-gesa membantu setiap alat, termasuk alat kami.

Labelkan Setiap Suara, Terjemahkan Setiap Giliran

Mula dengan satu jam percuma. Tiada kad kredit, tiada tetapan semula bulanan, tiada apa-apa untuk dipasang. Lihat siapa berkata apa, secara langsung, dalam bahasa anda.

Get Started Free