একাধিক বক্তার লাইভ অনুবাদ একসঙ্গে দুটি কাজ করে: এটি ঘরে থাকা প্রতিটি কণ্ঠকে শনাক্ত করে এবং মানুষ কথা বলতেই প্রতিটি পালা আপনার ভাষায় অনুবাদ করে। MirrorCaption ব্রাউজারের ভেতরেই এই দুটো কাজ করে, ৫০+টি বাছাইযোগ্য ভাষায়, এবং কলে কোনো বট যোগ দেয় না। মিটিং শেষ হওয়ার দশ মিনিট পরে নয়, কথা বলার সময়ই আপনি দেখেন কে কী বলল।
চারজনের একটি কল কল্পনা করুন। লন্ডনের একজন ইংরেজিভাষী PM, সাংহাইয়ের একজন ডেভেলপার যিনি ম্যান্ডারিনে কথা বলছেন, টোকিওর একজন ক্লায়েন্ট যিনি জাপানিতে কথা বলছেন, আর একজন ডিজাইনার যিনি এই দুজনের মধ্যে ভাষা বদলাচ্ছেন। সবাই কথা বলছে। আপনার ট্রান্সক্রিপ্ট হলো তিনটি ভাষায় উৎসহীন লেখার এক দেয়াল। আপনি জানেন কিছু গুরুত্বপূর্ণ বলা হয়েছে, কিন্তু কে বলেছে বা ঠিক কী বোঝাতে চেয়েছে তা জানেন না।
এই গাইড সেই ফাঁকটাই পূরণ করে। স্পিকার লেবেল ছাড়া অনুবাদ আপনাকে বলে কী বলা হয়েছে। একাধিক বক্তার লাইভ অনুবাদ আপনাকে বলে কে বলেছে, আপনার ভাষায়, রিয়েল টাইমে। নিচে আমরা দেখাবো এটি কী, লেবেল কেন গুরুত্বপূর্ণ, MirrorCaption-এ এটি কীভাবে কাজ করে, প্রযুক্তিটি কোথায় সত্যিই হোঁচট খায়, এবং বট ছাড়াই কীভাবে বিভিন্ন প্ল্যাটফর্মে এটি চালাতে হয়।
- একাধিক বক্তার লাইভ অনুবাদ দুটি কাজ একসঙ্গে করে, প্রতিটি কণ্ঠ আলাদা করে এবং প্রতিটি পালা অনুবাদ করে, এবং এটি মিটিং চলাকালেই করে, পরে নয়।
- স্পিকার লেবেল অনূদিত লেখার দেয়ালকে এমন একটি কে-কী-বলল রেকর্ডে বদলে দেয়, যেটি আপনি কাজে লাগাতে, উদ্ধৃত করতে এবং খুঁজতে পারেন।
- MirrorCaption কণ্ঠগুলোকে Speaker 1, Speaker 2, Speaker 3 হিসেবে লেবেল করে (ইচ্ছেমতো নাম বদলাতে পারেন) এবং ৫০+ ভাষায় অনুবাদের পাশে মূল লেখা দেখায়, কলে কোনো বট ছাড়াই।
- অতিরিক্ত ক্রস-টক এবং প্রায় একই রকম কণ্ঠ যেকোনো লাইভ সিস্টেমের জন্য কঠিন; আলাদা মাইক্রোফোন এবং পরিষ্কার মিটিং-ট্যাব অডিও সবচেয়ে বেশি সাহায্য করে।
- Premium হলো ৯৯ ইউরো এককালীন (একবার পেমেন্ট, কোনো পুনরাবৃত্ত সাবস্ক্রিপশন নেই), এতে ২০০ ঘণ্টার হোস্টেড ট্রান্সক্রিপশন ক্রেডিট এবং ভবিষ্যতের সব আপডেট অন্তর্ভুক্ত।
একাধিক বক্তার লাইভ অনুবাদ কী?
একাধিক বক্তার লাইভ অনুবাদ হলো একটি রিয়েল-টাইম সিস্টেম, যা কথোপকথনের প্রতিটি কণ্ঠ আলাদা করে এবং লেবেল দেয়, আর মানুষ কথা বলতেই প্রতিটি পালা আপনার পছন্দের ভাষায় অনুবাদ করে। এটি স্পিকার শনাক্তকরণ এবং অনুবাদ—এই দুই কাজকে এক লাইভ স্ট্রিমে একত্র করে, যাতে আপনি বহুভাষিক, বহু-ব্যক্তির কথোপকথন ঘটতে ঘটতেই অনুসরণ করতে পারেন।
বেশিরভাগ টুলের একটিমাত্র দিক ভালোভাবে কাজ করে। প্ল্যাটফর্ম ক্যাপশন অনুবাদ করে, কিন্তু ভাষা জুড়ে পালাগুলো খুব কমই স্পষ্টভাবে কার বলে চিহ্নিত করে। ডেভেলপার ট্রান্সক্রিপশন টুল কণ্ঠ আলাদা করে, কিন্তু আপলোড করা রেকর্ডিংয়ে, আগে ইংরেজিতে, পরে কাজ করে। লেবেল + অনুবাদ + কল চলাকালীন—এই সম্মিলিত কাজটাই প্রায় কেউ সমাধান করে না। আপনি যদি এই ক্যাটাগরির আরও বিস্তৃত চিত্র চান, তাহলে আমাদের সেরা রিয়েল-টাইম মিটিং অনুবাদক টুলগুলোর রাউন্ডআপ পুরো ক্ষেত্রটি কভার করে।
স্পিকার লেবেল বনাম স্পিকার ডায়ারাইজেশন
আপনি দুটি শব্দ ঢিলেঢালা ভাবে ব্যবহার হতে দেখবেন। স্পিকার ডায়ারাইজেশন হলো প্রযুক্তিগত প্রক্রিয়া, যেখানে অডিওকে “কে কখন বলেছে” অনুযায়ী ভাগ করা হয়—NIST-এর Rich Transcription evaluations-এ বর্ণিত একটি কাজ। স্পিকার লেবেল হলো মানুষের জন্য দৃশ্যমান ফল: Speaker 1 এবং Speaker 2-এর মতো ট্যাগ, যেগুলো আপনি “Priya” বা “Kenji”-তে বদলাতে পারেন।
ডায়ারাইজেশন হলো ইঞ্জিন। লেবেল হলো ড্যাশবোর্ড। একটি মিটিংয়ের জন্য আপনি ড্যাশবোর্ডটাই চান: প্রতিটি পালার একটি পরিষ্কার, পড়তে সহজ রেকর্ড, যেখানে কার বলা এবং অনুবাদ—দুটোই থাকে। ক্যাপশনে স্পিকার পরিচয় যোগ করাও একটি ভালো অ্যাক্সেসিবিলিটি অনুশীলন, যেমন W3C-এর ক্যাপশন নির্দেশিকা বলছে, যারা কেবল কণ্ঠের ওপর ভরসা করে মানুষকে আলাদা করতে পারেন না তাদের জন্য।
মিটিং অনুবাদ করার সময় স্পিকার লেবেল কেন গুরুত্বপূর্ণ
একভাষিক মিটিংয়ে আপনি প্রায়ই নিজেই কণ্ঠ আলাদা করতে পারেন। বহুভাষিক মিটিংয়ে আপনি ইতিমধ্যেই অনুবাদ পড়তে পরিশ্রম করছেন, তাই কার বলা তা প্রথমেই ফসকে যায়। আর ঠিক তখনই এটি সবচেয়ে গুরুত্বপূর্ণ।
লেবেল তিনটি জিনিস বদলে দেয়। প্রথমত, সিদ্ধান্ত গ্রহণ: কে আপত্তি তুলেছে তা জানা থাকলে বোঝা যায় কার উদ্বেগ সমাধান করতে হবে এবং সেটির গুরুত্ব কতটা। দ্বিতীয়ত, খোঁজযোগ্য রেকর্ড: কে কী বলেছে এমন ট্রান্সক্রিপ্ট আপনাকে “ক্লায়েন্ট সময়সূচি নিয়ে যা বলেছে সব” অংশে সরাসরি যেতে দেয়। তৃতীয়ত, পরিষ্কার হ্যান্ডঅফ: সীমান্তপারের বিক্রয় ও আইনগত টিমের দরকার হুবহু, কার বলা এমন উদ্ধৃতি, সারসংক্ষেপ নয়, ঝাপসা বর্ণনা নয়।
উৎসহীন অনূদিত ট্রান্সক্রিপ্টের সমস্যা
এখানে দেখুন কেন লেবেলবিহীন ট্রান্সক্রিপ্ট বাস্তবে ব্যর্থ হয়। ধরুন Speaker 2, ম্যান্ডারিনে কথা বলে, দাম নিয়ে উদ্বেগ জানাচ্ছে, আর একই সময় Speaker 3 ইংরেজিতে সময়সূচি নিয়ে একটি বাক্য শেষ করছে। একটি সমতল ট্রান্সক্রিপ্টে এই দুই লাইন একসঙ্গে জমে যায়, আর দামের উদ্বেগটি মনে হয় যেন সেটি তারই, যে তারিখ নিয়ে কথা বলছিল।
লেবেল থাকলে, একই মুহূর্তটি পরিষ্কারভাবে পড়া যায়:
অনুবাদ: এই দাম নিয়ে আমাদের আরও আলোচনা করতে হবে।
এখন দামের উদ্বেগটি স্পষ্টভাবে সেই ব্যক্তির নামে যুক্ত, যিনি এটি তুলেছেন, এবং আপনি সঠিক ব্যক্তির সঙ্গে সঠিক বিষয় নিয়ে উত্তর দিতে পারেন। এখানে attribution কোনো বাড়তি সৌজন্য নয়। এটি আপনি এরপর কী বলবেন, সেটাই বদলে দেয়।
MirrorCaption-এ একাধিক বক্তার লাইভ অনুবাদ কীভাবে কাজ করে
MirrorCaption একটি ওয়েব অ্যাপ হিসেবে চলে, তাই কোনো ক্লায়েন্ট ইনস্টল করতে হয় না এবং কোনো মিটিং বট অনুমোদনও করতে হয় না। একাধিক বক্তার কলের জন্য প্রক্রিয়াটি সংক্ষিপ্ত:
- ডেস্কটপ Chrome বা Microsoft Edge-এ MirrorCaption খুলে Meet mode শুরু করুন।
- মিটিং ট্যাব শেয়ার করুন, যাতে MirrorCaption কলের অডিও (এবং আপনার নিজের মাইক) ক্যাপচার করতে পারে।
- স্পিকার শনাক্তকরণ কণ্ঠগুলো আলাদা করে Speaker 1, Speaker 2, Speaker 3 হিসেবে ট্যাগ করে।
- প্রতিটি পালা আপনার নির্বাচিত ভাষায় অনুবাদের পাশে মূল লেখাসহ দেখা যায়।
- স্পিকারদের আসল নামে বদলান, তারপর ট্রান্সক্রিপ্ট খুঁজুন, এক্সপোর্ট করুন, বা সারসংক্ষেপ করুন।
স্বয়ংক্রিয় স্পিকার শনাক্তকরণ (Speaker 1, Speaker 2, নাম বদলান)
লাইভ ট্রান্সক্রিপশন স্তরটি আলাদা কণ্ঠ শনাক্ত করে এবং স্বয়ংক্রিয়ভাবে লেবেল দেয়। আপনাকে আগে থেকে কাউকে ট্যাগ করতে হয় না। কোনো কণ্ঠ চিনতে পারলে লেবেলে ক্লিক করে নাম বদলান, এবং সেই নাম পুরো ট্রান্সক্রিপ্ট জুড়ে প্রযোজ্য হয়। এরপর থেকে, ওই ব্যক্তির প্রতিটি পালা তার নামেই চিহ্নিত হয়।
পাশাপাশি মূল লেখা ও অনুবাদ, প্রতিটি স্পিকারের জন্য
MirrorCaption মূল লেখা এবং অনুবাদকে একসঙ্গে রাখে, একটিকে আরেকটির জায়গায় বসায় না, তাই সূক্ষ্মতা কখনো হারায় না। ক্লাসিক দ্বিভাষিক উদাহরণটি ধরুন: একজন জাপানি ক্লায়েন্ট বলেন 「ちょっと難しいです」। আক্ষরিক অনুবাদ হলো “একটু কঠিন,” যা ভাষাগতভাবে সঠিক এবং বাণিজ্যিকভাবে নরম না। যেহেতু উৎস লেখা অনুবাদের পাশে থাকে, আপনি যেকোনো শব্দে ট্যাপ করে মূলটি দেখতে পারেন এবং পরিস্থিতি ঠিকভাবে বুঝতে পারেন। এই রূপান্তরগুলো কতটা নির্ভুল, তা নিয়ে আরও জানতে আমাদের রিয়েল-টাইম অনুবাদ কতটা সঠিক ব্যাখ্যাটি দেখুন।
ঐচ্ছিক Speak Translations, ভাষা পেরিয়ে জোরে উত্তর দিন
শুধু পড়া সব সময় যথেষ্ট নয়। Speak Translations-এর মাধ্যমে MirrorCaption আপনার অনূদিত বক্তব্যকে লক্ষ্য ভাষায় প্রায় রিয়েল-টাইম টাইমিংসহ জোরে পড়ে শোনাতে পারে। আপনি ইংরেজিতে বললে, অন্যপক্ষ জাপানি শোনে; আপনি ম্যান্ডারিনে বললে, তারা ইংরেজি শোনে। অডিওটি আপনার ল্যাপটপ স্পিকার, একটি পেয়ার করা ফোন স্পিকার, অথবা Mac ক্লায়েন্টে একটি ভার্চুয়াল মাইক্রোফোনের মাধ্যমে বাজতে পারে, যা সেটিকে Zoom, Meet, বা Teams-এ পাঠায়। এতে লেবেলযুক্ত ট্রান্সক্রিপ্ট একটি সত্যিকারের দ্বিমুখী কথোপকথনে পরিণত হয়, যেখানে প্রতিটি পক্ষ নিজের ভাষাতেই কথা বলতে থাকে।
স্পিকার শনাক্তকরণ কোথায় কঠিন হয় (সৎ সীমাবদ্ধতা)
কোনো লাইভ সিস্টেমই বিশৃঙ্খল অডিওতে কণ্ঠ নিখুঁতভাবে আলাদা করতে পারে না, আর তা দাবি করা অসৎ হবে। কিছু পরিস্থিতি সত্যিই কঠিন।
ক্রস-টক। যখন দুইজন একসঙ্গে কথা বলেন, অডিও ওভারল্যাপ করে এবং পালার সীমানা ঝাপসা হয়ে যায়। একটি কণ্ঠ পরিষ্কার না হওয়া পর্যন্ত লেবেল দেরি করতে পারে বা মিশে যেতে পারে।
প্রায় একই রকম কণ্ঠ। একই মাইকে, একই ধরনের পিচ ও উচ্চারণের দুই বক্তাকে সফটওয়্যারের জন্য, আর কখনো কখনো মানুষের জন্যও, আলাদা করা কঠিন।
দুর্বল মাইক সেটআপ। একটি ল্যাপটপ মাইক যদি পুরো কনফারেন্স রুম ধরতে চায়, তবে আলাদা ডিভাইসের তুলনায় ডিটেক্টরের কাজ করার মতো তথ্য কম থাকে।
বাস্তবে যা সাহায্য করে: পালা শেষ হতে দিন, মাঝপথে বাধা দেবেন না, যেখানে সম্ভব আলাদা মাইক্রোফোন ব্যবহার করুন, এবং রুম মাইকের বদলে পরিষ্কার মিটিং-ট্যাব অডিওর ওপর ভরসা করুন। এগুলোই সেই শর্ত, যা যেকোনো টুলের নির্ভুলতা বাড়ায়, যেমন আমাদের বহুভাষিক ট্রান্সক্রিপশন গাইড-এ আরও বিস্তারিত বলা হয়েছে।
বট ছাড়াই বিভিন্ন প্ল্যাটফর্মে একাধিক বক্তার অনুবাদ
MirrorCaption ব্রাউজারের অডিও ক্যাপচার করে, মিটিংয়ে যোগ দেয় না বলে এটি হোস্ট ইতিমধ্যেই যে টুল বেছে নিয়েছেন তার সঙ্গে পাশাপাশি কাজ করে। ডেস্কটপ Chrome বা Edge-এ Meet mode ব্রাউজারভিত্তিক Zoom, Microsoft Teams, Google Meet, এবং Webex কলের জন্য মিটিং ট্যাব ক্যাপচার করে। কাউকে বটকে অনুমতি দিতে হয় না, এবং কোনো মিটিং অডিও সার্ভারে সংরক্ষিত হয় না—শুধু আপনি যেসব ট্রান্সক্রিপ্ট লোকালি সেভ করতে চান সেগুলোই থাকে।
সামনাসামনি, বহু-পক্ষের কথোপকথনের জন্য ফোনে Talk mode একটানা সেশন হিসেবে চলে। আপনি একবার শুরু করেন এবং মানুষকে পালা করে কথা বলতে দেন; এটি push-to-talk নয় এবং প্রতিটি বাক্যের পরে রিসেট হয় না। তাই এটি টেবিলের চারপাশে গোলটেবিল আলোচনার জন্য উপযুক্ত, শুধু এক-ফ্রেজের phrasebook খোঁজার জন্য নয়।
কণ্ঠ লেবেল করা এবং পালা লাইভ অনুবাদ করার নির্দিষ্ট কাজের জন্য সাধারণ পদ্ধতিগুলো কীভাবে তুলনা হয়, তা এখানে দেখুন:
| পদ্ধতি | স্পিকার লেবেল | লাইভ অনুবাদ | কল চলাকালীন | বট নেই | ভাষা |
|---|---|---|---|---|---|
| প্ল্যাটফর্ম-নেটিভ ক্যাপশন (Zoom, Teams, Meet) | প্ল্যাটফর্মভেদে ভিন্ন | প্রায়ই প্ল্যান টিয়ার দ্বারা সীমাবদ্ধ | হ্যাঁ, ক্যাপশনে | বিল্ট-ইন, তবে সেই প্ল্যাটফর্মেই সীমাবদ্ধ | ভেন্ডর ও প্ল্যান অনুযায়ী নির্ধারিত |
| STT / ডায়ারাইজেশন API (ডেভেলপার টুল) | হ্যাঁ, শক্তিশালী | প্রোভাইডারভেদে ভিন্ন | ইমপ্লিমেন্টেশনের ওপর নির্ভর করে লাইভ বা পোস্ট-প্রসেসিং | N/A, কোড দরকার | প্রোভাইডার ও মডেলভেদে ভিন্ন |
| MirrorCaption | হ্যাঁ, স্বয়ংক্রিয় এবং নাম বদলানো যায় | হ্যাঁ, পাশাপাশি | হ্যাঁ, কথা বলার সঙ্গে সঙ্গেই | হ্যাঁ, ব্রাউজার-ট্যাব ক্যাপচার | ৫০+টি বাছাইযোগ্য |
বিষয়টি এই নয় যে অন্য টুলগুলো খারাপ। প্ল্যাটফর্ম ক্যাপশন তাদের নিজস্ব পরিসরে সুবিধাজনক, আর ডায়ারাইজেশন API কাস্টম পাইপলাইন তৈরির জন্য চমৎকার। MirrorCaption সেই নির্দিষ্ট ফাঁকটি পূরণ করে, যেখানে লেবেলযুক্ত, অনূদিত পালা লাইভে, আপনার টিম যে ব্রাউজারভিত্তিক টুলই ব্যবহার করুক না কেন, দরকার হয়।
বাস্তব পরিস্থিতি যেখানে এটি সত্যিই কাজে লাগে
নিচেরগুলো উদাহরণমূলক ওয়ার্কফ্লো, গ্রাহক-প্রশংসাপত্র নয়।
বহুভাষিক অল-হ্যান্ডস। কল্পনা করুন একটি বিতরণকৃত টিম, যেখানে São Paulo-র Maria, Shenzhen-এর Wei, আর Berlin-এর Anna সবাই একটি standup-এ যোগ দেয়। সবাইকে ইংরেজিতে বাধ্য করার বদলে, প্রত্যেকে নিজের ভাষায় মিটিং পড়ে, আর প্রতিটি পালা কার বলা তা চিহ্নিত থাকে। দেরিতে যোগ দেওয়া লোকেরা চলমান সারসংক্ষেপ খুলে একবার পড়েই আপডেট হয়ে যায়। এটি রিমোট টিমের জন্য রিয়েল-টাইম অনুবাদ-এর দৈনন্দিন ব্যবহার।
সীমান্তপারের আলোচনা। ধরুন একজন সরবরাহকারীর কল, যেখানে ভেন্ডর সাইডে দুজন ম্যান্ডারিনে কথা বলছেন এবং দুইজন ক্রেতা ইংরেজিতে কথা বলছেন। Speaker 2 যখন ডেলিভারি ঝুঁকির কথা বলছে, আর Speaker 1 তখনও শর্ত নিয়ে কথা বলছে, লেবেলগুলো দুইটি ধারাকে আলাদা রাখে, ফলে ক্রেতা সঠিক ব্যক্তির কাছে ঝুঁকির উত্তর দেয়, বিষয়টি এড়িয়ে যায় না।
বহুভাষিক শ্রেণিকক্ষ। ভাবুন একটি অনলাইন সেমিনার, যেখানে একজন কোরিয়ানভাষী শিক্ষার্থী ইংরেজি লেকচারের সময় একটি প্রশ্ন করে। লেবেলযুক্ত, অনূদিত ট্রান্সক্রিপ্ট শিক্ষককে দেখায় কে কী জিজ্ঞেস করেছে এবং নির্ভুলভাবে উত্তর দিতে সাহায্য করে, আর শিক্ষার্থীর কাছে পরে পড়ার জন্য পাশাপাশি রেকর্ড থাকে।
প্রায়শই জিজ্ঞাসিত প্রশ্ন
একাধিক বক্তার লাইভ অনুবাদ কী?
একাধিক বক্তার লাইভ অনুবাদ হলো একটি রিয়েল-টাইম সিস্টেম, যা একসঙ্গে দুটি কাজ করে: এটি কথোপকথনের প্রতিটি কণ্ঠ আলাদা করে এবং লেবেল দেয়, আর মানুষ কথা বলতেই প্রতিটি পালা আপনার পছন্দের ভাষায় অনুবাদ করে, যাতে ঘটতে ঘটতেই আপনি দেখতে পারেন কে কী বলেছে।
বট ছাড়াই কি আমি একাধিক বক্তার মিটিং অনুবাদ করতে পারি?
হ্যাঁ। MirrorCaption আপনার ব্রাউজার ট্যাবে চলে এবং ডেস্কটপ Chrome বা Microsoft Edge-এ সরাসরি মিটিং অডিও ক্যাপচার করে, তাই কোনো বট কলে যোগ দেয় না। এটি মিটিং চলাকালীন প্রতিটি কণ্ঠ লেবেল করে এবং প্রতিটি পালা অনুবাদ করে, এবং কোনো মিটিং অডিও সার্ভারে সংরক্ষিত হয় না।
স্পিকার শনাক্তকরণ কীভাবে কণ্ঠ আলাদা করে?
স্পিকার শনাক্তকরণ অডিওতে আলাদা কণ্ঠগুলো আলাদা করে এবং তাদের Speaker 1, Speaker 2, ইত্যাদি হিসেবে লেবেল দেয়, যেগুলো আপনি নাম বদলাতে পারেন। এটি পরিষ্কার অডিও এবং আলাদা মাইক্রোফোনে সবচেয়ে ভালো কাজ করে। অতিরিক্ত ক্রস-টক বা প্রায় একই রকম কণ্ঠ কাজটিকে কঠিন করে তোলে।
অন্যপক্ষ কি শুধু পড়বে না, অনুবাদ শুনতেও পারবে?
হ্যাঁ। Speak Translations আপনার অনূদিত বক্তব্যকে লক্ষ্য ভাষায় প্রায় রিয়েল-টাইম টাইমিংসহ জোরে পড়ে শোনাতে পারে, ল্যাপটপ স্পিকার, পেয়ার করা ফোন স্পিকার, বা Mac ভার্চুয়াল মাইক্রোফোনের মাধ্যমে, যাতে মিটিং-পরবর্তী ট্রান্সক্রিপ্টের জন্য অপেক্ষা না করেই কথোপকথন এগিয়ে চলে।
একাধিক বক্তার লাইভ অনুবাদ কতগুলো ভাষা সমর্থন করে?
MirrorCaption ৫০+টি বাছাইযোগ্য ভাষা দেয়, দ্বিমুখীভাবে, যার মধ্যে ম্যান্ডারিন, জাপানি, কোরিয়ান, স্প্যানিশ, ফরাসি, জার্মান, এবং আরও অনেক কিছু আছে। প্রতিটি লেবেলযুক্ত পালা তার অনুবাদের পাশে পাশাপাশি দেখা যায়, এবং আপনি যেকোনো শব্দে ট্যাপ করে মূলটি দেখতে পারেন।
সারকথা
একাধিক বক্তার লাইভ অনুবাদ হলো সম্মিলিত কাজ: প্রতিটি কণ্ঠ লেবেল করা, প্রতিটি পালা অনুবাদ করা, এবং কথোপকথন চলতেই থাকা অবস্থায় দুটোই করা। শুধু অনুবাদ আপনাকে বলে কী বলা হয়েছে। স্পিকার লেবেল যোগ করলে বোঝা যায় কে বলেছে, আর সেটাই আপনাকে মুহূর্তেই উত্তর দিতে, উদ্ধৃত করতে, এবং সিদ্ধান্ত নিতে সাহায্য করে।
এখানে পৌঁছাতে Chrome বা Edge-এ মিটিং-ট্যাব অডিও ব্যবহার করুন, স্পিকার শনাক্তকরণকে কণ্ঠগুলো ট্যাগ করতে দিন, সেগুলোর নাম বদলান, এবং অনুবাদের পাশে মূলটি পড়ুন। শুধু পড়া যথেষ্ট না হলে Speak Translations চালু করুন, যাতে অন্যপক্ষ বার্তাটি শুনতে পারে এবং কথা চালিয়ে যেতে পারে। আর যেখানে অডিও এলোমেলো, মনে রাখবেন পরিষ্কার মাইক এবং তাড়াহুড়ো না করা পালা প্রতিটি টুলকেই সাহায্য করে, আমাদেরটিকেও।
প্রতিটি কণ্ঠ লেবেল করুন, প্রতিটি পালা অনুবাদ করুন
এক ঘণ্টা ফ্রি দিয়ে শুরু করুন। কোনো ক্রেডিট কার্ড নয়, কোনো মাসিক রিসেট নয়, কিছু ইনস্টল করতে হবে না। কে কী বলল, লাইভে, আপনার ভাষায় দেখুন।
ফ্রি শুরু করুন