Loading...
मेटा ने लॉन्च किया पहला रियल-टाइम ऑडियो AI मॉडल, क्या है खासियत?
मेटा ने लॉन्च किया पहला रियल-टाइम ऑडियो AI मॉडल

मेटा ने लॉन्च किया पहला रियल-टाइम ऑडियो AI मॉडल, क्या है खासियत?

Sep 02, 2026
03:10 pm

क्या है खबर?

मेटा ने अपना पहला रियल-टाइम ऑडियो आर्टिफिशियल इंटेलिजेंस (AI) मॉडल लॉन्च किया है। म्यूज वॉयस ट्रांसक्राइब नाम का यह मॉडल बातचीत के दौरान आवाज को तुरंत टेक्स्ट में बदल सकता है। कंपनी के मुताबिक यह 70 से ज्यादा भाषाओं को सपोर्ट करता है। इसमें हिंदी, तमिल, तेलुगु, मलयालम और कन्नड़ जैसी भारतीय भाषाएं भी शामिल हैं। मॉडल एक ही बातचीत में अलग-अलग भाषाओं के बीच बदलाव को भी समझ सकता है और उसी हिसाब से ट्रांसक्रिप्शन कर सकता है।

खासियत

क्या है इसकी खासियत?

म्यूज वॉयस ट्रांसक्राइब की खासियत यह है कि यह पूरी रिकॉर्डिंग खत्म होने का इंतजार नहीं करता।

कोई व्यक्ति जैसे ही बोलता है, मॉडल उसी समय उसकी आवाज को लिखित टेक्स्ट में बदलना शुरू कर देता है। यह 20 से ज्यादा लोगों वाली रिकॉर्डिंग में अलग-अलग वक्ताओं को पहचान सकता है।

साथ ही एक घंटे से ज्यादा लंबी रिकॉर्डिंग को भी संभाल सकता है। इससे मीटिंग, बातचीत और दूसरे ऑडियो को लिखित रूप में बदलना आसान हो सकता है।

समझ

हिंदी समेत कई भाषाओं को समझेगा

मेटा का कहना है कि म्यूज वॉयस ट्रांसक्राइब को 70 से ज्यादा भाषाओं के साथ काम करने के लिए तैयार किया गया है।

इसकी एक खास बात यह है कि बातचीत के बीच भाषा बदलने पर भी मॉडल काम करता रहता है। भारत में लोग अक्सर हिंदी और अंग्रेजी जैसी भाषाओं को एक ही बातचीत में मिलाकर बोलते हैं।

ऐसे में यह मॉडल बिना अलग व्यवस्था के ऐसी बातचीत को समझकर उसका ट्रांसक्रिप्शन कर सकता है।

ADVERTISEMENT

उपलब्धता

API के जरिए इस्तेमाल कर सकेंगे

म्यूज वॉयस ट्रांसक्राइब को मेटा के मॉडल API के जरिए इस्तेमाल किया जा सकता है।

कंपनी के मुताबिक इसका उपयोग मैक और म्यूज कोड के लिए मेटा AI में डिक्टेशन के लिए भी किया जा रहा है। इसकी कीमत 1,000 ऑडियो मिनट के लिए 3 डॉलर (करीब 17 रुपये प्रति घंटे) है।

मेटा के अनुसार, यह मॉडल ट्रांसक्रिप्शन, डिक्टेशन, कोडिंग और वॉयस असिस्टेंट जैसे कई कामों में उपयोगी हो सकता है।

ADVERTISEMENT