

మెటా ‘మ్యూజ్ వాయిస్ ట్రాన్స్క్రైబ్’ పేరుతో కొత్త రియల్టైమ్ స్పీచ్-టు-టెక్స్ట్ AI మోడల్ను విడుదల చేసింది. ముఖ్యంగా ఒకే సంభాషణలో పలు భాషలు మారుతూ మాట్లాడే వారికి ఇది మరింత ఉపయోగకరంగా ఉండేలా రూపొందించినట్లు మెటా తెలిపింది. 70కిపైగా భాషల్లో ఈ మోడల్కు శిక్షణ ఇచ్చినట్లు పేర్కొంది. వీటిలో హిందీ, తమిళం, తెలుగు, మలయాళం, కన్నడ వంటి ఐదు ప్రధాన భారతీయ భాషలు ఉన్నాయి. ఒకే సంభాషణలో ఇంగ్లిష్, ప్రాంతీయ భాషలను కలిపి మాట్లాడే సమయంలోనూ అదనపు మోడళ్లు లేదా ప్రత్యేక ప్రాసెసింగ్ అవసరం లేకుండా ట్రాన్స్క్రిప్షన్ చేయడం మ్యూజ్ వాయిస్ ట్రాన్స్క్రైబ్ ప్రత్యేకత. 20 మందికిపైగా మాట్లాడే రికార్డింగుల్లో వేర్వేరు వ్యక్తుల గొంతులను గుర్తించడంతో పాటు గంటకు పైగా నిడివి ఉన్న ఆడియోను కూడా ప్రాసెస్ చేయగలదని మెటా తెలిపింది.
వేగం, కచ్చితత్వం మధ్య సమతుల్యత సాధించడం ఈ మోడల్ మరో ప్రత్యేకత. ప్రతి పదాన్ని గుర్తించేందుకు ఎంత సమయం అవసరమో పదం వారీగా నిర్ణయించడం ద్వారా సులభమైన పదాలను వేగంగా, క్లిష్టమైన పదాలను మరింత సమయం తీసుకుని ట్రాన్స్క్రైబ్ చేస్తుంది. విడుదల సమయంలో 70కిపైగా భాషల్లో 25 భాషలను ధ్రువీకరించినట్లు మెటా వెల్లడించింది. సెప్టెంబరు 1, 2026 నాటికి ఆర్టిఫిషియల్ అనాలిసిస్ స్ట్రీమింగ్ స్పీచ్-టు-టెక్స్ట్ లీడర్బోర్డ్లో మ్యూజ్ వాయిస్ ట్రాన్స్క్రైబ్ మొదటి స్థానంలో నిలిచిందని సంస్థ పేర్కొంది. మెటా మోడల్ API ద్వారా ఇది అందుబాటులోకి వచ్చింది. 1,000 ఆడియో నిమిషాలకు 3 డాలర్లు, అంటే గంటకు సుమారు 0.18 డాలర్ల ధర ఉంటుందని మెటా తెలిపింది. ప్రస్తుతం మెటా AI ఫర్ మ్యాక్, మ్యూజ్ కోడ్లో డిక్టేషన్ కోసం ఈ మోడల్ను ఉపయోగిస్తున్నారు.



















కామెంట్స్ (0)
ఇప్పటికి కామెంట్స్ లేవు
మొదటిగా కామెంట్ చేయండి!