મેટાએ 1 સપ્ટેમ્બરના રોજ 'મ્યુઝ વોઇસ ટ્રાન્સક્રાઇબ' નામનું નવું AI સ્પીચ-ટુ-ટેક્સ્ટ મોડેલ રજૂ કર્યું છે. આ મોડેલ માત્ર વોઇસને ટેક્સ્ટમાં ફેરવતું નથી, પરંતુ એક જ વાતચીતમાં અનેક ભાષાઓને સમજી શકે છે.
મેટાના જણાવ્યા અનુસાર, આ મોડેલ 70 થી વધુ ભાષાઓને સપોર્ટ કરે છે, જેમાં હિન્દી, તમિલ, તેલુગુ, મલયાલમ અને કન્નડ જેવી પાંચ મુખ્ય ભારતીય ભાષાઓનો સમાવેશ થાય છે.
મ્યુઝની ખાસ વાત તેનો કોડ-સ્વિચિંગ સપોર્ટ છે. જો કોઈ વ્યક્તિ વાતચીત દરમિયાન અંગ્રેજીમાંથી ભારતીય ભાષામાં કે એક ભાષામાંથી બીજી ભાષામાં સ્વિચ કરે, તો મોડેલ તેને સમજી શકે છે. આ માટે અલગ મોડેલ કે વધારાની પ્રક્રિયાની જરૂર નથી.
આ મોડેલ સ્ટ્રીમિંગ ટ્રાન્સક્રિપ્શન પ્રદાન કરે છે, એટલે કે વ્યક્તિ બોલતી વખતે જ ટેક્સ્ટ જનરેટ થતું જાય છે. તે 20 થી વધુ લોકોના અવાજને ઓળખી શકે છે અને એક કલાકથી વધુ સમયની રેકોર્ડિંગને હેન્ડલ કરી શકે છે.
મેટા દાવો કરે છે કે મ્યુઝ સ્ટ્રીમિંગ સ્પીચ-ટુ-ટેક્સ્ટ લીડરબોર્ડમાં પ્રથમ ક્રમે છે. તેની કિંમત 1,000 ઓડિયો મિનિટ દીઠ $3 છે, જે ભારતીય રૂપિયામાં આશરે ₹285 અને કલાક દીઠ આશરે ₹16 થાય છે.