پخش زنده
امروز: -
شرکت متا مدل هوش مصنوعی جدیدی را معرفی کرد که قادر است گفتوگوهای پیچیده چندنفره را بهصورت بلادرنگ به متن تبدیل کند.

به گزارش خبرگزاری صداوسیما و به نقل از انگجت، مدل جدید متا با نام «میوز ویس ترنسکرایب» (Muse Voice Transcribe)، نخستین مدل صوتی بلادرنگ آزمایشگاه ابرهوش این شرکت است. تفاوت کلیدی این مدل با سامانههای رایج در این است که میتواند بیش از ۲۰ گوینده مختلف را در یک مکالمه مدیریت کرده و بهدقت تشخیص دهد هر بخش از صحبت متعلق به کدام فرد است.
قابلیت برجسته دیگر این فناوری، پشتیبانی از چند زبان در یک جریان صوتی واحد است؛ به گونهای که اگر زبان صحبت در حین گفتوگو تغییر کند، مدل بدون نیاز به تنظیمات دستی، این تغییر را شناسایی و رونویسی را ادامه میدهد. متا تأکید کرده است که فرآیند تشخیص گوینده و تبدیل صدا به متن در این مدل بهصورت بومی و در قالب یک مدل واحد انجام میشود که منجر به سادهسازی مسیر پردازش و کاهش تأخیر میگردد.
این فناوری در حال حاضر در قابلیت دیکته صوتی اپلیکیشن «مک متا» به کار گرفته شده است. معرفی این مدل در حالی صورت میگیرد که رقابت میان غولهای فناوری نظیر متا و گوگل بر سر ساخت مدلهای صوتی دقیقتر شدت یافته است تا دستیاران صوتی آینده بتوانند مانند یک «شنونده فعال»، مکالمات واقعی را در محیطهای شلوغ و چندزبانه پردازش کنند.