شرکت متا از مدل جدید تبدیل صوت به متن خود با نام Muse Voice Transcribe رونمایی کرد که قابلیت رونویسی همزمان گفتار بیش از ۲۰ گوینده و بیش از ۲۰ زبان را دارد. این مدل که اولین پردازش صوتی بلادرنگ متا است، میتواند تغییر زبان در میانه جمله را تشخیص داده و با استفاده از تأخیر تطبیقی، دقت رونویسی را افزایش دهد. مارک زاکربرگ، مدیرعامل متا، با انتشار نمونهای از عملکرد این مدل در شبکه اجتماعی ایکس، اشاره کرد که سیستم برای کار با صداهای واقعی و نامنظم آموزش دیده است. این مدل میتواند جلسات صوتی تا یک ساعت را مدیریت کند و در حال حاضر برای توسعهدهندگان با هزینه ۳ دلار به ازای هر هزار دقیقه صوت از طریق API در دسترس است. معرفی این مدل تنها یک هفته پس از معرفی مدل مشابه توسط گوگل صورت گرفت.