🚀 ظهور مدل پیشرو Sonic-3.6 در دنیای TTS
شرکت Cartesia با انتشار مدل جدید Sonic-3.6، استانداردهای تولید متن به گفتار (TTS) را جابجا کرده است. این مدل در حال حاضر رتبه اول را در هر دو بنچمارک اصلی Artificial Analysis کسب کرده و رقبای قدرتمندی را پشت سر گذاشته است.
مهمترین نکات درباره این مدل:
* صدرنشینی در بنچمارکها: کسب بالاترین امتیاز Elo در بخشهای Provider Voice و Controlled Voice.
* برتری در ارزیابی فنی: در بخش Controlled Voice که تفاوتهای ناشی از کیفیت صدا حذف شده و تنها موتور سنتز ارزیابی میشود، این مدل با کنار زدن ElevenLabs Eleven v3 به جایگاه نخست رسیده است.
* معماری متفاوت: برخلاف مدلهای ترنسفورمری رایج، Sonic بر پایه State Space Models توسعه یافته است.
* تاخیر بسیار کم: ادعای زمان تولید کمتر از 90 میلیثانیه تا شنیده شدن اولین بخش از صدا (Time-to-first-audio).
جزئیات بیشتر را میتوانید در بررسی تخصصی این مدل مطالعه کنید.
#Sonic_3_6 #State_Space_Models
شرکت Cartesia با انتشار مدل جدید Sonic-3.6، استانداردهای تولید متن به گفتار (TTS) را جابجا کرده است. این مدل در حال حاضر رتبه اول را در هر دو بنچمارک اصلی Artificial Analysis کسب کرده و رقبای قدرتمندی را پشت سر گذاشته است.
مهمترین نکات درباره این مدل:
* صدرنشینی در بنچمارکها: کسب بالاترین امتیاز Elo در بخشهای Provider Voice و Controlled Voice.
* برتری در ارزیابی فنی: در بخش Controlled Voice که تفاوتهای ناشی از کیفیت صدا حذف شده و تنها موتور سنتز ارزیابی میشود، این مدل با کنار زدن ElevenLabs Eleven v3 به جایگاه نخست رسیده است.
* معماری متفاوت: برخلاف مدلهای ترنسفورمری رایج، Sonic بر پایه State Space Models توسعه یافته است.
* تاخیر بسیار کم: ادعای زمان تولید کمتر از 90 میلیثانیه تا شنیده شدن اولین بخش از صدا (Time-to-first-audio).
جزئیات بیشتر را میتوانید در بررسی تخصصی این مدل مطالعه کنید.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Sonic_3_6 #State_Space_Models