طبق ادعای محققان آمازون، برای آموزش بزرگترین نسخه این مدل از 100 هزار ساعت سخنرانی در بخش عمومی استفاده شده است.
محققان آمازون ادعا کردهاند که بزرگترین مدل هوش مصنوعی تبدیل متن به گفتار را آموزش دادهاند. این مدل جدید که BASE TTS نام دارد، با 100 هزار ساعت اطلاعات صوتی آموزش داده شده است و با قابلیتهای بیسابقه خود، میتواند در بخش مدلهای تبدیل متن به صدا انقلابی ظاهر شود.
-

هدبند نوزادی سارینا گل مدل sz-203 مجموعه 3 عددی
خرید محصول -

باتری موبایل مدل EB-BJ510CBC ظرفیت 3100 میلی آمپر ساعت مناسب برای گوشی موبایل سامسونگ Galaxy J5 2016
خرید محصول -

شامپو بدن گلرنگ مدل Scrub Red مقدار 280 گرم
خرید محصول -

کارت حافظه microSDXC سن دیسک مدل Ultra کلاس10 استاندارد UHS-I U1 سرعت 100MBps 667X ظرفیت 128 گیگابایت به همراه با آداپتور SD
خرید محصول -

ردیاب خودرو کوبان مدل 303F
اطلاعات بیشتر -

پایه نگهدارنده گوشی موبایل پاپ سوکت کی اچ کد 9053
خرید محصول -

قفس مرغ عشق مدل 1028 مجموعه 2 عددی
399,000 ﷼ انتخاب گزینهها این محصول دارای انواع مختلفی می باشد. گزینه ها ممکن است در صفحه محصول انتخاب شوند -

هدفون بی سیم آنمکس مدل A22
399,000 ﷼ انتخاب گزینهها این محصول دارای انواع مختلفی می باشد. گزینه ها ممکن است در صفحه محصول انتخاب شوند
مدل جدید آمازون Big Adaptive Streamable TTS با قابلیتهای نوظهور نام دارد که بهصورت مخفف و با عنوان BASE TTS شناخته میشود. برای آموزش بزرگترین نسخه این مدل از 100 هزار ساعت سخنرانی در بخش عمومی استفاده شده که 90 درصد آن به زبان انگلیسی و بخش دیگر به زبانهای آلمانی، هلند و اسپانیایی است.
این نسخه (BASE-large) با پشتیبانی از 980 میلیون پارامتر، ظاهرا بزرگترین مدل در نوع خود محسوب میشود. همچنین این مدل اساساً یک تقلید کننده صدا نیست، بلکه با وجود ویژگیهای نوظهور خود میتواند حتی در صورت مواجهشدن با جملات پیچیده، در زمینه ارائه گفتار با صدای طبیعی، بهترین عملکرد را داشته باشد. آمازون همچنین مدلهای 400 و 150 پارامتری مدل خود را براساس 10 هزار و 1000 ساعت صدا آموزش داده است.
نمونه تولیدشده توسط مدل هوش مصنوعی تبدیل متن به گفتار آمازون
در وبسایتی که برای این مدل ساخته شده است، چندین نمونه صدا وجود دارد که توسط این هوش مصنوعی براساس برخی متون دشوار ایجاد شده است.
باید به این نکته توجه داشت که این مدل هنوز در مرحله فرایند تجربی خود قرار دارد و برای اهداف تجاری یا موارد مشابه نمیتوان از آن استفاده کرد. در تحقیقات بعدی احتمالاً توضیحات بیشتری درباره تواناییهای نوظهوری و همچنین نحوه آموزش و استقرار مدل اعلام خواهد شد.
هرچند منابع و دادههای مورداستفاده در BASE TTS به دلایل امنیتی فاش نشده است، اما عملکرد چشمگیر این مدل نشانههای روشنی از پیشرفت بخش هوش مصنوعی است.







