آمازون در حال توسعه بزرگ‌ترین مدل هوش مصنوعی تبدیل متن به گفتار است

طبق ادعای محققان آمازون، برای آموزش بزرگ‌ترین نسخه این مدل از ۱۰۰ هزار ساعت سخنرانی در بخش عمومی استفاده شده است.

محققان آمازون ادعا کرده‌اند که بزرگ‌ترین مدل هوش مصنوعی تبدیل متن به گفتار را آموزش داده‌اند. این مدل جدید که BASE TTS نام دارد، با ۱۰۰ هزار ساعت اطلاعات صوتی آموزش داده شده است و با قابلیت‌های بی‌سابقه خود، می‌تواند در بخش مدل‌های تبدیل متن به صدا انقلابی ظاهر شود.

محصولات بخش فروشگاه

ترازو مکانیکی هدیه مدل آلپاین
۵,۲۵۰,۰۰۰ ﷼ خرید محصول
کیف پول زنانه پاندورامدل P9010
اطلاعات بیشتر
اسپیکر بلوتوثی قابل حمل هوآوی مدل CM510
خرید محصول
کلاه کپ کد S93
خرید محصول
ساعت هوشمند مدل SK9
۱,۷۴۵,۰۰۰ ﷼ انتخاب گزینه‌ها این محصول دارای انواع مختلفی می باشد. گزینه ها ممکن است در صفحه محصول انتخاب شوند
چند راهی برق الدینیو مدل SC-3604
خرید محصول
دسته موتور جلو مدل 1001210U2010 مناسب برای جک J5
اطلاعات بیشتر
گوشواره طلا ۱۸ عیار دخترانه رزالیا مدل Diamond-GEA-008
خرید محصول

مدل جدید آمازون Big Adaptive Streamable TTS با قابلیت‌های نوظهور نام دارد که به‌صورت مخفف و با عنوان BASE TTS شناخته می‌شود. برای آموزش بزرگ‌ترین نسخه این مدل از ۱۰۰ هزار ساعت سخنرانی در بخش عمومی استفاده شده که ۹۰ درصد آن به زبان انگلیسی و بخش دیگر به زبان‌های آلمانی، هلند و اسپانیایی است.

این نسخه (BASE-large) با پشتیبانی از ۹۸۰ میلیون پارامتر، ظاهرا بزرگ‌ترین مدل در نوع خود محسوب می‌شود. همچنین این مدل اساساً یک تقلید کننده صدا نیست، بلکه با وجود ویژگی‌های نوظهور خود می‌تواند حتی در صورت مواجه‌شدن با جملات پیچیده، در زمینه ارائه گفتار با صدای طبیعی، بهترین عملکرد را داشته باشد. آمازون همچنین مدل‌های ۴۰۰ و ۱۵۰ پارامتری مدل خود را براساس ۱۰ هزار و ۱۰۰۰ ساعت صدا آموزش داده است.

نمونه تولید‌شده توسط مدل هوش مصنوعی تبدیل متن به گفتار آمازون
در وب‌سایتی که برای این مدل ساخته شده است، چندین نمونه صدا وجود دارد که توسط این هوش مصنوعی براساس برخی متون دشوار ایجاد شده است.

باید به این نکته توجه داشت که این مدل هنوز در مرحله فرایند تجربی خود قرار دارد و برای اهداف تجاری یا موارد مشابه نمی‌توان از آن استفاده کرد. در تحقیقات بعدی احتمالاً توضیحات بیشتری درباره توانایی‌های نوظهوری و همچنین نحوه آموزش و استقرار مدل اعلام خواهد شد.

هرچند منابع و داده‌های مورداستفاده در BASE TTS به دلایل امنیتی فاش نشده است، اما عملکرد چشمگیر این مدل نشانه‌های روشنی از پیشرفت بخش هوش مصنوعی است.

آمازون در حال توسعه بزرگ‌ترین مدل هوش مصنوعی تبدیل متن به گفتار است

ترازو مکانیکی هدیه مدل آلپاین

کیف پول زنانه پاندورامدل P9010

اسپیکر بلوتوثی قابل حمل هوآوی مدل CM510

کلاه کپ کد S93

ساعت هوشمند مدل SK9

چند راهی برق الدینیو مدل SC-3604

دسته موتور جلو مدل 1001210U2010 مناسب برای جک J5

گوشواره طلا ۱۸ عیار دخترانه رزالیا مدل Diamond-GEA-008

دیدگاهتان را بنویسید لغو پاسخ

این کارت حافظه کوچک ۴ ترابایت ظرفیت ذخیره‌سازی دارد

بازی/ Age of 2048؛ بزرگ‌ترین تمدن جهان را بسازید

برای شرکت‌های هوش مصنوعی اینترنت «بیش‌از‌حد کوچک» است

بازی/ Hide.io؛ از چشم بقیه پنهان شوید

با ماسک هوشمند سامسونگ دیگر نگران آلودگی هوا نباشید

بازی/ Agent Dash؛ سکه‌ها را جمع کنید

تراشه اسنپدراگون X Elite پرچم‌داران اینتل و AMD را شکست داد

بازی/ Looney Tunes؛ شهری بزرگ بسازید

سرعت دانلود این گوشی چینی، مغز شما را منفجر می‌کند

بازی/ Pastel Friends؛ آواتارها را به سلیقه خود طراحی کنید

این کارت حافظه کوچک ۴ ترابایت ظرفیت ذخیره‌سازی دارد

بازی/ Age of 2048؛ بزرگ‌ترین تمدن جهان را بسازید

برای شرکت‌های هوش مصنوعی اینترنت «بیش‌از‌حد کوچک» است

سوالات و پشتیبانی