دوره

پردازش زبان گفتاری در پایتون

یاد بگیرید چطور گفتار رو از فایل‌های صوتی خام در پایتون بارگذاری کنید، تغییر بدید و رونویسی کنید.

مقدماتی
تاریخ به‌روزرسانی:
4 مهر 1405
۴٫۸
پایتون
۴ ساعت
۱۴ ویدیو
۳۹ تمرین
۵۰۱ شرکت‌کننده
۴۴۰
کاربرهای فینکا در چه شرکت‌هایی مشغول به کار هستند؟
توضیحات دوره

ما خیلی قبل‌تر از اینکه خوندن رو یاد بگیریم، صحبت کردن رو یاد می‌گیریم. حتی در عصر دیجیتال هم، گفتار یکی از اصلی‌ترین روش‌های ارتباط ماست. در دوره پردازش زبان گفتاری در پایتون یاد می‌گیرید چطور فایل‌های صوتی رو بارگذاری کنید، تغییر بدید و رونویسی کنید. در ابتدا می‌بینید صدای خام در پایتون چه شکلیه و در پایان، با کار روی یک کاربرد واقعی تجاری، داده‌های تماس تلفنی رو رونویسی و طبقه‌بندی می‌کنید.

همونیه که می‌خواید یاد بگیرید؟

1
آشنایی با پردازش زبان گفتاری در پایتون

فایل‌های صوتی با بیشتر انواع داده‌ها تفاوت دارن و قبل از اینکه بتونید باهاشون کار کنید، به مقداری پیش‌پردازش نیاز دارن. در این بخش، اولین قدم‌های کار با فایل‌های گفتاری رو یاد می‌گیرید؛ دو فایل صوتی مختلف رو به موج‌های صوتی تبدیل می‌کنید و اون‌ها رو به‌صورت بصری با هم مقایسه می‌کنید.

2
استفاده از کتابخانه SpeechRecognition در پایتون

تشخیص گفتار هنوز بی‌نقص نیست، اما کتابخانه SpeechRecognition راه ساده‌ای برای کار با چندین API تبدیل گفتار به متن در اختیارتون می‌ذاره. در این بخش، یاد می‌گیرید چطور با استفاده از SpeechRecognition، گفتار موجود در فایل‌های صوتی رو به‌راحتی به متن تبدیل کنید.

3
تغییر فایل‌های صوتی با PyDub

همه فایل‌های صوتی شکل، اندازه یا فرمت یکسانی ندارن. خوشبختانه، کتابخانه PyDub ابزارهایی در اختیارتون می‌ذاره که باهاشون می‌تونید ویژگی‌های مختلف فایل‌های صوتی مثل نرخ فریم، تعداد کانال‌ها، فرمت فایل و موارد دیگه رو به‌صورت برنامه‌نویسی تغییر بدید. در این بخش، یاد می‌گیرید چطور با استفاده از PyDub، فایل‌های صوتی رو به شکل مناسبی برای رونویسی آماده کنید.

4
پردازش متن رونویسی‌شده از گفتار

در این بخش، همه چیزهایی رو که یاد گرفتید کنار هم می‌ذارید و یک پروژه اثبات مفهوم برای پردازش گفتار در شرکت فناوری فرضی «اکمی استودیوز» می‌سازید. ابتدا بخش‌هایی از تماس‌های پشتیبانی مشتریان رو از صوت به متن رونویسی می‌کنید. بعد روی متن‌های رونویسی‌شده، با NLTK تحلیل احساسات، با SpaCy تشخیص موجودیت نام‌دار و با Scikit-learn طبقه‌بندی متن انجام می‌دید.

گواهی پایان دوره

  • تأیید مهارت شما

    با تکمیل این دوره، شما یک گواهی معتبر دریافت می‌کنید که بیانگر کسب مهارت‌های لازم مرتبط با این دوره آموزشی است.

  • اعتبار و اصالت گواهی

    هر مدرک دارای شناسه یکتا و لینک اعتبارسنجی است که امکان بررسی و تأیید اصالت آن را فراهم می‌کند.

  • اشتراک‌گذاری

    می‌توانید گواهی‌های خود را به‌راحتی در شبکه‌های حرفه‌ای مانند لینکدین با دیگران به اشتراک بگذارید.

اشتراک‌گذاری
منابع
Pre- and post-purchase audio snippet transcriptions

سوالات متداول

پایتون از پروژه‌های تشخیص گفتار پشتیبانی می‌کنه و چند کتابخانه محبوب برای شروع کار در اختیارتون می‌ذاره. به‌طور خاص، SpeechRecognition و PyDub از کتابخانه‌های پرکاربردی هستن که برای آماده‌سازی و پردازش فایل‌های صوتی استفاده می‌شن.

با استفاده از کتابخانه SpeechRecognition در پایتون می‌تونید صدای ضبط‌شده رو به متن رونویسی کنید. این کار به نرم‌افزارتون کمک می‌کنه کلمات و عبارت‌های موجود در گفتار رو تشخیص بده و اون‌ها رو به متن قابل‌خواندن تبدیل کنه تا برای تحلیل بیشتر، بهبود دسترسی و کاربردهای دیگه استفاده بشن.

دریافت اپلیکیشن فینکا

با اپلیکیشن فینکا، به بیشتر دوره‌ها و مسیرها روی موبایل دسترسی دارید، تمرین می‌کنید و یادگیری رو هم‌زمان روی موبایل و دسکتاپ ادامه می‌دید.