واژه‌نامه · پایه

یادگیری عمیق (Deep Learning) چیست و چه کاربردی دارد؟

تعریف به زبان ساده

یادگیری عمیق، یکی از تکنیک‌های هوش مصنوعی (AI) است که به کامپیوترها آموزش می‌دهد که داده‌ها را با استفاده از الگوریتمی الهام‌گرفته از مغز انسان پردازش کنند.

تعریف تخصصی یادگیری عمیق (Deep Learning)

یادگیری عمیق (Deep Learning) زیرمجموعه‌ای از یادگیری ماشین است که توسط شبکه‌های عصبی چندلایه هدایت می‌شود؛ شبکه‌هایی که طراحی آن‌ها از ساختار مغز انسان الهام گرفته شده است. آن‌ها به جای تکیه بر قوانین برنامه‌نویسی‌شده برای وظایف خاص، به طور خودکار نحوه نمایش داده‌ها را یاد می‌گیرند. امروزه، مدل‌های یادگیری عمیق زیرساخت بیشتر سیستم‌های پیشرفته هوش مصنوعی (AI) هستند؛ از بینایی ماشین و هوش مصنوعی مولد گرفته تا خودروهای خودران و رباتیک.

یادگیری عمیق (Deep Learning) چگونه کار می‌کند؟

مغز طبیعی انسان از میلیون‌ها نورون به‌هم‌پیوسته تشکیل شده است. الگوریتم‌های این فناوری نیز با الگوبرداری از طبیعت، از شبکه‌های عصبی مصنوعی استفاده می‌کنند که از چندین لایه از گره‌های به‌هم‌پیوسته تشکیل شده‌اند؛ گره‌هایی که «نورون‌های مصنوعی» یا «واحدها» نامیده می‌شوند. هر لایه، اطلاعات دریافتی از لایه قبلی را پردازش و به لایه بعدی منتقل می‌کند و به‌تدریج ویژگی‌ها و الگوهایی با سطح بالاتر را استخراج می‌کند.

مدل‌های یادگیری عمیق با استفاده از مقادیر زیادی داده برچسب‌گذاری‌شده که «مجموعه‌های آموزشی» نامیده می‌شوند، آموزش می‌بینند تا نحوه تشخیص و طبقه‌بندی الگوها را یاد بگیرند. این داده‌ها می‌توانند مربوط به یک مسئله ساده مانند مجموعه‌داده «سگ‌ها در برابر گربه‌ها» باشند؛ یک مجموعه‌داده استاندارد در حوزه بینایی ماشین که در آن تصاویر باید بر اساس اینکه حاوی سگ یا گربه هستند، طبقه‌بندی شوند. مجموعه‌داده‌های پیچیده‌تر می‌توانند شامل ارزیابی کیفیت غذا یا تشخیص اخبار جعلی در میان گزارش‌های معتبر باشند.

در طول فرایند آموزش، پارامترها و وزن‌های شبکه عصبی تنظیم می‌شوند تا اختلاف میان خروجی‌های پیش‌بینی‌شده و خروجی‌های واقعی به حداقل برسد. با انجام تکرارهای متعدد، مدل به‌تدریج دقیق‌تر و بهینه‌تر می‌شود تا بتواند پیش‌بینی‌ها را انجام دهد یا وظایف مختلف را با درجه بالایی از صحت و دقت به اجرا درآورد.

نحوه کارکرد یادگیری عمیق

تفاوت بین یادگیری عمیق و یادگیری ماشین

یادگیری عمیق روشی برای ایجاد الگوهای پیچیده و چندلایه از طریق آموزش شبکه‌های عصبی با لایه‌های پنهان متعدد است. این فناوری، تکامل‌یافته یادگیری ماشین است و به مداخله بسیار کمتری از سوی انسان نیاز دارد. مدل‌های پایه یادگیری ماشین با دریافت داده‌های جدید، به‌تدریج در انجام وظایف مشخص‌شده بهتر عمل می‌کنند؛ اما اگر پیش‌بینی نادرستی داشته باشند، یک مهندس باید وارد عمل شود و تنظیمات لازم را انجام دهد. در این فناوری، مدل می‌تواند این تنظیمات را خودش انجام دهد و بدون نیاز به کمک انسان، عملکرد خود را اصلاح کند.

تفاوت بین یادگیری عمیق و یادگیری ماشین

انواع مدل های یادگیری عمیق (Deep Learning)

شبکه‌های عصبی کانولوشن (CNN)

عمدتاً برای کارهای بینایی ماشین به‌کار گرفته می‌شوند. این شبکه‌ها شامل لایه‌های پیچشی هستند که مانند فیلتر عمل کرده و با استخراج ویژگی‌ها از داده‌ها، یک «نقشه ویژگی» (Feature map) می‌سازند.

شبکه‌های عصبی بازگشتی (RNN)

برای کارهایی با داده‌های متوالی استفاده می‌شوند. RNNها در یک حلقه بازگشتی کار می‌کنند و یک «حافظه» درونی به‌نام حالت پنهان (Hidden state) تولید می‌کنند تا بتوانند زمینه و ترتیب داده‌ها را به‌خاطر بسپارند.

خودرمزگذارها (Autoencoders)

برای فشرده‌سازی (کدگذاری) داده‌های ورودی و سپس بازسازی (کدگشایی) ورودی اصلی طراحی شده‌اند. به‌زبان یادگیری ماشین، خودرمزگذارها فضای پنهان (Latent space) را مدل می‌کنند.

مدل‌های ترنسفورمر (Transformer Models)

ویژگی شاخص آن‌ها، مکانیسم منحصربه‌فرد توجه-به-خود (Self-attention) است که اجازه می‌دهد به‌صورت انتخابی روی مرتبط‌ترین بخش‌های یک توالی ورودی تمرکز کنند. این مدل‌ها پایه اصلی مدل‌های زبانی بزرگ (LLMs) را تشکیل می‌دهند.

مدل‌های مامبا (Mamba Models)

معماری جدیدی برای داده‌های متوالی است که از مدل‌های فضای حالت (SSMs) مشتق شده است. مامبا با قابلیت اولویت‌بندی انتخابی اطلاعات گذشته و الگوریتمی کم‌هزینه‌تر، جایگزینی با کارایی محاسباتی بالاتر نسبت به ترانسفورمرها ارائه می‌دهد.

شبکه‌های متخاصم مولد (GANs)

دو شبکه یادگیری عمیق را با هم ترکیب می‌کنند که به‌صورت متخاصم آموزش می‌بینند: شبکه مولد (Generator) که داده‌های جدید تولید می‌کند و شبکه تفکیک‌کننده (Discriminator) که تشخیص می‌دهد داده‌ها واقعی یا جعلی هستند.

مدل‌های انتشار (Diffusion Models)

یاد می‌گیرند یک نقطه داده را با نویز گاوسی (Gaussian noise) پخش کنند و سپس این فرایند را معکوس کنند. آن‌ها قادرند نمونه‌های جدیدی را از طریق «نویززدایی» (Denoising) یک نویز تصادفی تولید کنند.

شبکه‌های عصبی گراف (GNNs)

برای کارهایی طراحی شده‌اند که نیازمند مدل‌سازی روابط بسیار پیچیده میان موجودیت‌های مختلف هستند و امکان ایجاد نمایش‌های پیچیده‌تر و نامنظم‌تری از داده‌ها را فراهم می‌کنند.

یادگیری عمیق برای چه مواردی استفاده می‌شود؟

ماشین‌های خودران

الگوریتم‌های یادگیری عمیق به این وسایل نقلیه کمک می‌کنند تشخیص دهند که آیا خودروهای دیگر، موانع یا افراد در اطراف آن‌ها وجود دارد یا خیر و بر اساس آن واکنش مناسب نشان دهند.

چت‌بات‌ها

چت‌بات‌های مبتنی بر یادگیری عمیق که برای تقلید از هوش انسانی طراحی شده‌اند، مانند ChatGPT، اخیراً به دلیل توانایی خود در پاسخ‌گویی سریع و اغلب دقیق به پرسش‌های زبان طبیعی، محبوبیت زیادی پیدا کرده‌اند. هرچه مجموعه داده‌ای که بر اساس آن آموزش دیده شده ، گسترده‌تر باشد، این فناوری می‌تواند با سرعت بیشتری نتایج مطلوب را تولید کند.

تشخیص چهره

تشخیص چهره در زمینه‌های مختلف، از برچسب‌گذاری (تگ کردن) افراد در شبکه‌های اجتماعی گرفته تا اقدامات حیاتی امنیتی، نقش مهمی ایفا می‌کند. این روش به الگوریتم‌ها امکان می‌دهد حتی با وجود تغییرات ظاهری، مانند مدل مو و ریش، یا شرایطی مانند نور کم، عملکرد دقیقی داشته باشند.

علوم پزشکی

ژنوم انسان از حدود سه میلیارد جفت‌باز DNA در کروموزوم‌ها تشکیل شده است. یادگیری ماشین به دانشمندان و دیگر متخصصان پزشکی کمک می‌کند داروهای شخصی‌سازی‌شده تولید کنند و تومورها را تشخیص دهند و همچنین برای سایر کاربردهای دارویی و پزشکی نیز در حال تحقیق و استفاده است.

تشخیص گفتار

همانند تشخیص چهره، یادگیری عمیق از میلیون‌ها کلیپ صوتی برای یادگیری و تشخیص گفتار استفاده می‌کند. سپس الگوریتم‌ها می‌توانند تشخیص دهند که فرد چه گفته است، میان لحن‌های مختلف تمایز قائل شوند و حتی صدای یک فرد خاص را شناسایی کنند.

محدودیت‌های یادگیری عمیق چیست؟

با وجود قابلیت‌های چشمگیر و پتانسیل بالای یادگیری عمیق (DL)، این فناوری بدون محدودیت و چالش نیست. یادگیری عمیق به حافظه و فضای ذخیره‌سازی زیادی نیاز دارد و حجم زیادی از داده‌ها را با سرعت بالایی پردازش می‌کند. به همین دلیل، تهیه مجموعه‌داده‌های باکیفیت، متنوع و دارای برچسب گذاری دقیق می‌تواند چالش‌برانگیز باشد؛ به‌ویژه در حوزه‌هایی که داده‌ها کمیاب یا پرهزینه هستند.

 این فناوری همچنین برای آموزش به منابع محاسباتی و توان زیادی نیاز دارد و ممکن است دچار یادگیری بیش از اندازه (overfitting) شود؛ یعنی روی داده‌های آموزشی عملکرد خوبی داشته باشد، اما روی داده‌های جدید و دیده‌نشده عملکرد ضعیفی نشان دهد.

مانند بسیاری از حوزه‌های هوش مصنوعی، این فناوری نگرانی‌های اخلاقی نیز به همراه دارد؛ از جمله نگرانی درباره امنیت داده‌ها و سوگیری‌ها و خطاهای انسانی ذاتی که ممکن است در بخش‌های مختلف فرایند یادگیری وارد شوند.

آینده یادگیری عمیق

یادگیری عمیق هنوز در مراحل اولیه خود قرار دارد، اما انتظار می‌رود با سرعتی زیادی رشد کند و احتمالاً جامعه را دگرگون سازد. ترکیب یادگیری عمیق با فناوری‌های پیشرفته‌ای مانند واقعیت افزوده (AR) و واقعیت مجازی (VR) می‌تواند شیوه تجربه و تعامل ما با دنیای اطرافمان را متحول کند.حتی یک پیاده‌روی ساده در خیابان می‌تواند با نمایش اطلاعات فوری درباره ساختمان‌ها و مکان‌های دیدنی اطراف، تجربه‌ای متفاوت ایجاد کند. دنیاهای مجازی نیز به‌طور فزاینده‌ای فراگیر و واقع‌گرایانه خواهند شد.

انتظار می‌رود یادگیری عمیق در حوزه‌هایی مانند کشاورزی، انرژی و تولید نیز به کار گرفته شود؛ حوزه‌هایی که این فناوری می‌تواند در آن‌ها به بهینه‌سازی فرایندها، افزایش بهره‌وری و پیشبرد نوآوری کمک کند. مهم‌تر از همه، یادگیری عمیق می‌تواند به تسریع راه‌حل‌هایی برای مشکلات جهانی مانند تغییرات آب‌وهوایی و امنیت غذایی کمک کند.

منابع :