هوش مصنوعی مولد(Generative AI) چیست؟
«نسخه کامل و جامع این مقاله به همراه بررسی الگوهای عملی، در مقاله هوش مصنوعی مولد(Generative AI) چیست ،در سایت ImaniNova منتشر شده است. در ادامه بخشی از این مقاله را مطالعه می کنید:»
هوش مصنوعی مولد یا Generative AI به خانواده ای از مدل های هوش مصنوعی گفته می شود که توانایی ایجاد محتوای جدید بر اساس الگوهایی را دارند که در فرایند آموزش یاد گرفته اند. این محتوا می تواند شامل متن، تصویر، صدا، موسیقی، ویدیو، کد برنامه نویسی، مدل های سه بعدی و حتی داده های مصنوعی باشد. نکته مهم این است که سیستم مولد صرفا یک داده موجود را از میان مجموعه ای از اطلاعات انتخاب نمی کند، بلکه بر اساس ورودی کاربر و ساختار آماری آموخته شده، خروجی جدیدی ایجاد می کند.
هوش مصنوعی مولد چگونه به وجود آمد؟ریشه های هوش مصنوعی مولد به سال ها قبل از ظهور مدل های امروزی برمی گردد. پژوهشگران از مدت ها پیش تلاش می کردند سیستم هایی بسازند که بتوانند داده هایی شبیه داده های واقعی تولید کنند.
در ابتدا، این مدل ها بسیار محدود بودند. کیفیت خروجی پایین بود، مدل ها توانایی درک پیچیدگی های داده را نداشتند و برای تولید محتوای قابل استفاده در دنیای واقعی، به اندازه کافی قدرتمند نبودند.
با توسعه یادگیری عمیق یا Deep Learning شرایط تغییر کرد. شبکه های عصبی عمیق توانستند روابط پیچیده تری را در داده ها شناسایی کنند و همین موضوع زمینه را برای ساخت مدل های بزرگ تر فراهم کرد.
افزایش قدرت GPUها نیز نقش بسیار مهمی داشت. آموزش شبکه های عصبی بزرگ نیازمند انجام تعداد بسیار زیادی عملیات ریاضی است. GPUها به دلیل معماری موازی خود برای این نوع محاسبات بسیار مناسب هستند و امکان آموزش مدل هایی با میلیاردها پارامتر را فراهم کردند.
در کنار سخت افزار، حجم داده های دیجیتال نیز به شدت افزایش یافت. اینترنت، شبکه های اجتماعی، کتاب های دیجیتال، مقالات علمی، تصاویر، ویدیوها و سایر منابع دیجیتال مجموعه عظیمی از داده را ایجاد کردند که می توانست برای آموزش مدل های یادگیری ماشین مورد استفاده قرار گیرد.
اما یکی از مهم ترین نقاط عطف تاریخ هوش مصنوعی مدرن، ظهور معماری Transformer بود.
Transformer چیست؟Transformer یکی از مهم ترین معماری های شبکه عصبی در تاریخ هوش مصنوعی مدرن محسوب می شود. این معماری در سال ۲۰۱۷ در مقاله ای با عنوان Attention Is All You Need معرفی شد و بعدها پایه بسیاری از مدل های زبانی بزرگ و سیستم های هوش مصنوعی مولد قرار گرفت.
پیش از Transformer، مدل هایی مانند RNN و LSTM برای پردازش داده های ترتیبی، به خصوص متن، استفاده می شدند. این مدل ها در بسیاری از وظایف عملکرد خوبی داشتند اما هنگام پردازش وابستگی های طولانی در متن با محدودیت هایی مواجه می شدند.
Transformer با استفاده از مکانیزمی به نام Attention امکان بررسی ارتباط میان بخش های مختلف یک توالی را فراهم کرد.
برای مثال، در جمله ای طولانی ممکن است یک کلمه در ابتدای جمله با کلمه ای در انتهای جمله ارتباط معنایی مهمی داشته باشد. مکانیزم Attention به مدل کمک می کند این روابط را بهتر شناسایی کند.
اهمیت Transformer فقط به زبان محدود نماند. این معماری بعدها در پردازش تصویر، صوت، ویدیو و مدل های چندوجهی نیز مورد استفاده قرار گرفت.
به همین دلیل می توان Transformer را یکی از زیرساخت های اصلی انقلاب فعلی هوش مصنوعی دانست.
مدل زبانی بزرگ یا LLM چیست؟LLM یا Large Language Model مدلی است که برای پردازش و تولید زبان انسانی در مقیاس بسیار بزرگ آموزش داده شده است.
مدل های زبانی بزرگ معمولا با حجم بسیار زیادی از داده های متنی آموزش داده می شوند. هدف این فرایند آن است که مدل بتواند الگوهای زبان، روابط میان کلمات، ساختار جملات، مفاهیم و ارتباط میان بخش های مختلف متن را یاد بگیرد.
اما یک تصور اشتباه درباره LLMها این است که مدل تمام اطلاعات موجود در داده های آموزشی را مانند یک پایگاه داده ذخیره می کند. سازوکار مدل پیچیده تر از این است. مدل در طول آموزش میلیاردها پارامتر خود را تنظیم می کند تا بتواند الگوهای موجود در داده ها را بازنمایی کند.
وقتی کاربر سوالی را وارد می کند، مدل بر اساس ورودی، وضعیت داخلی خود و احتمالاتی که از آموزش به دست آورده است، ادامه مناسبی برای متن تولید می کند.
به همین دلیل، یک LLM را نباید صرفا یک «موتور جستجو» دانست. موتور جستجو معمولا برای یافتن و نمایش اطلاعات موجود طراحی شده است، در حالی که LLM می تواند پاسخ را به صورت پویا تولید کند.
پارامتر در مدل هوش مصنوعی چیست؟
یکی از اصطلاحاتی که هنگام بررسی مدل های هوش مصنوعی زیاد با آن مواجه می شویم، Parameter یا پارامتر است.
ادامه مقاله در