
Training and applying deep learning and generative AI models
در دنیای پرشتاب فناوری امروز، هوش مصنوعی و یادگیری ماشین به ارکان اصلی توسعه نرمافزار و حل مسائل پیچیده تبدیل شدهاند. کتاب یادگیری عمیق با پایتورچ با هدف ارائه پایههای مستحکم یادگیری عمیق و نمایش عملکرد آنها در پروژههای واقعی و کاربردی به رشته تحریر درآمده است. این اثر ارزشمند تلاش میکند تا مفاهیم کلیدی و بنیادین یادگیری عمیق را به شکلی موشکافانه بررسی کرده و نشان دهد که چگونه چارچوب قدرتمند پایتورچ این ابزارها را در دستان توسعهدهندگان و متخصصان قرار میدهد.
نویسندگان این کتاب در طول فصول مختلف، تلاش کردهاند تا بینشی عمیق و شهودی ریاضیاتی به خواننده منتقل کنند؛ بینشی که از کاوشهای بیشتر و یادگیریهای مستقل در آینده پشتیبانی خواهد کرد. در همین راستا، کتاب به صورت گزینشی به سراغ جزئیات فنی میرود تا به شما نشان دهد در پشت پرده الگوریتمها و توابع آماده چه میگذرد. هدف اصلی این است که شما تنها یک مصرفکننده کد نباشید، بلکه معماری و منطق درونی شبکههای عصبی را به صورت ریشهای درک کنید.
باید تاکید کرد که این کتاب هرگز سعی نمیکند تنها یک کتاب مرجع استاندارد یا یک فرهنگ لغت از توابع برنامهنویسی باشد؛ بلکه این اثر یک همراه مفهومی و تحلیلی است که به شما اجازه میدهد تا پس از مطالعه، با اعتماد به نفس کامل به سراغ مطالب پیشرفتهتر بروید و به صورت مستقل در دنیای پهناور مقالات علمی و منابع آنلاین به جستجو بپردازید. به همین دلیل، تمرکز نویسندگان بر روی مجموعهای از مهمترین و کاربردیترین ویژگیهای ارائهشده توسط این چارچوب برنامهنویسی است، تا از سردرگمی خواننده در میان هزاران تابع فرعی جلوگیری شود.
این کتاب به صورت ویژه برای توسعهدهندگانی طراحی شده است که در حال حاضر متخصص یادگیری عمیق هستند یا قصد دارند در آیندهای نزدیک به یک متخصص حرفهای و پیادهساز شبکههای عصبی تبدیل شوند و میخواهند با چارچوب قدرتمند پایتورچ آشنا شوند. ما مخاطب نمونه و ایدهآل این کتاب را یک دانشمند علوم کامپیوتر، یک دانشمند داده، یک مهندس نرمافزار و یا دانشجویان مقاطع کارشناسی و تحصیلات تکمیلی در رشتههای مرتبط با فناوری اطلاعات و هوش مصنوعی تصور میکنیم.
از آنجایی که فرض بر این نبوده که خواننده دانش قبلی و پیشرفتهای در زمینه یادگیری عمیق دارد، برخی از بخشهای نیمه اول کتاب ممکن است برای متخصصان باتجربهتر جنبه یادآوری مفاهیم را داشته باشد. با این حال، نویسندگان امیدوارند که حتی برای این دسته از خوانندگان نیز، نحوه بیان و زاویه دید متفاوت به موضوعات شناخته شده، طراوت و آموزندگی خاص خود را داشته باشد.
برای بهرهوری حداکثری از مطالب این اثر، انتظار میرود که خوانندگان دارای دانش پایهای در زمینه برنامهنویسی دستوری و همچنین برنامهنویسی شیگرا باشند. از آنجایی که تمام کدهای این کتاب با زبان برنامهنویسی پایتون نوشته شدهاند، شما باید با نحو این زبان و محیط عملیاتی آن آشنایی کامل داشته باشید.
کلمات کلیدی:خوانندگانی که از پیشزمینه زبانهای برنامهنویسی دیگری مانند سی پلاس پلاس، جاوا، جاوا اسکریپت، روبی یا سایر زبانهای مشابه وارد این حوزه میشوند، روند یادگیری نسبتاً آسانی برای درک پایتون خواهند داشت، اما قطعا نیاز دارند تا خارج از چارچوب این کتاب، برخی از مفاهیم اولیه پایتون را به سرعت مرور کنند. به طور مشابه، آشنایی با کتابخانه نامپای بسیار مفید و راهگشا خواهد بود. همچنین انتظار میرود که خواننده با مفاهیم اولیه جبر خطی آشنایی داشته باشد؛ به عنوان مثال بداند که ماتریسها و بردارها چه هستند و ضرب نقطهای چه معنایی در محاسبات ریاضی دارد. این پیشنیازها به شما کمک میکنند تا منطق محاسباتی پنهان در پس یادگیری عمیق را به راحتی هضم کنید.
کتاب حاضر به دو بخش کاملاً متمایز و در عین حال پیوسته تقسیم شده است. بخش اول به پوشش پایهها و مبانی اختصاص دارد، در حالی که بخش دوم به کاوش در موضوعات پیشرفته از جمله مدلهای مولد مدرن، یک پروژه جامع و کامل در زمینه تصویربرداری پزشکی، آموزش توزیعشده مدلها در مقیاس بزرگ و در نهایت استراتژیهای استقرار در محیط تولید میپردازد.
ممکن است در طول مطالعه متوجه تفاوتهایی در لحن بیان و سبکهای گرافیکی میان این دو بخش شوید. اگرچه این کتاب نتیجه ساعتها برنامهریزی مشترک، بحثهای طولانی و ویرایشهای دقیق تیمی است، اما وظیفه نگارش متون و طراحی گرافیکها بین نویسندگان مختلف تقسیم شده است تا هر بخش توسط متخصصترین فرد در همان زمینه نوشته شود. در ادامه، تفکیک دقیق هر بخش به فصلهای مختلف و توضیحات جامع مربوط به هر کدام را بررسی میکنیم.
در بخش اول، ما اولین قدمهای خود را در این چارچوب نرمافزاری برمیداریم و مهارتهای بنیادی مورد نیاز برای درک پروژههای واقعی و تجاری را ایجاد میکنیم تا بتوانیم از همان ابتدا شروع به ساخت پروژههای اختصاصی خود کنیم. در این بخش، رابط برنامهنویسی اپلیکیشن این ابزار و برخی از ویژگیهای پشت صحنه که آن را به یک کتابخانه بینظیر در دنیای هوش مصنوعی تبدیل کرده است، به دقت بررسی میشوند و کار بر روی آموزش یک مدل طبقهبندی اولیه را آغاز خواهیم کرد. تا پایان بخش اول، شما کاملاً آماده خواهید بود تا با چالشهای یک پروژه واقعی دست و پنجه نرم کنید.
در ابتدای مسیر، فصل اول به معرفی این چارچوب به عنوان یک کتابخانه مستقل و بررسی جایگاه ویژه آن در انقلاب یادگیری عمیق میپردازد. در این فصل با دلایلی آشنا میشویم که این ابزار را از سایر چارچوبهای یادگیری عمیق متمایز میکند و دلیل محبوبیت فوقالعاده آن در میان محققان را درک خواهیم کرد.
در فصل دوم، با اجرای مثالهایی از شبکههای از پیش آموزشدیده، عملکرد این چارچوب را در عمل مشاهده خواهیم کرد. این فصل به شما نشان میدهد که چگونه میتوانید مدلهای قدرتمند را از مخزن معروف هاگینگ فیس هاب دانلود کرده و اجرا کنید. این مهارت به شما اجازه میدهد تا بدون نیاز به ساعتها زمان برای آموزش مدل از صفر، از قدرت مدلهای آماده برای حل مسائل خود بهره ببرید.
فصل سوم نقطه عطفی در یادگیری شماست، جایی که واحد سازنده اصلی این کتابخانه، یعنی تنسور معرفی میشود. در این فصل، رابط برنامهنویسی تنسورها بررسی شده و با بررسی برخی از جزئیات پیادهسازی، به پشت صحنه نحوه مدیریت حافظه و محاسبات در این ساختارهای داده پرداخته میشود.
در ادامه، فصل چهارم نشان میدهد که چگونه میتوان انواع مختلف دادههای موجود در دنیای واقعی (مانند متن، تصویر، صدا و سریهای زمانی) را به عنوان تنسورها بازنمایی کرد. این فصل به شدت حیاتی است زیرا مدلهای یادگیری عمیق انتظار دارند که دادهها با شکل و ساختار بسیار دقیقی به آنها تغذیه شوند و درک این شکلدهی، کلید موفقیت در هر پروژهای است.
فصل پنجم به سراغ قلب تپنده یادگیری ماشین میرود و مکانیک یادگیری از طریق روش کاهش گرادیان را به صورت قدم به قدم تشریح میکند. شما در این فصل درک خواهید کرد که چگونه سیستم مشتقگیری خودکار، محاسبات پیچیده ریاضی را برای شما بینهایت ساده میکند.
فصل ششم روند ساخت و آموزش یک شبکه عصبی برای حل مسائل رگرسیون را به تصویر میکشد. در این فصل از ماژولهای شبکه عصبی و ماژولهای بهینهساز استفاده خواهیم کرد تا پایههای معماری مدل خود را شکل دهیم.
در فصل هفتم، بر اساس دانش فصلهای پیشین، یک مدل تمام متصل قدرتمند برای طبقهبندی تصاویر ایجاد میکنیم. این فصل دانش شما را در مورد رابط برنامهنویسی توسعه میدهد و شما را با چالشهای پردازش تصویر در سادهترین سطح آن آشنا میکند.
در نهایت، فصل هشتم یکی از مهمترین مفاهیم پردازش بینایی ماشین، یعنی شبکههای عصبی پیچشی را معرفی میکند. این فصل به مفاهیم بسیار پیشرفتهتری برای ساخت مدلهای شبکههای عصبی عمیق میپردازد و پیادهسازی گام به گام آنها را آموزش میدهد تا بتوانید الگوهای مکانی را در تصاویر به بهترین شکل ممکن استخراج کنید.
بخش دوم کتاب با معرفی مدلهای مولد مدرن، از جمله معماریهای انقلابی ترانسفورمر و مدلهای انتشار آغاز میشود و سپس با یک پروژه جامع و تمامعیار در زمینه تشخیص سرطان ریه ادامه مییابد که نشاندهنده قدرت حل مسئله در دنیای واقعی و در مقیاس بزرگ است. این بخش در نهایت با تکنیکهای پیشرفته آموزش توزیعشده و استراتژیهای استقرار محصول به پایان میرسد و یک سفر کامل و بینقص را از معماریهای پیشرفته تا سیستمهای آماده برای محیط عملیاتی به شما ارائه میدهد.
فصل نهم به سراغ داغترین موضوع این روزهای دنیای فناوری یعنی معماری ترانسفورمر میرود. در این فصل بررسی میکنیم که چگونه مکانیزم توجه به سیستمها اجازه تولید متنهای معنادار و پیوسته را میدهد. این فصل پایه و اساس درک شما را برای کار با مدلهای هوش مصنوعی مولد مدرن و پردازش زبان طبیعی بنا میکند.
فصل دهم مدلهای انتشار را برای تولید تصویر آموزش میدهد. شما یاد میگیرید که چگونه شبکههای عصبی میتوانند از طریق یک فرایند تکرارشونده و مبتنی بر حذف نویز، یاد بگیرند که تصاویری کاملاً واقعگرایانه و جدید خلق کنند. این فرایند سنگ بنای سیستمهای تولید تصویر پیشرفته امروزی است.
از فصل یازدهم، وارد یک چالش واقعی و نجاتبخش میشویم. این فصل استراتژی کاملی را از ابتدا تا انتها برای پروژه تشخیص سرطان ریه ارائه میدهد و توضیح میدهد که چگونه تصویربرداری سیتی اسکن را با قدرت یادگیری عمیق برای شناسایی تومورهای خطرناک ترکیب خواهیم کرد.
در فصل دوازدهم، نحوه بارگذاری و پردازش دادههای خام سیتی اسکن را میآموزیم. اجرای مجموعه دادههای سفارشی و تبدیل دادههای پیچیده تصویربرداری پزشکی به تنسورهای مناسب برای آموزش مدل، از مهارتهای کلیدی است که در این فصل به دست میآورید.
فصل سیزدهم به ساخت مدل طبقهبندی برای تشخیص تومورهای مشکوک اختصاص دارد. در اینجا ما حلقه آموزش اساسی و معماری مدل را برای تشخیص دقیق گرههای ریوی تثبیت میکنیم.
فصل چهاردهم بر روی بهبود عملکرد مدل تمرکز دارد. با معرفی معیارهای ارزیابی حیاتی مانند دقت، فراخوانی و امتیاز اف یک، عملکرد سیستم را میسنجیم. سپس با تکنیکهای متعادلسازی دادهها و افزایش دادهها، به حل مشکل عدم تعادل کلاسها که یکی از بزرگترین معضلات در دادههای پزشکی است، میپردازیم.
در فصل پانزدهم، مفهوم بخشبندی تصاویر با استفاده از مدل پیشرفته بخشبندی همه چیز معرفی میشود تا سیستم بتواند به صورت خودکار و بدون نیاز به دادههای حاشیهنویسی شده توسط انسان، مکانهای احتمالی گرههای سرطانی را در تصاویر سیتی اسکن شناسایی کند.
فصل شانزدهم برای کسانی نوشته شده است که قصد کار با کلاندادهها را دارند. در این فصل آموزش مدلها بر روی چندین پردازنده گرافیکی به صورت همزمان با استفاده از محاسبات توزیعشده پوشش داده میشود. مفاهیم پیچیدهای مانند موازیسازی داده، موازیسازی مدل، موازیسازی خط لوله و موازیسازی تنسور به شکلی روان توضیح داده میشوند تا بتوانید مدلهای غولپیکر را بهینهتر و سریعتر آموزش دهید.
در نهایت، فصل هفدهم به موضوع بسیار مهم استقرار مدلها در محیط تولید میپردازد. ما یاد میگیریم که چگونه استراتژیهای سرویسدهی را با ابزارهایی مانند گرادیو و فست ای پی آی پیادهسازی کنیم. خروجی گرفتن از مدلها با فرمت استاندارد او ان ان ایکس، بهینهسازی عملکرد با کامپایل تورچ و حتی استقرار مدلها بر روی دستگاههای همراه هوشمند با استفاده از اگزکیو تورچ، مباحثی هستند که شما را به یک مهندس نرمافزار کامل و همهفنحریف در حوزه هوش مصنوعی تبدیل میکنند.
با مطالعه دقیق این کتاب، شما تنها چند دستور برنامهنویسی را حفظ نخواهید کرد، بلکه درک عمیقی از معماری سیستمهای هوشمند، توانایی بهینهسازی مدلهای پیچیده، مهارت حل مسائل واقعی مانند تشخیص بیماریهای مرگبار و قابلیت پیادهسازی سیستمهای هوش مصنوعی در محیطهای تجاری و صنعتی را به دست خواهید آورد. این کتاب پلی است بین مفاهیم تئوری خستهکننده و پروژههای عملیاتی هیجانانگیز، تا شما بتوانید در صف اول نوآوران صنعت فناوری قرار بگیرید.
نمونه چاپ کتاب موجود نیست.
نظرات کاربران (0)