تخطّي إلى المحتوى
Kudos AI

موسومة بـ “gradient-descent”

3 مقالات.

قراءة 4 دقيقةالشبكات العصبية

أبطأ اتّجاه هو الذي يحدّد الإيقاع

حجم الخطوة المسموح به يحدّده أشدّ الاتّجاهات انحدارًا، وعدد الخطوات اللازم يحدّده أكثرها استواءً، فتكون كلفة النزول الاشتقاقي نسبتهما. المواءمة نفسها بالمربّعات الصغرى، وحتى العشرة أرقام العشريّة نفسها، تحتاج 1742 خطوة في أساس، و147 في أساس مُعاد قياسه، وخطوة واحدة بالضبط في أساس متعامد متجانس، والزخم لا يسترجع إلّا الجذر التربيعي للنسبة.

تعلّم الآلةالرياضيات
قراءة 8 دقيقةالشبكات العصبية

ما الذي يجعل التدريب يتقارب حقًا

فرقٌ بنسبة اثنين في المئة في معدّل التعلّم يفصل تنفيذًا متقاربًا عن آخر يبعد خمس مراتب عشرية، وعددُ شرطٍ يتنبأ بمعدّل التقارب إلى ست منازل عشرية، وانحدارُ التدرّج العشوائي بخطوة ثابتة لا يتقارب أبدًا - بل يستقر في كرة ينمو نصف قطرها بجذر الخطوة. وكل رقم هنا حُسب على مسألة يُعرف أمثلها بالضبط.

التحسينالتعلّم العميقتعلّم الآلة
قراءة 7 دقيقةالشبكات العصبية

الانتشار العكسي والنزول التدرّجي

كيف تتعلّم الشبكة العصبية: الخسارة بوصفها دالة في الأوزان، والنزول التدرّجي، والانتشار العكسي بوصفه قاعدة السلسلة مطبَّقةً إلى الوراء، مع حساب كل مشتقّة جزئية لشبكة صغيرة يدوياً والتحقّق منها مقابل الاشتقاق التلقائي.

التعلّم العميقالتحسينالرياضيات