Reinforcement Learning (למידת חיזוק)
שיטת למידת מכונה שבה סוכן AI לומד לפעול בסביבה על ידי קבלת תגמולים או עונשים. כך אומנו מודלי שפה להיות יותר מדויקים ובטוחים (RLHF).
קטגוריות: בינה מלאכותית (AI) · פיתוח תוכנה ו-Web
שיטת למידת מכונה שבה סוכן AI לומד לפעול בסביבה על ידי קבלת תגמולים או עונשים. כך אומנו מודלי שפה להיות יותר מדויקים ובטוחים (RLHF).
קטגוריות: בינה מלאכותית (AI) · פיתוח תוכנה ו-Web