Verstärkendes Lernen ist besonders nützlich in Situationen, in denen wir KIs trainieren möchten, bestimmte Fähigkeiten zu entwickeln, die wir selbst nicht vollständig verstehen. Im Gegensatz zu einigen der Techniken, die wir bisher besprochen haben, betrachtet verstärkendes Lernen im Allgemeinen nur, wie eine KI eine Aufgabe ausführt, nachdem sie sie abgeschlossen hat. Und wenn eine KI diese Aufgabe abschließt, herauszufinden, wann und wie man eine KI belohnt, was als Kreditzuweisung bezeichnet wird, ist einer der schwierigsten Teile des verstärkenden Lernens. Heute werden wir diese Ideen erkunden, eine Menge neuer Begriffe wie Wert, Politik, Agent, Umgebung, Aktionen und Zustände einführen und zeigen, wie wir Strategien wie Exploration und Ausbeutung nutzen können, um den John Green Bot beim nächsten Mal effizienter Dinge finden zu lassen.
Crashkurs KI wird in Zusammenarbeit mit PBS Digital Studios produziert:
Danke an die folgenden Unterstützer für ihre großzügigen monatlichen Beiträge, die helfen, Crashkurs für alle kostenlos zu halten:
Eric Prestemon, Sam Buck, Mark Brouwer, Indika Siriwardena, Avi Yashchin, Timothy J Kwist, Brian Thomas Gossett, Haixiang N/A Liu, Jonathan Zbikowski, Siobhan Sabino, Zach Van Stanley, Jennifer Killen, Nathan Catchings, Brandon Westmoreland, dorsey, Kenneth F Penttinen, Trevin Beattie, Erika & Alexa Saur, Justin Zingsheim, Jessica Wode, Tom Trval, Jason Saslow, Nathan Taylor, Khaled El Shalakany, SR Foxley, Sam Ferguson, Yasenia Cruz, Eric Koslow, Caleb Weeks, Tim Curwick, David Noe, Shawn Arnold, William McGraw, Andrei Krishkevich, Rachel Bright, Jirat, Ian Dundore
--
Möchtest du Crashkurs anderswo im Internet finden?
#Crashkurs #KünstlicheIntelligenz #Maschinenlernen