Skip to content
EntityQ7698910· pop 13· linked from 216 articles

Temporal Difference Learning

Sign in to save

Also known as TD Models

Methode des bestärkenden Lernens

Wikidata facts

Show 1 more fact
Sources (3)

via Wikidata · CC0

Article · Deutsch

Temporal Difference Learning (auch TD-Learning) ist eine Methode des bestärkenden Lernens. Beim bestärkenden Lernen erhält ein Agent nach einer Reihe von Aktionen eine Belohnung und passt seine Strategie an, um die Belohnung zu maximieren. Ein Agent mit einem TD-Learning-Algorithmus macht die Anpassung nicht erst, wenn er die Belohnung erhält, sondern nach jeder Aktion auf Basis einer geschätzten erwarteten Belohnung.

Abstract from DBpedia / Wikipedia · CC BY-SA

Temporal Difference Learning · Vinony