Verfahren und Vorrichtung zum Lernen einer Strategie und Betreiben der Strategie

Verfasst von

Steven Adriaenssen, Andre Biedenkapp, Frank Hutter, Gresa Shala, Marius Lindauer, Noor Awad

Abstract

Verfahren (20) zum Lernen einer Strategie (π), welche zumindest einen Parameter (σ) eines Evolutionären Algorithmus optimal anpasst. Das Verfahren umfasst die folgenden Schritte: Initialisieren der Strategie, welche abhängig von Zustandsinformationen (S) eine Parametrisierung (A) des Parameters (σ) ermittelt. Erlernen der Strategie (π) mittels bestärkendem Lernen (engl. reinforcement learning), wobei aus Interaktionen des CMA-ES Algorithmus mit einer Parametrisierung, bestimmt mittels der Strategie abhängig von den Zustandsinformationen (S), mit einer Probleminstanz (14) und einem Belohnungssignal (R) gelernt wird, welche Parametrisierung für mögliche Zustandsinformationen optimal ist.

Details

Organisationseinheit(en)
Fachgebiet Maschinelles Lernen
Typ
Patent
Publikationsdatum
27.01.2022
Publikationsstatus
Veröffentlicht
Elektronische Version(en)
https://worldwide.espacenet.com/patent/search/family/079179186/publication/CN113971460A?q=CN113971460A (Zugang: Offen )
https://worldwide.espacenet.com/patent/search/family/079179186/publication/US2022027743A1?q=US2022027743A1 (Zugang: Offen )
https://worldwide.espacenet.com/patent/search/family/079179186/publication/DE102020209281A1?q=DE102020209281A1 (Zugang: Offen )
https://worldwide.espacenet.com/patent/search/family/079179186/publication/JP2022022177A?q=JP2022022177A (Zugang: Offen )
https://worldwide.espacenet.com/patent/search/family/079179186/publication/JP7695836B2?q=JP7695836B2 (Zugang: Offen )

Zitieren

Laden...