Prilagodljiva umetna inteligenca
"Statično. Ne, dinamično. Že vem, prilagodljivo!"
ZnanstvenoProjekt

UI lahkoučimo s pomočjonagrade inkazni. Podobno kot hišni ljubljenčekdobi priboljšek,čenekajnarediprav,inosterpogledterdvignjenprst,koprevrnenajljubšo vazoizmize.
Primer znane formule, ki je v uporabi pri Q-učenju (Q je funkcija za ovrednotenje stanja prostora sob izbiri akcije a):
R(s,a) -> nagrada za izbirano dejanje v specifičnem stanju okolja.


