On peut noter que ce n'est pas fondamentalement différent du comportement humain qui cherche aussi à optimiser une fonction de récompense, laquelle est compliquée mais parfois modélisable.
Il y a eu pas mal de travaux en économie comportementale notamment sur le sujet.
On peut aussi modéliser des comportements animaux individuels ou de groupe de cette façon.
Au passage, c'est un des biais systématique et à peine croyable des discours sur l'IA : beaucoup disent "puisque l'IA se comporte comme ça et qu'on peut l'expliquer, c'est donc la preuve qu'elle est différente des humains".
Mais jamais "est ce qu'on sait comment les humains fonctionnent ? Est ce que la même explication pourrait s'appliquer ?".
Bref, on reste dans le mysticisme autour des capacités cognitives humaines qui seraient par définition non explicables, non reproductibles et jamais bien définies. On appelle ça intelligence, conscience, mensonge, etc.
-----


