Nous utilisons des cookies pour améliorer votre expérience. Pour nous conformer à la nouvelle directive sur la vie privée, nous devons demander votre consentement à l’utilisation de ces cookies. En savoir plus.
Les reseaux de Neurones formels et Les systemes Neuro-Flous pour A.p.R
Univ Europeenne - EAN : 9783639653694
Édition papier
EAN : 9783639653694
Paru le : 1 nov. 2018
49,90 €
47,30 €
Disponible
Pour connaître votre prix et commander, identifiez-vous
Notre engagement qualité
-
Livraison gratuite
en France sans minimum
de commande -
Manquants maintenus
en commande
automatiquement -
Un interlocuteur
unique pour toutes
vos commandes -
Toutes les licences
numériques du marché
au tarif éditeur -
Assistance téléphonique
personalisée sur le
numérique -
Service client
Du Lundi au vendredi
de 9h à 18h
- EAN13 : 9783639653694
- Réf. fournisseur : 2735974
- Editeur : Univ Europeenne
- Date Parution : 1 nov. 2018
- Disponibilite : Disponible
- Barème de remise : NS
- Nombre de pages : 104
- Format : H:229 mm L:152 mm E:6 mm
- Poids : 166gr
- Interdit de retour : Retour interdit
- Résumé : L'apprentissage par renforcement, est un type d'apprentissage automatique qui est souvent utilisé dans le domaine de la robotique. Il vise à déterminer une loi de commande pour un robot mobile dans un environnement intérieur connu. Ce genre de technique s'applique lorsqu'on suppose que la seule information sur la qualité des actions effectuées par le robot mobile, est un signal scalaire qui présente une récompense ou une punition. La procédure d'apprentissage vise à améliorer le choix des actions afin de maximiser les récompenses. L'un des plus algorithmes utilisés pour la résolution de ce problème d'apprentissage est l'algorithme Q-Learning qui est basé sur la Q-Fonction. Et pour assurer la génération de cette dernière fonction et le bon fonctionnement du système d'apprentissage on utilise un réseau de neurones artificiels car, les états des environnements où évolue un robot mobile ont des grands espaces. L'action effectuée par le robot mobile dans son environnement est assurée par l'utilisation d'une fonction de sélection. Cette action est évaluée par un signal scalaire qui vaut -1, 0 et 1