« A3C » : différence entre les versions
(Page créée avec « == '''<span style="font-family:arial black;font-size:24px; color:#1880a6;">ROBOTIQUE</span>'''== == Définition == '''Asynchronous Advantage Actor-Critic''' — un algorithme d'apprentissage par renforcement profond qui entraîne plusieurs instances d'agent en parallèle sur des copies d'environnement séparées, mettant à jour de manière asynchrone un réseau de contrôle partagé. A3C a été l'un des premiers algorithmes à attei... ») |
m (Remplacement de texte : « Catégorie:Robotique↵↵Catégorie:Vocabulaire » par « Catégorie:Robotique ») |
||
| Ligne 18 : | Ligne 18 : | ||
{{Modèle:Robotique}} | {{Modèle:Robotique}} | ||
[[Catégorie:Robotique]] | [[Catégorie:Robotique]] | ||
Dernière version du 8 octobre 2026 à 18:19
ROBOTIQUE
Définition
Asynchronous Advantage Actor-Critic — un algorithme d'apprentissage par renforcement profond qui entraîne plusieurs instances d'agent en parallèle sur des copies d'environnement séparées, mettant à jour de manière asynchrone un réseau de contrôle partagé. A3C a été l'un des premiers algorithmes à atteindre des performances surhumaines sur les jeux Atari et a démontré que la collecte de données parallèles peut remplacer la relecture d'expérience pour un entraînement stable.
Français
A3C
Anglais
Asynchronous Advantage Actor-Critic
A3C
Sources
Contributeurs: wiki





