« LlaMA 2 » : différence entre les versions


Aucun résumé des modifications
Aucun résumé des modifications
 
(Une version intermédiaire par un autre utilisateur non affichée)
Ligne 3 : Ligne 3 :


== Compléments ==  
== Compléments ==  
Ce qui différencie Llama 2, c'est que ses modèles sont [[Modèle préentraîné|pré-entraînés]] et qu'ils ont été [[Peaufinage|peaufinés]] par [[apprentissage par renforcement et rétroaction humaine]] (en anglais ''RHFL'').
Ce qui différencie Llama 2, c'est que ses modèles sont [[Modèle préentraîné|pré-entraînés]] et qu'ils ont été [[affinage|affinés]] par [[apprentissage par renforcement et rétroaction humaine]] (en anglais ''RHFL'').


Les paramètres (poids) de l'architecture de LLaMA sont divulgués publiquement, mais le code source d'entraînement demeure la propriété de la société META.  
Les paramètres (poids) de l'architecture de LLaMA sont divulgués publiquement, mais le code source d'entraînement demeure la propriété de la société META.  
Ligne 16 : Ligne 16 :
-->
-->


 
==Sources==
<small>


== Sources ==
== Sources ==

Dernière version du 22 septembre 2026 à 19:21

Définition

Version 2 du grand modèle de langues de la société META (voir LLaMA) .

Compléments

Ce qui différencie Llama 2, c'est que ses modèles sont pré-entraînés et qu'ils ont été affinés par apprentissage par renforcement et rétroaction humaine (en anglais RHFL).

Les paramètres (poids) de l'architecture de LLaMA sont divulgués publiquement, mais le code source d'entraînement demeure la propriété de la société META.

Français

LLaMA 2

Anglais

LLaMA 2


Sources

Sources

Source : arxiv

Source : Radio-Canada