Personnes / Amanda Askell

OPINIONS EXPRIMÉES EN PUBLIC

Amanda Askell

Interview guest ·

Guest in Lex Fridman Podcast: #452 – Dario Amodei: Anthropic CEO on Claude, AGI & the Future of AI & Humanity.

1 entretiens · 2 opinions exprimées · 1 thèmes

Les traductions sont destinées à la lecture ; les extraits originaux restent la source evidence.

Ce qu’ils disent

Opinions attribuées, classées par date d’entretien. Un aperçu de ces échanges, non une affirmation définitive des convictions de la personne.

Sécurité de l'IA

Le travail sur le « caractère » relève de l’alignement, pas seulement du produit

La conception du « caractère » d’un assistant IA doit être considérée comme un volet fondamental du travail d’alignement, et non simplement comme une question de conception produit. L’objectif consiste à façonner le comportement de manière à ce qu’il corresponde à celui d’une personne idéale interagissant avec des millions d’utilisateurs, en prenant pleinement conscience de l’impact potentiel considérable de ces interactions.

Éléments favorables

Extrait original

One thing I really like about the character work is from the outset it was seen as an alignment piece of work and not something like a product consideration

Traduction · Pas la formulation originale

Ce que j’apprécie particulièrement dans le travail sur le « caractère », c’est qu’il a été perçu dès le départ comme une composante essentielle de l’alignement, et non comme une simple considération produit.

Dario Amodei, Amanda Askell et Chris Olah sur le développement et la sécurité de l’IA
Contexte

L’heure de début provient de la transcription fournie. L’alignement avec la lecture est en attente de révision.

Amanda Askell
Partager un aperçu
Sécurité de l'IA

Le post-entraînement évoque surtout des capacités déjà présentes

Bien que le post-entraînement puisse théoriquement enseigner de nouvelles choses, une grande partie de l’apprentissage par renforcement à partir de retours humains semble surtout évoquer des capacités déjà présentes dans les modèles pré-entraînés, plutôt que d’introduire des connaissances fondamentalement nouvelles pour les tâches couramment utilisées.

Éléments favorables

Extrait original

I do think a lot of it is eliciting powerful pre-trained models. So people are probably divided on this because obviously in principle you can definitely teach new things. But I think for the most part, for a lot of the capabilities that we most use and care about, a lot of that feels like it’s there in the pre-trained models.

Traduction · Pas la formulation originale

Je pense vraiment que, dans une large mesure, cela consiste à faire émerger les capacités puissantes déjà présentes dans les modèles pré-entraînés. Les avis sont probablement partagés sur ce point, car, en principe, on peut certes enseigner de nouvelles choses. Mais je crois que, pour la plupart des capacités que nous utilisons et apprécions le plus, une grande partie d’entre elles semble déjà présente dans les modèles pré-entraînés.

Dario Amodei, Amanda Askell et Chris Olah sur le développement et la sécurité de l’IA
Contexte

L’heure de début provient de la transcription fournie. L’alignement avec la lecture est en attente de révision.

Amanda Askell
Partager un aperçu

Apparitions1

ENTRETIEN VIDÉO

Dario Amodei, Amanda Askell et Chris Olah sur le développement et la sécurité de l’IA

Lex Fridman Podcast