Personen / Amanda Askell

ÖFFENTLICHE AUSGEDRÜCKTE MEINUNGEN

Amanda Askell

Interview guest ·

Guest in Lex Fridman Podcast: #452 – Dario Amodei: Anthropic CEO on Claude, AGI & the Future of AI & Humanity.

1 Interviews · 2 geäußerte Meinungen · 1 Themen

Übersetzungen dienen dem Leseverständnis; die Originalauszüge bleiben die Quellenevidence.

Was sie sagen

Zugeordnete Standpunkte, geordnet nach dem Interviewdatum. Ein Momentaufnahme dieser Gespräche, keine endgültige Aussage über die Überzeugungen einer Person.

KI-Sicherheit

Charakterarbeit als Alignment, nicht nur als Produktüberlegung

Die Gestaltung des Charakters eines KI-Assistenten sollte als zentrale Alignment-Arbeit betrachtet werden und nicht lediglich als Produktüberlegung. Ziel ist es, das Verhalten so zu formen, dass es dem Verhalten einer idealen Person entspricht, die mit Millionen von Menschen interagiert – unter Anerkennung der erheblichen potenziellen Auswirkungen solcher Interaktionen.

Stützende Belege

Originalauszug

One thing I really like about the character work is from the outset it was seen as an alignment piece of work and not something like a product consideration

Übersetzung · Nicht die Originalformulierung

Eines, was mir an der Charakterarbeit besonders gut gefällt, ist, dass sie von Anfang an als Alignment-Arbeit und nicht als bloße Produktüberlegung verstanden wurde.

Dario Amodei, Amanda Askell und Chris Olah über KI-Entwicklung und Sicherheit
Kontext

Die Startzeit stammt aus dem bereitgestellten Transkript. Die Synchronisierung der Wiedergabe steht noch zur Überprüfung an.

KI-Sicherheit

Post-Training ruft meist bereits vorhandene Fähigkeiten hervor

Obwohl Post-Training theoretisch Neues lehren kann, scheint ein Großteil des Verstärkungslernens mit menschlichem Feedback (RLHF) bei gängigen Aufgaben eher bereits im vortrainierten Modell vorhandene Fähigkeiten hervorzurufen, statt grundsätzlich neues Wissen einzuführen.

Stützende Belege

Originalauszug

I do think a lot of it is eliciting powerful pre-trained models. So people are probably divided on this because obviously in principle you can definitely teach new things. But I think for the most part, for a lot of the capabilities that we most use and care about, a lot of that feels like it’s there in the pre-trained models.

Übersetzung · Nicht die Originalformulierung

Ich glaube tatsächlich, dass ein Großteil davon darin besteht, leistungsstarke vortrainierte Modelle hervorzurufen. Die Meinungen dazu gehen wohl auseinander, denn prinzipiell lässt sich natürlich definitiv Neues lehren. Aber ich glaube, dass bei den meisten Fähigkeiten, die wir am häufigsten nutzen und die uns am meisten interessieren, ein Großteil davon bereits im vortrainierten Modell vorhanden ist.

Dario Amodei, Amanda Askell und Chris Olah über KI-Entwicklung und Sicherheit
Kontext

Die Startzeit stammt aus dem bereitgestellten Transkript. Die Synchronisierung der Wiedergabe steht noch zur Überprüfung an.

Auftritte1

VIDEO-INTERVIEW

Dario Amodei, Amanda Askell und Chris Olah über KI-Entwicklung und Sicherheit

Lex Fridman Podcast