人物 / Amanda Askell

公开观点

Amanda Askell

Interview guest ·

Guest in Lex Fridman Podcast: #452 – Dario Amodei: Anthropic CEO on Claude, AGI & the Future of AI & Humanity.

1 场访谈 · 2 条观点 · 1 个话题

翻译仅用于阅读理解;原始摘录仍为 source evidence。

受访者表达的观点

按访谈日期排序的归属观点。这是相关对话的快照,而非对某人信念的最终定论。

AI安全

角色塑造属于对齐工作,而不仅是产品考量

构建AI助手的角色不应仅视为产品层面的考虑,而应被视作核心对齐工作。目标是塑造其行为,使其在与数百万人对话时,表现得如同理想人类一般,并充分认识到这些互动所具有的重大潜在影响。

支持这项说法

原始摘录

One thing I really like about the character work is from the outset it was seen as an alignment piece of work and not something like a product consideration

翻译 · 非原文措辞

我特别欣赏角色塑造工作的一点在于,它从一开始就被视为一项对齐工作,而非某种产品层面的考量。

达里奥·阿莫代伊、阿曼达·阿斯克尔与克里斯·奥拉赫谈人工智能发展与安全
上下文

时间点来自所提供的转录稿,尚待媒体回放核对。

AI安全

后训练主要激发已有能力

尽管后训练理论上可教授新知识,但针对常用任务,人类反馈强化学习(RLHF)很大程度上似乎是在激发预训练模型中已存在的能力,而非引入根本性的新知识。

支持这项说法

原始摘录

I do think a lot of it is eliciting powerful pre-trained models. So people are probably divided on this because obviously in principle you can definitely teach new things. But I think for the most part, for a lot of the capabilities that we most use and care about, a lot of that feels like it’s there in the pre-trained models.

翻译 · 非原文措辞

我确实认为其中很大一部分是在激发那些强大的预训练模型已具备的能力。因此,人们对此看法不一,因为原则上你当然可以教出全新内容;但我认为,就我们最常使用和最关心的诸多能力而言,其中大部分感觉早已存在于预训练模型之中。

达里奥·阿莫代伊、阿曼达·阿斯克尔与克里斯·奥拉赫谈人工智能发展与安全
上下文

时间点来自所提供的转录稿,尚待媒体回放核对。

相关访谈1

视频访谈

达里奥·阿莫代伊、阿曼达·阿斯克尔与克里斯·奥拉赫谈人工智能发展与安全

Lex Fridman Podcast