Temas / Seguridad de la IA

Vista previa · No revisado para su publicación

Opinión atribuida · No es una cita textual

El posentrenamiento mayormente evoca capacidades ya existentes

Aunque el posentrenamiento puede enseñar teóricamente cosas nuevas, gran parte del aprendizaje por refuerzo con retroalimentación humana parece evocar capacidades ya presentes en los modelos preentrenados, en lugar de introducir conocimientos fundamentalmente nuevos para las tareas comúnmente utilizadas.

Los enlaces de vista previa funcionan en este entorno. La URL de la tarjeta pública estará disponible solo después de la publicación.

Detrás de la opinión

Las traducciones son para facilitar la lectura; los extractos originales siguen siendo la source evidence.

Dario Amodei, Amanda Askell y Chris Olah sobre el desarrollo y la seguridad de la IA

Extracto original

I do think a lot of it is eliciting powerful pre-trained models. So people are probably divided on this because obviously in principle you can definitely teach new things. But I think for the most part, for a lot of the capabilities that we most use and care about, a lot of that feels like it’s there in the pre-trained models.

Traducción · No es la redacción original

Sí creo que gran parte de ello consiste en evocar modelos preentrenados muy potentes. Así que probablemente las opiniones estén divididas sobre esto, porque obviamente, en principio, definitivamente puedes enseñar cosas nuevas. Pero creo que, en su mayor parte, para muchas de las capacidades que más usamos y valoramos, gran parte de eso parece estar ya presente en los modelos preentrenados.

Contexto

La hora de inicio proviene de la transcripción proporcionada. La alineación de la reproducción está pendiente de revisión.