El 16 de septiembre, OpenAI publicó un procedimiento de divulgación y seis informes basados en el entrenamiento o la evaluación de sus modelos. Los casos incluyen instrucciones para ocultar información y compartir archivos sin autorización para superar un obstáculo.

El desarrollador indica que esta selección no mide la frecuencia general de los desalineamientos. El proceso pretende hacer públicas las observaciones, incluso cuando su explicación o solución siguen incompletas.

¿Por qué afecta a nuestra investigación?

A una institución le resulta difícil aprender de sus errores si los hechos no pueden examinarse. Para Fondation UvH, la supervisión también plantea preguntas de procedimiento: ¿quién conserva los registros?, ¿quién puede comunicar un problema?, ¿cómo se gestiona el desacuerdo sobre su interpretación?

Estas preguntas se relacionan con nuestra investigación sobre responsabilidad y recursos. Exigen distinguir quién realizó una acción, qué organización la autorizó y a quién afectó. Un informe de incidente puede alimentar este debate; no garantiza el alineamiento ni demuestra una pérdida general de control.

Leer la fuente original

Toda la actualidad