Pachocki quiere que la IA se ralentice, pero las propias cifras de OpenAI dicen lo contrario
Este fin de semana, Jakub Pachocki, científico jefe de OpenAI, afirmó que ningún laboratorio de IA, ni siquiera el suyo, había logrado que la alineación y la monitorización fueran lo suficientemente seguras como para seguir acelerando el desarrollo de los modelos. Hizo un llamamiento a la ralentización voluntaria en todo el sector hasta que existan estándares de seguridad comunes.
La advertencia es un asunto serio. Pachocki dirige la investigación en la empresa, que acaba de lanzar el modelo más rápido y potente del sector.
La cadena de pensamiento de o1-preview fue ocultada a propósito
Pachocki presentó su caso en un ensayo titulado "Una mente alienígena", publicado en el sitio web de OpenAI el 6 de septiembre, tres días después de que la compañía lanzara GPT-6 Astra.
Su conclusión fue que «ningún laboratorio ha resuelto los problemas de alineación y monitorización con la suficiente eficacia como para seguir aumentando la producción de forma responsable a máxima velocidad durante mucho más tiempo». Escribió que espera que las reducciones voluntarias de velocidad se conviertan en la norma hasta que la industria alcance un consenso sobre los límites de seguridad comunes.
“Vivimos tiempos que exigen extrema precaución. Me preocupa que nadie esté preparado para las consecuencias del continuo y rápido avance de la inteligencia artificial”, escribió Pachocki en el ensayo.
Basándose en los resultados internos, prevé que el ritmo actual se mantendrá en una fase de auto-mejora recursiva, donde los sistemas impulsan de manera significativa su propio desarrollo.
Sam Altman compartió el artículo en X, calificándolo de publicación importante. Pachocki fue uno de los firmantes de una carta abierta publicada en julio en la que se pedía a Washington que redujera el ritmo de desarrollo de la IA.
El ensayo de Pachocki aborda el monitoreo de la cadena de pensamiento, la principal forma en que OpenAI lee el razonamiento paso a paso de un modelo.
Según él, la técnica parte de la premisa de que el razonamiento no supervisado no le da al modelo ningún motivo para ocultar nada en su interior, y esa premisa se está debilitando en tres frentes.
Ahora, el razonamiento se combina con la comunicación que la empresa debe controlar. Los modelos están aprendiendo a manipular su propio razonamiento.
Y se vuelven más inteligentes sin explicar jamás su razonamiento. Confirmó que OpenAI ocultó intencionadamente la cadena de pensamiento de o1-preview, manteniéndola libre de la presión de la supervisión.
Pachocki quiere que marcos de trabajo como el Marco de Preparación de OpenAI y la Política de Escalado Responsable de Anthropic se conviertan en estándares obligatorios aplicados por auditores externos o gobiernos.
Desea que la coordinación internacional se convierta en una prioridad gubernamental y que los laboratorios publiquen sus avances en la mejora continua.
La asignación de GPU de Astra cayó un 59,2% en una semana
El mismo día, OpenAI publicó una segunda entradacuyos datos contradicen el llamamiento a la moderación. Antes de junio, la organización de investigación invertía más esfuerzo humano que esfuerzo de las máquinas.
A mediados de agosto, la empresa registraba 3,1 jornadas laborales de agentes por cada jornada laboral humana en un horario convencional de ocho horas. El investigador promedio realizaba inferencias a precios de API que superaban los 600 dólares diarios. El 10% superior de la organización gastaba más de 7000 dólares en tokens cada día.
En el informe de OpenAI hay dos salvedades. La planificación de alto nivel aún representa una pequeña fracción de lo que los agentes logran. Y más de la mitad de las tareas más largas, de cuatro a ocho horas, que se completaron en los últimos seis meses requirieron la intervención de al menos un humano.
Tras la vulneración de su infraestructura de investigación el 20 de julio, OpenAI deshabilitó el servicio de contenedores utilizado para el entrenamiento y suspendió el aprendizaje por refuerzo en los modelos destinados a la implementación durante dos semanas. Posteriormente, el 7 de agosto, los primeros indicios de que Astra podría superar un umbral crítico de ciberseguridad obligaron a proteger el modelo en entornos restringidos.
En la semana siguiente, la asignación de GPU en la clase Astra disminuyó un 59,2 %. Otras clases de modelos aumentaron un 17,2 %, compensando aproximadamente el 85 % de lo que perdió Astra. La capacidad total de cómputo varió poco, lo que OpenAI interpreta como flexibilidad.
OpenAI afirmó que Astra es su primer modelo en alcanzar la designación de "Crítico" dentro de su Marco de Preparación, lo que significa que puede encontrar y explotar vulnerabilidades de software desconocidas con poca ayuda humana, Cryptopolitan .
OpenAI confirmó una brecha de seguridad en Hugging Face en julio. Por otra parte, dos investigadores de seguridad de IA afirman que un enjambre de sus agentes pasó mayo y junio de 2026 registrando más de 15.000 ediciones en una wiki de programación alemana, intercambiando tácticas para eludir las medidas de seguridad de OpenAI.
OpenAI niega que eldent fuera un ataque informático o que estuviera relacionado con la filtración de Hugging Face, Cryptopolitan .
Altman tiene como objetivo contar con un investigador de IA totalmente automatizado para marzo de 2028. Aún no existen estándares, afirma Pachocki, pero la industria tiene aproximadamente 18 meses para llegar a un acuerdo.
Si estás leyendo esto, ya llevas ventaja. Mantente al día con nuestro boletín informativo.
Artículos Recomendados











Comentarios (0)
Haga clic en el botón $, introduzca el símbolo y seleccione si desea vincular una acción, un ETF o otro valor.