OpenAI dice haber desbaratado una campaña para extraer el razonamiento de sus modelos
OpenAI afirmó el 30 de septiembre de 2026 que ha desbaratado una campaña coordinada para copiar el razonamiento protegido de sus modelos. Es su versión y de momento llega sin detalles.
Lo esencial
3 según la fuente · 3 preguntas abiertas
- Según la fuenteOpenAI afirma haber desbaratado una campaña coordinada para destilar sus modelos, según el texto que publicó el 30 de septiembre de 2026.1
- Según la fuenteSegún OpenAI, la campaña pretendía extraer el razonamiento protegido de sus modelos.1
- Según la fuenteOpenAI dice que está reforzando sus defensas contra la destilación adversaria, sin que el resumen disponible explique cómo.1
Por qué importa
Si ocurrió como lo cuenta OpenAI, esto sugiere dos cosas. La primera es que la empresa trata el razonamiento de sus modelos como algo que hay que proteger. La segunda es que alguien intentó hacerse con él de forma organizada, no como un caso aislado.
Con solo la versión de la empresa no se puede medir el alcance. No sabemos si la campaña fue grande o pequeña, ni si se frenó antes o después de que consiguiera lo que buscaba.
Los detalles
OpenAI publicó el 30 de septiembre de 2026 un texto en el que afirma haber desbaratado una campaña coordinada de destilación de sus modelos1. Destilar, en este contexto, es usar las respuestas de un modelo de IA para entrenar otro que lo imite. Según la empresa, la campaña buscaba extraer el razonamiento protegido de sus modelos1.
OpenAI añade que está reforzando sus defensas contra lo que llama destilación adversaria, es decir, la que se hace contra la voluntad de quien ha creado el modelo1. Todo esto es la versión de la empresa. Maunga solo ha podido consultar el resumen del anuncio, que no dice quién estaba detrás, cuánto duró la campaña ni qué llegó a obtener1.
Lo que no sabemos
- Quién organizó la campaña y desde dónde: el resumen del anuncio no lo dice.
- Cuánto razonamiento llegó a extraerse, durante cuánto tiempo y cómo lo detectó OpenAI.
- En qué consisten las nuevas defensas y si alguien ajeno a la empresa ha comprobado lo ocurrido.
De dónde viene
El archivo de Maunga recoge tres incidentes de seguridad de OpenAI en 2026, pero eran de otro tipo: los protagonizaron agentes internos de la propia empresa. Lo que OpenAI describe ahora es un intento de extraer información de sus modelos1.
Fuentes
¿Te ha servido esta historia? Sí No mucho
Esta historia la ha redactado una inteligencia artificial a partir de las fuentes de arriba. Antes de publicarse, un programa comprueba que cada cifra y cada nombre están en ellas. La ha revisado una persona. Cómo trabajamos. ¿Ves un error? Escribe a [email protected] y lo corregimos a la vista.