OpenAI acusa a gente ligada a Moonshot de extraer su razonamiento

OpenAI acusó el 30 de septiembre de 2026 a personas asociadas con Moonshot AI, la empresa china que desarrolla los modelos Kimi, de formar parte de una campaña coordinada para extraer el «razonamiento protegido» de sus modelos. Se trata de una acusación de OpenAI, publicada en su propio blog: no hay, hasta ahora, una resolución judicial ni una confirmación independiente.
OpenAI define ese razonamiento como el registro interno con el que un modelo trabaja una tarea. Según la compañía, extraerlo puede revelar información que se omite en la respuesta final y ayudar a otros a reproducir las capacidades del modelo. La empresa describe la actividad como «destilación adversarial»: el uso sistemático y no autorizado de las salidas o el razonamiento de un modelo para entrenar, reproducir o mejorar otro. La destilación, en su versión legítima, consiste en entrenar un modelo más pequeño con las respuestas de uno más grande.
Las cifras que reporta OpenAI
- La actividad empezó el 1 de julio de 2026, con poco volumen al principio.
- Los días 24 y 25 de julio hubo picos de 16.000 solicitudes con un patrón de extracción relevante, provenientes de más de 4.000 usuarios. OpenAI aclara que son intentos, no necesariamente extracciones logradas.
- Una investigación posterior halló actividad con patrones de instrucciones parecidos en un conjunto de más de 15.000 usuarios.
- OpenAI afirma que logró interrumpir por completo la campaña a más tardar el 28 de julio.
Qué dice OpenAI de Moonshot, y qué no
La atribución es cuidadosa. OpenAI escribe que no está claro si todos los operadores observados venían de un solo actor, pero que atribuye «un núcleo principal de la actividad a personas vinculadas a Moonshot AI». No afirma que la empresa como tal haya ordenado la campaña, ni publica en su nota las pruebas técnicas de esa vinculación.
El método, según OpenAI, no fue una intrusión clásica. La compañía asegura que los operadores no rompieron su cifrado, no comprometieron una base de datos ni accedieron a conversaciones almacenadas de usuarios. Lo que hicieron, dice, fue manipular las interacciones con los modelos para que el razonamiento protegido apareciera en un formato visible. Un ejemplo que cita: copiar razonamiento cifrado de una conversación y pedirle a un modelo, en otra conversación, que lo descifrara y lo transcribiera.
OpenAI también señala que investigadores de seguridad independientes le avisaron, mediante divulgación responsable, de vulnerabilidades relacionadas entre modelos y en la compactación de conversaciones, y que confirmó que esas vías eran reales. Aclara además que esta manipulación no es una debilidad exclusiva de sus modelos.
La respuesta de OpenAI
La empresa dice que bloqueó o restringió cuentas fraudulentas, reforzó los controles de registro y de infraestructura, y amplió la vigilancia de redes relacionadas. También cerró una vía que permitía a quien ya tuviera el razonamiento cifrado de otro usuario reproducirlo para recuperar su contenido. Compartió sus hallazgos con otros desarrolladores mediante el Frontier Model Forum y con canales gubernamentales de intercambio de información. OpenAI añade que el trabajo de mitigación e investigación continúa.
Un contexto que ya existía
La acusación llega en medio de otras que apuntan a Moonshot, siempre como alegaciones de terceros. Según CNBC, Anthropic acusó en septiembre de 2026 a varios desarrolladores chinos, entre ellos Moonshot AI y Alibaba, de usar su modelo Claude en secreto para ayudar a entrenar sus propios sistemas. Por su parte, un aviso conjunto de la NSA, CISA y el FBI del 8 de septiembre de 2026 afirma que Moonshot AI y otras empresas chinas extrajeron datos de modelos estadounidenses; es una afirmación de esas agencias sobre un periodo distinto, que no equivale a la campaña que describe OpenAI.
CNBC informó de que Moonshot no respondió de inmediato a sus solicitudes de comentarios. Al momento de escribir esta nota no localizamos una respuesta pública de Moonshot a la acusación de OpenAI.
Por qué te importa
Para equipos que construyen productos sobre modelos de razonamiento por API, el caso muestra un riesgo concreto: los términos de uso se vigilan y OpenAI dice que baneó cuentas y endureció controles. Conviene revisar qué cuentas y claves comparten sus equipos y qué proveedores intermedios usan, porque OpenAI afirma que, cuando la actividad pasó por servicios de terceros, trabajó con esos proveedores para cortar las cuentas implicadas.
Para quien evalúa modelos chinos como Kimi, la lectura prudente (análisis de PrimixIA) es esperar: es una acusación sin respuesta pública de Moonshot ni verificación independiente. PrimixIA no encontró información confirmada sobre el efecto de esta disputa en la disponibilidad de Kimi en Latinoamérica, ni en sus precios, así que no los damos por supuestos.
Qué sigue
OpenAI dice que la investigación y las mitigaciones continúan y que espera que los intentos de destilación adversarial se vuelvan más sofisticados. No hay fecha confirmada para nuevas publicaciones de OpenAI ni para una respuesta de Moonshot. Seguiremos el caso y actualizaremos esta nota si Moonshot responde o si aparecen verificaciones independientes.








