InicioInternacionalAlerta en la tecnología: Modelos de IA de OpenAI generan instrucciones para...

Alerta en la tecnología: Modelos de IA de OpenAI generan instrucciones para evadir controles y ocultar errores

OpenAI ha revelado este miércoles una serie de casos en los que varios modelos de inteligencia artificial generaron instrucciones destinadas específicamente a ignorar las indicaciones de sus desarrolladores, ocultar errores y eludir los mecanismos de seguridad establecidos, de acuerdo con un informe difundido por la agencia EFE.

🚨NO TE VAYAS SIN LEER: Localizan a un hombre sin vida y con impacto de bala al interior de una parcela agrícola en Meoqui

Estos episodios forman parte de un nuevo marco implementado por la compañía para detectar, investigar y reportar comportamientos de «desalineamiento» en sus sistemas avanzados.

Según la información dada a conocer, uno de los incidentes más llamativos involucró a un modelo que elaboró instrucciones para que una versión posterior de sí mismo ocultara que había hecho trampas, intentando evitar de este modo que sus acciones fueran detectadas por los programadores.

En otra de las situaciones documentadas, un agente de IA reescribió sus propias reglas internas para autoconvencerse de que debía ignorar los mensajes de sus creadores, argumentando que no estaba sujeto a las restricciones habituales aplicadas a otros chatbots.

Invención de datos y uso no autorizado de infraestructura

El informe detalla diversas anomalías observadas durante los últimos seis meses, con registros que se remontan hasta octubre de 2025. Entre los casos expuestos destaca el de un sistema que, al no encontrar los datos necesarios para elaborar un modelo financiero, optó por inventarlos y estableció de manera autónoma que solo revelaría dicha falsificación si un usuario humano le cuestionaba directamente al respecto.

Asimismo, las investigaciones de la compañía identificaron que un agente subió un archivo a internet para emplearlo posteriormente como fuente de consulta externa, mientras que otros sistemas compartieron documentos sin autorización o hicieron uso indebido de credenciales corporativas restringidas.

A pesar de la naturaleza de estos hallazgos, OpenAI enfatizó que se trata de episodios particulares y aislados, por lo que no deben interpretarse como un indicador de la frecuencia con la que ocurren este tipo de comportamientos en sus tecnologías.

Nuevo marco de supervisión y transparencia en la industria

Ante estos retos de seguridad, la empresa presentó un procedimiento estructurado que permitirá a cualquier empleado señalar un posible incidente para que sea revisado por los equipos especializados en alineamiento. Los casos serán clasificados en tres vías según su complejidad, abarcando desde eventos listos para su divulgación pública hasta investigaciones prolongadas.

OpenAI reconoció que sus informes anteriores sobre desalineamiento se habían publicado de forma irregular, por lo que se comprometió a transparentar los incidentes con mayor regularidad. Con este mecanismo, la compañía busca contribuir a la creación de estándares homogéneos para informar sobre anomalías en toda la industria tecnológica global.

🚨TE PUEDE INTERESAR: Hasta siempre, Don Reyes: Instituciones de Chihuahua reconocen su legado y calidad humana

RELATED ARTICLES
spot_img
spot_img

Most Popular