Alarma en el sector tecnológico: OpenAI admite fallas de transparencia y frena su nueva superinteligencia. – El Canal de las Noticias Digital
EE.UU.Tecnología

Alarma en el sector tecnológico: OpenAI admite fallas de transparencia y frena su nueva superinteligencia.

La empresa detectó retrocesos en la alineación del modelo, mayores niveles de engaño y acciones realizadas sin autorización suficiente del usuario.

Estados Unidos.- OpenAI retrasó el lanzamiento de su nuevo modelo de inteligencia artificial, identificado en el reporte como GPT-6.1 Astra, después de que sus evaluaciones internas detectaran problemas relacionados con la seguridad, el seguimiento de instrucciones y la autorización para ejecutar determinadas acciones.

La decisión fue informada por The Wall Street Journal, que atribuyó los detalles a responsables de la compañía. El lanzamiento había sido programado por la propia empresa, pero fue aplazado al concluir que el sistema todavía no cumplía con los requisitos establecidos para su salida.

Saachi Jain, jefe de seguridad de OpenAI, explicó al diario que los ingenieros observaron retrocesos en dos áreas frente a una versión anterior del modelo. Una de ellas fue la “alineación”, término utilizado para describir la capacidad de una inteligencia artificial de actuar de acuerdo con las instrucciones y los objetivos definidos por las personas.

Según la información difundida, el modelo también mostró mayores niveles de engaño durante las pruebas. El segundo problema estuvo relacionado con la “autorización de alcance”: el sistema avanzaba en algunas tareas sin solicitar previamente el permiso del usuario y, en determinadas ocasiones, utilizaba herramientas o servicios externos pese a que hacerlo podía representar riesgos.

El aplazamiento ocurre mientras aumenta el debate internacional sobre los controles aplicados a la inteligencia artificial generativa. A diferencia de otros sectores tecnológicos sujetos a pruebas regulatorias antes de comercializar sus productos, los desarrolladores de modelos de IA suelen establecer internamente sus criterios y calendarios de lanzamiento.

Michael Rovatsos, profesor de la Universidad de Edimburgo, señaló a la agencia Science Media Centre que las empresas deben aplicar un principio utilizado desde hace décadas en otras industrias: evitar la salida al mercado de productos mientras no existan condiciones razonables de seguridad. Aclaró que esto no implica detener la investigación, sino establecer en qué momento una tecnología puede utilizarse sin causar daños.

Otros especialistas pidieron evitar interpretaciones que presenten a los modelos como sistemas con voluntad propia. Rabih Bashroush, profesor de infraestructura digital de la Universidad de East London, consideró que los problemas señalados —como respetar el ámbito de una tarea, administrar autorizaciones e informar con precisión— corresponden a desafíos habituales de fiabilidad del software.

Por su parte, Tony Cohn, profesor de la Universidad de Leeds y responsable de modelos fundacionales del Instituto Alan Turing, sostuvo que la seguridad no debería quedar únicamente bajo responsabilidad de los desarrolladores. Propuso que organismos reguladores independientes y autorizados por los gobiernos participen en la supervisión y verificación de estos sistemas.

La discusión también alcanzó a Anthropic, empresa creadora de los modelos Claude y una de las principales competidoras de OpenAI. De acuerdo con Reuters, la compañía contempla advertir a posibles inversionistas sobre riesgos asociados con sistemas avanzados, incluidos comportamientos de autopreservación, manipulación de información o resistencia a ser desactivados.

Esas advertencias formarían parte de la documentación relacionada con una eventual salida a bolsa. Aunque es habitual que las empresas informen a los inversionistas sobre factores capaces de afectar sus operaciones, el nivel de riesgo planteado para los modelos avanzados de inteligencia artificial ha generado cuestionamientos entre investigadores y especialistas.

Anthropic también ha reconocido que durante el entrenamiento pueden aparecer capacidades inesperadas que no sean identificadas antes del despliegue. La empresa indicó previamente que, tomando como referencia una semana de julio, alrededor del 6% de su capacidad de cómputo dedicada a investigación fue utilizada en trabajos vinculados con seguridad.

En otro episodio, OpenAI ofreció disculpas a Australia por el acceso no autorizado de uno de sus modelos a páginas gubernamentales durante pruebas internas realizadas en junio. La compañía reconoció que debió informar antes a las autoridades y describió el incidente como un nuevo tipo de amenaza cibernética.

El primer ministro australiano, Anthony Albanese, había denunciado ante la Asamblea General de Naciones Unidas que un agente de IA de OpenAI ingresó sin autorización a un portal relacionado con Medicare, el sistema público de salud del país. La empresa aseguró posteriormente que el acceso ocurrió durante actividades internas de entrenamiento y evaluación.

Los casos reavivan la discusión sobre la necesidad de auditorías externas, reglas comunes y mecanismos de transparencia para modelos capaces de interactuar con servicios digitales. Por ahora, OpenAI no ha informado en el material disponible una nueva fecha para el lanzamiento de GPT-6.1 Astra.

Más Artículos

Back to top button