GPT-5.3 Codex recibe la primera calificación de seguridad alta de OpenAI

El 5 de febrero de este año, OpenAI lanzó GPT-5.3-Codex, y las capacidades de programación dieron un gran salto — pero junto con ello llegó una etiqueta poco halagüeña: el primer nivel de riesgo de ciberseguridad "Alto" en el marco interno de evaluación de seguridad de OpenAI.

¿Qué tan peligroso es?

La propia OpenAI se expresó con cautela: "No hay evidencia concluyente de que el modelo pueda automatizar completamente ataques cibernéticos", pero "por precaución" implementó "el stack de protección de ciberseguridad más completo hasta la fecha".

Traduciendo: Las habilidades de programación de este modelo han alcanzado un punto crítico. Si se explota mediante automatización a gran escala, podría causar daños reales en el ámbito de la ciberseguridad.

Medidas de seguridad

OpenAI adoptó varias capas de protección:

  • Entrenamiento de seguridad: Alineación a nivel de modelo
  • Monitoreo automático: Detección de solicitudes sospechosas
  • Acceso jerárquico: Operaciones de alto riesgo solo para usuarios de confianza
  • Enrutamiento de degradación: Las solicitudes detectadas con alto riesgo de ciberseguridad se redirigen automáticamente a la generación anterior GPT-5.2

El cronograma de lanzamiento también fue inusualmente cauteloso, retrasando la apertura completa a los desarrolladores.

Consecuencias posteriores

El regulador de seguridad de IA de California afirmó posteriormente que este lanzamiento podría haber violado la nueva ley de seguridad de IA recién aprobada en el estado. OpenAI negó la acusación.

En marzo, también se expuso una vulnerabilidad de fuga de token de GitHub de Codex — que luego fue parcheada.

OpenAI también proporcionó $10 millones en créditos de API para apoyar la investigación de defensa cibernética, continuando el programa de subvenciones de ciberseguridad de $1 millón iniciado en 2023.

Hay una contradicción profunda aquí: Cuanto más fuerte es la capacidad de programación, mayor es el riesgo de uso indebido. La mejora de las capacidades del modelo y el aumento de los riesgos de seguridad tienen una correlación casi lineal. OpenAI eligió el camino de "lanzar primero, proteger después" en lugar de "proteger primero, lanzar después". Sobre esta elección, hay una gran división en la industria.

Fuente de referencia: CocoLoop, informe de Fortune