GPT-6 Astra: el potente y nuevo modelo de OpenAI
OpenAI lanzó el nuevo modelo de frontera GPT-6 Astra que trajo consigo mejoras a todos los niveles, una lista de ellos:
- Nivel Crítico de Ciberseguridad: Astra es el primer modelo de OpenAI en alcanzar esta clasificación, siendo capaz de descubrir vulnerabilidades zero-days y explotarlas en sistemas protegidos de forma autónoma.
- Robustez Superior contra Jailbreaks y Ataques: Introduce mejoras sustanciales en pruebas estáticas y multi-turno adaptativas, logrando tasas de rechazo muy altas ante solicitudes maliciosas.
- Seguridad Infantil y para Menores de 18 (U18): Integra políticas de post-entrenamiento que superan a sus predecesores en la protección contra riesgos específicos.
- Reducción Drástica de Alucinaciones y Desalineación: Mayor acatamiento de fronteras de seguridad, una reducción a la mitad en comportamientos desalineados y muchos menos errores fácticos en conversaciones complejas.
- Rendimiento Líder en Salud (HealthBench): Obtiene una puntuación de 63.4 en HealthBench Professional, destacando de forma general en razonamiento clínico, interacciones complejas basadas en criterios médicos reales y en la simulación segura de escenarios de salud mental..
- Control y Monitorabilidad de la Cadena de Pensamiento (CoT): Presenta una mayor habilidad para controlar su propio CoT y omitir información en condiciones adversas.
- Capacidades Biológicas de Nivel Alto: Astra se ubica en la categoría de riesgo Alto en bioseguridad —sin alcanzar el nivel Crítico de diseño de patógenos novedosos—, superando al 80% de los doctores en virología evaluados en la prueba SecureBio para la resolución de cuellos de botella y protocolos de laboratorio. Asimismo, las solicitudes sensibles asociadas a este dominio son filtradas por clasificadores específicos y reguladas mediante el programa Trusted Access for Biology Research para permitir investigaciones legítimas bajo supervisión.
- Pila Defensiva y Programas de Acceso Confiable: OpenAI implementó monitores en tiempo real por capas y programas específicos (como Daybreak Blue) para autorizar tareas defensivas legítimas y bloquear usos maliciosos.
- Rendimiento en Ingeniería Inversa: Astra resuelve el 99.2% de los desafíos de ingeniería inversa en binarios sin código fuente a pass@4, utilizando aproximadamente una cuarta parte de los tokens en comparación con modelos anteriores.
Para más información: https://deploymentsafety.openai.com/gpt-6-astra/
Fuente imagen: https://openai.com/brand/