← volver al portal

OpenAI implementa modelo de pruebas de seguridad automatizado para reforzar GPT-5.6

OpenAI ha presentado GPT-Red, un modelo interno especializado en pruebas de seguridad adversarial que automatiza la detección de vulnerabilidades…

Los equipos de seguridad deben monitorear la evolución de herramientas de pruebas adversariales como GPT-Red para entender metodologías de detección de inyección de prompts aplicables a sus propios sistemas de IA. Considerar integrar pruebas adversariales similares en su ciclo de desarrollo y evaluación de modelos de lenguaje antes de poner en producción.