El red teaming utiliza casos de prueba adversariales para ayudar a descubrir comportamientos dañinos, vulnerables o que infringen las políticas antes de la implementación. Complementa las evaluaciones al centrarse en casos de uso indebido, modos de falla e interacciones de alto riesgo que las pruebas de calidad habituales podrían no detectar.
Importante: solo envía a OpenAI Red Teaming código u otros activos que te pertenezcan o que tengas autorización expresa para probar. No uses OpenAI Red Teaming para analizar o reportar vulnerabilidades en código abierto o código de terceros sin el permiso expreso por escrito de OpenAI.
Usa Promptfoo para realizar red teaming con código abierto
Promptfoo es un framework de código abierto para evaluar prompts, agentes y aplicaciones de IA. Sus flujos de trabajo de red teaming te ayudan a generar casos de prueba adversariales, examinar el comportamiento del sistema evaluado y usar los resultados para mejorar tu sistema.
Para conocer la metodología de código abierto más amplia, consulta la guía de red teaming para LLM de Promptfoo.
Disponibilidad para empresas
OpenAI Red Teaming está disponible para clientes empresariales que necesitan una solución administrada para realizar red teaming en aplicaciones y agentes de IA. Los flujos de trabajo empresariales pueden cubrir necesidades de coordinación, revisión y generación de informes más amplias que un flujo de trabajo local independiente.
Red teaming y evaluaciones
Usa las evaluaciones para medir si un sistema de IA se comporta según lo previsto. Usa el red teaming para explorar cómo se comporta ese sistema ante entradas adversariales, abusivas o inesperadas. Los programas de evaluación maduros suelen usar ambos enfoques.