For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegación principal

Red teaming

Pon a prueba los sistemas de IA para detectar usos indebidos y riesgos de seguridad antes de implementarlos.

El red teaming utiliza casos de prueba adversariales para ayudar a descubrir comportamientos dañinos, vulnerables o que infringen las políticas antes de la implementación. Complementa las evaluaciones al centrarse en casos de uso indebido, modos de falla e interacciones de alto riesgo que las pruebas de calidad habituales podrían no detectar.

Importante: solo envía a OpenAI Red Teaming código u otros activos que te pertenezcan o que tengas autorización expresa para probar. No uses OpenAI Red Teaming para analizar o reportar vulnerabilidades en código abierto o código de terceros sin el permiso expreso por escrito de OpenAI.

Usa Promptfoo para realizar red teaming con código abierto

Promptfoo es un framework de código abierto para evaluar prompts, agentes y aplicaciones de IA. Sus flujos de trabajo de red teaming te ayudan a generar casos de prueba adversariales, examinar el comportamiento del sistema evaluado y usar los resultados para mejorar tu sistema.

Para conocer la metodología de código abierto más amplia, consulta la guía de red teaming para LLM de Promptfoo.

Disponibilidad para empresas

OpenAI Red Teaming está disponible para clientes empresariales que necesitan una solución administrada para realizar red teaming en aplicaciones y agentes de IA. Los flujos de trabajo empresariales pueden cubrir necesidades de coordinación, revisión y generación de informes más amplias que un flujo de trabajo local independiente.

Red teaming y evaluaciones

Usa las evaluaciones para medir si un sistema de IA se comporta según lo previsto. Usa el red teaming para explorar cómo se comporta ese sistema ante entradas adversariales, abusivas o inesperadas. Los programas de evaluación maduros suelen usar ambos enfoques.