Glossário · Segurança
Jailbreak de LLM
Contorno deliberado das restrições do modelo.
Definição
Técnica que induz o modelo a ignorar políticas de conteúdo, salvaguardas ou instruções de sistema por meio de reformulação, role-play, codificação ou encadeamento de contexto. Testar jailbreak é parte do red teaming de IA e da validação de guardrails.
Páginas relacionadas
Próximo passo
Quer aplicar esse conceito na sua empresa?
Solicite um diagnóstico inicial de Governança de IA com a VGrid.
Retornamos o contato após análise inicial do contexto.
