ConceptGuard: Desaprendizado Sensível ao Contexto em Modelos de Linguagem
Apresenta um benchmark abrangente para avaliar a capacidade de LLMs em remover seletivamente conhecimento prejudicial enquanto preservam comportamentos benignos. Diferencia-se dos trabalhos anteriores ao capturar a relação entre fatos esquecidos e retenção de conhecimento contextualmente relevante, endereçando um desafio crítico para a implantação segura de LLMs em produção.
Ler artigo completo