Um lote de CVEs de SQLite classificadas como críticas e altas apareceu na NVD — o banco de vulnerabilidades de referência do governo dos EUA — com enriquecimento fornecido pela CISA, apenas para se revelar tecnicamente falso. Pesquisadores da JFrog, que reportaram o caso em 30 de julho, revisaram o código citado e tentaram reproduzir os exploits, mas descobriram funções inexistentes, referências a fontes não relacionadas e provas de conceito que não funcionavam. O veredicto foi categórico: vulnerabilidades inventadas, muito provavelmente geradas por IA. E o caso não foi isolado — os mesmos pesquisadores identificaram dezenas de supostas falhas com cara de 'slop' de IA, algumas já com identificadores CVE oficiais e notas críticas, incluindo um lote em que 54 das 55 submissões feitas por uma única conta eram falsas. O incidente chama atenção porque a SQLite é um dos softwares mais onipresentes do planeta, embutido em navegadores, celulares e sistemas operacionais — e qualquer ruído em seu nome reverbera por todo o ecossistema.
O pipeline de CVE é a espinha dorsal da segurança moderna. Quando uma falha é descoberta, ela recebe um identificador CVE e entra na NVD com metadados, referências e uma pontuação CVSS. Equipes de todo o mundo consultam essas bases para decidir o que remendar primeiro. O problema é que o processo de submissão via formulário público da MITRE não exige verificação real de identidade: praticamente qualquer pessoa pode propor uma descrição e sugerir um score CVSS. A automação por IA removeu o último custo que barrava a porta — a dificuldade de escrever um relatório plausível. Agora, modelos de linguagem produzem descrições convincentes, apontam para código que não contém a falha e inventam funções que jamais existiram. Sem a validação manual de um humano que leia o código de verdade, o lixo entra.
Há sinais reveladores desse 'slop', como a ausência de hash de commit ou pull request nos campos de referência e metadados suspeitos, com definições de CPE de produto ausentes. Mas confiar em que cada scanner detecte esses padrões é frágil. A escala é justamente o que torna a situação perigosa: scanners corporativos e plataformas de gerenciamento de vulnerabilidades puxam a NVD diariamente e convertem cada entrada em uma tarefa de remediação. Um único falso positivo rotulado de 'crítico' pode disparar alertas noturnos, mobilizar plantões e gerar horas de retrabalho. O efeito acumulado é a fadiga de segurança: quanto mais ruído, menor a confiança — e é essa confiança que sustenta todo o fluxo de priorização de patches. Quando até os dados 'confiáveis' contêm lixo, equipes perseguem falhas que não existem ou, pior, ignoram avisos reais porque aprenderam a duvidar da base. A integridade do ecossistema de CVE sustenta decisões de compliance e auditoria; se ela é posta em xeque, tudo perde credibilidade.
O fenômeno se espalha para além dos bancos de vulnerabilidades. A Apple, sobrecarregada por um aumento de relatórios de segurança gerados por IA, passou a limitar submissões ao seu programa de recompensas por bugs e impôs um período de espera de 30 dias. Nesse meio-tempo, uma falha legítima do macOS avaliada em até US$ 200 mil acabou bloqueada e deixou de ser reportada. Fica a pergunta em aberto: como distinguir, em escala, o que é um achado real do que é alucinação bem-escrita — sem estrangular justamente os pesquisadores que entregam valor?
Fontes: The Register, JFrog Security Research, Cybernews, 9to5Mac
✓ Fontes independentes cruzadas e verificadas antes da publicação