LLMs_Phishing
收藏资源简介:
Este repositório contém os conjuntos de dados utilizados na pesquisa“Cibercrime e Inteligência Artificial: O Papel dos Modelos de Linguagem no Aperfeiçoamento de Ataques de Phishing”. O dataset é composto por 2.000 e-mails de phishing, sendo:– Human_phishing.csv: 1.000 mensagens autênticas provenientes do Nazario Phishing Corpus e SpamAssassin Public Corpus;– LLM_phishing.csv: 1.000 mensagens sintéticas geradas por Grandes Modelos de Linguagem (ChatGPT e LLaMA-2-13B) em ambiente controlado, com domínios fictícios e anonimização integral. Os dados possibilitam a reprodução completa das análises estatísticas de persuasão, personalização e realismo textual descritas no artigo científico associado.Licença: Creative Commons Attribution 4.0 International (CC BY 4.0).



