遇见数据集

Synthetic Dataset and Evaluation Results: Validating AI-Generated Content: Security Challenges and Solutions Inspired by OWASP

收藏
Zenodo2026-01-21 更新2026-05-26 收录
官方服务:

资源简介:

Synthetic Dataset and Evaluation Results for LLM Output Validation This repository contains the synthetic dataset and evaluation results used in the Master's thesis: Validating AI-Generated Content: Security Challenges and Solutions Inspired by OWASP by Kamran Khan, Tampere University, 2025. Contents 1. Dataset dataset.csv: Synthetic dataset generated for evaluating LLM outputs Contains 446 samples across 9 categories Each sample includes: Context, LLMOutput, TrueLabel Generated using: Deepseek-V3.2-Exp , Gpt-4 2. Evaluation Results BaselineResulat.csv: Results from the baseline model using only procedural security and schema/structure validator agent(non-llm) NoJudgeAgentResult: Results ablation study using semantic, validator and Semantic Agent without Judge audit EvalauationResult: Results from comple

提供机构:
Zenodo
创建时间:
2025-12-23
二维码
社区交流群
二维码
科研交流群
商业服务