官方服务:
资源简介:
Movie scripts starting with B
应用场景:
创建时间:
2017-02-08
相关数据集
CHATTER
CHATTER数据集由南加州大学信号分析与解释实验室创建,用于电影剧本中角色特征的标注。该数据集包含88148个角色-特征对,涵盖2998个角色、13324个特征和660部电影。数据集的创建过程包括从TVTropes网站获取角色特征标签,并从ScriptsonScreen网站获取电影剧本。CHATTER数据集旨在解决电影剧本中角色特征识别的问题,通过二元分类任务评估模型对角色特征的理解能力。
arXiv2024-11-08 更新1450
Replication Data for: Movie Scripts Corpus
Data Source: https://www.kaggle.com/datasets/gufukuro/movie-scripts-corpus Data Description : Movie Scripts Corpus This corpus was collected to use for screenplay analysis with machine learning method
DataONE2024-05-06 更新250
jondurbin/cinematika-v0.1
Cinematika是一个包含211部电影剧本的数据集,这些剧本被转换为小说风格的多角色角色扮演(RP)数据。转换过程结合了手动正则表达式解析和基于上下文学习的LLM增强技术,使用了定制的mistral-7b模型进行微调。数据集包含多个Parquet文件,每个文件都有不同的用途,如存储单个场景、完整剧本、角色卡片等。此外,README还提供了角色卡片和场景的示例,以及如何贡献和资助项目的信息。
Hugging Face2024-04-11 更新290
r7dai/cinerai-1800
Cinerai-1800是一个多模态数据集,旨在用于电影成功预测和剧本分析。它直接将电影剧本的创意内容与其财务表现指标联系起来。数据集包含1,471个处理过的CSV文件,每个文件代表一部电影,结合了完整的剧本文本(逐场景)与财务元数据和成功标签。数据集的结构是CSV文件集合,每行代表剧本的一个场景或片段,但电影的元数据(预算、收入、ROI)对整个电影是重复的。数据字段包括场景文本、IMDb ID、
Hugging Face2025-12-11 更新190



