遇见数据集

lien-quan-data

收藏
github2026-08-12 更新2026-08-15 收录
官方服务:

资源简介:

《Arena of Valor / Liên Quân Mobile》的开放JSON数据集——包含129个英雄、112件物品、88个符文、召唤师技能等。无需API密钥,每周刷新。

Open JSON Dataset for Arena of Valor / Liên Quân Mobile, which includes 129 heroes, 112 in-game items, 88 runes, summoner spells, and more. No API key is required, and the dataset is refreshed weekly.

创建时间:
2026-08-12
原始信息汇总

数据集概述

lien-quan-data 是一个开放、机器可读的《Arena of Valor / Liên Quân Mobile》游戏数据集,以纯 JSON 格式提供英雄、装备、奥术(符文)、召唤师技能、徽章和游戏模式等数据。数据集每周从 Garena 官方网站和 Arena of Valor Fandom wiki 自动重建,无需 API 密钥、无速率限制,也无需自行爬取数据。

数据文件与规模

文件 记录数 内容
data/heroes.json 129 属性、技能、皮肤、价格、背景故事、推荐出装、平衡性调整历史
data/items.json 112 价格、属性、被动效果
data/runes.json 88 层级、效果
data/spells.json 11 冷却时间、解锁等级、效果
data/badges.json 4 徽章系统
data/modes.json 5 游戏模式
data/name-aliases.json 越南语 ↔ 英语英雄名称映射

数据特点

  • 英雄记录结构:每个英雄记录包含 slug、名称、称号、职业、分路、伤害类型、标签、金币/点券价格、基础属性、技能(含图标与效果)、皮肤(含缩略图与原画)、推荐出装、徽章、个人档案、背景故事、冷知识及平衡性调整历史。
  • 可追溯性:每条记录都带有 sources 字段,指向数据来源页面,便于核对。
  • 文本语言:数据文本为越南语,这是来源网站的发布语言。

使用方式

无需安装,可直接通过 CDN 获取数据,例如使用 jsDelivr 加载英雄数据。如需稳定快照,可将 URL 中的 @main 固定到特定 commit。

自行重建

要求 Node.js 18+,无第三方依赖。可通过以下命令运行:

  • npm run data:爬取所有数据并合并
  • npm run merge:仅重新合并 data/raw 下的数据,不重新爬取
  • 分步命令包括 crawl:heroes(Garena 英雄页面)、crawl:systems(装备/符文/技能/徽章/模式)、crawl:fandom(通过 MediaWiki API 获取 wiki 文本)、merge(合并来源到 data/*.json

合并步骤会输出覆盖率报告,显示多少英雄获得了背景故事、出装和平衡性历史,以及哪些页面匹配失败。

数据来源与许可

  • 仓库代码:MIT 许可证。
  • 游戏数据(名称、属性、图片、技能文本):归 Garena / TiMi Studios 所有,本仓库为非官方、非商业参考项目,与其无关联或背书。
  • Wiki 文本(背景故事、冷知识、平衡性历史):来自 Arena of Valor Fandom wiki,遵循 CC BY-SA 3.0 许可证,再分发需保留署名并保持相同许可。
  • 图片 URL 指向原始托管方,仓库不转存图片。

贡献方式

如发现数据错误或过时,可提交 issue,注明英雄/装备名称及来源 URL。也欢迎提交解析器修复,爬虫代码为无依赖的 ESM 脚本,位于 scripts/ 目录下。

搜集汇总
数据集介绍
lien-quan-data 数据集图片
构建方式
本数据集名为lien-quan-data,是针对《Arena of Valor / Liên Quân Mobile》游戏的开源机器可读数据集,以纯JSON格式提供英雄、装备、奥术(符文)、召唤师技能、徽章及游戏模式等核心数据。数据集的构建依托于本仓库中的爬虫程序,每周从Garena官方网站和Arena of Valor Fandom wiki自动抓取并整合数据,确保信息的时效性与准确性。爬虫采用Node.js 18+编写,零依赖,可独立运行各步骤(如爬取英雄、系统数据、维基文本),最终通过merge脚本合并为结构化的JSON文件,并生成覆盖率报告,以便追踪数据完整性与来源可溯性。
特点
该数据集的特点在于其开放性、结构化与可追溯性。无需API密钥、无速率限制,用户可直接通过CDN获取数据,极大降低了使用门槛。数据集涵盖129名英雄的详尽档案,包括属性、技能、皮肤、价格、背景故事、推荐出装及平衡性调整历史;同时收录112件装备、88枚符文、11个召唤师技能、4个徽章及5种游戏模式,内容丰富且层次分明。每条记录均包含sources字段,指向原始数据来源页面,确保每项信息可追踪验证。文本以越南语呈现,忠实反映游戏官方语言的真实内容,适合本地化研究与应用开发。
使用方法
使用此数据集极为便捷,无需安装任何依赖,可直接通过JavaScript的fetch函数从提供的CDN链接读取JSON文件,例如获取英雄数据后,可按slug字段查找特定英雄并访问其技能详情。若需稳定版本,可将URL中的@main固定为特定commit哈希。此外,开发者还可使用npm run data命令自行爬取并合并数据,便于定制化更新。数据集代码采用MIT许可,游戏数据版权归Garena/TiMi所有,维基文本遵循CC BY-SA 3.0协议,使用时需遵守相应版权与署名要求。对于发现的数据错误,欢迎通过GitHub Issues提交反馈,便于持续改进数据质量。
背景与挑战
背景概述
lien-quan-data 数据集由开发者 MLuc24 创建,旨在为《王者荣耀》国际版(Arena of Valor / Liên Quân Mobile)提供开放、机器可读的结构化数据。该数据集于近年持续维护,每周自动从 Garena 官方网站及 Arena of Valor Fandom 维基重建,覆盖 129 位英雄、112 件装备、88 种奥术(符文)、11 个召唤师技能、徽章系统及游戏模式等核心内容。数据以 JSON 格式呈现,无需 API 密钥或抓取,即可通过 CDN 直接获取,极大地方便了研究者、开发者及游戏社区进行数据分析、工具开发与策略研究。该数据集的独特之处在于每项记录均附带来源链接,确保数据可追溯性,为游戏知识图谱构建、平衡性分析与多语言本地化研究提供了坚实基础。
当前挑战
该数据集面临多重挑战。在领域问题层面,其核心挑战在于整合分散于多语言、多平台(如官方 Garena 站与 Fandom 维基)的异构信息,并解决英雄名称(越南语与英语)映射、数值波动及平衡性更新频繁导致的同步问题。在构建过程中,爬虫需应对动态网页结构、反爬机制及维基文本解析复杂性,同时确保数据准确性、完整性与一致性。此外,游戏数据的版权归属(Garena/TiMi Studios)与维基内容的共享许可(CC BY-SA 3.0)要求数据集在合法合规框架下运营,避免侵权风险。最终,如何自动检测并处理爬取失败或数据缺失(如英雄故事、推荐出装)仍是持续运维的难题,需通过覆盖率报告机制加以监控与改进。
常用场景
经典使用场景
在电子竞技与移动游戏研究领域,lien-quan-data数据集为《Arena of Valor》与《Liên Quân Mobile》提供了全面且结构化的机器可读数据。其经典使用场景聚焦于游戏平衡性分析与英雄策略研究,研究者可依据英雄的详尽属性、技能机制与历史平衡调整记录,结合装备、符文等系统数据,构建深度分析模型,以探索游戏设计的内在逻辑与演化规律。该数据集的开放性与无限制访问特性,亦为游戏数据科学的教学与实践提供了便利的基准资源。
解决学术问题
该数据集有效解决了学术研究中长期存在的游戏数据获取壁垒问题,传统上此类数据散落于官方网站与社区维基,缺乏统一的格式与稳定的接口。lien-quan-data通过半自动化的爬虫流程与周更机制,确保了数据的时效性与完整性,同时每项记录附带的来源追踪字段极大增强了数据的可验证性与学术严谨性。这为游戏平衡性量化评估、玩家行为预测及游戏模式演化等研究奠定了坚实而可靠的数据基础,促进了实证研究范式的建立。
衍生相关工作
该数据集的衍生工作已初步显现,其开放的许可与规范的格式激励了社区内的二次开发与数据再利用。研究者可基于该数据进行英雄技能效果可视化、装备协同网络分析或游戏元策略演化研究,从而催生一系列数据驱动的游戏分析工具与学术论文。此外,数据中蕴含的多语言映射(越南语与英语)为跨语言信息处理与自然语言处理技术提供了独特场景,有望推动针对非英语游戏数据的本地化与国际化研究。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务