遇见数据集

RL4QE

收藏
Figshare2025-04-10 更新2026-04-08 收录
官方服务:

资源简介:

A Reinforcement Learning framework for Large Language Models (LLMs), focusing on code generation tasks. This repository implements various RL training methods to enhance LLMs' ability to generate high-quality code based on user queries.

提供机构:
yuan, david
创建时间:
2025-04-10
二维码
社区交流群
二维码
科研交流群
商业服务