Skip to content
Closed
Show file tree
Hide file tree
Changes from all commits
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
38 changes: 35 additions & 3 deletions CITATION.cff
Original file line number Diff line number Diff line change
Expand Up @@ -8,10 +8,11 @@ authors:
email: wangxk0223@gmail.com
- family-names: Hao
given-names: Zhuoyuan
affiliation: Tsinghua University
affiliation: Harbin Institute of Technology, Shenzhen
website: "https://hhh2210.github.io/"
Comment on lines 10 to +12
- family-names: Hou
given-names: Shuo
affiliation: Tsinghua University
affiliation: Xi'an Jiaotong University
- family-names: Peng
given-names: Hao
affiliation: Tsinghua University
Expand All @@ -25,4 +26,35 @@ authors:
date-released: "2026-06-03"
license: Apache-2.0
repository-code: https://github.com/THUAIS-Lab/CHERRL
# url: https://arxiv.org/abs/TODO # fill in once posted
url: https://arxiv.org/abs/2606.04923
identifiers:
- type: doi
value: 10.48550/arXiv.2606.04923
description: arXiv DOI for the paper
Comment on lines +31 to +33
preferred-citation:
type: article
title: "Reproducing, Analyzing, and Detecting Reward Hacking in Rubric-Based Reinforcement Learning"
authors:
- family-names: Wang
given-names: Xuekang
affiliation: Tsinghua University
- family-names: Hao
given-names: Zhuoyuan
affiliation: Harbin Institute of Technology, Shenzhen
website: "https://hhh2210.github.io/"
Comment on lines +42 to +44
- family-names: Hou
given-names: Shuo
affiliation: Xi'an Jiaotong University
- family-names: Peng
given-names: Hao
affiliation: Tsinghua University
- family-names: Li
given-names: Juanzi
affiliation: Tsinghua University
- family-names: Wang
given-names: Xiaozhi
affiliation: Tsinghua University
journal: arXiv
year: 2026
doi: 10.48550/arXiv.2606.04923
url: https://arxiv.org/abs/2606.04923
7 changes: 5 additions & 2 deletions README.md
Original file line number Diff line number Diff line change
Expand Up @@ -4,17 +4,20 @@

Official code for the paper **[Reproducing, Analyzing, and Detecting Reward Hacking in Rubric-Based Reinforcement Learning](https://arxiv.org/abs/2606.04923)**.

Xuekang Wang<sup>\*</sup>, Zhuoyuan Hao<sup>\*</sup>, Shuo Hou, Hao Peng, Juanzi Li, Xiaozhi Wang<sup>†</sup>
Xuekang Wang<sup>1,\*</sup>, [Zhuoyuan Hao](https://hhh2210.github.io/)<sup>2,\*</sup>, Shuo Hou<sup>3</sup>, Hao Peng<sup>1</sup>, Juanzi Li<sup>1</sup>, Xiaozhi Wang<sup>1,†</sup>

Tsinghua University
<sup>1</sup>Tsinghua University &nbsp; <sup>2</sup>Harbin Institute of Technology, Shenzhen &nbsp; <sup>3</sup>Xi'an Jiaotong University

<sup>\*</sup> Equal contribution &nbsp;&nbsp;·&nbsp;&nbsp; <sup>†</sup> Corresponding author

[![arXiv](https://img.shields.io/badge/arXiv-2606.04923-b31b1b.svg)](https://arxiv.org/abs/2606.04923)
[![DOI](https://img.shields.io/badge/DOI-10.48550%2FarXiv.2606.04923-blue.svg)](https://doi.org/10.48550/arXiv.2606.04923)
[![HF Paper](https://img.shields.io/badge/Hugging%20Face-Paper-yellow?logo=huggingface&logoColor=white)](https://huggingface.co/papers/2606.04923)
[![License](https://img.shields.io/badge/License-Apache%202.0-blue.svg)](LICENSE)
[![Code](https://img.shields.io/badge/Code-THUAIS--Lab%2FCHERRL-181717.svg?logo=github)](https://github.com/THUAIS-Lab/CHERRL)

[Readable project summary and author context](https://hhh2210.github.io/projects/cherrl/)

</div>

---
Expand Down