← all datasets

ChatReward-30K

Emerging
1papers using it
2025first seen

ChatReward-30K is a preference dataset used to train WavReward, containing scenarios that evaluate both comprehension and generation aspects of spoken dialogue models across various tasks.

Papers using ChatReward-30K (1)

ChatReward-30K β€” datasets β€” reinforcement-learning