v0.0.3-alpha22
Add oa leet10k dataset for SFT training (#2452)
add Red Pajama dataset. (#2976)
Rl training (#2206)
update dataset entry to support list of list type (#2879)
Add GPTNeoXRewardModel (#2182)
add check dataset appearances, update vicuna to dataset entry (#2818)
fix bug
augment rank results for reward model and some other improvements for RM training (#2321)