Chinese text humanization model series: SFT + DPO training pipeline, models and datasets included.
🏝️ On Vacation
Isaac
XiangJinYu
AI & ML interests
Agent, LLM, RL
Organizations
None yet
models 5
XiangJinYu/Qwen3.5-9B-Humanize-DPO-Round2
Text Generation • Updated • 37 • 5
XiangJinYu/Qwen3.5-9B-Humanize-DPO-Round1
Text Generation • Updated • 14 • 1
XiangJinYu/Qwen3.5-9B-Humanize-SFT
Text Generation • Updated • 15
XiangJinYu/Qwen3-1.7B-GameRL-AdaptiveCurriculum
Reinforcement Learning • Updated
XiangJinYu/Zhihu_Qwen2
Text Generation • Updated • 8 • 2
datasets 6
XiangJinYu/Qwen3.5-9B-Humanize-Dataset
Preview • Updated • 73 • 3
XiangJinYu/quant-h-share-prices
Viewer • Updated • 5.86M • 618
XiangJinYu/quant-us-prices
Preview • Updated • 4.24k
XiangJinYu/quant-a-share-prices
Viewer • Updated • 7.76M • 1.36k • 1
XiangJinYu/quant-prices
Viewer • Updated • 15.7M • 526
XiangJinYu/gdpval
Viewer • Updated • 220 • 59