arxiv:2607.14614
ZHANG HAO
26hzhang
AI & ML interests
Multimodal LLM, Financial Learning and Reasoning
Recent Activity
authored a paper 6 days ago
Beyond Entropy: Correctness-Aware Advantage Shaping via Contrastive Policy Optimization upvoted a paper about 2 months ago
Reinforcement Learning Elicits Contextual Learning of Unseen Language Translation