feat(v2): update train_grpo.py for step-level prompts and per_step_reward 164cb07 ianalin123 commited on Mar 8
feat(v2): add extract_crease_json and valid_crease reward to training/reward.py 5637418 ianalin123 commited on Mar 8
feat: Railway deployment + multi-task GRPO + Modal B200 training f7dd892 ianalin123 commited on Mar 8
Add GRPO training notebook + Dockerfile for cloud training (#1) 769b2e8 Praveen sissississi commited on Mar 8
Rename server/ to origami_server/ to avoid module name conflict with uvicorn.server 3831c6f prasanna287 commited on Mar 8