arxiv:2608.08722
Victor Gallego
vicgalle
AI & ML interests
Preference fine-tuning, alignment & synthetic data.
Building LLMs in general!
Recent Activity
liked a dataset about 3 hours ago
Fer14/colored-dragons liked a model 6 days ago
Cloudflare/clef authored a paper about 1 month ago
Opponent Aware Reinforcement Learning