橋本翔太
lucashernandez4
AI & ML interests
None yet
Recent Activity
upvoted a paper 4 days ago
CoRT: Counterfactual Replay for Token-Level Rubric-Guided Policy Optimization liked a model 4 days ago
cosmos1030/qwen3-4b-gmp-tr-dwup-s70pct upvoted a paper 5 days ago
Progress Reward Modeling for Robotic Learning: A Comprehensive SurveyOrganizations
None yet