橋本翔太
lucashernandez4
AI & ML interests
None yet
Recent Activity
upvoted a paper about 15 hours ago
CoRT: Counterfactual Replay for Token-Level Rubric-Guided Policy Optimization liked a model about 18 hours ago
cosmos1030/qwen3-4b-gmp-tr-dwup-s70pct upvoted a paper 2 days ago
Progress Reward Modeling for Robotic Learning: A Comprehensive SurveyOrganizations
None yet