Open Issues Need Help
View All on GitHub Independently reproduce the released 3B TRACE validation result about 2 hours ago
help wanted reproduction
Trace: A Taxonomy-Guided Environment for Multidomain Visual Reasoning
Python
#benchmark#dataset-generation#grpo#multimodal#multimodal-reasoning#post-training#procedural-generation#qwen2-5-vl#reinforcement-learning#rlvr#synthetic-data#verifiable-rewards#vision-language-models#visual-question-answering#visual-reasoning#vlm-training
Validate a memory-efficient 4-bit inference path for the 3B checkpoint about 2 hours ago
enhancement help wanted
Trace: A Taxonomy-Guided Environment for Multidomain Visual Reasoning
Python
#benchmark#dataset-generation#grpo#multimodal#multimodal-reasoning#post-training#procedural-generation#qwen2-5-vl#reinforcement-learning#rlvr#synthetic-data#verifiable-rewards#vision-language-models#visual-question-answering#visual-reasoning#vlm-training
Add a minimal veRL GRPO integration example about 2 hours ago
enhancement help wanted integration
Trace: A Taxonomy-Guided Environment for Multidomain Visual Reasoning
Python
#benchmark#dataset-generation#grpo#multimodal#multimodal-reasoning#post-training#procedural-generation#qwen2-5-vl#reinforcement-learning#rlvr#synthetic-data#verifiable-rewards#vision-language-models#visual-question-answering#visual-reasoning#vlm-training
Add a minimal TRL GRPO integration example about 2 hours ago
enhancement help wanted integration
Trace: A Taxonomy-Guided Environment for Multidomain Visual Reasoning
Python
#benchmark#dataset-generation#grpo#multimodal#multimodal-reasoning#post-training#procedural-generation#qwen2-5-vl#reinforcement-learning#rlvr#synthetic-data#verifiable-rewards#vision-language-models#visual-question-answering#visual-reasoning#vlm-training