GRPO-SMu training dataset
CodeArtifactFirst seen 9/3/2026
Last seen 9/3/2026
Evidence 2 chunks
NEIGHBORHOOD
4 nodes · 5 edgesgraph · GRPO-SMu training dataset · depth=1
RELATIONSHIPS
3 connectionsThe paper uses the GRPO-SMu training dataset constructed via tree-based mutation strategy.
RL fine-tuning uses the GRPO-SMu training dataset constructed via tree-based mutations.
The GRPO-SMu training dataset is constructed from golden RTL codes sourced from the ScaleRTL dataset.