StarsMakeGalaxy/competitive-programming-curated-600
π Competitive Programming & Algorithmic Reasoning (Verbose CoT Reasoning) This dataset contains 600 curated training records with in-depth, verbose 4-phase <Thinking> Chain-of-Thought reasoning, 100 frozen evaluation benchmark samples, and 50 frozen regression verification samples formatted in standard ChatML (messages) and Prompt-Target pairs, strictly following the Pioneer / Prometheus research paper 3-slice curriculum design. π Dataset Composition & 3-Sliceβ¦ See the full description on the dataset page: https://huggingface.co/datasets/StarsMakeGalaxy/competitive-programming-curated-600.
π Competitive Programming & Algorithmic Reasoning (Verbose CoT Reasoning)
This dataset contains 600 curated training records with in-depth, verbose 4-phase `<Thinking>` Chain-of-Thought reasoning, 100 frozen evaluation benchmark samples, and 50 frozen regression verification samples formatted in standard ChatML (`messages`) and Prompt-Target pairs, strictly following the Pioneer / Prometheus research paper 3-slice curriculum design.
π Dataset Composition & 3-Slice Breakdown
π‘οΈ 5-Point Quality Audit (100% Passed)
- Uniqueness:
100.0%unique prompts (600 / 600). - Zero Eval Leakage:
0prompt overlaps across train, test, and regression splits. - Replay Fraction:
10.0%dedicated to optimization and schema resilience.
π Usage with Unsloth / Hugging Face
from datasets import load_dataset
dataset = load_dataset("StarsMakeGalaxy/competitive-programming-curated-600")
print(dataset)