continue
klue-sroberta-base-continue-learning-by-mnrLlama-3.3_70_b_uncensored_continued-i1-GGUFavemio-digital_-_gemma2b-continued-training-pre-trained_50ksample_v2-ggufgemma-4-E4B-it-uncensored-continued-GGUFgemma-4-E4B-it-uncensored-continued-i1-GGUFQwen3-4B-Base-Continued-GRPO-Style-Karcher-i1-GGUFgemma-4-31B-it-continued-i1-GGUFLlama-3.1-8B-ContinuedTraining2-FFT
Datasets
All datasets matching “continue”ourmethod_128batchsize_continue_continue_checkpointscontinue-training-datacontinue_vs_terminate_Qwen3-1.7B_DAPO-Math-en_BATCHcontinue-pretrained-v1
Continue Pretrained v1
Continual-pretraining (CPT) mixture shards for Vietnamese LLM training.
Splits
Split
Description
Rows (approx)
Est. tokens
stage_1
Warmup / general mix (VI-heavy + EN replay)
56,419,797
~52.2B
Schema
id, text, source, subset
stage, stage_name, mix_source, language, epoch, quality_pred
Load
from datasets import load_dataset
ds = load_dataset("brownyeyez/continue-pretrained-v1", split="stage_1")
continue_vs_terminate_neg_Qwen3-1.7B_DAPO-Math-en_BATCHcontinue_vs_terminate_DAPO-Math-en
