llama3-7b-en-ru-v4

LLaMA-3 7B pretrained on English-Russian bilingual data, 133,600 total steps (v4 run). Uses a shared 65k English-Russian tokenizer (65k_en1.0_ru1.0).

Validation Results

Last validation: step 133,600

Validation set Cross-entropy loss (nats) Perplexity
English (en) 2.2378 9.37
Russian (ru) 2.2127 9.14

Training Curves

Training and validation loss curves are in training_curves/:

  • train_en_ru_v4.csv — step, train_loss (12,594 entries, steps 10–133,600)
  • val_en_ru_v4.csv — step, lang, val_loss (95 checkpoints × 2 languages)

Evaluation Results

EEE-format evaluation results are stored under eval_results/eee/ in this repository. Tasks: Global MMLU (EN), Global MMLU (RU), PIQA, ECLeKTic.

Related Models

Citation

Part of the The-CoLab multilingual-transfer collection.

Downloads last month
21
Safetensors
Model size
6B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Collection including The-CoLab/llama3-7b-en-ru-v4