Multilingual-Transfer
Collection
Pretraining models to find what allows multilingual transfer • 38 items • Updated • 3
LLaMA-3 7B pretrained on English-Russian bilingual data, 133,600 total steps (v4 run).
Uses a shared 65k English-Russian tokenizer (65k_en1.0_ru1.0).
Last validation: step 133,600
| Validation set | Cross-entropy loss (nats) | Perplexity |
|---|---|---|
| English (en) | 2.2378 | 9.37 |
| Russian (ru) | 2.2127 | 9.14 |
Training and validation loss curves are in training_curves/:
train_en_ru_v4.csv — step, train_loss (12,594 entries, steps 10–133,600)val_en_ru_v4.csv — step, lang, val_loss (95 checkpoints × 2 languages)EEE-format evaluation results are stored under eval_results/eee/ in this repository.
Tasks: Global MMLU (EN), Global MMLU (RU), PIQA, ECLeKTic.
The-CoLab/llama3-7b-en-ru-v3 — v3 runPart of the The-CoLab multilingual-transfer collection.