{
  "model_id": "mobtranslate/kuku-yalanji-nllb-lora",
  "version": "0.1.0",
  "created_at": "2026-07-02T11:30:00.237161+00:00",
  "base_model": "/workspace/base_models/v12.0-tagged-direct-plus-reference-bible-gvn-token-4096row-25epoch-batch16/merged",
  "direction": "eng-gvn",
  "source_lang": "eng_Latn",
  "target_lang": "gvn_Latn",
  "target_lang_init_from": null,
  "source_lang_token_id": 256047,
  "target_lang_token_id": 256204,
  "dataset": {
    "train_file": "/workspace/data/kuku_yalanji_v19_0_balanced_replay/train.eng-gvn.jsonl",
    "validation_file": "/workspace/data/kuku_yalanji_v19_0_balanced_replay/validation.eng-gvn.jsonl",
    "test_file": "/workspace/data/kuku_yalanji_v19_0_balanced_replay/validation.eng-gvn.jsonl",
    "split_rows": {
      "train": 5900,
      "validation": 235,
      "test": 235
    },
    "max_train_samples": null,
    "max_validation_samples": 235,
    "max_test_samples": 235,
    "shuffle_before_cap": false
  },
  "training_args": {
    "epochs": 8.0,
    "batch_size": 16,
    "gradient_accumulation_steps": 1,
    "learning_rate": 3e-05,
    "lora_r": 64,
    "lora_alpha": 128,
    "lora_dropout": 0.0,
    "lora_target_modules": [
      "q_proj",
      "k_proj",
      "v_proj",
      "out_proj",
      "fc1",
      "fc2"
    ],
    "modules_to_save": [],
    "seed": 42,
    "ensure_weight_tying": true,
    "effective_ensure_weight_tying": true,
    "generation_num_beams": 1,
    "generation_no_repeat_ngram_size": 0,
    "generation_repetition_penalty": 1.0,
    "generation_length_penalty": 1.0,
    "save_total_limit": 2,
    "gradient_checkpointing": false
  },
  "metrics": {
    "train": {
      "train_runtime": 1035.5482,
      "train_samples_per_second": 45.58,
      "train_steps_per_second": 2.851,
      "total_flos": 2.0345809243078656e+16,
      "train_loss": 0.21289994141596766,
      "epoch": 8.0
    },
    "validation": {
      "eval_loss": 0.060371559113264084,
      "eval_bleu": 95.74804414980893,
      "eval_chrf": 97.17588021242459,
      "eval_runtime": 47.9703,
      "eval_samples_per_second": 4.899,
      "eval_steps_per_second": 0.313,
      "epoch": 8.0
    },
    "test": {
      "test_loss": 0.060371559113264084,
      "test_bleu": 95.74804414980893,
      "test_chrf": 97.17588021242459,
      "test_runtime": 47.4264,
      "test_samples_per_second": 4.955,
      "test_steps_per_second": 0.316,
      "epoch": 8.0
    }
  },
  "artifacts": {
    "adapter_dir": "/workspace/models/kuku-yalanji-nllb-lora/v19.0-balanced-replay-from-v12-gvn-8epoch-lr3e-5/adapter",
    "merged_dir": "/workspace/models/kuku-yalanji-nllb-lora/v19.0-balanced-replay-from-v12-gvn-8epoch-lr3e-5/merged"
  }
}
