Files
buddha-gpt/configs/lora.yaml
2026-08-17 13:43:32 -07:00

17 lines
314 B
YAML

model: mlx-community/Qwen2.5-7B-Instruct-4bit
train: true
data: data/train
adapter_path: adapters/buddhagpt-v1
batch_size: 1
grad_accumulation_steps: 8
iters: 1200
learning_rate: 1e-5
num_layers: 16
lora_parameters:
rank: 16
scale: 20.0
dropout: 0.05
max_seq_length: 1024
steps_per_eval: 200
save_every: 200