KeisukeMiyamoto commited on
Commit
797ced3
·
verified ·
1 Parent(s): a776d8d

Upload lambda-1-160m instruction-tuned model

Browse files
Files changed (2) hide show
  1. model.pth +1 -1
  2. model_config.json +1 -1
model.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:a22b52a9e391112f2d00d2d7c827aa14310e5ba43efbe5e905ac3ff9919ad233
3
  size 655045351
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:b249fb687799948b81c26f5ff00125c0658ab17afc352b3fc54a53d7c52e009e
3
  size 655045351
model_config.json CHANGED
@@ -1 +1 @@
1
- {"max_len": 1024, "d_model": 768, "num_layers": 16, "num_heads": 12, "d_ff": 2048, "learning_rate": 0.0001, "pad_token_id": 0, "bos_token_id": 2, "eos_token_id": 3, "training_max_len": 1024, "end_of_turn_token_id": 12, "base_model_id": "KeisukeMiyamoto/lambda-1-160m-base", "batch_size": 16, "gradient_accumulation_steps": 2, "devices": "auto", "device_count": 4, "global_batch_size": 64, "effective_batch_size": 32, "global_effective_batch_size": 128, "lr_schedule": "warmup_cosine", "lr_warmup_steps": 200, "min_learning_rate": 2e-05, "min_learning_rate_ratio": 0.2, "loss_chunk_size": 32, "trainable_layers": "all", "chat_template_version": 1, "posttraining_datasets": ["KeisukeMiyamoto/lambda-chat:train"], "validation_dataset": "KeisukeMiyamoto/lambda-chat:validation", "validation_cache_path": "models/lambda-1-160m-it/validation-cache-bucket-packing-v1-len1024-samples512.pt", "validation_sample_count": 512, "posttraining_steps": 1024}
 
1
+ {"max_len": 1024, "d_model": 768, "num_layers": 16, "num_heads": 12, "d_ff": 2048, "learning_rate": 0.0001, "pad_token_id": 0, "bos_token_id": 2, "eos_token_id": 3, "training_max_len": 1024, "end_of_turn_token_id": 12, "base_model_id": "KeisukeMiyamoto/lambda-1-160m-base", "batch_size": 16, "gradient_accumulation_steps": 2, "devices": "auto", "device_count": 4, "global_batch_size": 64, "effective_batch_size": 32, "global_effective_batch_size": 128, "lr_schedule": "warmup_cosine", "lr_warmup_steps": 200, "min_learning_rate": 2e-05, "min_learning_rate_ratio": 0.2, "loss_chunk_size": 32, "trainable_layers": "all", "chat_template_version": 1, "posttraining_datasets": ["KeisukeMiyamoto/SyntheticTalk-jp:train"], "validation_dataset": "KeisukeMiyamoto/SyntheticTalk-jp:validation", "validation_cache_path": "models/lambda-1-160m-it/validation-cache-SyntheticTalk-jp-bucket-packing-v1-len1024-samples512.pt", "validation_sample_count": 512, "posttraining_steps": 5000}