hf-transformers-bot commited on
Commit
bd64b08
·
verified ·
1 Parent(s): 40bc48b

Update tiny models for Ernie4_5_MoeModel

Browse files
.gitattributes CHANGED
@@ -33,3 +33,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
 
 
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ tokenizer.json filter=lfs diff=lfs merge=lfs -text
chat_template.jinja ADDED
@@ -0,0 +1,24 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {%- if not add_generation_prompt is defined -%}
2
+ {%- set add_generation_prompt = true -%}
3
+ {%- endif -%}
4
+ {%- if not cls_token is defined -%}
5
+ {%- set cls_token = "<|begin_of_sentence|>" -%}
6
+ {%- endif -%}
7
+ {%- if not sep_token is defined -%}
8
+ {%- set sep_token = "<|end_of_sentence|>" -%}
9
+ {%- endif -%}
10
+ {{- cls_token -}}
11
+ {%- for message in messages -%}
12
+ {%- if message["role"] == "user" -%}
13
+ {{- "User: " + message["content"] + "
14
+ " -}}
15
+ {%- elif message["role"] == "assistant" -%}
16
+ {{- "Assistant: " + message["content"] + sep_token -}}
17
+ {%- elif message["role"] == "system" -%}
18
+ {{- message["content"] + "
19
+ " -}}
20
+ {%- endif -%}
21
+ {%- endfor -%}
22
+ {%- if add_generation_prompt -%}
23
+ {{- "Assistant: " -}}
24
+ {%- endif -%}
config.json ADDED
@@ -0,0 +1,38 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "architectures": [
3
+ "Ernie4_5_MoeModel"
4
+ ],
5
+ "bos_token_id": 1,
6
+ "dtype": "float32",
7
+ "eos_token_id": 2,
8
+ "hidden_act": "gelu",
9
+ "hidden_size": 32,
10
+ "initializer_range": 0.02,
11
+ "intermediate_size": 32,
12
+ "max_position_embeddings": 512,
13
+ "model_type": "ernie4_5_moe",
14
+ "moe_intermediate_size": 16,
15
+ "moe_k": 2,
16
+ "moe_layer_end_index": 1,
17
+ "moe_layer_interval": 1,
18
+ "moe_layer_start_index": 0,
19
+ "moe_norm_min": 1e-12,
20
+ "moe_num_experts": 8,
21
+ "moe_num_shared_experts": 2,
22
+ "num_attention_heads": 2,
23
+ "num_hidden_layers": 2,
24
+ "num_key_value_heads": 2,
25
+ "output_router_logits": false,
26
+ "pad_token_id": 0,
27
+ "rms_norm_eps": 1e-05,
28
+ "rope_parameters": {
29
+ "rope_theta": 500000.0,
30
+ "rope_type": "default"
31
+ },
32
+ "router_aux_loss_coef": 0.001,
33
+ "tie_word_embeddings": false,
34
+ "transformers_version": "5.16.0.dev0",
35
+ "use_bias": false,
36
+ "use_cache": true,
37
+ "vocab_size": 101304
38
+ }
model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:898fc7d4f2d3723d190f7f9c9905a01645956978ee5cd2e4425e8d5345a3155a
3
+ size 13133040
tokenizer.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:4e5b4d49475d27c7ef7a61eea2d675f9cc013e91e3ddb5e06d964f5027c1814a
3
+ size 11185815
tokenizer_config.json ADDED
@@ -0,0 +1,20 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "add_prefix_space": false,
3
+ "backend": "tokenizers",
4
+ "bos_token": "<s>",
5
+ "clean_up_tokenization_spaces": false,
6
+ "cls_token": "<|begin_of_sentence|>",
7
+ "eos_token": "</s>",
8
+ "is_local": true,
9
+ "legacy": true,
10
+ "local_files_only": false,
11
+ "mask_token": "<mask:1>",
12
+ "model_max_length": 512,
13
+ "pad_token": "<unk>",
14
+ "sep_token": "<|end_of_sentence|>",
15
+ "sp_model_kwargs": {},
16
+ "spaces_between_special_tokens": false,
17
+ "tokenizer_class": "TokenizersBackend",
18
+ "unk_token": "<unk>",
19
+ "use_default_system_prompt": false
20
+ }