Asilarknes commited on
Commit
4285437
·
verified ·
1 Parent(s): 5811395

Checkpoint step 6000

Browse files
Files changed (4) hide show
  1. config.json +15 -0
  2. pytorch_model.bin +3 -0
  3. tokenizer.json +0 -0
  4. tokenizer_config.json +35 -0
config.json ADDED
@@ -0,0 +1,15 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "vocab_size": 49152,
3
+ "d_model": 2048,
4
+ "n_layers": 16,
5
+ "n_heads": 16,
6
+ "n_kv_heads": 4,
7
+ "d_head": 128,
8
+ "d_ff": 8192,
9
+ "max_seq_len": 8192,
10
+ "rope_theta": 10000.0,
11
+ "architectures": [
12
+ "CodeTransformer"
13
+ ],
14
+ "model_type": "code_transformer"
15
+ }
pytorch_model.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:f2dfeae38099d8523eab94f3e210b24040eece6681bca75259dbf414458976a8
3
+ size 2214793067
tokenizer.json ADDED
The diff for this file is too large to render. See raw diff
 
tokenizer_config.json ADDED
@@ -0,0 +1,35 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "add_prefix_space": false,
3
+ "backend": "tokenizers",
4
+ "bos_token": "<|endoftext|>",
5
+ "eos_token": "<|endoftext|>",
6
+ "errors": "replace",
7
+ "extra_special_tokens": [
8
+ "<|endoftext|>",
9
+ "<fim_prefix>",
10
+ "<fim_middle>",
11
+ "<fim_suffix>",
12
+ "<fim_pad>",
13
+ "<filename>",
14
+ "<gh_stars>",
15
+ "<issue_start>",
16
+ "<issue_comment>",
17
+ "<issue_closed>",
18
+ "<jupyter_start>",
19
+ "<jupyter_text>",
20
+ "<jupyter_code>",
21
+ "<jupyter_output>",
22
+ "<empty_output>",
23
+ "<commit_before>",
24
+ "<commit_msg>",
25
+ "<commit_after>",
26
+ "<reponame>"
27
+ ],
28
+ "is_local": true,
29
+ "local_files_only": false,
30
+ "model_max_length": 1000000000000000019884624838656,
31
+ "pad_token": "<|endoftext|>",
32
+ "tokenizer_class": "GPT2Tokenizer",
33
+ "unk_token": "<|endoftext|>",
34
+ "vocab_size": 49152
35
+ }