hf-transformers-bot commited on
Commit
4d59bad
·
verified ·
1 Parent(s): 5a63dea

Update tiny models for Florence2ForConditionalGeneration

Browse files
config.json ADDED
@@ -0,0 +1,78 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "architectures": [
3
+ "Florence2ForConditionalGeneration"
4
+ ],
5
+ "dtype": "float32",
6
+ "image_token_id": 4,
7
+ "initializer_range": 0.02,
8
+ "is_encoder_decoder": true,
9
+ "model_type": "florence2",
10
+ "text_config": {
11
+ "activation_dropout": 0.1,
12
+ "activation_function": "gelu",
13
+ "attention_dropout": 0.1,
14
+ "bos_token_id": 0,
15
+ "classifier_dropout": 0.0,
16
+ "d_model": 16,
17
+ "decoder_attention_heads": 1,
18
+ "decoder_ffn_dim": 16,
19
+ "decoder_layerdrop": 0.0,
20
+ "decoder_layers": 1,
21
+ "decoder_start_token_id": 2,
22
+ "dropout": 0.1,
23
+ "encoder_attention_heads": 1,
24
+ "encoder_ffn_dim": 16,
25
+ "encoder_layerdrop": 0.0,
26
+ "encoder_layers": 1,
27
+ "eos_token_id": 2,
28
+ "forced_eos_token_id": 2,
29
+ "init_std": 0.02,
30
+ "is_decoder": false,
31
+ "max_position_embeddings": 200,
32
+ "model_type": "bart",
33
+ "pad_token_id": 1,
34
+ "scale_embedding": false,
35
+ "tie_word_embeddings": true,
36
+ "use_cache": true,
37
+ "vocab_size": 51290
38
+ },
39
+ "tie_word_embeddings": true,
40
+ "transformers_version": "5.16.0.dev0",
41
+ "vision_config": {
42
+ "activation_function": "gelu",
43
+ "depths": [
44
+ 1
45
+ ],
46
+ "drop_path_rate": 0.1,
47
+ "embed_dim": [
48
+ 16
49
+ ],
50
+ "in_channels": 3,
51
+ "initializer_range": 0.02,
52
+ "max_position_embeddings": 50,
53
+ "max_temporal_embeddings": 100,
54
+ "mlp_ratio": 4.0,
55
+ "model_type": "florence_vision",
56
+ "num_groups": [
57
+ 1
58
+ ],
59
+ "num_heads": [
60
+ 1
61
+ ],
62
+ "patch_padding": [
63
+ 3
64
+ ],
65
+ "patch_prenorm": [
66
+ false
67
+ ],
68
+ "patch_size": [
69
+ 7
70
+ ],
71
+ "patch_stride": [
72
+ 4
73
+ ],
74
+ "projection_dim": 16,
75
+ "qkv_bias": true,
76
+ "window_size": 12
77
+ }
78
+ }
generation_config.json ADDED
@@ -0,0 +1,12 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "_from_model_config": true,
3
+ "bos_token_id": 0,
4
+ "decoder_start_token_id": 2,
5
+ "eos_token_id": 2,
6
+ "forced_eos_token_id": 2,
7
+ "output_attentions": false,
8
+ "output_hidden_states": false,
9
+ "pad_token_id": 1,
10
+ "transformers_version": "5.16.0.dev0",
11
+ "use_cache": true
12
+ }
model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e2cb702f81ff1ec27f341e340038af451e00f59a809b7b623b6ad907c4ab5b5e
3
+ size 3386960
preprocessor_config.json ADDED
@@ -0,0 +1,32 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "auto_map": {
3
+ "AutoProcessor": "processing_florence2.Florence2Processor"
4
+ },
5
+ "crop_size": {
6
+ "height": 768,
7
+ "width": 768
8
+ },
9
+ "do_center_crop": false,
10
+ "do_convert_rgb": null,
11
+ "do_normalize": true,
12
+ "do_rescale": true,
13
+ "do_resize": true,
14
+ "image_mean": [
15
+ 0.485,
16
+ 0.456,
17
+ 0.406
18
+ ],
19
+ "image_processor_type": "CLIPImageProcessor",
20
+ "image_seq_length": 577,
21
+ "image_std": [
22
+ 0.229,
23
+ 0.224,
24
+ 0.225
25
+ ],
26
+ "resample": 3,
27
+ "rescale_factor": 0.00392156862745098,
28
+ "size": {
29
+ "height": 768,
30
+ "width": 768
31
+ }
32
+ }
tokenizer.json ADDED
The diff for this file is too large to render. See raw diff
 
tokenizer_config.json ADDED
@@ -0,0 +1,23 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "add_prefix_space": false,
3
+ "backend": "tokenizers",
4
+ "bos_token": "<s>",
5
+ "clean_up_tokenization_spaces": false,
6
+ "cls_token": "<s>",
7
+ "eos_token": "</s>",
8
+ "errors": "replace",
9
+ "image_token": "<image>",
10
+ "is_local": true,
11
+ "local_files_only": false,
12
+ "mask_token": "<mask>",
13
+ "model_max_length": 1024,
14
+ "model_specific_special_tokens": {
15
+ "image_token": "<image>"
16
+ },
17
+ "pad_token": "<pad>",
18
+ "processor_class": "Florence2Processor",
19
+ "sep_token": "</s>",
20
+ "tokenizer_class": "RobertaTokenizer",
21
+ "trim_offsets": true,
22
+ "unk_token": "<unk>"
23
+ }