wesley7137
/

fal-7B-shard-quantum

RefinedWebModel

Model card Files Files and versions Community

wesley7137 commited on Jul 10, 2023

Commit

ce759ce

•

1 Parent(s): 05f4acb

Create config.json

Files changed (1) hide show

config.json +77 -0

config.json ADDED Viewed

	@@ -0,0 +1,77 @@

+Hugging Face's logo
+Hugging Face
+Search models, datasets, users...
+Models
+Datasets
+Spaces
+Docs
+Solutions
+Pricing
+ybelkada
+/
+falcon-7b-sharded-bf16
+like
+6
+Text Generation
+PyTorch
+Transformers
+RefinedWebModel
+custom_code
+text-generation-inference
+Model card
+Files and versions
+Community
+2
+falcon-7b-sharded-bf16
+/
+config.json
+ybelkada's picture
+ybelkada
+HF STAFF
+Upload RWForCausalLM
+83dcd9c
+about 1 month ago
+raw
+history
+blame
+contribute
+delete
+1.1 kB
+{
+  "_name_or_path": "tiiuae/falcon-7b",
+  "alibi": false,
+  "apply_residual_connection_post_layernorm": false,
+  "architectures": [
+    "RWForCausalLM"
+  ],
+  "attention_dropout": 0.0,
+  "auto_map": {
+    "AutoConfig": "tiiuae/falcon-7b--configuration_RW.RWConfig",
+    "AutoModel": "tiiuae/falcon-7b--modelling_RW.RWModel",
+    "AutoModelForCausalLM": "tiiuae/falcon-7b--modelling_RW.RWForCausalLM",
+    "AutoModelForQuestionAnswering": "tiiuae/falcon-7b--modelling_RW.RWForQuestionAnswering",
+    "AutoModelForSequenceClassification": "tiiuae/falcon-7b--modelling_RW.RWForSequenceClassification",
+    "AutoModelForTokenClassification": "tiiuae/falcon-7b--modelling_RW.RWForTokenClassification"
+  },
+  "bias": false,
+  "bos_token_id": 11,
+  "eos_token_id": 11,
+  "hidden_dropout": 0.0,
+  "hidden_size": 4544,
+  "initializer_range": 0.02,
+  "layer_norm_epsilon": 1e-05,
+  "model_type": "RefinedWebModel",
+  "multi_query": true,
+  "n_head": 71,
+  "n_layer": 32,
+  "parallel_attn": true,
+  "torch_dtype": "bfloat16",
+  "transformers_version": "4.30.0.dev0",
+  "use_cache": true,
+  "vocab_size": 65024
+}