Ashx098 commited on
Commit
9478759
·
verified ·
1 Parent(s): 18dce30

Upload README.md with huggingface_hub

Browse files
Files changed (1) hide show
  1. README.md +42 -0
README.md ADDED
@@ -0,0 +1,42 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ # chipforge-llm
2
+
3
+ LoRA adapters for Verilog HDL generation, fine-tuned on Nemotron-30B.
4
+
5
+ ## phase_1/v0.1/
6
+
7
+ | Field | Value |
8
+ |-------|-------|
9
+ | Base model | NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 |
10
+ | Training data | 36,321 Verilog modules (filtered ≤10k tokens) |
11
+ | Method | LoRA CPT (Continued Pre-Training) |
12
+ | LoRA rank | 8 |
13
+ | Trainable params | ~4.5M (0.015% of 30B) |
14
+ | Max seq len | 1024 |
15
+ | Epochs | 2 |
16
+ | Final train loss | 0.42 |
17
+ | Final eval loss | 0.43 |
18
+ | Token accuracy | ~89% |
19
+ | Hardware | 2x A100-80GB, FSDP |
20
+
21
+ ### Usage
22
+
23
+ ``\python
24
+ from peft import PeftModel
25
+ from transformers import AutoModelForCausalLM, AutoTokenizer
26
+
27
+ model = AutoModelForCausalLM.from_pretrained(
28
+ "NVIDIA/Nemotron-3-Nano-30B-A3B-BF16",
29
+ torch_dtype="bfloat16",
30
+ device_map="auto",
31
+ trust_remote_code=True,
32
+ )
33
+ model = PeftModel.from_pretrained(model, "Ashx098/chipforge-llm/phase_1/v0.1")
34
+ tokenizer = AutoTokenizer.from_pretrained(
35
+ "NVIDIA/Nemotron-3-Nano-30B-A3B-BF16",
36
+ trust_remote_code=True,
37
+ )
38
+ ```
39
+
40
+ ### wandb
41
+
42
+ Run: https://wandb.ai/avinash-mynampati-juspay/vaschpforge-llm/runs/c5gid36w