prince-canuma commited on
Commit
6156b10
·
verified ·
1 Parent(s): 4201d02

Upload folder using huggingface_hub

Browse files
config.json CHANGED
@@ -37,6 +37,26 @@
37
  "group_size": 64,
38
  "bits": 5,
39
  "mode": "affine",
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
40
  "model.decoder.layers.0.mlp.gate_proj": {
41
  "group_size": 64,
42
  "bits": 8
@@ -53,6 +73,22 @@
53
  "group_size": 64,
54
  "bits": 8
55
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
56
  "model.decoder.layers.1.mlp.gate_proj": {
57
  "group_size": 64,
58
  "bits": 8
@@ -69,6 +105,22 @@
69
  "group_size": 64,
70
  "bits": 8
71
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
72
  "model.decoder.layers.2.mlp.gate_proj": {
73
  "group_size": 64,
74
  "bits": 8
@@ -85,6 +137,22 @@
85
  "group_size": 64,
86
  "bits": 8
87
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
88
  "model.decoder.layers.3.mlp.gate_proj": {
89
  "group_size": 64,
90
  "bits": 8
@@ -101,6 +169,22 @@
101
  "group_size": 64,
102
  "bits": 8
103
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
104
  "model.decoder.layers.4.mlp.gate_proj": {
105
  "group_size": 64,
106
  "bits": 8
@@ -117,6 +201,18 @@
117
  "group_size": 64,
118
  "bits": 8
119
  },
 
 
 
 
 
 
 
 
 
 
 
 
120
  "model.decoder.layers.5.mlp.gate_proj": {
121
  "group_size": 64,
122
  "bits": 8
@@ -133,6 +229,22 @@
133
  "group_size": 64,
134
  "bits": 8
135
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
136
  "model.decoder.layers.6.mlp.gate_proj": {
137
  "group_size": 64,
138
  "bits": 8
@@ -149,6 +261,22 @@
149
  "group_size": 64,
150
  "bits": 8
151
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
152
  "model.decoder.layers.7.mlp.gate_proj": {
153
  "group_size": 64,
154
  "bits": 8
@@ -165,6 +293,22 @@
165
  "group_size": 64,
166
  "bits": 8
167
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
168
  "model.decoder.layers.8.mlp.gate_proj": {
169
  "group_size": 64,
170
  "bits": 8
@@ -181,6 +325,22 @@
181
  "group_size": 64,
182
  "bits": 8
183
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
184
  "model.decoder.layers.9.mlp.gate_proj": {
185
  "group_size": 64,
186
  "bits": 8
@@ -197,6 +357,22 @@
197
  "group_size": 64,
198
  "bits": 8
199
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
200
  "model.decoder.layers.10.mlp.gate_proj": {
201
  "group_size": 64,
202
  "bits": 8
@@ -213,6 +389,18 @@
213
  "group_size": 64,
214
  "bits": 8
215
  },
 
 
 
 
 
 
 
 
 
 
 
 
216
  "model.decoder.layers.11.mlp.gate_proj": {
217
  "group_size": 64,
218
  "bits": 8
@@ -229,6 +417,22 @@
229
  "group_size": 64,
230
  "bits": 8
231
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
232
  "model.decoder.layers.12.mlp.gate_proj": {
233
  "group_size": 64,
234
  "bits": 8
@@ -245,6 +449,22 @@
245
  "group_size": 64,
246
  "bits": 8
247
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
248
  "model.decoder.layers.13.mlp.gate_proj": {
249
  "group_size": 64,
250
  "bits": 8
@@ -261,6 +481,22 @@
261
  "group_size": 64,
262
  "bits": 8
263
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
264
  "model.decoder.layers.14.mlp.gate_proj": {
265
  "group_size": 64,
266
  "bits": 8
@@ -277,6 +513,22 @@
277
  "group_size": 64,
278
  "bits": 8
279
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
280
  "model.decoder.layers.15.mlp.gate_proj": {
281
  "group_size": 64,
282
  "bits": 8
@@ -293,6 +545,22 @@
293
  "group_size": 64,
294
  "bits": 8
295
  },
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
296
  "model.decoder.layers.16.mlp.gate_proj": {
297
  "group_size": 64,
298
  "bits": 8
@@ -309,6 +577,18 @@
309
  "group_size": 64,
310
  "bits": 8
311
  },
 
 
 
 
 
 
 
 
 
 
 
 
312
  "model.decoder.layers.17.mlp.gate_proj": {
313
  "group_size": 64,
314
  "bits": 8
@@ -325,648 +605,1284 @@
325
  "group_size": 64,
326
  "bits": 8
327
  },
328
- "model.decoder.layers.18.mlp.gate_proj": {
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
329
  "group_size": 64,
330
  "bits": 8
331
  },
332
- "model.decoder.layers.18.mlp.up_proj": {
333
  "group_size": 64,
334
  "bits": 8
335
  },
336
- "model.decoder.layers.18.mlp.down_proj": {
337
  "group_size": 64,
338
  "bits": 8
339
  },
340
- "model.decoder.layers.18.router.proj": {
341
  "group_size": 64,
342
  "bits": 8
343
  },
344
- "model.decoder.layers.19.mlp.gate_proj": {
345
  "group_size": 64,
346
  "bits": 8
347
  },
348
- "model.decoder.layers.19.mlp.up_proj": {
349
  "group_size": 64,
350
  "bits": 8
351
  },
352
- "model.decoder.layers.19.mlp.down_proj": {
353
  "group_size": 64,
354
  "bits": 8
355
  },
356
- "model.decoder.layers.19.router.proj": {
357
  "group_size": 64,
358
  "bits": 8
359
  },
360
- "model.decoder.layers.20.mlp.gate_proj": {
361
  "group_size": 64,
362
  "bits": 8
363
  },
364
- "model.decoder.layers.20.mlp.up_proj": {
365
  "group_size": 64,
366
  "bits": 8
367
  },
368
- "model.decoder.layers.20.mlp.down_proj": {
369
  "group_size": 64,
370
  "bits": 8
371
  },
372
- "model.decoder.layers.20.router.proj": {
373
  "group_size": 64,
374
  "bits": 8
375
  },
376
- "model.decoder.layers.21.mlp.gate_proj": {
377
  "group_size": 64,
378
  "bits": 8
379
  },
380
- "model.decoder.layers.21.mlp.up_proj": {
381
  "group_size": 64,
382
  "bits": 8
383
  },
384
- "model.decoder.layers.21.mlp.down_proj": {
385
  "group_size": 64,
386
  "bits": 8
387
  },
388
- "model.decoder.layers.21.router.proj": {
389
  "group_size": 64,
390
  "bits": 8
391
  },
392
- "model.decoder.layers.22.mlp.gate_proj": {
393
  "group_size": 64,
394
  "bits": 8
395
  },
396
- "model.decoder.layers.22.mlp.up_proj": {
397
  "group_size": 64,
398
  "bits": 8
399
  },
400
- "model.decoder.layers.22.mlp.down_proj": {
401
  "group_size": 64,
402
  "bits": 8
403
  },
404
- "model.decoder.layers.22.router.proj": {
405
  "group_size": 64,
406
  "bits": 8
407
  },
408
- "model.decoder.layers.23.mlp.gate_proj": {
409
  "group_size": 64,
410
  "bits": 8
411
  },
412
- "model.decoder.layers.23.mlp.up_proj": {
413
  "group_size": 64,
414
  "bits": 8
415
  },
416
- "model.decoder.layers.23.mlp.down_proj": {
417
  "group_size": 64,
418
  "bits": 8
419
  },
420
- "model.decoder.layers.23.router.proj": {
421
  "group_size": 64,
422
  "bits": 8
423
  },
424
- "model.decoder.layers.24.mlp.gate_proj": {
425
  "group_size": 64,
426
  "bits": 8
427
  },
428
- "model.decoder.layers.24.mlp.up_proj": {
429
  "group_size": 64,
430
  "bits": 8
431
  },
432
- "model.decoder.layers.24.mlp.down_proj": {
433
  "group_size": 64,
434
  "bits": 8
435
  },
436
- "model.decoder.layers.24.router.proj": {
437
  "group_size": 64,
438
  "bits": 8
439
  },
440
- "model.decoder.layers.25.mlp.gate_proj": {
441
  "group_size": 64,
442
  "bits": 8
443
  },
444
- "model.decoder.layers.25.mlp.up_proj": {
445
  "group_size": 64,
446
  "bits": 8
447
  },
448
- "model.decoder.layers.25.mlp.down_proj": {
449
  "group_size": 64,
450
  "bits": 8
451
  },
452
- "model.decoder.layers.25.router.proj": {
453
  "group_size": 64,
454
  "bits": 8
455
  },
456
- "model.decoder.layers.26.mlp.gate_proj": {
457
  "group_size": 64,
458
  "bits": 8
459
  },
460
- "model.decoder.layers.26.mlp.up_proj": {
461
  "group_size": 64,
462
  "bits": 8
463
  },
464
- "model.decoder.layers.26.mlp.down_proj": {
465
  "group_size": 64,
466
  "bits": 8
467
  },
468
- "model.decoder.layers.26.router.proj": {
469
  "group_size": 64,
470
  "bits": 8
471
  },
472
- "model.decoder.layers.27.mlp.gate_proj": {
473
  "group_size": 64,
474
  "bits": 8
475
  },
476
- "model.decoder.layers.27.mlp.up_proj": {
477
  "group_size": 64,
478
  "bits": 8
479
  },
480
- "model.decoder.layers.27.mlp.down_proj": {
481
  "group_size": 64,
482
  "bits": 8
483
  },
484
- "model.decoder.layers.27.router.proj": {
485
  "group_size": 64,
486
  "bits": 8
487
  },
488
- "model.decoder.layers.28.mlp.gate_proj": {
489
  "group_size": 64,
490
  "bits": 8
491
  },
492
- "model.decoder.layers.28.mlp.up_proj": {
493
  "group_size": 64,
494
  "bits": 8
495
  },
496
- "model.decoder.layers.28.mlp.down_proj": {
497
  "group_size": 64,
498
  "bits": 8
499
  },
500
- "model.decoder.layers.28.router.proj": {
501
  "group_size": 64,
502
  "bits": 8
503
  },
504
- "model.decoder.layers.29.mlp.gate_proj": {
505
  "group_size": 64,
506
  "bits": 8
507
  },
508
- "model.decoder.layers.29.mlp.up_proj": {
509
  "group_size": 64,
510
  "bits": 8
511
  },
512
- "model.decoder.layers.29.mlp.down_proj": {
513
  "group_size": 64,
514
  "bits": 8
515
  },
516
- "model.decoder.layers.29.router.proj": {
517
  "group_size": 64,
518
  "bits": 8
519
- }
520
- },
521
- "quantization_config": {
522
- "group_size": 64,
523
- "bits": 5,
524
- "mode": "affine",
525
- "model.decoder.layers.0.mlp.gate_proj": {
526
  "group_size": 64,
527
  "bits": 8
528
  },
529
- "model.decoder.layers.0.mlp.up_proj": {
530
  "group_size": 64,
531
  "bits": 8
532
  },
533
- "model.decoder.layers.0.mlp.down_proj": {
534
  "group_size": 64,
535
  "bits": 8
536
  },
537
- "model.decoder.layers.0.router.proj": {
538
  "group_size": 64,
539
  "bits": 8
540
  },
541
- "model.decoder.layers.1.mlp.gate_proj": {
542
  "group_size": 64,
543
  "bits": 8
544
  },
545
- "model.decoder.layers.1.mlp.up_proj": {
546
  "group_size": 64,
547
  "bits": 8
548
  },
549
- "model.decoder.layers.1.mlp.down_proj": {
550
  "group_size": 64,
551
  "bits": 8
552
  },
553
- "model.decoder.layers.1.router.proj": {
554
  "group_size": 64,
555
  "bits": 8
556
  },
557
- "model.decoder.layers.2.mlp.gate_proj": {
558
  "group_size": 64,
559
  "bits": 8
560
  },
561
- "model.decoder.layers.2.mlp.up_proj": {
562
  "group_size": 64,
563
  "bits": 8
564
  },
565
- "model.decoder.layers.2.mlp.down_proj": {
566
  "group_size": 64,
567
  "bits": 8
568
  },
569
- "model.decoder.layers.2.router.proj": {
570
  "group_size": 64,
571
  "bits": 8
572
  },
573
- "model.decoder.layers.3.mlp.gate_proj": {
574
  "group_size": 64,
575
  "bits": 8
576
  },
577
- "model.decoder.layers.3.mlp.up_proj": {
578
  "group_size": 64,
579
  "bits": 8
580
  },
581
- "model.decoder.layers.3.mlp.down_proj": {
582
  "group_size": 64,
583
  "bits": 8
584
  },
585
- "model.decoder.layers.3.router.proj": {
586
  "group_size": 64,
587
  "bits": 8
588
  },
589
- "model.decoder.layers.4.mlp.gate_proj": {
590
  "group_size": 64,
591
  "bits": 8
592
  },
593
- "model.decoder.layers.4.mlp.up_proj": {
594
  "group_size": 64,
595
  "bits": 8
596
  },
597
- "model.decoder.layers.4.mlp.down_proj": {
598
  "group_size": 64,
599
  "bits": 8
600
  },
601
- "model.decoder.layers.4.router.proj": {
602
  "group_size": 64,
603
  "bits": 8
604
  },
605
- "model.decoder.layers.5.mlp.gate_proj": {
606
  "group_size": 64,
607
  "bits": 8
608
  },
609
- "model.decoder.layers.5.mlp.up_proj": {
610
  "group_size": 64,
611
  "bits": 8
612
  },
613
- "model.decoder.layers.5.mlp.down_proj": {
614
  "group_size": 64,
615
  "bits": 8
616
  },
617
- "model.decoder.layers.5.router.proj": {
618
  "group_size": 64,
619
  "bits": 8
620
  },
621
- "model.decoder.layers.6.mlp.gate_proj": {
622
  "group_size": 64,
623
  "bits": 8
624
  },
625
- "model.decoder.layers.6.mlp.up_proj": {
626
  "group_size": 64,
627
  "bits": 8
628
  },
629
- "model.decoder.layers.6.mlp.down_proj": {
630
  "group_size": 64,
631
  "bits": 8
632
  },
633
- "model.decoder.layers.6.router.proj": {
634
  "group_size": 64,
635
  "bits": 8
636
  },
637
- "model.decoder.layers.7.mlp.gate_proj": {
638
  "group_size": 64,
639
  "bits": 8
640
  },
641
- "model.decoder.layers.7.mlp.up_proj": {
642
  "group_size": 64,
643
  "bits": 8
644
  },
645
- "model.decoder.layers.7.mlp.down_proj": {
646
  "group_size": 64,
647
  "bits": 8
648
  },
649
- "model.decoder.layers.7.router.proj": {
650
  "group_size": 64,
651
  "bits": 8
652
  },
653
- "model.decoder.layers.8.mlp.gate_proj": {
654
  "group_size": 64,
655
  "bits": 8
656
  },
657
- "model.decoder.layers.8.mlp.up_proj": {
658
  "group_size": 64,
659
  "bits": 8
660
  },
661
- "model.decoder.layers.8.mlp.down_proj": {
662
  "group_size": 64,
663
  "bits": 8
664
  },
665
- "model.decoder.layers.8.router.proj": {
666
  "group_size": 64,
667
  "bits": 8
668
  },
669
- "model.decoder.layers.9.mlp.gate_proj": {
670
  "group_size": 64,
671
  "bits": 8
672
  },
673
- "model.decoder.layers.9.mlp.up_proj": {
674
  "group_size": 64,
675
  "bits": 8
676
  },
677
- "model.decoder.layers.9.mlp.down_proj": {
678
  "group_size": 64,
679
  "bits": 8
680
  },
681
- "model.decoder.layers.9.router.proj": {
682
  "group_size": 64,
683
  "bits": 8
684
  },
685
- "model.decoder.layers.10.mlp.gate_proj": {
686
  "group_size": 64,
687
  "bits": 8
688
  },
689
- "model.decoder.layers.10.mlp.up_proj": {
690
  "group_size": 64,
691
  "bits": 8
692
  },
693
- "model.decoder.layers.10.mlp.down_proj": {
694
  "group_size": 64,
695
  "bits": 8
696
  },
697
- "model.decoder.layers.10.router.proj": {
698
  "group_size": 64,
699
  "bits": 8
700
  },
701
- "model.decoder.layers.11.mlp.gate_proj": {
702
  "group_size": 64,
703
  "bits": 8
704
  },
705
- "model.decoder.layers.11.mlp.up_proj": {
706
  "group_size": 64,
707
  "bits": 8
708
  },
709
- "model.decoder.layers.11.mlp.down_proj": {
710
  "group_size": 64,
711
  "bits": 8
712
  },
713
- "model.decoder.layers.11.router.proj": {
714
  "group_size": 64,
715
  "bits": 8
716
  },
717
- "model.decoder.layers.12.mlp.gate_proj": {
718
  "group_size": 64,
719
  "bits": 8
720
  },
721
- "model.decoder.layers.12.mlp.up_proj": {
722
  "group_size": 64,
723
  "bits": 8
724
  },
725
- "model.decoder.layers.12.mlp.down_proj": {
726
  "group_size": 64,
727
  "bits": 8
728
  },
729
- "model.decoder.layers.12.router.proj": {
730
  "group_size": 64,
731
  "bits": 8
732
  },
733
- "model.decoder.layers.13.mlp.gate_proj": {
734
  "group_size": 64,
735
  "bits": 8
736
  },
737
- "model.decoder.layers.13.mlp.up_proj": {
738
  "group_size": 64,
739
  "bits": 8
740
  },
741
- "model.decoder.layers.13.mlp.down_proj": {
742
  "group_size": 64,
743
  "bits": 8
744
  },
745
- "model.decoder.layers.13.router.proj": {
746
  "group_size": 64,
747
  "bits": 8
748
  },
749
- "model.decoder.layers.14.mlp.gate_proj": {
750
  "group_size": 64,
751
  "bits": 8
752
  },
753
- "model.decoder.layers.14.mlp.up_proj": {
754
  "group_size": 64,
755
  "bits": 8
756
  },
757
- "model.decoder.layers.14.mlp.down_proj": {
758
  "group_size": 64,
759
  "bits": 8
760
  },
761
- "model.decoder.layers.14.router.proj": {
762
  "group_size": 64,
763
  "bits": 8
764
  },
765
- "model.decoder.layers.15.mlp.gate_proj": {
766
  "group_size": 64,
767
  "bits": 8
768
  },
769
- "model.decoder.layers.15.mlp.up_proj": {
770
  "group_size": 64,
771
  "bits": 8
772
  },
773
- "model.decoder.layers.15.mlp.down_proj": {
774
  "group_size": 64,
775
  "bits": 8
776
  },
777
- "model.decoder.layers.15.router.proj": {
778
  "group_size": 64,
779
  "bits": 8
780
  },
781
- "model.decoder.layers.16.mlp.gate_proj": {
782
  "group_size": 64,
783
  "bits": 8
784
  },
785
- "model.decoder.layers.16.mlp.up_proj": {
786
  "group_size": 64,
787
  "bits": 8
788
  },
789
- "model.decoder.layers.16.mlp.down_proj": {
790
  "group_size": 64,
791
  "bits": 8
792
  },
793
- "model.decoder.layers.16.router.proj": {
794
  "group_size": 64,
795
  "bits": 8
796
  },
797
- "model.decoder.layers.17.mlp.gate_proj": {
798
  "group_size": 64,
799
  "bits": 8
800
  },
801
- "model.decoder.layers.17.mlp.up_proj": {
802
  "group_size": 64,
803
  "bits": 8
804
  },
805
- "model.decoder.layers.17.mlp.down_proj": {
806
  "group_size": 64,
807
  "bits": 8
808
  },
809
- "model.decoder.layers.17.router.proj": {
810
  "group_size": 64,
811
  "bits": 8
812
  },
813
- "model.decoder.layers.18.mlp.gate_proj": {
814
  "group_size": 64,
815
  "bits": 8
816
  },
817
- "model.decoder.layers.18.mlp.up_proj": {
818
  "group_size": 64,
819
  "bits": 8
820
  },
821
- "model.decoder.layers.18.mlp.down_proj": {
822
  "group_size": 64,
823
  "bits": 8
824
  },
825
- "model.decoder.layers.18.router.proj": {
826
  "group_size": 64,
827
  "bits": 8
828
  },
829
- "model.decoder.layers.19.mlp.gate_proj": {
830
  "group_size": 64,
831
  "bits": 8
832
  },
833
- "model.decoder.layers.19.mlp.up_proj": {
834
  "group_size": 64,
835
  "bits": 8
836
  },
837
- "model.decoder.layers.19.mlp.down_proj": {
838
  "group_size": 64,
839
  "bits": 8
840
  },
841
- "model.decoder.layers.19.router.proj": {
842
  "group_size": 64,
843
  "bits": 8
844
  },
845
- "model.decoder.layers.20.mlp.gate_proj": {
846
  "group_size": 64,
847
  "bits": 8
848
  },
849
- "model.decoder.layers.20.mlp.up_proj": {
850
  "group_size": 64,
851
  "bits": 8
852
  },
853
- "model.decoder.layers.20.mlp.down_proj": {
854
  "group_size": 64,
855
  "bits": 8
856
  },
857
- "model.decoder.layers.20.router.proj": {
858
  "group_size": 64,
859
  "bits": 8
860
  },
861
- "model.decoder.layers.21.mlp.gate_proj": {
862
  "group_size": 64,
863
  "bits": 8
864
  },
865
- "model.decoder.layers.21.mlp.up_proj": {
866
  "group_size": 64,
867
  "bits": 8
868
  },
869
- "model.decoder.layers.21.mlp.down_proj": {
870
  "group_size": 64,
871
  "bits": 8
872
  },
873
- "model.decoder.layers.21.router.proj": {
874
  "group_size": 64,
875
  "bits": 8
876
  },
877
- "model.decoder.layers.22.mlp.gate_proj": {
878
  "group_size": 64,
879
  "bits": 8
880
  },
881
- "model.decoder.layers.22.mlp.up_proj": {
882
  "group_size": 64,
883
  "bits": 8
884
  },
885
- "model.decoder.layers.22.mlp.down_proj": {
886
  "group_size": 64,
887
  "bits": 8
888
  },
889
- "model.decoder.layers.22.router.proj": {
890
  "group_size": 64,
891
  "bits": 8
892
  },
893
- "model.decoder.layers.23.mlp.gate_proj": {
894
  "group_size": 64,
895
  "bits": 8
896
  },
897
- "model.decoder.layers.23.mlp.up_proj": {
898
  "group_size": 64,
899
  "bits": 8
900
  },
901
- "model.decoder.layers.23.mlp.down_proj": {
902
  "group_size": 64,
903
  "bits": 8
904
  },
905
- "model.decoder.layers.23.router.proj": {
906
  "group_size": 64,
907
  "bits": 8
908
  },
909
- "model.decoder.layers.24.mlp.gate_proj": {
910
  "group_size": 64,
911
  "bits": 8
912
  },
913
- "model.decoder.layers.24.mlp.up_proj": {
914
  "group_size": 64,
915
  "bits": 8
916
  },
917
- "model.decoder.layers.24.mlp.down_proj": {
918
  "group_size": 64,
919
  "bits": 8
920
  },
921
- "model.decoder.layers.24.router.proj": {
922
  "group_size": 64,
923
  "bits": 8
924
  },
925
- "model.decoder.layers.25.mlp.gate_proj": {
926
  "group_size": 64,
927
  "bits": 8
928
  },
929
- "model.decoder.layers.25.mlp.up_proj": {
930
  "group_size": 64,
931
  "bits": 8
932
  },
933
- "model.decoder.layers.25.mlp.down_proj": {
934
  "group_size": 64,
935
  "bits": 8
936
  },
937
- "model.decoder.layers.25.router.proj": {
938
  "group_size": 64,
939
  "bits": 8
940
  },
941
- "model.decoder.layers.26.mlp.gate_proj": {
942
  "group_size": 64,
943
  "bits": 8
944
  },
945
- "model.decoder.layers.26.mlp.up_proj": {
946
  "group_size": 64,
947
  "bits": 8
948
  },
949
- "model.decoder.layers.26.mlp.down_proj": {
950
  "group_size": 64,
951
  "bits": 8
952
  },
953
- "model.decoder.layers.26.router.proj": {
954
  "group_size": 64,
955
  "bits": 8
956
  },
957
- "model.decoder.layers.27.mlp.gate_proj": {
958
  "group_size": 64,
959
  "bits": 8
960
  },
961
- "model.decoder.layers.27.mlp.up_proj": {
962
  "group_size": 64,
963
  "bits": 8
964
  },
965
- "model.decoder.layers.27.mlp.down_proj": {
966
  "group_size": 64,
967
  "bits": 8
968
  },
969
- "model.decoder.layers.27.router.proj": {
970
  "group_size": 64,
971
  "bits": 8
972
  },
@@ -986,6 +1902,18 @@
986
  "group_size": 64,
987
  "bits": 8
988
  },
 
 
 
 
 
 
 
 
 
 
 
 
989
  "model.decoder.layers.29.mlp.gate_proj": {
990
  "group_size": 64,
991
  "bits": 8
 
37
  "group_size": 64,
38
  "bits": 5,
39
  "mode": "affine",
40
+ "model.decoder.embed_tokens": {
41
+ "group_size": 64,
42
+ "bits": 8
43
+ },
44
+ "model.decoder.layers.0.self_attn.q_proj": {
45
+ "group_size": 64,
46
+ "bits": 8
47
+ },
48
+ "model.decoder.layers.0.self_attn.k_proj": {
49
+ "group_size": 64,
50
+ "bits": 8
51
+ },
52
+ "model.decoder.layers.0.self_attn.v_proj": {
53
+ "group_size": 64,
54
+ "bits": 8
55
+ },
56
+ "model.decoder.layers.0.self_attn.o_proj": {
57
+ "group_size": 64,
58
+ "bits": 8
59
+ },
60
  "model.decoder.layers.0.mlp.gate_proj": {
61
  "group_size": 64,
62
  "bits": 8
 
73
  "group_size": 64,
74
  "bits": 8
75
  },
76
+ "model.decoder.layers.1.self_attn.q_proj": {
77
+ "group_size": 64,
78
+ "bits": 8
79
+ },
80
+ "model.decoder.layers.1.self_attn.k_proj": {
81
+ "group_size": 64,
82
+ "bits": 8
83
+ },
84
+ "model.decoder.layers.1.self_attn.v_proj": {
85
+ "group_size": 64,
86
+ "bits": 8
87
+ },
88
+ "model.decoder.layers.1.self_attn.o_proj": {
89
+ "group_size": 64,
90
+ "bits": 8
91
+ },
92
  "model.decoder.layers.1.mlp.gate_proj": {
93
  "group_size": 64,
94
  "bits": 8
 
105
  "group_size": 64,
106
  "bits": 8
107
  },
108
+ "model.decoder.layers.2.self_attn.q_proj": {
109
+ "group_size": 64,
110
+ "bits": 8
111
+ },
112
+ "model.decoder.layers.2.self_attn.k_proj": {
113
+ "group_size": 64,
114
+ "bits": 8
115
+ },
116
+ "model.decoder.layers.2.self_attn.v_proj": {
117
+ "group_size": 64,
118
+ "bits": 8
119
+ },
120
+ "model.decoder.layers.2.self_attn.o_proj": {
121
+ "group_size": 64,
122
+ "bits": 8
123
+ },
124
  "model.decoder.layers.2.mlp.gate_proj": {
125
  "group_size": 64,
126
  "bits": 8
 
137
  "group_size": 64,
138
  "bits": 8
139
  },
140
+ "model.decoder.layers.3.self_attn.q_proj": {
141
+ "group_size": 64,
142
+ "bits": 8
143
+ },
144
+ "model.decoder.layers.3.self_attn.k_proj": {
145
+ "group_size": 64,
146
+ "bits": 8
147
+ },
148
+ "model.decoder.layers.3.self_attn.v_proj": {
149
+ "group_size": 64,
150
+ "bits": 8
151
+ },
152
+ "model.decoder.layers.3.self_attn.o_proj": {
153
+ "group_size": 64,
154
+ "bits": 8
155
+ },
156
  "model.decoder.layers.3.mlp.gate_proj": {
157
  "group_size": 64,
158
  "bits": 8
 
169
  "group_size": 64,
170
  "bits": 8
171
  },
172
+ "model.decoder.layers.4.self_attn.q_proj": {
173
+ "group_size": 64,
174
+ "bits": 8
175
+ },
176
+ "model.decoder.layers.4.self_attn.k_proj": {
177
+ "group_size": 64,
178
+ "bits": 8
179
+ },
180
+ "model.decoder.layers.4.self_attn.v_proj": {
181
+ "group_size": 64,
182
+ "bits": 8
183
+ },
184
+ "model.decoder.layers.4.self_attn.o_proj": {
185
+ "group_size": 64,
186
+ "bits": 8
187
+ },
188
  "model.decoder.layers.4.mlp.gate_proj": {
189
  "group_size": 64,
190
  "bits": 8
 
201
  "group_size": 64,
202
  "bits": 8
203
  },
204
+ "model.decoder.layers.5.self_attn.q_proj": {
205
+ "group_size": 64,
206
+ "bits": 8
207
+ },
208
+ "model.decoder.layers.5.self_attn.k_proj": {
209
+ "group_size": 64,
210
+ "bits": 8
211
+ },
212
+ "model.decoder.layers.5.self_attn.o_proj": {
213
+ "group_size": 64,
214
+ "bits": 8
215
+ },
216
  "model.decoder.layers.5.mlp.gate_proj": {
217
  "group_size": 64,
218
  "bits": 8
 
229
  "group_size": 64,
230
  "bits": 8
231
  },
232
+ "model.decoder.layers.6.self_attn.q_proj": {
233
+ "group_size": 64,
234
+ "bits": 8
235
+ },
236
+ "model.decoder.layers.6.self_attn.k_proj": {
237
+ "group_size": 64,
238
+ "bits": 8
239
+ },
240
+ "model.decoder.layers.6.self_attn.v_proj": {
241
+ "group_size": 64,
242
+ "bits": 8
243
+ },
244
+ "model.decoder.layers.6.self_attn.o_proj": {
245
+ "group_size": 64,
246
+ "bits": 8
247
+ },
248
  "model.decoder.layers.6.mlp.gate_proj": {
249
  "group_size": 64,
250
  "bits": 8
 
261
  "group_size": 64,
262
  "bits": 8
263
  },
264
+ "model.decoder.layers.7.self_attn.q_proj": {
265
+ "group_size": 64,
266
+ "bits": 8
267
+ },
268
+ "model.decoder.layers.7.self_attn.k_proj": {
269
+ "group_size": 64,
270
+ "bits": 8
271
+ },
272
+ "model.decoder.layers.7.self_attn.v_proj": {
273
+ "group_size": 64,
274
+ "bits": 8
275
+ },
276
+ "model.decoder.layers.7.self_attn.o_proj": {
277
+ "group_size": 64,
278
+ "bits": 8
279
+ },
280
  "model.decoder.layers.7.mlp.gate_proj": {
281
  "group_size": 64,
282
  "bits": 8
 
293
  "group_size": 64,
294
  "bits": 8
295
  },
296
+ "model.decoder.layers.8.self_attn.q_proj": {
297
+ "group_size": 64,
298
+ "bits": 8
299
+ },
300
+ "model.decoder.layers.8.self_attn.k_proj": {
301
+ "group_size": 64,
302
+ "bits": 8
303
+ },
304
+ "model.decoder.layers.8.self_attn.v_proj": {
305
+ "group_size": 64,
306
+ "bits": 8
307
+ },
308
+ "model.decoder.layers.8.self_attn.o_proj": {
309
+ "group_size": 64,
310
+ "bits": 8
311
+ },
312
  "model.decoder.layers.8.mlp.gate_proj": {
313
  "group_size": 64,
314
  "bits": 8
 
325
  "group_size": 64,
326
  "bits": 8
327
  },
328
+ "model.decoder.layers.9.self_attn.q_proj": {
329
+ "group_size": 64,
330
+ "bits": 8
331
+ },
332
+ "model.decoder.layers.9.self_attn.k_proj": {
333
+ "group_size": 64,
334
+ "bits": 8
335
+ },
336
+ "model.decoder.layers.9.self_attn.v_proj": {
337
+ "group_size": 64,
338
+ "bits": 8
339
+ },
340
+ "model.decoder.layers.9.self_attn.o_proj": {
341
+ "group_size": 64,
342
+ "bits": 8
343
+ },
344
  "model.decoder.layers.9.mlp.gate_proj": {
345
  "group_size": 64,
346
  "bits": 8
 
357
  "group_size": 64,
358
  "bits": 8
359
  },
360
+ "model.decoder.layers.10.self_attn.q_proj": {
361
+ "group_size": 64,
362
+ "bits": 8
363
+ },
364
+ "model.decoder.layers.10.self_attn.k_proj": {
365
+ "group_size": 64,
366
+ "bits": 8
367
+ },
368
+ "model.decoder.layers.10.self_attn.v_proj": {
369
+ "group_size": 64,
370
+ "bits": 8
371
+ },
372
+ "model.decoder.layers.10.self_attn.o_proj": {
373
+ "group_size": 64,
374
+ "bits": 8
375
+ },
376
  "model.decoder.layers.10.mlp.gate_proj": {
377
  "group_size": 64,
378
  "bits": 8
 
389
  "group_size": 64,
390
  "bits": 8
391
  },
392
+ "model.decoder.layers.11.self_attn.q_proj": {
393
+ "group_size": 64,
394
+ "bits": 8
395
+ },
396
+ "model.decoder.layers.11.self_attn.k_proj": {
397
+ "group_size": 64,
398
+ "bits": 8
399
+ },
400
+ "model.decoder.layers.11.self_attn.o_proj": {
401
+ "group_size": 64,
402
+ "bits": 8
403
+ },
404
  "model.decoder.layers.11.mlp.gate_proj": {
405
  "group_size": 64,
406
  "bits": 8
 
417
  "group_size": 64,
418
  "bits": 8
419
  },
420
+ "model.decoder.layers.12.self_attn.q_proj": {
421
+ "group_size": 64,
422
+ "bits": 8
423
+ },
424
+ "model.decoder.layers.12.self_attn.k_proj": {
425
+ "group_size": 64,
426
+ "bits": 8
427
+ },
428
+ "model.decoder.layers.12.self_attn.v_proj": {
429
+ "group_size": 64,
430
+ "bits": 8
431
+ },
432
+ "model.decoder.layers.12.self_attn.o_proj": {
433
+ "group_size": 64,
434
+ "bits": 8
435
+ },
436
  "model.decoder.layers.12.mlp.gate_proj": {
437
  "group_size": 64,
438
  "bits": 8
 
449
  "group_size": 64,
450
  "bits": 8
451
  },
452
+ "model.decoder.layers.13.self_attn.q_proj": {
453
+ "group_size": 64,
454
+ "bits": 8
455
+ },
456
+ "model.decoder.layers.13.self_attn.k_proj": {
457
+ "group_size": 64,
458
+ "bits": 8
459
+ },
460
+ "model.decoder.layers.13.self_attn.v_proj": {
461
+ "group_size": 64,
462
+ "bits": 8
463
+ },
464
+ "model.decoder.layers.13.self_attn.o_proj": {
465
+ "group_size": 64,
466
+ "bits": 8
467
+ },
468
  "model.decoder.layers.13.mlp.gate_proj": {
469
  "group_size": 64,
470
  "bits": 8
 
481
  "group_size": 64,
482
  "bits": 8
483
  },
484
+ "model.decoder.layers.14.self_attn.q_proj": {
485
+ "group_size": 64,
486
+ "bits": 8
487
+ },
488
+ "model.decoder.layers.14.self_attn.k_proj": {
489
+ "group_size": 64,
490
+ "bits": 8
491
+ },
492
+ "model.decoder.layers.14.self_attn.v_proj": {
493
+ "group_size": 64,
494
+ "bits": 8
495
+ },
496
+ "model.decoder.layers.14.self_attn.o_proj": {
497
+ "group_size": 64,
498
+ "bits": 8
499
+ },
500
  "model.decoder.layers.14.mlp.gate_proj": {
501
  "group_size": 64,
502
  "bits": 8
 
513
  "group_size": 64,
514
  "bits": 8
515
  },
516
+ "model.decoder.layers.15.self_attn.q_proj": {
517
+ "group_size": 64,
518
+ "bits": 8
519
+ },
520
+ "model.decoder.layers.15.self_attn.k_proj": {
521
+ "group_size": 64,
522
+ "bits": 8
523
+ },
524
+ "model.decoder.layers.15.self_attn.v_proj": {
525
+ "group_size": 64,
526
+ "bits": 8
527
+ },
528
+ "model.decoder.layers.15.self_attn.o_proj": {
529
+ "group_size": 64,
530
+ "bits": 8
531
+ },
532
  "model.decoder.layers.15.mlp.gate_proj": {
533
  "group_size": 64,
534
  "bits": 8
 
545
  "group_size": 64,
546
  "bits": 8
547
  },
548
+ "model.decoder.layers.16.self_attn.q_proj": {
549
+ "group_size": 64,
550
+ "bits": 8
551
+ },
552
+ "model.decoder.layers.16.self_attn.k_proj": {
553
+ "group_size": 64,
554
+ "bits": 8
555
+ },
556
+ "model.decoder.layers.16.self_attn.v_proj": {
557
+ "group_size": 64,
558
+ "bits": 8
559
+ },
560
+ "model.decoder.layers.16.self_attn.o_proj": {
561
+ "group_size": 64,
562
+ "bits": 8
563
+ },
564
  "model.decoder.layers.16.mlp.gate_proj": {
565
  "group_size": 64,
566
  "bits": 8
 
577
  "group_size": 64,
578
  "bits": 8
579
  },
580
+ "model.decoder.layers.17.self_attn.q_proj": {
581
+ "group_size": 64,
582
+ "bits": 8
583
+ },
584
+ "model.decoder.layers.17.self_attn.k_proj": {
585
+ "group_size": 64,
586
+ "bits": 8
587
+ },
588
+ "model.decoder.layers.17.self_attn.o_proj": {
589
+ "group_size": 64,
590
+ "bits": 8
591
+ },
592
  "model.decoder.layers.17.mlp.gate_proj": {
593
  "group_size": 64,
594
  "bits": 8
 
605
  "group_size": 64,
606
  "bits": 8
607
  },
608
+ "model.decoder.layers.18.self_attn.q_proj": {
609
+ "group_size": 64,
610
+ "bits": 8
611
+ },
612
+ "model.decoder.layers.18.self_attn.k_proj": {
613
+ "group_size": 64,
614
+ "bits": 8
615
+ },
616
+ "model.decoder.layers.18.self_attn.v_proj": {
617
+ "group_size": 64,
618
+ "bits": 8
619
+ },
620
+ "model.decoder.layers.18.self_attn.o_proj": {
621
+ "group_size": 64,
622
+ "bits": 8
623
+ },
624
+ "model.decoder.layers.18.mlp.gate_proj": {
625
+ "group_size": 64,
626
+ "bits": 8
627
+ },
628
+ "model.decoder.layers.18.mlp.up_proj": {
629
+ "group_size": 64,
630
+ "bits": 8
631
+ },
632
+ "model.decoder.layers.18.mlp.down_proj": {
633
+ "group_size": 64,
634
+ "bits": 8
635
+ },
636
+ "model.decoder.layers.18.router.proj": {
637
+ "group_size": 64,
638
+ "bits": 8
639
+ },
640
+ "model.decoder.layers.19.self_attn.q_proj": {
641
+ "group_size": 64,
642
+ "bits": 8
643
+ },
644
+ "model.decoder.layers.19.self_attn.k_proj": {
645
+ "group_size": 64,
646
+ "bits": 8
647
+ },
648
+ "model.decoder.layers.19.self_attn.v_proj": {
649
+ "group_size": 64,
650
+ "bits": 8
651
+ },
652
+ "model.decoder.layers.19.self_attn.o_proj": {
653
+ "group_size": 64,
654
+ "bits": 8
655
+ },
656
+ "model.decoder.layers.19.mlp.gate_proj": {
657
+ "group_size": 64,
658
+ "bits": 8
659
+ },
660
+ "model.decoder.layers.19.mlp.up_proj": {
661
+ "group_size": 64,
662
+ "bits": 8
663
+ },
664
+ "model.decoder.layers.19.mlp.down_proj": {
665
+ "group_size": 64,
666
+ "bits": 8
667
+ },
668
+ "model.decoder.layers.19.router.proj": {
669
+ "group_size": 64,
670
+ "bits": 8
671
+ },
672
+ "model.decoder.layers.20.self_attn.q_proj": {
673
+ "group_size": 64,
674
+ "bits": 8
675
+ },
676
+ "model.decoder.layers.20.self_attn.k_proj": {
677
+ "group_size": 64,
678
+ "bits": 8
679
+ },
680
+ "model.decoder.layers.20.self_attn.v_proj": {
681
+ "group_size": 64,
682
+ "bits": 8
683
+ },
684
+ "model.decoder.layers.20.self_attn.o_proj": {
685
+ "group_size": 64,
686
+ "bits": 8
687
+ },
688
+ "model.decoder.layers.20.mlp.gate_proj": {
689
+ "group_size": 64,
690
+ "bits": 8
691
+ },
692
+ "model.decoder.layers.20.mlp.up_proj": {
693
+ "group_size": 64,
694
+ "bits": 8
695
+ },
696
+ "model.decoder.layers.20.mlp.down_proj": {
697
+ "group_size": 64,
698
+ "bits": 8
699
+ },
700
+ "model.decoder.layers.20.router.proj": {
701
+ "group_size": 64,
702
+ "bits": 8
703
+ },
704
+ "model.decoder.layers.21.self_attn.q_proj": {
705
+ "group_size": 64,
706
+ "bits": 8
707
+ },
708
+ "model.decoder.layers.21.self_attn.k_proj": {
709
+ "group_size": 64,
710
+ "bits": 8
711
+ },
712
+ "model.decoder.layers.21.self_attn.v_proj": {
713
+ "group_size": 64,
714
+ "bits": 8
715
+ },
716
+ "model.decoder.layers.21.self_attn.o_proj": {
717
+ "group_size": 64,
718
+ "bits": 8
719
+ },
720
+ "model.decoder.layers.21.mlp.gate_proj": {
721
+ "group_size": 64,
722
+ "bits": 8
723
+ },
724
+ "model.decoder.layers.21.mlp.up_proj": {
725
+ "group_size": 64,
726
+ "bits": 8
727
+ },
728
+ "model.decoder.layers.21.mlp.down_proj": {
729
+ "group_size": 64,
730
+ "bits": 8
731
+ },
732
+ "model.decoder.layers.21.router.proj": {
733
+ "group_size": 64,
734
+ "bits": 8
735
+ },
736
+ "model.decoder.layers.22.self_attn.q_proj": {
737
+ "group_size": 64,
738
+ "bits": 8
739
+ },
740
+ "model.decoder.layers.22.self_attn.k_proj": {
741
+ "group_size": 64,
742
+ "bits": 8
743
+ },
744
+ "model.decoder.layers.22.self_attn.v_proj": {
745
+ "group_size": 64,
746
+ "bits": 8
747
+ },
748
+ "model.decoder.layers.22.self_attn.o_proj": {
749
+ "group_size": 64,
750
+ "bits": 8
751
+ },
752
+ "model.decoder.layers.22.mlp.gate_proj": {
753
+ "group_size": 64,
754
+ "bits": 8
755
+ },
756
+ "model.decoder.layers.22.mlp.up_proj": {
757
+ "group_size": 64,
758
+ "bits": 8
759
+ },
760
+ "model.decoder.layers.22.mlp.down_proj": {
761
+ "group_size": 64,
762
+ "bits": 8
763
+ },
764
+ "model.decoder.layers.22.router.proj": {
765
+ "group_size": 64,
766
+ "bits": 8
767
+ },
768
+ "model.decoder.layers.23.self_attn.q_proj": {
769
+ "group_size": 64,
770
+ "bits": 8
771
+ },
772
+ "model.decoder.layers.23.self_attn.k_proj": {
773
+ "group_size": 64,
774
+ "bits": 8
775
+ },
776
+ "model.decoder.layers.23.self_attn.o_proj": {
777
+ "group_size": 64,
778
+ "bits": 8
779
+ },
780
+ "model.decoder.layers.23.mlp.gate_proj": {
781
+ "group_size": 64,
782
+ "bits": 8
783
+ },
784
+ "model.decoder.layers.23.mlp.up_proj": {
785
+ "group_size": 64,
786
+ "bits": 8
787
+ },
788
+ "model.decoder.layers.23.mlp.down_proj": {
789
+ "group_size": 64,
790
+ "bits": 8
791
+ },
792
+ "model.decoder.layers.23.router.proj": {
793
+ "group_size": 64,
794
+ "bits": 8
795
+ },
796
+ "model.decoder.layers.24.self_attn.q_proj": {
797
+ "group_size": 64,
798
+ "bits": 8
799
+ },
800
+ "model.decoder.layers.24.self_attn.k_proj": {
801
+ "group_size": 64,
802
+ "bits": 8
803
+ },
804
+ "model.decoder.layers.24.self_attn.v_proj": {
805
+ "group_size": 64,
806
+ "bits": 8
807
+ },
808
+ "model.decoder.layers.24.self_attn.o_proj": {
809
+ "group_size": 64,
810
+ "bits": 8
811
+ },
812
+ "model.decoder.layers.24.mlp.gate_proj": {
813
+ "group_size": 64,
814
+ "bits": 8
815
+ },
816
+ "model.decoder.layers.24.mlp.up_proj": {
817
+ "group_size": 64,
818
+ "bits": 8
819
+ },
820
+ "model.decoder.layers.24.mlp.down_proj": {
821
+ "group_size": 64,
822
+ "bits": 8
823
+ },
824
+ "model.decoder.layers.24.router.proj": {
825
+ "group_size": 64,
826
+ "bits": 8
827
+ },
828
+ "model.decoder.layers.25.self_attn.q_proj": {
829
+ "group_size": 64,
830
+ "bits": 8
831
+ },
832
+ "model.decoder.layers.25.self_attn.k_proj": {
833
+ "group_size": 64,
834
+ "bits": 8
835
+ },
836
+ "model.decoder.layers.25.self_attn.v_proj": {
837
+ "group_size": 64,
838
+ "bits": 8
839
+ },
840
+ "model.decoder.layers.25.self_attn.o_proj": {
841
+ "group_size": 64,
842
+ "bits": 8
843
+ },
844
+ "model.decoder.layers.25.mlp.gate_proj": {
845
+ "group_size": 64,
846
+ "bits": 8
847
+ },
848
+ "model.decoder.layers.25.mlp.up_proj": {
849
+ "group_size": 64,
850
+ "bits": 8
851
+ },
852
+ "model.decoder.layers.25.mlp.down_proj": {
853
+ "group_size": 64,
854
+ "bits": 8
855
+ },
856
+ "model.decoder.layers.25.router.proj": {
857
+ "group_size": 64,
858
+ "bits": 8
859
+ },
860
+ "model.decoder.layers.26.self_attn.q_proj": {
861
+ "group_size": 64,
862
+ "bits": 8
863
+ },
864
+ "model.decoder.layers.26.self_attn.k_proj": {
865
+ "group_size": 64,
866
+ "bits": 8
867
+ },
868
+ "model.decoder.layers.26.self_attn.v_proj": {
869
+ "group_size": 64,
870
+ "bits": 8
871
+ },
872
+ "model.decoder.layers.26.self_attn.o_proj": {
873
+ "group_size": 64,
874
+ "bits": 8
875
+ },
876
+ "model.decoder.layers.26.mlp.gate_proj": {
877
+ "group_size": 64,
878
+ "bits": 8
879
+ },
880
+ "model.decoder.layers.26.mlp.up_proj": {
881
+ "group_size": 64,
882
+ "bits": 8
883
+ },
884
+ "model.decoder.layers.26.mlp.down_proj": {
885
+ "group_size": 64,
886
+ "bits": 8
887
+ },
888
+ "model.decoder.layers.26.router.proj": {
889
+ "group_size": 64,
890
+ "bits": 8
891
+ },
892
+ "model.decoder.layers.27.self_attn.q_proj": {
893
+ "group_size": 64,
894
+ "bits": 8
895
+ },
896
+ "model.decoder.layers.27.self_attn.k_proj": {
897
+ "group_size": 64,
898
+ "bits": 8
899
+ },
900
+ "model.decoder.layers.27.self_attn.v_proj": {
901
+ "group_size": 64,
902
+ "bits": 8
903
+ },
904
+ "model.decoder.layers.27.self_attn.o_proj": {
905
+ "group_size": 64,
906
+ "bits": 8
907
+ },
908
+ "model.decoder.layers.27.mlp.gate_proj": {
909
+ "group_size": 64,
910
+ "bits": 8
911
+ },
912
+ "model.decoder.layers.27.mlp.up_proj": {
913
+ "group_size": 64,
914
+ "bits": 8
915
+ },
916
+ "model.decoder.layers.27.mlp.down_proj": {
917
+ "group_size": 64,
918
+ "bits": 8
919
+ },
920
+ "model.decoder.layers.27.router.proj": {
921
+ "group_size": 64,
922
+ "bits": 8
923
+ },
924
+ "model.decoder.layers.28.self_attn.q_proj": {
925
+ "group_size": 64,
926
+ "bits": 8
927
+ },
928
+ "model.decoder.layers.28.self_attn.k_proj": {
929
+ "group_size": 64,
930
+ "bits": 8
931
+ },
932
+ "model.decoder.layers.28.self_attn.v_proj": {
933
+ "group_size": 64,
934
+ "bits": 8
935
+ },
936
+ "model.decoder.layers.28.self_attn.o_proj": {
937
+ "group_size": 64,
938
+ "bits": 8
939
+ },
940
+ "model.decoder.layers.28.mlp.gate_proj": {
941
+ "group_size": 64,
942
+ "bits": 8
943
+ },
944
+ "model.decoder.layers.28.mlp.up_proj": {
945
+ "group_size": 64,
946
+ "bits": 8
947
+ },
948
+ "model.decoder.layers.28.mlp.down_proj": {
949
+ "group_size": 64,
950
+ "bits": 8
951
+ },
952
+ "model.decoder.layers.28.router.proj": {
953
+ "group_size": 64,
954
+ "bits": 8
955
+ },
956
+ "model.decoder.layers.29.self_attn.q_proj": {
957
+ "group_size": 64,
958
+ "bits": 8
959
+ },
960
+ "model.decoder.layers.29.self_attn.k_proj": {
961
+ "group_size": 64,
962
+ "bits": 8
963
+ },
964
+ "model.decoder.layers.29.self_attn.o_proj": {
965
+ "group_size": 64,
966
+ "bits": 8
967
+ },
968
+ "model.decoder.layers.29.mlp.gate_proj": {
969
+ "group_size": 64,
970
+ "bits": 8
971
+ },
972
+ "model.decoder.layers.29.mlp.up_proj": {
973
+ "group_size": 64,
974
+ "bits": 8
975
+ },
976
+ "model.decoder.layers.29.mlp.down_proj": {
977
+ "group_size": 64,
978
+ "bits": 8
979
+ },
980
+ "model.decoder.layers.29.router.proj": {
981
+ "group_size": 64,
982
+ "bits": 8
983
+ }
984
+ },
985
+ "quantization_config": {
986
+ "group_size": 64,
987
+ "bits": 5,
988
+ "mode": "affine",
989
+ "model.decoder.embed_tokens": {
990
+ "group_size": 64,
991
+ "bits": 8
992
+ },
993
+ "model.decoder.layers.0.self_attn.q_proj": {
994
+ "group_size": 64,
995
+ "bits": 8
996
+ },
997
+ "model.decoder.layers.0.self_attn.k_proj": {
998
+ "group_size": 64,
999
+ "bits": 8
1000
+ },
1001
+ "model.decoder.layers.0.self_attn.v_proj": {
1002
+ "group_size": 64,
1003
+ "bits": 8
1004
+ },
1005
+ "model.decoder.layers.0.self_attn.o_proj": {
1006
+ "group_size": 64,
1007
+ "bits": 8
1008
+ },
1009
+ "model.decoder.layers.0.mlp.gate_proj": {
1010
+ "group_size": 64,
1011
+ "bits": 8
1012
+ },
1013
+ "model.decoder.layers.0.mlp.up_proj": {
1014
+ "group_size": 64,
1015
+ "bits": 8
1016
+ },
1017
+ "model.decoder.layers.0.mlp.down_proj": {
1018
+ "group_size": 64,
1019
+ "bits": 8
1020
+ },
1021
+ "model.decoder.layers.0.router.proj": {
1022
+ "group_size": 64,
1023
+ "bits": 8
1024
+ },
1025
+ "model.decoder.layers.1.self_attn.q_proj": {
1026
+ "group_size": 64,
1027
+ "bits": 8
1028
+ },
1029
+ "model.decoder.layers.1.self_attn.k_proj": {
1030
+ "group_size": 64,
1031
+ "bits": 8
1032
+ },
1033
+ "model.decoder.layers.1.self_attn.v_proj": {
1034
+ "group_size": 64,
1035
+ "bits": 8
1036
+ },
1037
+ "model.decoder.layers.1.self_attn.o_proj": {
1038
+ "group_size": 64,
1039
+ "bits": 8
1040
+ },
1041
+ "model.decoder.layers.1.mlp.gate_proj": {
1042
+ "group_size": 64,
1043
+ "bits": 8
1044
+ },
1045
+ "model.decoder.layers.1.mlp.up_proj": {
1046
+ "group_size": 64,
1047
+ "bits": 8
1048
+ },
1049
+ "model.decoder.layers.1.mlp.down_proj": {
1050
+ "group_size": 64,
1051
+ "bits": 8
1052
+ },
1053
+ "model.decoder.layers.1.router.proj": {
1054
+ "group_size": 64,
1055
+ "bits": 8
1056
+ },
1057
+ "model.decoder.layers.2.self_attn.q_proj": {
1058
+ "group_size": 64,
1059
+ "bits": 8
1060
+ },
1061
+ "model.decoder.layers.2.self_attn.k_proj": {
1062
+ "group_size": 64,
1063
+ "bits": 8
1064
+ },
1065
+ "model.decoder.layers.2.self_attn.v_proj": {
1066
+ "group_size": 64,
1067
+ "bits": 8
1068
+ },
1069
+ "model.decoder.layers.2.self_attn.o_proj": {
1070
+ "group_size": 64,
1071
+ "bits": 8
1072
+ },
1073
+ "model.decoder.layers.2.mlp.gate_proj": {
1074
+ "group_size": 64,
1075
+ "bits": 8
1076
+ },
1077
+ "model.decoder.layers.2.mlp.up_proj": {
1078
+ "group_size": 64,
1079
+ "bits": 8
1080
+ },
1081
+ "model.decoder.layers.2.mlp.down_proj": {
1082
+ "group_size": 64,
1083
+ "bits": 8
1084
+ },
1085
+ "model.decoder.layers.2.router.proj": {
1086
+ "group_size": 64,
1087
+ "bits": 8
1088
+ },
1089
+ "model.decoder.layers.3.self_attn.q_proj": {
1090
+ "group_size": 64,
1091
+ "bits": 8
1092
+ },
1093
+ "model.decoder.layers.3.self_attn.k_proj": {
1094
+ "group_size": 64,
1095
+ "bits": 8
1096
+ },
1097
+ "model.decoder.layers.3.self_attn.v_proj": {
1098
+ "group_size": 64,
1099
+ "bits": 8
1100
+ },
1101
+ "model.decoder.layers.3.self_attn.o_proj": {
1102
+ "group_size": 64,
1103
+ "bits": 8
1104
+ },
1105
+ "model.decoder.layers.3.mlp.gate_proj": {
1106
+ "group_size": 64,
1107
+ "bits": 8
1108
+ },
1109
+ "model.decoder.layers.3.mlp.up_proj": {
1110
+ "group_size": 64,
1111
+ "bits": 8
1112
+ },
1113
+ "model.decoder.layers.3.mlp.down_proj": {
1114
+ "group_size": 64,
1115
+ "bits": 8
1116
+ },
1117
+ "model.decoder.layers.3.router.proj": {
1118
+ "group_size": 64,
1119
+ "bits": 8
1120
+ },
1121
+ "model.decoder.layers.4.self_attn.q_proj": {
1122
+ "group_size": 64,
1123
+ "bits": 8
1124
+ },
1125
+ "model.decoder.layers.4.self_attn.k_proj": {
1126
+ "group_size": 64,
1127
+ "bits": 8
1128
+ },
1129
+ "model.decoder.layers.4.self_attn.v_proj": {
1130
+ "group_size": 64,
1131
+ "bits": 8
1132
+ },
1133
+ "model.decoder.layers.4.self_attn.o_proj": {
1134
+ "group_size": 64,
1135
+ "bits": 8
1136
+ },
1137
+ "model.decoder.layers.4.mlp.gate_proj": {
1138
+ "group_size": 64,
1139
+ "bits": 8
1140
+ },
1141
+ "model.decoder.layers.4.mlp.up_proj": {
1142
+ "group_size": 64,
1143
+ "bits": 8
1144
+ },
1145
+ "model.decoder.layers.4.mlp.down_proj": {
1146
+ "group_size": 64,
1147
+ "bits": 8
1148
+ },
1149
+ "model.decoder.layers.4.router.proj": {
1150
+ "group_size": 64,
1151
+ "bits": 8
1152
+ },
1153
+ "model.decoder.layers.5.self_attn.q_proj": {
1154
+ "group_size": 64,
1155
+ "bits": 8
1156
+ },
1157
+ "model.decoder.layers.5.self_attn.k_proj": {
1158
+ "group_size": 64,
1159
+ "bits": 8
1160
+ },
1161
+ "model.decoder.layers.5.self_attn.o_proj": {
1162
+ "group_size": 64,
1163
+ "bits": 8
1164
+ },
1165
+ "model.decoder.layers.5.mlp.gate_proj": {
1166
+ "group_size": 64,
1167
+ "bits": 8
1168
+ },
1169
+ "model.decoder.layers.5.mlp.up_proj": {
1170
+ "group_size": 64,
1171
+ "bits": 8
1172
+ },
1173
+ "model.decoder.layers.5.mlp.down_proj": {
1174
+ "group_size": 64,
1175
+ "bits": 8
1176
+ },
1177
+ "model.decoder.layers.5.router.proj": {
1178
+ "group_size": 64,
1179
+ "bits": 8
1180
+ },
1181
+ "model.decoder.layers.6.self_attn.q_proj": {
1182
+ "group_size": 64,
1183
+ "bits": 8
1184
+ },
1185
+ "model.decoder.layers.6.self_attn.k_proj": {
1186
+ "group_size": 64,
1187
+ "bits": 8
1188
+ },
1189
+ "model.decoder.layers.6.self_attn.v_proj": {
1190
+ "group_size": 64,
1191
+ "bits": 8
1192
+ },
1193
+ "model.decoder.layers.6.self_attn.o_proj": {
1194
+ "group_size": 64,
1195
+ "bits": 8
1196
+ },
1197
+ "model.decoder.layers.6.mlp.gate_proj": {
1198
+ "group_size": 64,
1199
+ "bits": 8
1200
+ },
1201
+ "model.decoder.layers.6.mlp.up_proj": {
1202
+ "group_size": 64,
1203
+ "bits": 8
1204
+ },
1205
+ "model.decoder.layers.6.mlp.down_proj": {
1206
+ "group_size": 64,
1207
+ "bits": 8
1208
+ },
1209
+ "model.decoder.layers.6.router.proj": {
1210
+ "group_size": 64,
1211
+ "bits": 8
1212
+ },
1213
+ "model.decoder.layers.7.self_attn.q_proj": {
1214
+ "group_size": 64,
1215
+ "bits": 8
1216
+ },
1217
+ "model.decoder.layers.7.self_attn.k_proj": {
1218
+ "group_size": 64,
1219
+ "bits": 8
1220
+ },
1221
+ "model.decoder.layers.7.self_attn.v_proj": {
1222
+ "group_size": 64,
1223
+ "bits": 8
1224
+ },
1225
+ "model.decoder.layers.7.self_attn.o_proj": {
1226
+ "group_size": 64,
1227
+ "bits": 8
1228
+ },
1229
+ "model.decoder.layers.7.mlp.gate_proj": {
1230
+ "group_size": 64,
1231
+ "bits": 8
1232
+ },
1233
+ "model.decoder.layers.7.mlp.up_proj": {
1234
+ "group_size": 64,
1235
+ "bits": 8
1236
+ },
1237
+ "model.decoder.layers.7.mlp.down_proj": {
1238
+ "group_size": 64,
1239
+ "bits": 8
1240
+ },
1241
+ "model.decoder.layers.7.router.proj": {
1242
+ "group_size": 64,
1243
+ "bits": 8
1244
+ },
1245
+ "model.decoder.layers.8.self_attn.q_proj": {
1246
+ "group_size": 64,
1247
+ "bits": 8
1248
+ },
1249
+ "model.decoder.layers.8.self_attn.k_proj": {
1250
  "group_size": 64,
1251
  "bits": 8
1252
  },
1253
+ "model.decoder.layers.8.self_attn.v_proj": {
1254
  "group_size": 64,
1255
  "bits": 8
1256
  },
1257
+ "model.decoder.layers.8.self_attn.o_proj": {
1258
  "group_size": 64,
1259
  "bits": 8
1260
  },
1261
+ "model.decoder.layers.8.mlp.gate_proj": {
1262
  "group_size": 64,
1263
  "bits": 8
1264
  },
1265
+ "model.decoder.layers.8.mlp.up_proj": {
1266
  "group_size": 64,
1267
  "bits": 8
1268
  },
1269
+ "model.decoder.layers.8.mlp.down_proj": {
1270
  "group_size": 64,
1271
  "bits": 8
1272
  },
1273
+ "model.decoder.layers.8.router.proj": {
1274
  "group_size": 64,
1275
  "bits": 8
1276
  },
1277
+ "model.decoder.layers.9.self_attn.q_proj": {
1278
  "group_size": 64,
1279
  "bits": 8
1280
  },
1281
+ "model.decoder.layers.9.self_attn.k_proj": {
1282
  "group_size": 64,
1283
  "bits": 8
1284
  },
1285
+ "model.decoder.layers.9.self_attn.v_proj": {
1286
  "group_size": 64,
1287
  "bits": 8
1288
  },
1289
+ "model.decoder.layers.9.self_attn.o_proj": {
1290
  "group_size": 64,
1291
  "bits": 8
1292
  },
1293
+ "model.decoder.layers.9.mlp.gate_proj": {
1294
  "group_size": 64,
1295
  "bits": 8
1296
  },
1297
+ "model.decoder.layers.9.mlp.up_proj": {
1298
  "group_size": 64,
1299
  "bits": 8
1300
  },
1301
+ "model.decoder.layers.9.mlp.down_proj": {
1302
  "group_size": 64,
1303
  "bits": 8
1304
  },
1305
+ "model.decoder.layers.9.router.proj": {
1306
  "group_size": 64,
1307
  "bits": 8
1308
  },
1309
+ "model.decoder.layers.10.self_attn.q_proj": {
1310
  "group_size": 64,
1311
  "bits": 8
1312
  },
1313
+ "model.decoder.layers.10.self_attn.k_proj": {
1314
  "group_size": 64,
1315
  "bits": 8
1316
  },
1317
+ "model.decoder.layers.10.self_attn.v_proj": {
1318
  "group_size": 64,
1319
  "bits": 8
1320
  },
1321
+ "model.decoder.layers.10.self_attn.o_proj": {
1322
  "group_size": 64,
1323
  "bits": 8
1324
  },
1325
+ "model.decoder.layers.10.mlp.gate_proj": {
1326
  "group_size": 64,
1327
  "bits": 8
1328
  },
1329
+ "model.decoder.layers.10.mlp.up_proj": {
1330
  "group_size": 64,
1331
  "bits": 8
1332
  },
1333
+ "model.decoder.layers.10.mlp.down_proj": {
1334
  "group_size": 64,
1335
  "bits": 8
1336
  },
1337
+ "model.decoder.layers.10.router.proj": {
1338
  "group_size": 64,
1339
  "bits": 8
1340
  },
1341
+ "model.decoder.layers.11.self_attn.q_proj": {
1342
  "group_size": 64,
1343
  "bits": 8
1344
  },
1345
+ "model.decoder.layers.11.self_attn.k_proj": {
1346
  "group_size": 64,
1347
  "bits": 8
1348
  },
1349
+ "model.decoder.layers.11.self_attn.o_proj": {
1350
  "group_size": 64,
1351
  "bits": 8
1352
  },
1353
+ "model.decoder.layers.11.mlp.gate_proj": {
1354
  "group_size": 64,
1355
  "bits": 8
1356
  },
1357
+ "model.decoder.layers.11.mlp.up_proj": {
1358
  "group_size": 64,
1359
  "bits": 8
1360
  },
1361
+ "model.decoder.layers.11.mlp.down_proj": {
1362
  "group_size": 64,
1363
  "bits": 8
1364
  },
1365
+ "model.decoder.layers.11.router.proj": {
1366
  "group_size": 64,
1367
  "bits": 8
1368
  },
1369
+ "model.decoder.layers.12.self_attn.q_proj": {
1370
  "group_size": 64,
1371
  "bits": 8
1372
  },
1373
+ "model.decoder.layers.12.self_attn.k_proj": {
1374
  "group_size": 64,
1375
  "bits": 8
1376
  },
1377
+ "model.decoder.layers.12.self_attn.v_proj": {
1378
  "group_size": 64,
1379
  "bits": 8
1380
  },
1381
+ "model.decoder.layers.12.self_attn.o_proj": {
1382
  "group_size": 64,
1383
  "bits": 8
1384
  },
1385
+ "model.decoder.layers.12.mlp.gate_proj": {
1386
  "group_size": 64,
1387
  "bits": 8
1388
  },
1389
+ "model.decoder.layers.12.mlp.up_proj": {
1390
  "group_size": 64,
1391
  "bits": 8
1392
  },
1393
+ "model.decoder.layers.12.mlp.down_proj": {
1394
  "group_size": 64,
1395
  "bits": 8
1396
  },
1397
+ "model.decoder.layers.12.router.proj": {
1398
  "group_size": 64,
1399
  "bits": 8
1400
  },
1401
+ "model.decoder.layers.13.self_attn.q_proj": {
1402
  "group_size": 64,
1403
  "bits": 8
1404
  },
1405
+ "model.decoder.layers.13.self_attn.k_proj": {
1406
  "group_size": 64,
1407
  "bits": 8
1408
  },
1409
+ "model.decoder.layers.13.self_attn.v_proj": {
1410
  "group_size": 64,
1411
  "bits": 8
1412
  },
1413
+ "model.decoder.layers.13.self_attn.o_proj": {
1414
  "group_size": 64,
1415
  "bits": 8
1416
  },
1417
+ "model.decoder.layers.13.mlp.gate_proj": {
1418
  "group_size": 64,
1419
  "bits": 8
1420
  },
1421
+ "model.decoder.layers.13.mlp.up_proj": {
1422
  "group_size": 64,
1423
  "bits": 8
1424
  },
1425
+ "model.decoder.layers.13.mlp.down_proj": {
1426
  "group_size": 64,
1427
  "bits": 8
1428
  },
1429
+ "model.decoder.layers.13.router.proj": {
1430
  "group_size": 64,
1431
  "bits": 8
1432
  },
1433
+ "model.decoder.layers.14.self_attn.q_proj": {
1434
  "group_size": 64,
1435
  "bits": 8
1436
  },
1437
+ "model.decoder.layers.14.self_attn.k_proj": {
1438
  "group_size": 64,
1439
  "bits": 8
1440
+ },
1441
+ "model.decoder.layers.14.self_attn.v_proj": {
 
 
 
 
 
1442
  "group_size": 64,
1443
  "bits": 8
1444
  },
1445
+ "model.decoder.layers.14.self_attn.o_proj": {
1446
  "group_size": 64,
1447
  "bits": 8
1448
  },
1449
+ "model.decoder.layers.14.mlp.gate_proj": {
1450
  "group_size": 64,
1451
  "bits": 8
1452
  },
1453
+ "model.decoder.layers.14.mlp.up_proj": {
1454
  "group_size": 64,
1455
  "bits": 8
1456
  },
1457
+ "model.decoder.layers.14.mlp.down_proj": {
1458
  "group_size": 64,
1459
  "bits": 8
1460
  },
1461
+ "model.decoder.layers.14.router.proj": {
1462
  "group_size": 64,
1463
  "bits": 8
1464
  },
1465
+ "model.decoder.layers.15.self_attn.q_proj": {
1466
  "group_size": 64,
1467
  "bits": 8
1468
  },
1469
+ "model.decoder.layers.15.self_attn.k_proj": {
1470
  "group_size": 64,
1471
  "bits": 8
1472
  },
1473
+ "model.decoder.layers.15.self_attn.v_proj": {
1474
  "group_size": 64,
1475
  "bits": 8
1476
  },
1477
+ "model.decoder.layers.15.self_attn.o_proj": {
1478
  "group_size": 64,
1479
  "bits": 8
1480
  },
1481
+ "model.decoder.layers.15.mlp.gate_proj": {
1482
  "group_size": 64,
1483
  "bits": 8
1484
  },
1485
+ "model.decoder.layers.15.mlp.up_proj": {
1486
  "group_size": 64,
1487
  "bits": 8
1488
  },
1489
+ "model.decoder.layers.15.mlp.down_proj": {
1490
  "group_size": 64,
1491
  "bits": 8
1492
  },
1493
+ "model.decoder.layers.15.router.proj": {
1494
  "group_size": 64,
1495
  "bits": 8
1496
  },
1497
+ "model.decoder.layers.16.self_attn.q_proj": {
1498
  "group_size": 64,
1499
  "bits": 8
1500
  },
1501
+ "model.decoder.layers.16.self_attn.k_proj": {
1502
  "group_size": 64,
1503
  "bits": 8
1504
  },
1505
+ "model.decoder.layers.16.self_attn.v_proj": {
1506
  "group_size": 64,
1507
  "bits": 8
1508
  },
1509
+ "model.decoder.layers.16.self_attn.o_proj": {
1510
  "group_size": 64,
1511
  "bits": 8
1512
  },
1513
+ "model.decoder.layers.16.mlp.gate_proj": {
1514
  "group_size": 64,
1515
  "bits": 8
1516
  },
1517
+ "model.decoder.layers.16.mlp.up_proj": {
1518
  "group_size": 64,
1519
  "bits": 8
1520
  },
1521
+ "model.decoder.layers.16.mlp.down_proj": {
1522
  "group_size": 64,
1523
  "bits": 8
1524
  },
1525
+ "model.decoder.layers.16.router.proj": {
1526
  "group_size": 64,
1527
  "bits": 8
1528
  },
1529
+ "model.decoder.layers.17.self_attn.q_proj": {
1530
  "group_size": 64,
1531
  "bits": 8
1532
  },
1533
+ "model.decoder.layers.17.self_attn.k_proj": {
1534
  "group_size": 64,
1535
  "bits": 8
1536
  },
1537
+ "model.decoder.layers.17.self_attn.o_proj": {
1538
  "group_size": 64,
1539
  "bits": 8
1540
  },
1541
+ "model.decoder.layers.17.mlp.gate_proj": {
1542
  "group_size": 64,
1543
  "bits": 8
1544
  },
1545
+ "model.decoder.layers.17.mlp.up_proj": {
1546
  "group_size": 64,
1547
  "bits": 8
1548
  },
1549
+ "model.decoder.layers.17.mlp.down_proj": {
1550
  "group_size": 64,
1551
  "bits": 8
1552
  },
1553
+ "model.decoder.layers.17.router.proj": {
1554
  "group_size": 64,
1555
  "bits": 8
1556
  },
1557
+ "model.decoder.layers.18.self_attn.q_proj": {
1558
  "group_size": 64,
1559
  "bits": 8
1560
  },
1561
+ "model.decoder.layers.18.self_attn.k_proj": {
1562
  "group_size": 64,
1563
  "bits": 8
1564
  },
1565
+ "model.decoder.layers.18.self_attn.v_proj": {
1566
  "group_size": 64,
1567
  "bits": 8
1568
  },
1569
+ "model.decoder.layers.18.self_attn.o_proj": {
1570
  "group_size": 64,
1571
  "bits": 8
1572
  },
1573
+ "model.decoder.layers.18.mlp.gate_proj": {
1574
  "group_size": 64,
1575
  "bits": 8
1576
  },
1577
+ "model.decoder.layers.18.mlp.up_proj": {
1578
  "group_size": 64,
1579
  "bits": 8
1580
  },
1581
+ "model.decoder.layers.18.mlp.down_proj": {
1582
  "group_size": 64,
1583
  "bits": 8
1584
  },
1585
+ "model.decoder.layers.18.router.proj": {
1586
  "group_size": 64,
1587
  "bits": 8
1588
  },
1589
+ "model.decoder.layers.19.self_attn.q_proj": {
1590
  "group_size": 64,
1591
  "bits": 8
1592
  },
1593
+ "model.decoder.layers.19.self_attn.k_proj": {
1594
  "group_size": 64,
1595
  "bits": 8
1596
  },
1597
+ "model.decoder.layers.19.self_attn.v_proj": {
1598
  "group_size": 64,
1599
  "bits": 8
1600
  },
1601
+ "model.decoder.layers.19.self_attn.o_proj": {
1602
  "group_size": 64,
1603
  "bits": 8
1604
  },
1605
+ "model.decoder.layers.19.mlp.gate_proj": {
1606
  "group_size": 64,
1607
  "bits": 8
1608
  },
1609
+ "model.decoder.layers.19.mlp.up_proj": {
1610
  "group_size": 64,
1611
  "bits": 8
1612
  },
1613
+ "model.decoder.layers.19.mlp.down_proj": {
1614
  "group_size": 64,
1615
  "bits": 8
1616
  },
1617
+ "model.decoder.layers.19.router.proj": {
1618
  "group_size": 64,
1619
  "bits": 8
1620
  },
1621
+ "model.decoder.layers.20.self_attn.q_proj": {
1622
  "group_size": 64,
1623
  "bits": 8
1624
  },
1625
+ "model.decoder.layers.20.self_attn.k_proj": {
1626
  "group_size": 64,
1627
  "bits": 8
1628
  },
1629
+ "model.decoder.layers.20.self_attn.v_proj": {
1630
  "group_size": 64,
1631
  "bits": 8
1632
  },
1633
+ "model.decoder.layers.20.self_attn.o_proj": {
1634
  "group_size": 64,
1635
  "bits": 8
1636
  },
1637
+ "model.decoder.layers.20.mlp.gate_proj": {
1638
  "group_size": 64,
1639
  "bits": 8
1640
  },
1641
+ "model.decoder.layers.20.mlp.up_proj": {
1642
  "group_size": 64,
1643
  "bits": 8
1644
  },
1645
+ "model.decoder.layers.20.mlp.down_proj": {
1646
  "group_size": 64,
1647
  "bits": 8
1648
  },
1649
+ "model.decoder.layers.20.router.proj": {
1650
  "group_size": 64,
1651
  "bits": 8
1652
  },
1653
+ "model.decoder.layers.21.self_attn.q_proj": {
1654
  "group_size": 64,
1655
  "bits": 8
1656
  },
1657
+ "model.decoder.layers.21.self_attn.k_proj": {
1658
  "group_size": 64,
1659
  "bits": 8
1660
  },
1661
+ "model.decoder.layers.21.self_attn.v_proj": {
1662
  "group_size": 64,
1663
  "bits": 8
1664
  },
1665
+ "model.decoder.layers.21.self_attn.o_proj": {
1666
  "group_size": 64,
1667
  "bits": 8
1668
  },
1669
+ "model.decoder.layers.21.mlp.gate_proj": {
1670
  "group_size": 64,
1671
  "bits": 8
1672
  },
1673
+ "model.decoder.layers.21.mlp.up_proj": {
1674
  "group_size": 64,
1675
  "bits": 8
1676
  },
1677
+ "model.decoder.layers.21.mlp.down_proj": {
1678
  "group_size": 64,
1679
  "bits": 8
1680
  },
1681
+ "model.decoder.layers.21.router.proj": {
1682
  "group_size": 64,
1683
  "bits": 8
1684
  },
1685
+ "model.decoder.layers.22.self_attn.q_proj": {
1686
  "group_size": 64,
1687
  "bits": 8
1688
  },
1689
+ "model.decoder.layers.22.self_attn.k_proj": {
1690
  "group_size": 64,
1691
  "bits": 8
1692
  },
1693
+ "model.decoder.layers.22.self_attn.v_proj": {
1694
  "group_size": 64,
1695
  "bits": 8
1696
  },
1697
+ "model.decoder.layers.22.self_attn.o_proj": {
1698
  "group_size": 64,
1699
  "bits": 8
1700
  },
1701
+ "model.decoder.layers.22.mlp.gate_proj": {
1702
  "group_size": 64,
1703
  "bits": 8
1704
  },
1705
+ "model.decoder.layers.22.mlp.up_proj": {
1706
  "group_size": 64,
1707
  "bits": 8
1708
  },
1709
+ "model.decoder.layers.22.mlp.down_proj": {
1710
  "group_size": 64,
1711
  "bits": 8
1712
  },
1713
+ "model.decoder.layers.22.router.proj": {
1714
  "group_size": 64,
1715
  "bits": 8
1716
  },
1717
+ "model.decoder.layers.23.self_attn.q_proj": {
1718
  "group_size": 64,
1719
  "bits": 8
1720
  },
1721
+ "model.decoder.layers.23.self_attn.k_proj": {
1722
  "group_size": 64,
1723
  "bits": 8
1724
  },
1725
+ "model.decoder.layers.23.self_attn.o_proj": {
1726
  "group_size": 64,
1727
  "bits": 8
1728
  },
1729
+ "model.decoder.layers.23.mlp.gate_proj": {
1730
  "group_size": 64,
1731
  "bits": 8
1732
  },
1733
+ "model.decoder.layers.23.mlp.up_proj": {
1734
  "group_size": 64,
1735
  "bits": 8
1736
  },
1737
+ "model.decoder.layers.23.mlp.down_proj": {
1738
  "group_size": 64,
1739
  "bits": 8
1740
  },
1741
+ "model.decoder.layers.23.router.proj": {
1742
  "group_size": 64,
1743
  "bits": 8
1744
  },
1745
+ "model.decoder.layers.24.self_attn.q_proj": {
1746
  "group_size": 64,
1747
  "bits": 8
1748
  },
1749
+ "model.decoder.layers.24.self_attn.k_proj": {
1750
  "group_size": 64,
1751
  "bits": 8
1752
  },
1753
+ "model.decoder.layers.24.self_attn.v_proj": {
1754
  "group_size": 64,
1755
  "bits": 8
1756
  },
1757
+ "model.decoder.layers.24.self_attn.o_proj": {
1758
  "group_size": 64,
1759
  "bits": 8
1760
  },
1761
+ "model.decoder.layers.24.mlp.gate_proj": {
1762
  "group_size": 64,
1763
  "bits": 8
1764
  },
1765
+ "model.decoder.layers.24.mlp.up_proj": {
1766
  "group_size": 64,
1767
  "bits": 8
1768
  },
1769
+ "model.decoder.layers.24.mlp.down_proj": {
1770
  "group_size": 64,
1771
  "bits": 8
1772
  },
1773
+ "model.decoder.layers.24.router.proj": {
1774
  "group_size": 64,
1775
  "bits": 8
1776
  },
1777
+ "model.decoder.layers.25.self_attn.q_proj": {
1778
  "group_size": 64,
1779
  "bits": 8
1780
  },
1781
+ "model.decoder.layers.25.self_attn.k_proj": {
1782
  "group_size": 64,
1783
  "bits": 8
1784
  },
1785
+ "model.decoder.layers.25.self_attn.v_proj": {
1786
  "group_size": 64,
1787
  "bits": 8
1788
  },
1789
+ "model.decoder.layers.25.self_attn.o_proj": {
1790
  "group_size": 64,
1791
  "bits": 8
1792
  },
1793
+ "model.decoder.layers.25.mlp.gate_proj": {
1794
  "group_size": 64,
1795
  "bits": 8
1796
  },
1797
+ "model.decoder.layers.25.mlp.up_proj": {
1798
  "group_size": 64,
1799
  "bits": 8
1800
  },
1801
+ "model.decoder.layers.25.mlp.down_proj": {
1802
  "group_size": 64,
1803
  "bits": 8
1804
  },
1805
+ "model.decoder.layers.25.router.proj": {
1806
  "group_size": 64,
1807
  "bits": 8
1808
  },
1809
+ "model.decoder.layers.26.self_attn.q_proj": {
1810
  "group_size": 64,
1811
  "bits": 8
1812
  },
1813
+ "model.decoder.layers.26.self_attn.k_proj": {
1814
  "group_size": 64,
1815
  "bits": 8
1816
  },
1817
+ "model.decoder.layers.26.self_attn.v_proj": {
1818
  "group_size": 64,
1819
  "bits": 8
1820
  },
1821
+ "model.decoder.layers.26.self_attn.o_proj": {
1822
  "group_size": 64,
1823
  "bits": 8
1824
  },
1825
+ "model.decoder.layers.26.mlp.gate_proj": {
1826
  "group_size": 64,
1827
  "bits": 8
1828
  },
1829
+ "model.decoder.layers.26.mlp.up_proj": {
1830
  "group_size": 64,
1831
  "bits": 8
1832
  },
1833
+ "model.decoder.layers.26.mlp.down_proj": {
1834
  "group_size": 64,
1835
  "bits": 8
1836
  },
1837
+ "model.decoder.layers.26.router.proj": {
1838
  "group_size": 64,
1839
  "bits": 8
1840
  },
1841
+ "model.decoder.layers.27.self_attn.q_proj": {
1842
  "group_size": 64,
1843
  "bits": 8
1844
  },
1845
+ "model.decoder.layers.27.self_attn.k_proj": {
1846
  "group_size": 64,
1847
  "bits": 8
1848
  },
1849
+ "model.decoder.layers.27.self_attn.v_proj": {
1850
  "group_size": 64,
1851
  "bits": 8
1852
  },
1853
+ "model.decoder.layers.27.self_attn.o_proj": {
1854
  "group_size": 64,
1855
  "bits": 8
1856
  },
1857
+ "model.decoder.layers.27.mlp.gate_proj": {
1858
  "group_size": 64,
1859
  "bits": 8
1860
  },
1861
+ "model.decoder.layers.27.mlp.up_proj": {
1862
  "group_size": 64,
1863
  "bits": 8
1864
  },
1865
+ "model.decoder.layers.27.mlp.down_proj": {
1866
  "group_size": 64,
1867
  "bits": 8
1868
  },
1869
+ "model.decoder.layers.27.router.proj": {
1870
  "group_size": 64,
1871
  "bits": 8
1872
  },
1873
+ "model.decoder.layers.28.self_attn.q_proj": {
1874
  "group_size": 64,
1875
  "bits": 8
1876
  },
1877
+ "model.decoder.layers.28.self_attn.k_proj": {
1878
  "group_size": 64,
1879
  "bits": 8
1880
  },
1881
+ "model.decoder.layers.28.self_attn.v_proj": {
1882
  "group_size": 64,
1883
  "bits": 8
1884
  },
1885
+ "model.decoder.layers.28.self_attn.o_proj": {
1886
  "group_size": 64,
1887
  "bits": 8
1888
  },
 
1902
  "group_size": 64,
1903
  "bits": 8
1904
  },
1905
+ "model.decoder.layers.29.self_attn.q_proj": {
1906
+ "group_size": 64,
1907
+ "bits": 8
1908
+ },
1909
+ "model.decoder.layers.29.self_attn.k_proj": {
1910
+ "group_size": 64,
1911
+ "bits": 8
1912
+ },
1913
+ "model.decoder.layers.29.self_attn.o_proj": {
1914
+ "group_size": 64,
1915
+ "bits": 8
1916
+ },
1917
  "model.decoder.layers.29.mlp.gate_proj": {
1918
  "group_size": 64,
1919
  "bits": 8
model-00001-of-00004.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:a30b9bacc1c74568d825ed830d417cc0a580af5c82257b63d3e4bd98eeec0485
3
- size 5093001807
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:7124986683c442659692863370157777acda16b7ae1f30f8b188def2b90e6f8a
3
+ size 5261403888
model-00002-of-00004.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:d3d737ff1c982c5f4fa7240558bc9ce9c4a1867042e2c74e0a5a64b5b2e61a4b
3
- size 5118792725
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2c29bb68b6b4c0231c84bd22917bd5e94924c5b8c6b5b3421fce194d02523a18
3
+ size 5231071623
model-00003-of-00004.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:1b1992b12de471d15115f0dbbe46fdf3365a84be551e515df311c75b8cb21557
3
- size 5108879738
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:377406d17476c7308739f5ab4413215223f62963d2ec311614942ec138d9e5a4
3
+ size 5246391324
model-00004-of-00004.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:e0f470ef3c02c4704faede735053ca96dad2589a60911e34abb4bf6a4fd294b8
3
- size 3386623829
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:203fdfa2eacde7f193363a863120144b2a0665fd9f55a14187f00200a3db097c
3
+ size 3661572919
model.safetensors.index.json CHANGED
@@ -1,6 +1,6 @@
1
  {
2
  "metadata": {
3
- "total_size": 18707087064
4
  },
5
  "weight_map": {
6
  "model.decoder.embed_tokens.biases": "model-00001-of-00004.safetensors",
@@ -339,14 +339,14 @@
339
  "model.decoder.layers.15.self_attn.v_proj.biases": "model-00002-of-00004.safetensors",
340
  "model.decoder.layers.15.self_attn.v_proj.scales": "model-00002-of-00004.safetensors",
341
  "model.decoder.layers.15.self_attn.v_proj.weight": "model-00002-of-00004.safetensors",
342
- "model.decoder.layers.16.experts.down_proj.biases": "model-00002-of-00004.safetensors",
343
- "model.decoder.layers.16.experts.down_proj.scales": "model-00002-of-00004.safetensors",
344
- "model.decoder.layers.16.experts.down_proj.weight": "model-00002-of-00004.safetensors",
345
  "model.decoder.layers.16.experts.gate_up_proj.biases": "model-00002-of-00004.safetensors",
346
  "model.decoder.layers.16.experts.gate_up_proj.scales": "model-00002-of-00004.safetensors",
347
  "model.decoder.layers.16.experts.gate_up_proj.weight": "model-00002-of-00004.safetensors",
348
  "model.decoder.layers.16.input_layernorm.weight": "model-00002-of-00004.safetensors",
349
- "model.decoder.layers.16.layer_scalar": "model-00002-of-00004.safetensors",
350
  "model.decoder.layers.16.mlp.down_proj.biases": "model-00002-of-00004.safetensors",
351
  "model.decoder.layers.16.mlp.down_proj.scales": "model-00002-of-00004.safetensors",
352
  "model.decoder.layers.16.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
@@ -358,10 +358,10 @@
358
  "model.decoder.layers.16.mlp.up_proj.weight": "model-00002-of-00004.safetensors",
359
  "model.decoder.layers.16.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
360
  "model.decoder.layers.16.post_feedforward_layernorm.weight": "model-00002-of-00004.safetensors",
361
- "model.decoder.layers.16.post_feedforward_layernorm_1.weight": "model-00002-of-00004.safetensors",
362
- "model.decoder.layers.16.post_feedforward_layernorm_2.weight": "model-00002-of-00004.safetensors",
363
  "model.decoder.layers.16.pre_feedforward_layernorm.weight": "model-00002-of-00004.safetensors",
364
- "model.decoder.layers.16.pre_feedforward_layernorm_2.weight": "model-00002-of-00004.safetensors",
365
  "model.decoder.layers.16.router.per_expert_scale": "model-00002-of-00004.safetensors",
366
  "model.decoder.layers.16.router.proj.biases": "model-00002-of-00004.safetensors",
367
  "model.decoder.layers.16.router.proj.scales": "model-00002-of-00004.safetensors",
@@ -387,39 +387,39 @@
387
  "model.decoder.layers.17.experts.gate_up_proj.biases": "model-00003-of-00004.safetensors",
388
  "model.decoder.layers.17.experts.gate_up_proj.scales": "model-00003-of-00004.safetensors",
389
  "model.decoder.layers.17.experts.gate_up_proj.weight": "model-00003-of-00004.safetensors",
390
- "model.decoder.layers.17.input_layernorm.weight": "model-00002-of-00004.safetensors",
391
  "model.decoder.layers.17.layer_scalar": "model-00003-of-00004.safetensors",
392
- "model.decoder.layers.17.mlp.down_proj.biases": "model-00002-of-00004.safetensors",
393
- "model.decoder.layers.17.mlp.down_proj.scales": "model-00002-of-00004.safetensors",
394
- "model.decoder.layers.17.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
395
- "model.decoder.layers.17.mlp.gate_proj.biases": "model-00002-of-00004.safetensors",
396
- "model.decoder.layers.17.mlp.gate_proj.scales": "model-00002-of-00004.safetensors",
397
- "model.decoder.layers.17.mlp.gate_proj.weight": "model-00002-of-00004.safetensors",
398
- "model.decoder.layers.17.mlp.up_proj.biases": "model-00002-of-00004.safetensors",
399
- "model.decoder.layers.17.mlp.up_proj.scales": "model-00002-of-00004.safetensors",
400
- "model.decoder.layers.17.mlp.up_proj.weight": "model-00002-of-00004.safetensors",
401
- "model.decoder.layers.17.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
402
- "model.decoder.layers.17.post_feedforward_layernorm.weight": "model-00002-of-00004.safetensors",
403
  "model.decoder.layers.17.post_feedforward_layernorm_1.weight": "model-00003-of-00004.safetensors",
404
  "model.decoder.layers.17.post_feedforward_layernorm_2.weight": "model-00003-of-00004.safetensors",
405
- "model.decoder.layers.17.pre_feedforward_layernorm.weight": "model-00002-of-00004.safetensors",
406
  "model.decoder.layers.17.pre_feedforward_layernorm_2.weight": "model-00003-of-00004.safetensors",
407
- "model.decoder.layers.17.router.per_expert_scale": "model-00002-of-00004.safetensors",
408
- "model.decoder.layers.17.router.proj.biases": "model-00002-of-00004.safetensors",
409
- "model.decoder.layers.17.router.proj.scales": "model-00002-of-00004.safetensors",
410
- "model.decoder.layers.17.router.proj.weight": "model-00002-of-00004.safetensors",
411
- "model.decoder.layers.17.router.scale": "model-00002-of-00004.safetensors",
412
- "model.decoder.layers.17.self_attn.k_norm.weight": "model-00002-of-00004.safetensors",
413
- "model.decoder.layers.17.self_attn.k_proj.biases": "model-00002-of-00004.safetensors",
414
- "model.decoder.layers.17.self_attn.k_proj.scales": "model-00002-of-00004.safetensors",
415
- "model.decoder.layers.17.self_attn.k_proj.weight": "model-00002-of-00004.safetensors",
416
- "model.decoder.layers.17.self_attn.o_proj.biases": "model-00002-of-00004.safetensors",
417
- "model.decoder.layers.17.self_attn.o_proj.scales": "model-00002-of-00004.safetensors",
418
- "model.decoder.layers.17.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
419
- "model.decoder.layers.17.self_attn.q_norm.weight": "model-00002-of-00004.safetensors",
420
- "model.decoder.layers.17.self_attn.q_proj.biases": "model-00002-of-00004.safetensors",
421
- "model.decoder.layers.17.self_attn.q_proj.scales": "model-00002-of-00004.safetensors",
422
- "model.decoder.layers.17.self_attn.q_proj.weight": "model-00002-of-00004.safetensors",
423
  "model.decoder.layers.18.experts.down_proj.biases": "model-00003-of-00004.safetensors",
424
  "model.decoder.layers.18.experts.down_proj.scales": "model-00003-of-00004.safetensors",
425
  "model.decoder.layers.18.experts.down_proj.weight": "model-00003-of-00004.safetensors",
@@ -753,14 +753,14 @@
753
  "model.decoder.layers.24.self_attn.v_proj.biases": "model-00003-of-00004.safetensors",
754
  "model.decoder.layers.24.self_attn.v_proj.scales": "model-00003-of-00004.safetensors",
755
  "model.decoder.layers.24.self_attn.v_proj.weight": "model-00003-of-00004.safetensors",
756
- "model.decoder.layers.25.experts.down_proj.biases": "model-00003-of-00004.safetensors",
757
- "model.decoder.layers.25.experts.down_proj.scales": "model-00003-of-00004.safetensors",
758
- "model.decoder.layers.25.experts.down_proj.weight": "model-00003-of-00004.safetensors",
759
  "model.decoder.layers.25.experts.gate_up_proj.biases": "model-00003-of-00004.safetensors",
760
  "model.decoder.layers.25.experts.gate_up_proj.scales": "model-00003-of-00004.safetensors",
761
  "model.decoder.layers.25.experts.gate_up_proj.weight": "model-00003-of-00004.safetensors",
762
  "model.decoder.layers.25.input_layernorm.weight": "model-00003-of-00004.safetensors",
763
- "model.decoder.layers.25.layer_scalar": "model-00003-of-00004.safetensors",
764
  "model.decoder.layers.25.mlp.down_proj.biases": "model-00003-of-00004.safetensors",
765
  "model.decoder.layers.25.mlp.down_proj.scales": "model-00003-of-00004.safetensors",
766
  "model.decoder.layers.25.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
@@ -772,10 +772,10 @@
772
  "model.decoder.layers.25.mlp.up_proj.weight": "model-00003-of-00004.safetensors",
773
  "model.decoder.layers.25.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
774
  "model.decoder.layers.25.post_feedforward_layernorm.weight": "model-00003-of-00004.safetensors",
775
- "model.decoder.layers.25.post_feedforward_layernorm_1.weight": "model-00003-of-00004.safetensors",
776
- "model.decoder.layers.25.post_feedforward_layernorm_2.weight": "model-00003-of-00004.safetensors",
777
  "model.decoder.layers.25.pre_feedforward_layernorm.weight": "model-00003-of-00004.safetensors",
778
- "model.decoder.layers.25.pre_feedforward_layernorm_2.weight": "model-00003-of-00004.safetensors",
779
  "model.decoder.layers.25.router.per_expert_scale": "model-00003-of-00004.safetensors",
780
  "model.decoder.layers.25.router.proj.biases": "model-00003-of-00004.safetensors",
781
  "model.decoder.layers.25.router.proj.scales": "model-00003-of-00004.safetensors",
@@ -801,42 +801,42 @@
801
  "model.decoder.layers.26.experts.gate_up_proj.biases": "model-00004-of-00004.safetensors",
802
  "model.decoder.layers.26.experts.gate_up_proj.scales": "model-00004-of-00004.safetensors",
803
  "model.decoder.layers.26.experts.gate_up_proj.weight": "model-00004-of-00004.safetensors",
804
- "model.decoder.layers.26.input_layernorm.weight": "model-00003-of-00004.safetensors",
805
  "model.decoder.layers.26.layer_scalar": "model-00004-of-00004.safetensors",
806
- "model.decoder.layers.26.mlp.down_proj.biases": "model-00003-of-00004.safetensors",
807
- "model.decoder.layers.26.mlp.down_proj.scales": "model-00003-of-00004.safetensors",
808
- "model.decoder.layers.26.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
809
- "model.decoder.layers.26.mlp.gate_proj.biases": "model-00003-of-00004.safetensors",
810
- "model.decoder.layers.26.mlp.gate_proj.scales": "model-00003-of-00004.safetensors",
811
- "model.decoder.layers.26.mlp.gate_proj.weight": "model-00003-of-00004.safetensors",
812
- "model.decoder.layers.26.mlp.up_proj.biases": "model-00003-of-00004.safetensors",
813
- "model.decoder.layers.26.mlp.up_proj.scales": "model-00003-of-00004.safetensors",
814
- "model.decoder.layers.26.mlp.up_proj.weight": "model-00003-of-00004.safetensors",
815
- "model.decoder.layers.26.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
816
- "model.decoder.layers.26.post_feedforward_layernorm.weight": "model-00003-of-00004.safetensors",
817
  "model.decoder.layers.26.post_feedforward_layernorm_1.weight": "model-00004-of-00004.safetensors",
818
  "model.decoder.layers.26.post_feedforward_layernorm_2.weight": "model-00004-of-00004.safetensors",
819
- "model.decoder.layers.26.pre_feedforward_layernorm.weight": "model-00003-of-00004.safetensors",
820
  "model.decoder.layers.26.pre_feedforward_layernorm_2.weight": "model-00004-of-00004.safetensors",
821
- "model.decoder.layers.26.router.per_expert_scale": "model-00003-of-00004.safetensors",
822
- "model.decoder.layers.26.router.proj.biases": "model-00003-of-00004.safetensors",
823
- "model.decoder.layers.26.router.proj.scales": "model-00003-of-00004.safetensors",
824
- "model.decoder.layers.26.router.proj.weight": "model-00003-of-00004.safetensors",
825
- "model.decoder.layers.26.router.scale": "model-00003-of-00004.safetensors",
826
- "model.decoder.layers.26.self_attn.k_norm.weight": "model-00003-of-00004.safetensors",
827
- "model.decoder.layers.26.self_attn.k_proj.biases": "model-00003-of-00004.safetensors",
828
- "model.decoder.layers.26.self_attn.k_proj.scales": "model-00003-of-00004.safetensors",
829
- "model.decoder.layers.26.self_attn.k_proj.weight": "model-00003-of-00004.safetensors",
830
- "model.decoder.layers.26.self_attn.o_proj.biases": "model-00003-of-00004.safetensors",
831
- "model.decoder.layers.26.self_attn.o_proj.scales": "model-00003-of-00004.safetensors",
832
- "model.decoder.layers.26.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
833
- "model.decoder.layers.26.self_attn.q_norm.weight": "model-00003-of-00004.safetensors",
834
- "model.decoder.layers.26.self_attn.q_proj.biases": "model-00003-of-00004.safetensors",
835
- "model.decoder.layers.26.self_attn.q_proj.scales": "model-00003-of-00004.safetensors",
836
- "model.decoder.layers.26.self_attn.q_proj.weight": "model-00003-of-00004.safetensors",
837
- "model.decoder.layers.26.self_attn.v_proj.biases": "model-00003-of-00004.safetensors",
838
- "model.decoder.layers.26.self_attn.v_proj.scales": "model-00003-of-00004.safetensors",
839
- "model.decoder.layers.26.self_attn.v_proj.weight": "model-00003-of-00004.safetensors",
840
  "model.decoder.layers.27.experts.down_proj.biases": "model-00004-of-00004.safetensors",
841
  "model.decoder.layers.27.experts.down_proj.scales": "model-00004-of-00004.safetensors",
842
  "model.decoder.layers.27.experts.down_proj.weight": "model-00004-of-00004.safetensors",
@@ -1125,14 +1125,14 @@
1125
  "model.decoder.layers.6.self_attn.v_proj.biases": "model-00001-of-00004.safetensors",
1126
  "model.decoder.layers.6.self_attn.v_proj.scales": "model-00001-of-00004.safetensors",
1127
  "model.decoder.layers.6.self_attn.v_proj.weight": "model-00001-of-00004.safetensors",
1128
- "model.decoder.layers.7.experts.down_proj.biases": "model-00001-of-00004.safetensors",
1129
- "model.decoder.layers.7.experts.down_proj.scales": "model-00001-of-00004.safetensors",
1130
- "model.decoder.layers.7.experts.down_proj.weight": "model-00001-of-00004.safetensors",
1131
  "model.decoder.layers.7.experts.gate_up_proj.biases": "model-00001-of-00004.safetensors",
1132
  "model.decoder.layers.7.experts.gate_up_proj.scales": "model-00001-of-00004.safetensors",
1133
  "model.decoder.layers.7.experts.gate_up_proj.weight": "model-00001-of-00004.safetensors",
1134
  "model.decoder.layers.7.input_layernorm.weight": "model-00001-of-00004.safetensors",
1135
- "model.decoder.layers.7.layer_scalar": "model-00001-of-00004.safetensors",
1136
  "model.decoder.layers.7.mlp.down_proj.biases": "model-00001-of-00004.safetensors",
1137
  "model.decoder.layers.7.mlp.down_proj.scales": "model-00001-of-00004.safetensors",
1138
  "model.decoder.layers.7.mlp.down_proj.weight": "model-00001-of-00004.safetensors",
@@ -1144,10 +1144,10 @@
1144
  "model.decoder.layers.7.mlp.up_proj.weight": "model-00001-of-00004.safetensors",
1145
  "model.decoder.layers.7.post_attention_layernorm.weight": "model-00001-of-00004.safetensors",
1146
  "model.decoder.layers.7.post_feedforward_layernorm.weight": "model-00001-of-00004.safetensors",
1147
- "model.decoder.layers.7.post_feedforward_layernorm_1.weight": "model-00001-of-00004.safetensors",
1148
- "model.decoder.layers.7.post_feedforward_layernorm_2.weight": "model-00001-of-00004.safetensors",
1149
  "model.decoder.layers.7.pre_feedforward_layernorm.weight": "model-00001-of-00004.safetensors",
1150
- "model.decoder.layers.7.pre_feedforward_layernorm_2.weight": "model-00001-of-00004.safetensors",
1151
  "model.decoder.layers.7.router.per_expert_scale": "model-00001-of-00004.safetensors",
1152
  "model.decoder.layers.7.router.proj.biases": "model-00001-of-00004.safetensors",
1153
  "model.decoder.layers.7.router.proj.scales": "model-00001-of-00004.safetensors",
@@ -1173,42 +1173,42 @@
1173
  "model.decoder.layers.8.experts.gate_up_proj.biases": "model-00002-of-00004.safetensors",
1174
  "model.decoder.layers.8.experts.gate_up_proj.scales": "model-00002-of-00004.safetensors",
1175
  "model.decoder.layers.8.experts.gate_up_proj.weight": "model-00002-of-00004.safetensors",
1176
- "model.decoder.layers.8.input_layernorm.weight": "model-00001-of-00004.safetensors",
1177
  "model.decoder.layers.8.layer_scalar": "model-00002-of-00004.safetensors",
1178
- "model.decoder.layers.8.mlp.down_proj.biases": "model-00001-of-00004.safetensors",
1179
- "model.decoder.layers.8.mlp.down_proj.scales": "model-00001-of-00004.safetensors",
1180
- "model.decoder.layers.8.mlp.down_proj.weight": "model-00001-of-00004.safetensors",
1181
- "model.decoder.layers.8.mlp.gate_proj.biases": "model-00001-of-00004.safetensors",
1182
- "model.decoder.layers.8.mlp.gate_proj.scales": "model-00001-of-00004.safetensors",
1183
- "model.decoder.layers.8.mlp.gate_proj.weight": "model-00001-of-00004.safetensors",
1184
- "model.decoder.layers.8.mlp.up_proj.biases": "model-00001-of-00004.safetensors",
1185
- "model.decoder.layers.8.mlp.up_proj.scales": "model-00001-of-00004.safetensors",
1186
- "model.decoder.layers.8.mlp.up_proj.weight": "model-00001-of-00004.safetensors",
1187
- "model.decoder.layers.8.post_attention_layernorm.weight": "model-00001-of-00004.safetensors",
1188
- "model.decoder.layers.8.post_feedforward_layernorm.weight": "model-00001-of-00004.safetensors",
1189
  "model.decoder.layers.8.post_feedforward_layernorm_1.weight": "model-00002-of-00004.safetensors",
1190
  "model.decoder.layers.8.post_feedforward_layernorm_2.weight": "model-00002-of-00004.safetensors",
1191
- "model.decoder.layers.8.pre_feedforward_layernorm.weight": "model-00001-of-00004.safetensors",
1192
  "model.decoder.layers.8.pre_feedforward_layernorm_2.weight": "model-00002-of-00004.safetensors",
1193
- "model.decoder.layers.8.router.per_expert_scale": "model-00001-of-00004.safetensors",
1194
- "model.decoder.layers.8.router.proj.biases": "model-00001-of-00004.safetensors",
1195
- "model.decoder.layers.8.router.proj.scales": "model-00001-of-00004.safetensors",
1196
- "model.decoder.layers.8.router.proj.weight": "model-00001-of-00004.safetensors",
1197
- "model.decoder.layers.8.router.scale": "model-00001-of-00004.safetensors",
1198
- "model.decoder.layers.8.self_attn.k_norm.weight": "model-00001-of-00004.safetensors",
1199
- "model.decoder.layers.8.self_attn.k_proj.biases": "model-00001-of-00004.safetensors",
1200
- "model.decoder.layers.8.self_attn.k_proj.scales": "model-00001-of-00004.safetensors",
1201
- "model.decoder.layers.8.self_attn.k_proj.weight": "model-00001-of-00004.safetensors",
1202
- "model.decoder.layers.8.self_attn.o_proj.biases": "model-00001-of-00004.safetensors",
1203
- "model.decoder.layers.8.self_attn.o_proj.scales": "model-00001-of-00004.safetensors",
1204
- "model.decoder.layers.8.self_attn.o_proj.weight": "model-00001-of-00004.safetensors",
1205
- "model.decoder.layers.8.self_attn.q_norm.weight": "model-00001-of-00004.safetensors",
1206
- "model.decoder.layers.8.self_attn.q_proj.biases": "model-00001-of-00004.safetensors",
1207
- "model.decoder.layers.8.self_attn.q_proj.scales": "model-00001-of-00004.safetensors",
1208
- "model.decoder.layers.8.self_attn.q_proj.weight": "model-00001-of-00004.safetensors",
1209
- "model.decoder.layers.8.self_attn.v_proj.biases": "model-00001-of-00004.safetensors",
1210
- "model.decoder.layers.8.self_attn.v_proj.scales": "model-00001-of-00004.safetensors",
1211
- "model.decoder.layers.8.self_attn.v_proj.weight": "model-00001-of-00004.safetensors",
1212
  "model.decoder.layers.9.experts.down_proj.biases": "model-00002-of-00004.safetensors",
1213
  "model.decoder.layers.9.experts.down_proj.scales": "model-00002-of-00004.safetensors",
1214
  "model.decoder.layers.9.experts.down_proj.weight": "model-00002-of-00004.safetensors",
 
1
  {
2
  "metadata": {
3
+ "total_size": 19400228568
4
  },
5
  "weight_map": {
6
  "model.decoder.embed_tokens.biases": "model-00001-of-00004.safetensors",
 
339
  "model.decoder.layers.15.self_attn.v_proj.biases": "model-00002-of-00004.safetensors",
340
  "model.decoder.layers.15.self_attn.v_proj.scales": "model-00002-of-00004.safetensors",
341
  "model.decoder.layers.15.self_attn.v_proj.weight": "model-00002-of-00004.safetensors",
342
+ "model.decoder.layers.16.experts.down_proj.biases": "model-00003-of-00004.safetensors",
343
+ "model.decoder.layers.16.experts.down_proj.scales": "model-00003-of-00004.safetensors",
344
+ "model.decoder.layers.16.experts.down_proj.weight": "model-00003-of-00004.safetensors",
345
  "model.decoder.layers.16.experts.gate_up_proj.biases": "model-00002-of-00004.safetensors",
346
  "model.decoder.layers.16.experts.gate_up_proj.scales": "model-00002-of-00004.safetensors",
347
  "model.decoder.layers.16.experts.gate_up_proj.weight": "model-00002-of-00004.safetensors",
348
  "model.decoder.layers.16.input_layernorm.weight": "model-00002-of-00004.safetensors",
349
+ "model.decoder.layers.16.layer_scalar": "model-00003-of-00004.safetensors",
350
  "model.decoder.layers.16.mlp.down_proj.biases": "model-00002-of-00004.safetensors",
351
  "model.decoder.layers.16.mlp.down_proj.scales": "model-00002-of-00004.safetensors",
352
  "model.decoder.layers.16.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
 
358
  "model.decoder.layers.16.mlp.up_proj.weight": "model-00002-of-00004.safetensors",
359
  "model.decoder.layers.16.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
360
  "model.decoder.layers.16.post_feedforward_layernorm.weight": "model-00002-of-00004.safetensors",
361
+ "model.decoder.layers.16.post_feedforward_layernorm_1.weight": "model-00003-of-00004.safetensors",
362
+ "model.decoder.layers.16.post_feedforward_layernorm_2.weight": "model-00003-of-00004.safetensors",
363
  "model.decoder.layers.16.pre_feedforward_layernorm.weight": "model-00002-of-00004.safetensors",
364
+ "model.decoder.layers.16.pre_feedforward_layernorm_2.weight": "model-00003-of-00004.safetensors",
365
  "model.decoder.layers.16.router.per_expert_scale": "model-00002-of-00004.safetensors",
366
  "model.decoder.layers.16.router.proj.biases": "model-00002-of-00004.safetensors",
367
  "model.decoder.layers.16.router.proj.scales": "model-00002-of-00004.safetensors",
 
387
  "model.decoder.layers.17.experts.gate_up_proj.biases": "model-00003-of-00004.safetensors",
388
  "model.decoder.layers.17.experts.gate_up_proj.scales": "model-00003-of-00004.safetensors",
389
  "model.decoder.layers.17.experts.gate_up_proj.weight": "model-00003-of-00004.safetensors",
390
+ "model.decoder.layers.17.input_layernorm.weight": "model-00003-of-00004.safetensors",
391
  "model.decoder.layers.17.layer_scalar": "model-00003-of-00004.safetensors",
392
+ "model.decoder.layers.17.mlp.down_proj.biases": "model-00003-of-00004.safetensors",
393
+ "model.decoder.layers.17.mlp.down_proj.scales": "model-00003-of-00004.safetensors",
394
+ "model.decoder.layers.17.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
395
+ "model.decoder.layers.17.mlp.gate_proj.biases": "model-00003-of-00004.safetensors",
396
+ "model.decoder.layers.17.mlp.gate_proj.scales": "model-00003-of-00004.safetensors",
397
+ "model.decoder.layers.17.mlp.gate_proj.weight": "model-00003-of-00004.safetensors",
398
+ "model.decoder.layers.17.mlp.up_proj.biases": "model-00003-of-00004.safetensors",
399
+ "model.decoder.layers.17.mlp.up_proj.scales": "model-00003-of-00004.safetensors",
400
+ "model.decoder.layers.17.mlp.up_proj.weight": "model-00003-of-00004.safetensors",
401
+ "model.decoder.layers.17.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
402
+ "model.decoder.layers.17.post_feedforward_layernorm.weight": "model-00003-of-00004.safetensors",
403
  "model.decoder.layers.17.post_feedforward_layernorm_1.weight": "model-00003-of-00004.safetensors",
404
  "model.decoder.layers.17.post_feedforward_layernorm_2.weight": "model-00003-of-00004.safetensors",
405
+ "model.decoder.layers.17.pre_feedforward_layernorm.weight": "model-00003-of-00004.safetensors",
406
  "model.decoder.layers.17.pre_feedforward_layernorm_2.weight": "model-00003-of-00004.safetensors",
407
+ "model.decoder.layers.17.router.per_expert_scale": "model-00003-of-00004.safetensors",
408
+ "model.decoder.layers.17.router.proj.biases": "model-00003-of-00004.safetensors",
409
+ "model.decoder.layers.17.router.proj.scales": "model-00003-of-00004.safetensors",
410
+ "model.decoder.layers.17.router.proj.weight": "model-00003-of-00004.safetensors",
411
+ "model.decoder.layers.17.router.scale": "model-00003-of-00004.safetensors",
412
+ "model.decoder.layers.17.self_attn.k_norm.weight": "model-00003-of-00004.safetensors",
413
+ "model.decoder.layers.17.self_attn.k_proj.biases": "model-00003-of-00004.safetensors",
414
+ "model.decoder.layers.17.self_attn.k_proj.scales": "model-00003-of-00004.safetensors",
415
+ "model.decoder.layers.17.self_attn.k_proj.weight": "model-00003-of-00004.safetensors",
416
+ "model.decoder.layers.17.self_attn.o_proj.biases": "model-00003-of-00004.safetensors",
417
+ "model.decoder.layers.17.self_attn.o_proj.scales": "model-00003-of-00004.safetensors",
418
+ "model.decoder.layers.17.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
419
+ "model.decoder.layers.17.self_attn.q_norm.weight": "model-00003-of-00004.safetensors",
420
+ "model.decoder.layers.17.self_attn.q_proj.biases": "model-00003-of-00004.safetensors",
421
+ "model.decoder.layers.17.self_attn.q_proj.scales": "model-00003-of-00004.safetensors",
422
+ "model.decoder.layers.17.self_attn.q_proj.weight": "model-00003-of-00004.safetensors",
423
  "model.decoder.layers.18.experts.down_proj.biases": "model-00003-of-00004.safetensors",
424
  "model.decoder.layers.18.experts.down_proj.scales": "model-00003-of-00004.safetensors",
425
  "model.decoder.layers.18.experts.down_proj.weight": "model-00003-of-00004.safetensors",
 
753
  "model.decoder.layers.24.self_attn.v_proj.biases": "model-00003-of-00004.safetensors",
754
  "model.decoder.layers.24.self_attn.v_proj.scales": "model-00003-of-00004.safetensors",
755
  "model.decoder.layers.24.self_attn.v_proj.weight": "model-00003-of-00004.safetensors",
756
+ "model.decoder.layers.25.experts.down_proj.biases": "model-00004-of-00004.safetensors",
757
+ "model.decoder.layers.25.experts.down_proj.scales": "model-00004-of-00004.safetensors",
758
+ "model.decoder.layers.25.experts.down_proj.weight": "model-00004-of-00004.safetensors",
759
  "model.decoder.layers.25.experts.gate_up_proj.biases": "model-00003-of-00004.safetensors",
760
  "model.decoder.layers.25.experts.gate_up_proj.scales": "model-00003-of-00004.safetensors",
761
  "model.decoder.layers.25.experts.gate_up_proj.weight": "model-00003-of-00004.safetensors",
762
  "model.decoder.layers.25.input_layernorm.weight": "model-00003-of-00004.safetensors",
763
+ "model.decoder.layers.25.layer_scalar": "model-00004-of-00004.safetensors",
764
  "model.decoder.layers.25.mlp.down_proj.biases": "model-00003-of-00004.safetensors",
765
  "model.decoder.layers.25.mlp.down_proj.scales": "model-00003-of-00004.safetensors",
766
  "model.decoder.layers.25.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
 
772
  "model.decoder.layers.25.mlp.up_proj.weight": "model-00003-of-00004.safetensors",
773
  "model.decoder.layers.25.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
774
  "model.decoder.layers.25.post_feedforward_layernorm.weight": "model-00003-of-00004.safetensors",
775
+ "model.decoder.layers.25.post_feedforward_layernorm_1.weight": "model-00004-of-00004.safetensors",
776
+ "model.decoder.layers.25.post_feedforward_layernorm_2.weight": "model-00004-of-00004.safetensors",
777
  "model.decoder.layers.25.pre_feedforward_layernorm.weight": "model-00003-of-00004.safetensors",
778
+ "model.decoder.layers.25.pre_feedforward_layernorm_2.weight": "model-00004-of-00004.safetensors",
779
  "model.decoder.layers.25.router.per_expert_scale": "model-00003-of-00004.safetensors",
780
  "model.decoder.layers.25.router.proj.biases": "model-00003-of-00004.safetensors",
781
  "model.decoder.layers.25.router.proj.scales": "model-00003-of-00004.safetensors",
 
801
  "model.decoder.layers.26.experts.gate_up_proj.biases": "model-00004-of-00004.safetensors",
802
  "model.decoder.layers.26.experts.gate_up_proj.scales": "model-00004-of-00004.safetensors",
803
  "model.decoder.layers.26.experts.gate_up_proj.weight": "model-00004-of-00004.safetensors",
804
+ "model.decoder.layers.26.input_layernorm.weight": "model-00004-of-00004.safetensors",
805
  "model.decoder.layers.26.layer_scalar": "model-00004-of-00004.safetensors",
806
+ "model.decoder.layers.26.mlp.down_proj.biases": "model-00004-of-00004.safetensors",
807
+ "model.decoder.layers.26.mlp.down_proj.scales": "model-00004-of-00004.safetensors",
808
+ "model.decoder.layers.26.mlp.down_proj.weight": "model-00004-of-00004.safetensors",
809
+ "model.decoder.layers.26.mlp.gate_proj.biases": "model-00004-of-00004.safetensors",
810
+ "model.decoder.layers.26.mlp.gate_proj.scales": "model-00004-of-00004.safetensors",
811
+ "model.decoder.layers.26.mlp.gate_proj.weight": "model-00004-of-00004.safetensors",
812
+ "model.decoder.layers.26.mlp.up_proj.biases": "model-00004-of-00004.safetensors",
813
+ "model.decoder.layers.26.mlp.up_proj.scales": "model-00004-of-00004.safetensors",
814
+ "model.decoder.layers.26.mlp.up_proj.weight": "model-00004-of-00004.safetensors",
815
+ "model.decoder.layers.26.post_attention_layernorm.weight": "model-00004-of-00004.safetensors",
816
+ "model.decoder.layers.26.post_feedforward_layernorm.weight": "model-00004-of-00004.safetensors",
817
  "model.decoder.layers.26.post_feedforward_layernorm_1.weight": "model-00004-of-00004.safetensors",
818
  "model.decoder.layers.26.post_feedforward_layernorm_2.weight": "model-00004-of-00004.safetensors",
819
+ "model.decoder.layers.26.pre_feedforward_layernorm.weight": "model-00004-of-00004.safetensors",
820
  "model.decoder.layers.26.pre_feedforward_layernorm_2.weight": "model-00004-of-00004.safetensors",
821
+ "model.decoder.layers.26.router.per_expert_scale": "model-00004-of-00004.safetensors",
822
+ "model.decoder.layers.26.router.proj.biases": "model-00004-of-00004.safetensors",
823
+ "model.decoder.layers.26.router.proj.scales": "model-00004-of-00004.safetensors",
824
+ "model.decoder.layers.26.router.proj.weight": "model-00004-of-00004.safetensors",
825
+ "model.decoder.layers.26.router.scale": "model-00004-of-00004.safetensors",
826
+ "model.decoder.layers.26.self_attn.k_norm.weight": "model-00004-of-00004.safetensors",
827
+ "model.decoder.layers.26.self_attn.k_proj.biases": "model-00004-of-00004.safetensors",
828
+ "model.decoder.layers.26.self_attn.k_proj.scales": "model-00004-of-00004.safetensors",
829
+ "model.decoder.layers.26.self_attn.k_proj.weight": "model-00004-of-00004.safetensors",
830
+ "model.decoder.layers.26.self_attn.o_proj.biases": "model-00004-of-00004.safetensors",
831
+ "model.decoder.layers.26.self_attn.o_proj.scales": "model-00004-of-00004.safetensors",
832
+ "model.decoder.layers.26.self_attn.o_proj.weight": "model-00004-of-00004.safetensors",
833
+ "model.decoder.layers.26.self_attn.q_norm.weight": "model-00004-of-00004.safetensors",
834
+ "model.decoder.layers.26.self_attn.q_proj.biases": "model-00004-of-00004.safetensors",
835
+ "model.decoder.layers.26.self_attn.q_proj.scales": "model-00004-of-00004.safetensors",
836
+ "model.decoder.layers.26.self_attn.q_proj.weight": "model-00004-of-00004.safetensors",
837
+ "model.decoder.layers.26.self_attn.v_proj.biases": "model-00004-of-00004.safetensors",
838
+ "model.decoder.layers.26.self_attn.v_proj.scales": "model-00004-of-00004.safetensors",
839
+ "model.decoder.layers.26.self_attn.v_proj.weight": "model-00004-of-00004.safetensors",
840
  "model.decoder.layers.27.experts.down_proj.biases": "model-00004-of-00004.safetensors",
841
  "model.decoder.layers.27.experts.down_proj.scales": "model-00004-of-00004.safetensors",
842
  "model.decoder.layers.27.experts.down_proj.weight": "model-00004-of-00004.safetensors",
 
1125
  "model.decoder.layers.6.self_attn.v_proj.biases": "model-00001-of-00004.safetensors",
1126
  "model.decoder.layers.6.self_attn.v_proj.scales": "model-00001-of-00004.safetensors",
1127
  "model.decoder.layers.6.self_attn.v_proj.weight": "model-00001-of-00004.safetensors",
1128
+ "model.decoder.layers.7.experts.down_proj.biases": "model-00002-of-00004.safetensors",
1129
+ "model.decoder.layers.7.experts.down_proj.scales": "model-00002-of-00004.safetensors",
1130
+ "model.decoder.layers.7.experts.down_proj.weight": "model-00002-of-00004.safetensors",
1131
  "model.decoder.layers.7.experts.gate_up_proj.biases": "model-00001-of-00004.safetensors",
1132
  "model.decoder.layers.7.experts.gate_up_proj.scales": "model-00001-of-00004.safetensors",
1133
  "model.decoder.layers.7.experts.gate_up_proj.weight": "model-00001-of-00004.safetensors",
1134
  "model.decoder.layers.7.input_layernorm.weight": "model-00001-of-00004.safetensors",
1135
+ "model.decoder.layers.7.layer_scalar": "model-00002-of-00004.safetensors",
1136
  "model.decoder.layers.7.mlp.down_proj.biases": "model-00001-of-00004.safetensors",
1137
  "model.decoder.layers.7.mlp.down_proj.scales": "model-00001-of-00004.safetensors",
1138
  "model.decoder.layers.7.mlp.down_proj.weight": "model-00001-of-00004.safetensors",
 
1144
  "model.decoder.layers.7.mlp.up_proj.weight": "model-00001-of-00004.safetensors",
1145
  "model.decoder.layers.7.post_attention_layernorm.weight": "model-00001-of-00004.safetensors",
1146
  "model.decoder.layers.7.post_feedforward_layernorm.weight": "model-00001-of-00004.safetensors",
1147
+ "model.decoder.layers.7.post_feedforward_layernorm_1.weight": "model-00002-of-00004.safetensors",
1148
+ "model.decoder.layers.7.post_feedforward_layernorm_2.weight": "model-00002-of-00004.safetensors",
1149
  "model.decoder.layers.7.pre_feedforward_layernorm.weight": "model-00001-of-00004.safetensors",
1150
+ "model.decoder.layers.7.pre_feedforward_layernorm_2.weight": "model-00002-of-00004.safetensors",
1151
  "model.decoder.layers.7.router.per_expert_scale": "model-00001-of-00004.safetensors",
1152
  "model.decoder.layers.7.router.proj.biases": "model-00001-of-00004.safetensors",
1153
  "model.decoder.layers.7.router.proj.scales": "model-00001-of-00004.safetensors",
 
1173
  "model.decoder.layers.8.experts.gate_up_proj.biases": "model-00002-of-00004.safetensors",
1174
  "model.decoder.layers.8.experts.gate_up_proj.scales": "model-00002-of-00004.safetensors",
1175
  "model.decoder.layers.8.experts.gate_up_proj.weight": "model-00002-of-00004.safetensors",
1176
+ "model.decoder.layers.8.input_layernorm.weight": "model-00002-of-00004.safetensors",
1177
  "model.decoder.layers.8.layer_scalar": "model-00002-of-00004.safetensors",
1178
+ "model.decoder.layers.8.mlp.down_proj.biases": "model-00002-of-00004.safetensors",
1179
+ "model.decoder.layers.8.mlp.down_proj.scales": "model-00002-of-00004.safetensors",
1180
+ "model.decoder.layers.8.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
1181
+ "model.decoder.layers.8.mlp.gate_proj.biases": "model-00002-of-00004.safetensors",
1182
+ "model.decoder.layers.8.mlp.gate_proj.scales": "model-00002-of-00004.safetensors",
1183
+ "model.decoder.layers.8.mlp.gate_proj.weight": "model-00002-of-00004.safetensors",
1184
+ "model.decoder.layers.8.mlp.up_proj.biases": "model-00002-of-00004.safetensors",
1185
+ "model.decoder.layers.8.mlp.up_proj.scales": "model-00002-of-00004.safetensors",
1186
+ "model.decoder.layers.8.mlp.up_proj.weight": "model-00002-of-00004.safetensors",
1187
+ "model.decoder.layers.8.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
1188
+ "model.decoder.layers.8.post_feedforward_layernorm.weight": "model-00002-of-00004.safetensors",
1189
  "model.decoder.layers.8.post_feedforward_layernorm_1.weight": "model-00002-of-00004.safetensors",
1190
  "model.decoder.layers.8.post_feedforward_layernorm_2.weight": "model-00002-of-00004.safetensors",
1191
+ "model.decoder.layers.8.pre_feedforward_layernorm.weight": "model-00002-of-00004.safetensors",
1192
  "model.decoder.layers.8.pre_feedforward_layernorm_2.weight": "model-00002-of-00004.safetensors",
1193
+ "model.decoder.layers.8.router.per_expert_scale": "model-00002-of-00004.safetensors",
1194
+ "model.decoder.layers.8.router.proj.biases": "model-00002-of-00004.safetensors",
1195
+ "model.decoder.layers.8.router.proj.scales": "model-00002-of-00004.safetensors",
1196
+ "model.decoder.layers.8.router.proj.weight": "model-00002-of-00004.safetensors",
1197
+ "model.decoder.layers.8.router.scale": "model-00002-of-00004.safetensors",
1198
+ "model.decoder.layers.8.self_attn.k_norm.weight": "model-00002-of-00004.safetensors",
1199
+ "model.decoder.layers.8.self_attn.k_proj.biases": "model-00002-of-00004.safetensors",
1200
+ "model.decoder.layers.8.self_attn.k_proj.scales": "model-00002-of-00004.safetensors",
1201
+ "model.decoder.layers.8.self_attn.k_proj.weight": "model-00002-of-00004.safetensors",
1202
+ "model.decoder.layers.8.self_attn.o_proj.biases": "model-00002-of-00004.safetensors",
1203
+ "model.decoder.layers.8.self_attn.o_proj.scales": "model-00002-of-00004.safetensors",
1204
+ "model.decoder.layers.8.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
1205
+ "model.decoder.layers.8.self_attn.q_norm.weight": "model-00002-of-00004.safetensors",
1206
+ "model.decoder.layers.8.self_attn.q_proj.biases": "model-00002-of-00004.safetensors",
1207
+ "model.decoder.layers.8.self_attn.q_proj.scales": "model-00002-of-00004.safetensors",
1208
+ "model.decoder.layers.8.self_attn.q_proj.weight": "model-00002-of-00004.safetensors",
1209
+ "model.decoder.layers.8.self_attn.v_proj.biases": "model-00002-of-00004.safetensors",
1210
+ "model.decoder.layers.8.self_attn.v_proj.scales": "model-00002-of-00004.safetensors",
1211
+ "model.decoder.layers.8.self_attn.v_proj.weight": "model-00002-of-00004.safetensors",
1212
  "model.decoder.layers.9.experts.down_proj.biases": "model-00002-of-00004.safetensors",
1213
  "model.decoder.layers.9.experts.down_proj.scales": "model-00002-of-00004.safetensors",
1214
  "model.decoder.layers.9.experts.down_proj.weight": "model-00002-of-00004.safetensors",