Skip to content

Commit dc6c568

Browse files
authored
Update models.json
1 parent 14b6b3a commit dc6c568

1 file changed

Lines changed: 100 additions & 1 deletion

File tree

models.json

Lines changed: 100 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -1,5 +1,5 @@
11
{
2-
"version": "0.7",
2+
"version": "0.8",
33
"last_updated": "2026-04-26",
44
"tiers": {
55
"1": {
@@ -643,6 +643,105 @@
643643
"min_ram_gb": 3.0
644644
}
645645
}
646+
},
647+
{
648+
"id": "qwen3-1.7b",
649+
"name": "Qwen3 1.7B",
650+
"tier": 1,
651+
"hf_repo": "bartowski/Qwen_Qwen3-1.7B-GGUF",
652+
"prompt_format": "chatml",
653+
"categories": [
654+
"chat",
655+
"reasoning",
656+
"fast"
657+
],
658+
"best_for": "Smart fast chat \u2014 noticeably smarter than Qwen2.5 at same size",
659+
"languages": [
660+
"english",
661+
"chinese",
662+
"multilingual"
663+
],
664+
"license": "Apache 2.0",
665+
"note": "Qwen3 generation \u2014 much better reasoning than Qwen2.5 1.5B. Supports /think mode for step-by-step reasoning.",
666+
"verified": false,
667+
"variants": {
668+
"Q4_K_M": {
669+
"filename": "Qwen_Qwen3-1.7B-Q4_K_M.gguf",
670+
"download_size_gb": 1.1,
671+
"min_ram_gb": 1.8
672+
},
673+
"Q2_K": {
674+
"filename": "Qwen_Qwen3-1.7B-Q2_K.gguf",
675+
"download_size_gb": 0.7,
676+
"min_ram_gb": 1.2
677+
}
678+
}
679+
},
680+
{
681+
"id": "qwen3-4b",
682+
"name": "Qwen3 4B",
683+
"tier": 2,
684+
"hf_repo": "bartowski/Qwen_Qwen3-4B-GGUF",
685+
"prompt_format": "chatml",
686+
"categories": [
687+
"chat",
688+
"reasoning",
689+
"coding"
690+
],
691+
"best_for": "Best quality model under 3GB RAM \u2014 reasoning, coding, chat",
692+
"languages": [
693+
"english",
694+
"chinese",
695+
"multilingual"
696+
],
697+
"license": "Apache 2.0",
698+
"note": "The #1 recommendation for phones with 3GB+ free RAM. Qwen3 4B at Q4 needs ~2.75GB and performs far above its size. Supports /think mode.",
699+
"verified": false,
700+
"variants": {
701+
"Q4_K_M": {
702+
"filename": "Qwen_Qwen3-4B-Q4_K_M.gguf",
703+
"download_size_gb": 2.5,
704+
"min_ram_gb": 3.0
705+
},
706+
"Q2_K": {
707+
"filename": "Qwen_Qwen3-4B-Q2_K.gguf",
708+
"download_size_gb": 1.6,
709+
"min_ram_gb": 2.2
710+
}
711+
}
712+
},
713+
{
714+
"id": "qwen3.5-4b",
715+
"name": "Qwen3.5 4B",
716+
"tier": 2,
717+
"hf_repo": "bartowski/Qwen_Qwen3.5-4B-GGUF",
718+
"prompt_format": "chatml",
719+
"categories": [
720+
"chat",
721+
"reasoning",
722+
"multilingual"
723+
],
724+
"best_for": "Latest Qwen generation \u2014 200+ language support, best multilingual small model",
725+
"languages": [
726+
"english",
727+
"chinese",
728+
"multilingual"
729+
],
730+
"license": "Apache 2.0",
731+
"note": "Qwen3.5 is newer than Qwen3. 200+ languages, better reasoning. If Qwen3 4B fits, try this one next.",
732+
"verified": false,
733+
"variants": {
734+
"Q4_K_M": {
735+
"filename": "Qwen_Qwen3.5-4B-Q4_K_M.gguf",
736+
"download_size_gb": 2.5,
737+
"min_ram_gb": 3.2
738+
},
739+
"Q2_K": {
740+
"filename": "Qwen_Qwen3.5-4B-Q2_K.gguf",
741+
"download_size_gb": 1.6,
742+
"min_ram_gb": 2.3
743+
}
744+
}
646745
}
647746
]
648747
}

0 commit comments

Comments
 (0)