|
1 | 1 | { |
2 | | - "version": "0.7", |
| 2 | + "version": "0.8", |
3 | 3 | "last_updated": "2026-04-26", |
4 | 4 | "tiers": { |
5 | 5 | "1": { |
|
643 | 643 | "min_ram_gb": 3.0 |
644 | 644 | } |
645 | 645 | } |
| 646 | + }, |
| 647 | + { |
| 648 | + "id": "qwen3-1.7b", |
| 649 | + "name": "Qwen3 1.7B", |
| 650 | + "tier": 1, |
| 651 | + "hf_repo": "bartowski/Qwen_Qwen3-1.7B-GGUF", |
| 652 | + "prompt_format": "chatml", |
| 653 | + "categories": [ |
| 654 | + "chat", |
| 655 | + "reasoning", |
| 656 | + "fast" |
| 657 | + ], |
| 658 | + "best_for": "Smart fast chat \u2014 noticeably smarter than Qwen2.5 at same size", |
| 659 | + "languages": [ |
| 660 | + "english", |
| 661 | + "chinese", |
| 662 | + "multilingual" |
| 663 | + ], |
| 664 | + "license": "Apache 2.0", |
| 665 | + "note": "Qwen3 generation \u2014 much better reasoning than Qwen2.5 1.5B. Supports /think mode for step-by-step reasoning.", |
| 666 | + "verified": false, |
| 667 | + "variants": { |
| 668 | + "Q4_K_M": { |
| 669 | + "filename": "Qwen_Qwen3-1.7B-Q4_K_M.gguf", |
| 670 | + "download_size_gb": 1.1, |
| 671 | + "min_ram_gb": 1.8 |
| 672 | + }, |
| 673 | + "Q2_K": { |
| 674 | + "filename": "Qwen_Qwen3-1.7B-Q2_K.gguf", |
| 675 | + "download_size_gb": 0.7, |
| 676 | + "min_ram_gb": 1.2 |
| 677 | + } |
| 678 | + } |
| 679 | + }, |
| 680 | + { |
| 681 | + "id": "qwen3-4b", |
| 682 | + "name": "Qwen3 4B", |
| 683 | + "tier": 2, |
| 684 | + "hf_repo": "bartowski/Qwen_Qwen3-4B-GGUF", |
| 685 | + "prompt_format": "chatml", |
| 686 | + "categories": [ |
| 687 | + "chat", |
| 688 | + "reasoning", |
| 689 | + "coding" |
| 690 | + ], |
| 691 | + "best_for": "Best quality model under 3GB RAM \u2014 reasoning, coding, chat", |
| 692 | + "languages": [ |
| 693 | + "english", |
| 694 | + "chinese", |
| 695 | + "multilingual" |
| 696 | + ], |
| 697 | + "license": "Apache 2.0", |
| 698 | + "note": "The #1 recommendation for phones with 3GB+ free RAM. Qwen3 4B at Q4 needs ~2.75GB and performs far above its size. Supports /think mode.", |
| 699 | + "verified": false, |
| 700 | + "variants": { |
| 701 | + "Q4_K_M": { |
| 702 | + "filename": "Qwen_Qwen3-4B-Q4_K_M.gguf", |
| 703 | + "download_size_gb": 2.5, |
| 704 | + "min_ram_gb": 3.0 |
| 705 | + }, |
| 706 | + "Q2_K": { |
| 707 | + "filename": "Qwen_Qwen3-4B-Q2_K.gguf", |
| 708 | + "download_size_gb": 1.6, |
| 709 | + "min_ram_gb": 2.2 |
| 710 | + } |
| 711 | + } |
| 712 | + }, |
| 713 | + { |
| 714 | + "id": "qwen3.5-4b", |
| 715 | + "name": "Qwen3.5 4B", |
| 716 | + "tier": 2, |
| 717 | + "hf_repo": "bartowski/Qwen_Qwen3.5-4B-GGUF", |
| 718 | + "prompt_format": "chatml", |
| 719 | + "categories": [ |
| 720 | + "chat", |
| 721 | + "reasoning", |
| 722 | + "multilingual" |
| 723 | + ], |
| 724 | + "best_for": "Latest Qwen generation \u2014 200+ language support, best multilingual small model", |
| 725 | + "languages": [ |
| 726 | + "english", |
| 727 | + "chinese", |
| 728 | + "multilingual" |
| 729 | + ], |
| 730 | + "license": "Apache 2.0", |
| 731 | + "note": "Qwen3.5 is newer than Qwen3. 200+ languages, better reasoning. If Qwen3 4B fits, try this one next.", |
| 732 | + "verified": false, |
| 733 | + "variants": { |
| 734 | + "Q4_K_M": { |
| 735 | + "filename": "Qwen_Qwen3.5-4B-Q4_K_M.gguf", |
| 736 | + "download_size_gb": 2.5, |
| 737 | + "min_ram_gb": 3.2 |
| 738 | + }, |
| 739 | + "Q2_K": { |
| 740 | + "filename": "Qwen_Qwen3.5-4B-Q2_K.gguf", |
| 741 | + "download_size_gb": 1.6, |
| 742 | + "min_ram_gb": 2.3 |
| 743 | + } |
| 744 | + } |
646 | 745 | } |
647 | 746 | ] |
648 | 747 | } |
0 commit comments