Unsloth

科技人工智能

Qwen3.8 27B量化性能测试:4位量化保持完整模型水平,1位量化性能崩溃

针对Qwen3.8 27B模型的多种量化版本进行的基准测试显示,性能表现在不同量化等级间存在显著差异。完整BF16模型权重达55GB,超出大多数消费级硬件能力范围,而4位量化Q4_K_M版本仅需17GB存储空间,可在RTX 4090等24GB显卡上运行。