ZooWork
ZooWork Market · Skill

gguf-quantization

GGUF format and llama.cpp quantization for efficient CPU/GPU inference. Use when deploying models on consumer hardware, Apple Silicon, or when needing flexible quantization from 2–8 bit without GPU requirements.

davila7
davila7-claude-code-templates-optimization-gguf · v1.0.0
分类ai-llms
安装次数40
更新时间2026-08-08T08:49:42.880Z
校验状态待验证
GGUFQuantizationllama.cppCPU InferenceApple SiliconModel CompressionOptimization