Gemma 4

RTX 4090 本地部署:Gemma 4 與 Qwen 3.6 的效能測試
以 RTX 4090 24GB VRAM 為基準,拆解 Gemma 4 與 Qwen 3.6 的量化選型、KV Cache、Flash Attention、Docker llama.cpp 部署與 OOM 排障方法。
閱讀全文
以 RTX 4090 24GB VRAM 為基準,拆解 Gemma 4 與 Qwen 3.6 的量化選型、KV Cache、Flash Attention、Docker llama.cpp 部署與 OOM 排障方法。
閱讀全文