🔥 Вышли официальные GGUF-квантизации GLM-5.3 Flash Uncensored
Модель: 320B параметров, 18B активных.
Доступные варианты:
- Q6_K — 263 ГБ / 94,3% Top-1
- Q4_K_M — 193 ГБ / 89,8% Top-1 — рекомендуемый
- Q3_K_M — 153 ГБ / 85,6% Top-1
- Q2_K — 117 ГБ / 75,5% Top-1
Подходит для запуска на CPU + GPU, включая Apple Silicon.
Это не jailbreak: удаление отказов зашито прямо в веса модели.
API со стандартными весами:
https://orcarouter.ai/models/z-ai/glm-5.3-flash
Uncensored GGUF:
https://huggingface.co/orcarouter/GLM-5.3-Flash-Uncensored-GGUF
Модель: 320B параметров, 18B активных.
Доступные варианты:
- Q6_K — 263 ГБ / 94,3% Top-1
- Q4_K_M — 193 ГБ / 89,8% Top-1 — рекомендуемый
- Q3_K_M — 153 ГБ / 85,6% Top-1
- Q2_K — 117 ГБ / 75,5% Top-1
Подходит для запуска на CPU + GPU, включая Apple Silicon.
Это не jailbreak: удаление отказов зашито прямо в веса модели.
API со стандартными весами:
https://orcarouter.ai/models/z-ai/glm-5.3-flash
Uncensored GGUF:
https://huggingface.co/orcarouter/GLM-5.3-Flash-Uncensored-GGUF
GLM 5.3 Flash API — Pricing & Benchmarks · OrcaRouter
Drop-in GLM 5.3 Flash API for any OpenAI SDK — $0.07 / $0.25 per 1M tokens, p50 8725ms via OrcaRouter. Zero markup. Zero migration. One API.
OrcaRouter