Практическое руководство по запуску Qwen3.8-27B на видеокарте с 16 ГБ VRAM с помощью llama.cpp и агрессивной квантизации.
источник ↗#локальный-ai
2 записейРуководство по запуску open-weight модели DeepSeek-V4-Flash-0731 (284B параметров, 13B активных) с 1M контекстом и улучшенным шаблоном чата.
источник ↗