Новая линейка моделей Qwen3.8 с поддержкой vision, reasoning, 256K контекста и квантизацией до 1-битных GGUFs, запускаемая через Unsloth и llama.cpp.
источник ↗#unsloth
3 записейРуководство по запуску open-weight модели DeepSeek-V4-Flash-0731 (284B параметров, 13B активных) с 1M контекстом и улучшенным шаблоном чата.
источник ↗Подробные инструкции по использованию нецензурированной модели HauhauCS/Qwen3.5-9B-Uncensored-HauhauCS-Aggressive (1.33k) с llama-cpp-python, llama.cpp, Ollama и Unsloth Studio для локального инференса. 🚀
источник ↗