Rust-библиотека с Python-обёрткой для сжатого векторного поиска, дающая 8× экономию RAM и 3.4× ускорение поиска по сравнению с FAISS.
источник ↗#quantization
3 записейНовая линейка моделей Qwen3.8 с поддержкой vision, reasoning, 256K контекста и квантизацией до 1-битных GGUFs, запускаемая через Unsloth и llama.cpp.
источник ↗Руководство по запуску open-weight модели DeepSeek-V4-Flash-0731 (284B параметров, 13B активных) с 1M контекстом и улучшенным шаблоном чата.
источник ↗