TimesFM 2.5 — это декодер-only foundation model от Google Research для прогнозирования временных рядов с 200M параметров и контекстом до 16k.
источник ↗#huggingface
6 записейGated 7B-модель NVIDIA для speech-to-speech и audio-to-audio задач на базе Moshi с весами 16.7 ГБ.
источник ↗Marlin-2B — это 2-миллиардная мультимодальная модель от NemoStation, доступная на Hugging Face под лицензией Apache 2.0.
источник ↗Подробные инструкции по использованию нецензурированной модели HauhauCS/Qwen3.5-9B-Uncensored-HauhauCS-Aggressive (1.33k) с llama-cpp-python, llama.cpp, Ollama и Unsloth Studio для локального инференса. 🚀
источник ↗oLLM — легковесная Python-библиотека для инференса больших LLM на потребительских GPU с 8GB VRAM без квантизации, поддерживает 100k контекст и мультимодальные модели.
источник ↗VibeVoice — семейство open-source моделей TTS и ASR от Microsoft для обработки длинных аудио до 90 мин с поддержкой multi-speaker, timestamps и custom context.
источник ↗