Новая линейка моделей Qwen3.8 с поддержкой vision, reasoning, 256K контекста и квантизацией до 1-битных GGUFs, запускаемая через Unsloth и llama.cpp.
источник ↗#qwen
3 записейПрактическое руководство по запуску Qwen3.8-27B на видеокарте с 16 ГБ VRAM с помощью llama.cpp и агрессивной квантизации.
источник ↗Marlin — 2B-параметровая видео-VLM, которая извлекает структурированные описания сцен и событий с точными таймкодами и находит временные интервалы по естественному языку.
источник ↗