collections/qwen/qwen38-flash-next

huggingface.co
Открыть сайт

Расчехляйте свои DGX Spark и макстудии — вышла Qwen 3.8 Flash Next Это 125B-A6B модель с 51B Engram параметров на архи

Расчехляйте свои DGX Spark и макстудии — вышла Qwen 3.8 Flash Next Это 125B-A6B модель с 51B Engram параметров на архитектуре Qwen 4. Обходит по всем бенчам Qwen 3.8 27B, очень хорошо соревнуется с DeepSeek V4 Flash. Модель уже поддерживается vLLM и SGLang. Очень интересный форм-фактор для моделей, позволяющий эффективно их запускать на локальных машинах с 128gb памяти — DGX Spark, Mac, Strix Halo, нужно таких моделей побольше. В такой весовой категории в последнее время никого не было, ~30B модели запускались и на сильно более слабом железе, а DeepSeek V4 Flash и модели в подобной весовой категории уже не влезали. Блогпост Техрепорт Веса @ai_newz

Характеристики

Тип Инструмент
Категория3D и моделирование
Язык сайтаen

Найден в источниках

Похожие в разделе «3D и моделирование»

Предложить сайт в каталог

Пришлите ссылку — остальное мы выясним сами.

Мы рассмотрим, что вы прислали, и добавим в каталог, если подойдёт.

Не знаете, как внедрить? Мы поможем

Расскажите про задачу — подберём инструменты и подскажем, с чего начать.

0 / 5000
Проверочный код

Поля со звёздочкой обязательны. Данные используются только для ответа.