+7 (987) 680-29-96Оставить заявку
Профиль

Расчехляйте свои DGX Spark и макстудии — вышла Qwen 3.8 Flash Next

04 сентября 2026
7
0

Расчехляйте свои DGX Spark и макстудии — вышла Qwen 3.8 Flash Next

Это 125B-A6B модель с 51B Engram параметров на архитектуре Qwen 4. Обходит по всем бенчам Qwen 3.8 27B, очень хорошо соревнуется с DeepSeek V4 Flash. Модель уже поддерживается vLLM и SGLang.

Очень интересный форм-фактор для моделей, позволяющий эффективно их запускать на локальных машинах с 128gb памяти — DGX Spark, Mac, Strix Halo, нужно таких моделей побольше. В такой весовой категории в последнее время никого не было, ~30B модели запускались и на сильно более слабом железе, а DeepSeek V4 Flash и модели в подобной весовой категории уже не влезали.

Блогпост
Техрепорт
Веса

@ai_newz

Источник: Telegram

Понравилась статья?
Поделитесь мыслями
Войдите, чтобы оставить комментарий

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

Перейти к сравнению