[МСК]

DeepSeek V4.1 Flash: агентные сценарии считают заново

11 сентября 2026 · 1 минНовостиРелизы

DeepSeek выложил V4.1 Flash. Модель построена по схеме MoE: 552 млрд параметров всего, на один ответ включается 8–16 млрд. Отсюда цена ответа на уровне лёгкого тарифа.

Считают не параметры, а активацию

В MoE на запрос работает малая часть сети. Здесь это 8–16 млрд из 552 — примерно тридцатая часть. Стоимость вывода считают по активной части, поэтому тяжёлая модель попадает в дешёвый тариф.

По агентным замерам заявлены три числа. Работа в терминале — 90,6 балла против 89,1 у Claude Opus 5 и 88,8 у GPT-5.6. Починка багов в реальных проектах — 74,2.

DeepSeek V4.1 Flash
90.6 баллов
Claude Opus 5
89.1 баллов
GPT-5.6
88.8 баллов
Работа в терминале, баллы · Источник: t.me/ai_product/2409

Что это значит для сметы

Агентные и кодовые сценарии — самая дорогая статья счёта: агент делает десятки вызовов на одну задачу. Перенос такой нагрузки на более дешёвый вывод меняет месячный счёт сильнее, чем любая правка промптов.

Порядок проверки простой: берут неделю реальных запросов, прогоняют через обе модели, сравнивают счёт и долю верных ответов. Оценить порядок цифр заранее помогает калькулятор счёта за инференс.

Чего пока не известно

Цены за токены для российских плательщиков, лицензия и доступность весов для развёртывания в своём контуре, предел контекста и дата открытия API.

Источник: t.me