
DeepSeek V4 Pro поднял цены: как пересчитать смету за вечер
DeepSeek выпустил модель V4 Pro 0813 и одновременно поднял тарифы API примерно в 1,5–2,5 раза. Сильнее всего подорожал кэш. В пиковые часы к тарифу применяется двойной коэффициент.
Подорожал не сам запрос, а привычка на нём экономить
По качеству V4 Pro встала вровень или чуть ниже GPT-5.6 Luna, которая доступна шире. Рост тарифа неравномерный: базовые позиции подорожали в нижней части диапазона, кэш — в верхней. Пиковое окно удваивает счёт поверх нового тарифа. Прежний расчёт держался на дешёвом кэше и прямой доступности из России — обе опоры сместились.
Пересчёт занимает вечер, а не квартал
Месячная смета на инференс пересчитывается по факту. Берётся выгрузка за прошлый месяц. Дальше считается доля токенов из кэша и доля обращений в пиковое окно. Видно, какая часть роста снимается расписанием, а какая — сокращением промпта. Выигрывают те, у кого контекст собирается под задачу, а не отправляется целиком. Прикинуть новый порядок сумм помогает калькулятор счёта за инференс.
Границы пикового окна и точные тарифы по позициям поставщиком пока не названы. Нет и даты окончания старых цен для действующих клиентов, условий оплаты и доступа из России. До этих данных смета считается по верхней границе диапазона.
Обсудим задачу?
Расскажите о процессе — предложим, где ИИ окупится быстрее всего.
Ещё по теме

OpenAI снизила цену Luna на 80%: массовую нагрузку считают заново
Вход у GPT-5.6 Luna подешевел с $1 до $0,20 за миллион токенов, у Terra — с $2,50 до $2. Смету на квартал пересчитывают.

Недетерминированность — что это простыми словами
Недетерминированность — это свойство языковой модели отвечать на один и тот же запрос по-разному; разброс сужается форматом ответа, порогом и приёмкой по выборке.