DeepSeek готовит V4.1 Flash: дешевле и мощнее прежней Pro-модели

· Искусственный интеллект
Китайская лаборатория DeepSeek анонсировала на 10 сентября 2026 года выход V4.1 Flash, которая, по её словам, превосходит модель V4 Pro по всем ключевым метрикам при более низкой цене.

cover.svg

Компания DeepSeek объявила о скором выходе новой языковой модели V4.1 Flash. Официальный запуск намечен примерно на 10 сентября 2026 года по пекинскому времени. Сообщение появилось не в виде громкого пресс-релиза, а как баннер в личном кабинете на портале platform.deepseek.com — обсуждающие новость на Hacker News признались, что не сразу отыскали первоисточник.

По утверждению разработчиков, после внутреннего и внешнего тестирования V4.1 Flash «всесторонне превзошла» предыдущую флагманскую V4 Pro по всем ключевым показателям: производительности, стоимости, скорости и времени выполнения задач. Иными словами, младшая по названию модель обгоняет старшую — тенденция, которую в комментариях сравнивают с недавним случаем, когда GLM 5.3 Flash оказалась лучше и дешевле GLM 5.2.

Спорное решение с маршрутизацией

Особое внимание вызвал один пункт объявления. После запуска V4.1 Flash и до выхода V4.1 Pro все запросы, адресованные модели Pro, будут автоматически перенаправляться на V4.1 Flash — и тарифицироваться уже по цене Flash. DeepSeek преподносит это как заботу о пользователях, но многие восприняли шаг иначе.

В обсуждении звучит резонное возражение: если рабочий процесс тщательно отлажен и протестирован под конкретную модель, внезапная подмена — пусть и на «лучшую» — способна сломать привычное поведение. Регрессионное тестирование, отмечают участники, хочется запускать по собственному графику, а не по навязанному. Прозвучало и напоминание, что модели с открытыми весами можно поднять у сторонних провайдеров вроде Together.ai или OpenRouter, если прежняя версия ещё нужна.

Цены

С 12:00 10 сентября по пекинскому времени вступает в силу новый тариф для линейки Flash. В непиковые часы обещаны $0,003 за попадание в кэш входных токенов, $0,15 за промах и $0,6 за выходные токены (за миллион). В пиковые часы ставки удваиваются. По сопоставлению, приведённому в комментариях, каждая из позиций оказывается ниже текущих расценок Flash.

В целом сообщество встретило анонс с энтузиазмом: многие давно используют «флеш»-модели как дешёвую и быструю рабочую лошадку для агентных задач, отмечая отличное соотношение цены и качества. Среди претензий к нынешней версии — склонность иногда отвечать по-китайски на английские запросы, а также ограничения на объём вывода. Останутся ли V4.1 Flash и будущая V4.1 Pro моделями с открытыми весами, компания пока не уточнила.


Источник: Hacker News

Комментарии

Войдите, чтобы комментировать.

  • Пока нет комментариев.