#kv-cache
-
DeepSeek-V4.1 Flash: как сжать KV-кэш вчетверо ради длинного контекста
Технический разбор новой модели DeepSeek, чья главная цель — не рост качества, а радикальное сжатие кэша ключей и значений. Автор блога признаётся: изучив отчёт, он понял, что по масштабу изменений модель тянет скорее на «пятёрку».