Месяц с DeepSeek 4.1 Flash
За последний месяц модель использовалась интенсивно, на проектах в разных областях. Она показывает себя как настоящая frontier-модель — производительная и на порядки дешевле аналогов. Во время работы, если не смотреть на название модели, сложно понять, что работаешь с DeepSeek или Opus. Ни в разговорах, ни в качестве выполнения, ни в скорости разницы не заметно. Отсутствие Pro-версии вообще не беспокоит, потому что она работает как frontier-модель.
Если нужны объективные цифры, есть полные бенчмарки. Но субъективный опыт говорит громче: китайские модели вплотную приблизились к frontier, и это серьёзно.
Почему же лидеры индустрии не паникуют? Потому что не понимают масштаб проблемы. Китай готов съесть их обед. Может, они отстают на месяц-два от Anthropic и OpenAI, но дистиллированные модели справляются с теми же задачами.
Да, DeepSeek использовал данные Claude, а Anthropic когда-то вдохновилась другими источниками. Не будем влезать в философию того, кому принадлежат данные — разработчики не думают об этом. Им нужен максимум функционала за минимум денег.
«Достаточно хорошего» хватает для всего
Современные модели уже справляются с высококачественными автоматизированными задачами. Гоняться за новейшей версией глупо. Да, интересно смотреть на новые возможности, но то, что мы им даём — часто смешно (может быть, даже оскорбительно для сознательной нейросети). Это как просить PhD по математике организовать файлы на рабочем столе.
С подпиской OpenCode Go за $10/месяц DeepSeek работает практически без ограничений. Это полностью изменило подход к разработке. Нет стыда в том, чтобы запустить простейшую задачу или поэкспериментировать с интерфейсом. Да, можно переорганизовать файлы на рабочем столе — это будет стоить $0.003 вместо $1. Редко когда одна сессия превышает $1 в расходах. Сеансы обычно держаны в узде, но иногда они тянутся целый день.
DeepSeek 4.1 Flash привлекается даже для сложного планирования и исследований. На критических этапах иногда подключается Opus 5.5 для финального кода-ревью — ловит пару краевых случаев. Потом DeepSeek исправляет найденное. И даже когда нужен Opus или GLM (который пьёт то же китайское зелье, что и DeepSeek), это не про качество, а про свежий взгляд на проблему.
Магия кэша
DeepSeek сократил KV-кэш в 437 раз по сравнению с V1. Хранение такого кэша в видеопамяти — один из основных расходов при долгих сеансах кодирования. Вот почему дневные сеансы остаются в пределах доллара.
И для окружающей среды это, похоже, выигрыш. Использование Claude кажется расточительным, и дело не только в цене: из-за его кэширования DeepSeek должен потреблять меньше воды и электричества. Эта оптимизация кэша — также часть того, как Opus 5.5 тихо получил собственный прирост эффективности.
Да, есть подписки на frontier-модели. На работе предоставляют Claude, Cursor и другие инструменты. Здесь не о скупости. Речь идёт о долгосрочной стратегии, устойчивости и доступе к интеллекту. Это переломный момент.
Но tech-индустрия этого не видит. Ей кажется: если не платишь максимум, то не достоин качества. FAANG хочет тратить больше, чтобы получить больший интеллект. Неважно, этично ли это, дорого ли, плохо ли для окружающей среды или экономики. Дикий капитализм: выживает сильнейший. Отсюда сумасшедшие схемы — балансирование дюжины подписок Claude Max и жалобы, что их недостаточно.
Тем, кто запускает свои серверы: экономика 4.1 Flash такова, что самостоятельное развёртывание сейчас себя не окупает. Если целью только деньги, вложения не вернутся. Но если беспокоит приватность — подождите немного. Эти оптимизации кэша приходят и туда, и эта магия скоро будет работать локально. Уже сейчас 4.1 Flash технически можно запустить самостоятельно — просто непрактично пока. Но в любой день это изменится.