DeepSeek анонсировала три связанных обновления 12–13 августа 2026 года: open-source агентный фреймворк Harness v0.1 под MIT-лицензией, выход флагманской модели V4 Pro в общую доступность и введение с 16 августа нового ценообразования с пиковыми и непиковыми часами, которое удвоит стоимость output-токенов.


Что произошло
Выпущен DeepSeek Harness v0.1 — open-source фреймворк для агентов с архитектурой «всё есть плагин»: модели, инструменты, агенты и UI заменяются через конфигурацию без изменения кода. Харнес работает поверх meta-фреймворка Cordis (модель обратимых эффектов). Репозиторий набрал 27 900 звёзд на GitHub. Одновременно модель DeepSeek V4 Pro (билд 0813) вышла из превью в GA: архитектура Sparse MoE, 1.6 трлн параметров с 49 млрд активных на токен, контекст до 1 млн токенов. Результаты на бенчмарках: SWE-bench Verified 80.6%, GPQA Diamond 90.1%, LiveCodeBench 93.5%. С 16 августа вводится тарификация по пиковым и непиковым часам: V4 Pro output вырастет с $0.87/млн до $1.98/млн в непиковое время и $3.96/млн в пиковое (01:00–04:00 и 06:00–10:00 UTC), стоимость input-токенов вырастет примерно в 1.5 раза.
Контекст
DeepSeek Harness — первая попытка компании-разработчика моделей предложить открытый агентный фреймворк с архитектурой на основе Cordis, что может стать стандартом для plugin-first агентов, аналогично тому, как LangChain и Agents стали стандартом для chain-архитектуры в 2023–2024. Веса V4 Pro опубликованы под MIT-лицензией, что позволяет локальный деплой и fine-tuning. Коеффициент разреженности архитектуры V4 Pro составляет примерно 32.7:1 (1.6 трлн / 49 млрд активных), что требует серьёзной оптимизации роутинга, особенно при контексте в 1 млн токенов. До этого DeepSeek проводила агрессивную ценовую политику: модель V4 Flash обрабатывала до 8 трлн токенов в день, и теперь инфраструктура уперлась в GPU-ёмкость.
Почему это важно для индустрии
Повышение цен до 2.2x за output-токены сигнализирует о конце фазы демпинга на рынке API: DeepSeek переходит от ценовой экспансии к управлению нагрузкой через ценовую эластичность. Модель пиковых/непиковых часов, вероятно, будет скопирована другими провайдерами. Открытие весов V4 Pro под MIT и выпуск Harness создаёт окно для стартапов: можно строить решения на бесплатных весах и открытом фреймворке, но нужно готовиться к росту расходов на managed API. Если Harness достигнет стабильной версии и наберёт экосистему плагинов, он может стать де-факто стандартом для агентных приложений.
Почему это важно для пользователей
Пользователям DeepSeek API необходимо до 16 августа пересчитать бюджеты, перенести batch-задачи в непиковые часы и настроить резервных провайдеров для fallback. Harness доступен для тестирования прямо сейчас через команду npx @deepseek-ai/dsh web (требуется Node.js). Он работает не только с моделями DeepSeek, но и с OpenAI, Anthropic, Vertex и другими провайдерами через OpenAI-совместимые эндпоинты. Веса V4 Pro доступны на HuggingFace — можно начать локальный деплой и fine-tuning без привязки к API.
Что пока неизвестно / ограничения
Отсутствует методологический документ для V4 Pro: бенчмарки приведены как готовые цифры без описания условий тестирования. Неизвестно, использовался ли chain-of-thought, применялось ли multiple-attempt evaluation, и при каких условиях запускались тесты. Результаты SWE-bench Verified 80.6% и GPQA Diamond 90.1% не верифицированы независимыми лабораториями.
Источники
- DeepSeek Harness — GitHub (deepseek-ai/deepseek-harness)
- DeepSeek Ships V4 Pro as Its Flagship Model Leaves Preview — Unite.AI
- Models & Pricing — DeepSeek API Docs
Автор
Look at AI, редакция
