mimile
На главную

DeepSeek-V4-Flash: кодинг на уровне лидеров рынка при цене $0,28 за миллион токенов

AI-дайджест

Материал подготовлен искусственным интеллектом на основе нескольких источников — ссылки на оригиналы приведены ниже.

DeepSeek-V4-Flash: кодинг на уровне лидеров рынка при цене $0,28 за миллион токенов

Модель DeepSeek-V4-Flash достигает производительности, близкой к передовой, в задачах агентного программирования при стоимости 0,28 доллара за миллион выходных токенов — в то время как Claude Opus 4.8 обходится в 25 долларов. Архитектура сочетает смесь экспертов и гибридное разреженное внимание, что позволяет радикально снизить затраты на обслуживание.

Архитектура эффективности и ценообразование

DeepSeek-V4-Flash использует архитектуру «смесь экспертов», где на каждый токен активируется лишь небольшая часть параметров, и гибридное разреженное внимание — сочетание сжатого разреженного и head-wise сжатого внимания, — чтобы эффективно обрабатывать контексты до 1 миллиона токенов. Это обеспечивает стоимость вывода, составляющую лишь малую долю от затрат на плотные модели: 0,28 доллара за миллион выходных токенов против 25 долларов у Claude Opus 4.8 и 3–15 долларов у конкурентов из линейки GPT. Входные токены стоят 0,14 доллара, что делает задачи с длинным контекстом экономически оправданными. Подход DeepSeek показывает, что оптимизация способна сократить разрыв в производительности с передовыми моделями на 30–50% при снижении затрат на 99%.

Агентное программирование и практическое применение

На SWE-bench Verified, ключевом бенчмарке агентного кодинга, Flash набирает 36,6 балла, опережая GPT-4.1-mini (31,7) и уступая лишь 4 балла Claude Opus 4.8 (40,5). Модель сохраняет цепочки рассуждений между вызовами инструментов, повышая связность поведения агентов. Поддерживаются несколько режимов интенсивности рассуждений и API, совместимый с OpenAI, что упрощает миграцию существующих систем. Однако общие знания Flash уступают более крупным моделям, поэтому она менее пригодна для задач, требующих широкой эрудиции. Эксплуатационным командам всё равно необходимо изолировать вызовы bash-инструментов и отслеживать скрытые обновления модели.

Что дальше

Ожидается, что DeepSeek расширит доступность V4-Flash в региональных дата-центрах для снижения задержек и соблюдения требований к резидентности данных. Остаётся неясным, вызовет ли такое ценообразование гонку на понижение среди провайдеров или конкуренты сделают ставку на премиальные функции.

1 источник

DeepSeek-V4-Flash: кодинг на уровне лидеров рынка при цене $0,28 за миллион токенов