Часы пик DeepSeek выдали географию пользователей
Последние недели в США активно обсуждали экспансию китайских моделей с открытыми весами и опасались, что американский бизнес массово перейдёт на них.
Однако новая схема тарификации DeepSeek с наценкой в часы пик косвенно показывает обратное – основная аудитория лаборатории по-прежнему находится в Азии.
В конце июля DeepSeek выпустила обновлённую версию модели облегчённого класса под названием V4-Flash-0731. При 284 миллиардах параметров она демонстрирует результаты, сопоставимые с Opus 4.8 от Anthropic, которая, по распространённым оценкам, оперирует триллионами параметров.
Стартовый ценник выглядел агрессивно даже по меркам китайского рынка – 0,14 доллара за миллион входных токенов и 0,28 доллара за миллион выходных. На прошлой неделе к линейке добавилась V4-Pro, доступная через API и чат по цене 0,435 доллара за миллион входных токенов и 0,87 доллара за миллион выходных.
Судя по предварительным замерам, опубликованным в WeChat, V4-Pro обходит Opus 4.8 в бенчмарках Terminal Bench 2.1, Cybergym, DeepSWE и AutomationBench. При этом вычислительных мощностей лаборатории явно не хватает – в июле DeepSeek уступала по объёму обработанных токенов только Anthropic и в ближайшие месяцы может выйти на первое место.
Именно дефицит ресурсов и заставил компанию ввести раздельные тарифы для загруженных и разгруженных часов:
V4-Flash, вход – с 0,14 доллара до 0,22 доллара вне пика и 0,44 доллара в пик за миллион токенов
V4-Flash, выход – с 0,28 доллара до 0,66 доллара вне пика и 1,32 доллара в пик
V4-Pro, вход – с 0,435 доллара до 0,66 доллара вне пика и 1,32 доллара в пик
V4-Pro, выход – с 0,87 доллара до 1,98 доллара вне пика и 3,96 доллара в пик
Ключевая деталь скрыта в расписании. Пиковые окна у DeepSeek приходятся на 09:00–12:00 и 14:00–16:00 по пекинскому времени, то есть нагрузка растёт в азиатский рабочий день, а не в американский. Это указывает на то, что западные корпоративные клиенты пока не составляют основу трафика.
Параллельно свои позиции укрепляет Alibaba, недавно представившая сразу две модели поколения Qwen 3.8. Флагманская Qwen 3.8-Max на 2,8 триллиона параметров уступает по производительности только Kimi K3 от Moonshot.
Ещё интереснее выглядит компактная версия Qwen 3.8 на 27 миллиардов параметров, которая по качеству кодинга приближается к Opus 4.5 и при этом запускается на одном MacBook. В тесте WeirdML вариант Qwen 3.8 2.4T A95B (xhigh) набирает 75,2% и занимает второе место среди открытых моделей после Kimi-K3, хотя расходует много токенов на рассуждения и пишет очень длинный код.
Поскольку китайские открытые модели вплотную подобрались к возможностям закрытых решений OpenAI и Anthropic, их популярность растёт стремительно. По данным Hugging Face, одного из крупнейших репозиториев открытых моделей, на семейство Qwen приходится 151 448 производных загрузок.
- Китайский суд запретил увольнять сотрудников ради замены на ИИ
- Семья в Китае создала ИИ-клона умершего сына, чтобы утешить пожилую мать
- Сотня беспилотных роботакси заблокировала улицы Уханя из-за массового сбоя системы