Часы пик DeepSeek выдали географию пользователей

Последние недели в США активно обсуждали экспансию китайских моделей с открытыми весами и опасались, что американский бизнес массово перейдёт на них.

Однако новая схема тарификации DeepSeek с наценкой в часы пик косвенно показывает обратное – основная аудитория лаборатории по-прежнему находится в Азии.

В конце июля DeepSeek выпустила обновлённую версию модели облегчённого класса под названием V4-Flash-0731. При 284 миллиардах параметров она демонстрирует результаты, сопоставимые с Opus 4.8 от Anthropic, которая, по распространённым оценкам, оперирует триллионами параметров.

Стартовый ценник выглядел агрессивно даже по меркам китайского рынка – 0,14 доллара за миллион входных токенов и 0,28 доллара за миллион выходных. На прошлой неделе к линейке добавилась V4-Pro, доступная через API и чат по цене 0,435 доллара за миллион входных токенов и 0,87 доллара за миллион выходных.

Судя по предварительным замерам, опубликованным в WeChat, V4-Pro обходит Opus 4.8 в бенчмарках Terminal Bench 2.1, Cybergym, DeepSWE и AutomationBench. При этом вычислительных мощностей лаборатории явно не хватает – в июле DeepSeek уступала по объёму обработанных токенов только Anthropic и в ближайшие месяцы может выйти на первое место.

Именно дефицит ресурсов и заставил компанию ввести раздельные тарифы для загруженных и разгруженных часов:

  • V4-Flash, вход – с 0,14 доллара до 0,22 доллара вне пика и 0,44 доллара в пик за миллион токенов

  • V4-Flash, выход – с 0,28 доллара до 0,66 доллара вне пика и 1,32 доллара в пик

  • V4-Pro, вход – с 0,435 доллара до 0,66 доллара вне пика и 1,32 доллара в пик

  • V4-Pro, выход – с 0,87 доллара до 1,98 доллара вне пика и 3,96 доллара в пик

Ключевая деталь скрыта в расписании. Пиковые окна у DeepSeek приходятся на 09:00–12:00 и 14:00–16:00 по пекинскому времени, то есть нагрузка растёт в азиатский рабочий день, а не в американский. Это указывает на то, что западные корпоративные клиенты пока не составляют основу трафика.

Параллельно свои позиции укрепляет Alibaba, недавно представившая сразу две модели поколения Qwen 3.8. Флагманская Qwen 3.8-Max на 2,8 триллиона параметров уступает по производительности только Kimi K3 от Moonshot.

Ещё интереснее выглядит компактная версия Qwen 3.8 на 27 миллиардов параметров, которая по качеству кодинга приближается к Opus 4.5 и при этом запускается на одном MacBook. В тесте WeirdML вариант Qwen 3.8 2.4T A95B (xhigh) набирает 75,2% и занимает второе место среди открытых моделей после Kimi-K3, хотя расходует много токенов на рассуждения и пишет очень длинный код.

Поскольку китайские открытые модели вплотную подобрались к возможностям закрытых решений OpenAI и Anthropic, их популярность растёт стремительно. По данным Hugging Face, одного из крупнейших репозиториев открытых моделей, на семейство Qwen приходится 151 448 производных загрузок.

Больше статей на Shazoo
Тэги:

Об авторе

Эксперт по Fallout
Главный редактор
Более 16 лет в индустрии освещения видеоигр, кино, сериалов, науки и техники. Особенно разбираюсь в серии Fallout, ценитель The Elder Scrolls. Поклонник Arcanum и Fallout Tactics. Больше всего играю в Civilization, Old World и градостроители. Изучаю ИИ и загадки космоса.