Цена на искусственный интеллект достигла нового минимума. По данным исследовательской компании Artificial Analysis из Сан-Франциско, запуск стандартного набора бенчмарк-тестов DeepSeek V4-Flash, официально выпущенного в пятницу, обходится примерно в три цента . Kimi K3 от Moonshot AI стоит 86 центов ; GPT-5.6 Sol от OpenAI — 1,86 доллара ; а Claude Fable 5 от Anthropic, лучшая в отрасли модель, — 3,15 доллара . В действительности, китайская модель более чем в 100 раз дешевле в эксплуатации, чем американский флагман, сообщает Reuters .

V4-Flash — самая дешевая и известная модель в мире , причем с большим отрывом. Эта цифра еще более поразительна из-за детали, скрытой в описании компании: V4-Flash необычайно многословна. Она потребляет большое количество токенов, но при этом ее цена составляет всего три цента. Вся работа выполняется ценой за токен.
Та же компания предоставляет оговорку. V4-Flash набирает 50 из 100 баллов по индексу искусственного интеллекта , который представляет собой совокупность девяти показателей, охватывающих программирование, логическое мышление и рабочие задачи. Это соответствует результату Google Gemini 3.6 Flash и на один балл отстает от Meta Muse Spark 1.1 и Zhipu GLM-5.2. Kimi K3 от Moonshot набирает 57 баллов, в то время как Claude Opus 5 и Fable 5 от Anthropic, а также GPT-5.6 от OpenAI, набирают как минимум на девять баллов больше .
Тем не менее, V4-Flash отлично справляется с рутинными задачами, но основные задачи по-прежнему остаются в руках моделей нового поколения. В сложных, многоэтапных процессах работы с агентами небольшие пробелы в надежности на каждом этапе приводят к огромным сквозным различиям. По сути, таково текущее положение дел с ценообразованием моделей нового поколения. Но для рутинного объема данных, составляющего большую часть производственного трафика — суммирование, шаблонный код и автоматизация бэк-офиса — V4-Flash является оптимальным решением.
Китайский ножевой бой
Цена V4-Flash в 3 цента — это четвертый выстрел в 18-дневной волне : китайские лаборатории ИИ борются друг с другом за долю на внутреннем рынке, и это приводит к переоценке рынка моделей повсюду. 16 июля Moonshot выпустила Kimi K3, модель с 2,8 триллионами параметров, которая быстро заняла первое место в рейтинге Frontend Code на Arena, обогнав Fable 5 и GPT-5.6 Sol. 19 июля Alibaba в спешке представила предварительную версию Qwen3.8-Max на Всемирной конференции по ИИ в Шанхае. Цены, характеристики модели не были указаны, а утверждение о том, что она занимает «второе место после Fable 5», основывалось на внутренних оценках Alibaba .
27 июля Moonshot ответила, открыв исходный код всех весов K3, что стало крупнейшим релизом открытых весов в истории. DeepSeek выпустила V4-Flash 31 июля. Затем 3 августа — в понедельник, в то же утро, когда вышла статья Reuters, — Alibaba выпустила Qwen3.8-Max в общий доступ : 2,4 триллиона параметров, 95 миллиардов активных параметров, контекстное окно в один миллион токенов и фиксированная цена в 2 доллара за миллион входных токенов и 6 долларов за миллион выходных токенов, без надбавки за длительный контекст.
Ноутбук Qwen быстро занял 4-е место в рейтинге Frontend Code Arena с 1668 баллами — на один балл меньше, чем у Claude Opus 5 (высокопроизводительный), на восемь баллов меньше, чем у Kimi K3, и больше, чем у Fable 5 (1630 баллов) и GPT-5.6 Sol (1620 баллов). Из пяти моделей, которые Arena относит к категории «соотношение цены и производительности» по Парето, четыре — китайские : Kimi K3, Qwen3.8-Max, GLM-5.2 и V4-Flash. Единственная американская модель, Opus 5, занимает самую дорогую позицию, удерживая 37 баллов Elo.
В таблице результатов собственных тестов Alibaba ситуация более откровенная. Qwen3.8-Max превосходит Fable 5 и Opus 4.8 в Terminal-Bench (86,6 против 84,6), но значительно отстает в тестах на разработку сложных репозиториев: в SWE-bench Pro он набирает 67,7 балла против 80,0 у Fable 5. Преимущество, основанное на предпочтениях в кодировании, исчезло. Преимущество в глубокой разработке остается нетронутым — пока что.
Всё это поднимает более фундаментальный вопрос: кто платит за выводы, сделанные с точностью до трёх центов?
До этой весны DeepSeek никогда не привлекала внешних инвестиций. Основатель Лян Вэньфэн финансировал компанию через свой количественный фонд High-Flyer. В конце мая DeepSeek закрыла свой первый раунд внешнего финансирования — более 50 миллиардов юаней, или примерно 7,4 миллиарда долларов, при оценке компании выше 50 миллиардов долларов , как впервые сообщило издание The Information.
Структура этого раунда необычна. Коммерческие инвесторы, как сообщается, во главе с Tencent и CATL , приобрели долю в товариществе с ограниченной ответственностью, контролируемом Ляном, без права голоса и с пятилетним периодом блокировки. Только одна сторона получила прямой доступ к акциям и право голоса: китайский государственный Национальный инвестиционный фонд в сфере искусственного интеллекта . В течение нескольких недель DeepSeek вела переговоры о последующем раунде финансирования на сумму около 71 миллиарда долларов, средства от которого были направлены на развитие центров обработки данных и микросхем.
Добавьте к этому 75-процентную скидку на API, которую компания закрепила на постоянной основе ранее в этом году, и схема начнет напоминать промышленную политику, проводимую через API: привилегированный государством капитал гарантирует выпуск токенов по цене ниже себестоимости для завоевания глобальной доли рынка. Это работает: в июне на долю DeepSeek приходилось почти 23% из десятков триллионов токенов, прошедших через корпоративный шлюз искусственного интеллекта Vercel, по сравнению с 32% у Anthropic .
Тем временем...
Как мы (и теперь Уолл-стрит) отмечали , Индекс расходов токенов — средневзвешенное значение того, сколько рынок платит за миллион токенов, рассчитанное на основе данных с новых API и открытых платформ, — достиг пика выше 2,0 в мае, почти удвоившись с момента запуска в декабре, и теперь снижается .
Стратег Андреас Стено Ларсен назвал это событие тем, за которым все должны следить , предупредив, что устойчивое снижение цен на токены положит конец торговле памятью, оборудованием и центрами обработки данных в этом цикле . Индекс в последний раз показал значение 1,3394, примерно на треть ниже своего майского максимума. В начале июля Bloomberg указал на это как на свидетельство того, что поставщики ИИ теряют ценовую власть у все более чувствительных к стоимости клиентов; в комментариях Silicon Data это было истолковано как возвращение использования к моделям с открытым весом.
Также актуален вопрос противодействия центрам обработки данных на фоне инвестиционного бума, превышающего 700 миллиардов долларов. Как мы сообщали в прошлом месяце, от общенациональных протестов 18 июля, организованных ветераном движения «Чайная партия» Эми Кремер и её организацией Humans First, до углубляющегося раскола внутри республиканской коалиции по вопросам земли, воды и энергетики — в обсуждение вмешалась внутренняя политика , с которой Пекину не приходится иметь дело, — поэтому теперь у них есть трёхцентовый эталон, финансируемый на условиях, недоступных ни одной западной лаборатории . Благодаря открытому доступу к весам, он также совместим с американскими кремниевыми чипами, где американские поставщики решений для обработки данных с удовольствием будут предоставлять китайским моделям по товарным ценам . Экспортный контроль не может ограничить набор весов в этом потоке.
Наиболее перспективной моделью является V4-Pro, более ресурсоемкая система, которую DeepSeek подтвердила, не назвав дату выпуска. Цена Flash в три цента оказывает давление на бюджетные сегменты OpenAI и Google. Если Pro приблизится к показателям передовых технологий по ценам DeepSeek, то оставшиеся 37 пунктов рейтинга Эло — и надбавка за передовые технологии, которую OpenAI и Anthropic взимают для финансирования разработки — окажутся под угрозой.


Комментариев нет:
Отправить комментарий