Статья

Токен подешевел в разы: что ценовая война ИИ даёт обычному пользователю

Токен подешевел в разы: что ценовая война ИИ даёт обычному пользователю

ProfileProfile·3 ч назад·
4
··1·
3DNews на этой неделе сформулировал то, что разработчики почувствовали ещё в июле: гонка ИИ-моделей превратилась в ценовую войну. OpenAI и Anthropic режут тарифы, и причина не в щедрости, а в китайских конкурентах — к ним, по данным издания, уже перешли DoorDash и Airbnb. Расходы клиентов двух американских лабораторий упали почти на четверть с середины июля. Новость хорошая, но у неё есть подкладка. Разберём по порядку: откуда берётся цена ИИ, почему она падает, что это меняет для человека и небольшой компании и где дешевизна выходит боком.

Что произошло летом 2026

Хроника снижений

24 июля Anthropic выпустила Claude Opus 5 — модель уровня флагмана ровно вдвое дешевле старшей Fable 5: 5 долларов за миллион входных токенов и 25 за миллион выходных против 10 и 50. По данным 3DNews, компания заодно отменила запланированное на сентябрь повышение цен на Sonnet 5, который идёт по вводному тарифу 2 и 10 долларов. 30 июля ответила OpenAI: младшая GPT-5.6 Luna подешевела на 80% — вход с 1 доллара до 0,20, выход с 6 до 1,20 за миллион токенов; средняя Terra потеряла 20% и стоит 2 и 12 долларов. Знаменатель общий: обе компании готовятся к выходу на биржу и должны показать инвесторам работающую экономику, а не только красивые бенчмарки. Ценовая война для них — проверка бизнес-модели на прочность, а не жест доброй воли.

Почему цену продавили снизу

Давление идёт не от конкуренции американских лабораторий между собой, а от нижнего яруса рынка: китайские модели и модели с открытыми весами подтянулись настолько, что для типовых задач разница в качестве перестала оправдывать разницу в счёте. Масштаб сдвига проще всего увидеть на цене за фиксированное качество. По расчётам Epoch AI, планка уровня GPT-3 на тесте общих знаний стоила 60 долларов за миллион токенов в ноябре 2021 года и 7 центов к октябрю 2024-го; уровень GPT-4 на научных вопросах PhD-сложности — 37,5 доллара в марте 2023-го против 12 центов в декабре 2024-го. Самое дешёвое API качества GPT-4 в июле 2026 года стоило 14 центов за миллион входных токенов против 30 долларов на старте самого GPT-4: падение примерно в 214 раз за сорок месяцев.

Из чего складывается цена токена

Железо, которое подешевело

Первая статья расходов — ускорители. Час аренды H100 в облаке стабилизировался в районе 2,85–3,50 доллара после падения на 64–75% от пиковых значений. Дефицит, два года диктовавший цены, из острого стал хроническим — и это само по себе сняло часть наценки. Важная деталь: карты покупают не за наличные, дата-центры строятся в кредит, и стоимость этих денег зашита в цену вашего запроса.

Электричество и загрузка

Электричество считается прозрачно: карта с тепловым пакетом 0,7 кВт, накладные расходы сервера ×1,8, эффективность дата-центра ×1,4, тариф 12 центов за киловатт-час — около 21 цента в час. На фоне трёх долларов за аренду немного, но счёт идёт на миллионы карто-часов. Дальше интереснее. Карта, загруженная на 20% и обрабатывающая запросы по одному, потребляет почти столько же, сколько загруженная на 80% с шестьюдесятью четырьмя параллельными запросами, — себестоимость токена при высокой загрузке оказывается вчетверо ниже. Отсюда любовь провайдеров к пакетной обработке со скидкой 50% и ночным тарифам: они продают время, когда железо всё равно крутится.

Размер модели и цена «думания»

Третий множитель — сама модель. Чем больше параметров активируется на каждый токен, тем дороже каждое слово ответа. Плюс модели «думают» перед ответом, и эти рассуждения тарифицируются как выходные токены — самые дорогие в прайсе. Отсюда разрыв: выход почти везде в 5–6 раз дороже входа. Вывод: длинный вопрос стоит копейки, длинный ответ — заметно дороже. Экономят не на том, что вы пишете модели, а на том, сколько просите написать в ответ.

Прайс-лист августа

Цены за миллион токенов, август 2026. Разброс между верхом и низом прайса — полсотни раз

Разброс в пятьдесят раз

Официальные тарифы Anthropic на середину августа: Fable 5 — 10 и 50 долларов за миллион входных и выходных токенов, Opus 5 — 5 и 25, Sonnet 5 — 3 и 15 по базовой цене и 2 и 10 по вводной, Haiku 4.5 — 1 и 5. У OpenAI: Terra — 2 и 12, Luna — 0,20 и 1,20. По агрегаторам цен (это сводки обзоров, а не официальные прайсы) Gemini 3 Pro идёт по 2 и 12 долларов на контексте до 200 тысяч токенов и по 4 и 18 сверх него, а лёгкие модели опускаются до 10 и 40 центов. Между верхней и нижней строчкой — пятидесятикратная разница, поэтому вопрос «сколько стоит ИИ» без указания задачи смысла не имеет.

Сколько стоит типичная задача

Расчёт редакции: одна и та же работа на трёх классах моделей
Переведём прайс в понятные вещи. Пересказ статьи на две тысячи слов — около трёх тысяч входных токенов и восьмисот выходных: от 13 копеек на дешёвой модели до трёх рублей на топовой. Дешевле, чем принято думать. Чат-бот поддержки для небольшого магазина: три тысячи обращений в месяц, по четыре тысячи входных токенов с историей и инструкцией и по четыреста выходных. Младшая модель — около четырёх долларов в месяц, средняя — тридцать восемь, топовая — девяносто. Разница ощутима, но неподъёмным не выглядит ни один вариант. Счётчик по-настоящему раскручивается на агентных задачах. Сорок шагов работы по коду с растущим контекстом — больше миллиона входных токенов за одну задачу: 34 цента на младшей модели, три доллара на средней, восемь на топовой. Умножьте на десяток задач в день, и получится статья расходов, о которой стоит думать заранее.

Что это меняет для человека и небольшой компании

Подписки: появился средний ярус

Для человека, который просто задаёт вопросы и читает ответы, падение цен на API проявляется через тарифы. Бесплатные уровни у крупных сервисов стали пригодными для жизни, а между «бесплатно» и классическими двадцатью долларами вырос средний ярус — планы за 5–8 долларов для тех, кто регулярно упирается в бесплатный потолок. Если ваша работа с ИИ это несколько десятков вопросов в день, полная подписка уже не обязательна. В Schai GPT логика та же, но на уровне интерфейса: уровень модели выбирается под задачу, а не покупается пакетом на месяц вперёд.

Малый бизнес: порог входа обвалился

Главное изменение — не в процентах скидки, а в том, что исчез разговор «сначала посчитаем экономику пилота». Бот поддержки за четыре доллара в месяц не требует обоснования перед финдиректором: его просто включают и смотрят. Разбор отзывов, черновики карточек товара, расшифровка звонков переехали из категории «проект» в категорию «настройка на вечер». Побочный эффект: если функция стоит четыре доллара, она есть у всех.

Три приёма, которые режут счёт

Первое — кэширование контекста. Если вы гоняете один и тот же большой промпт или базу знаний, повторное чтение из кэша стоит около 10% обычной цены входа при наценке 25% на запись: для бота с длинной инструкцией это снижение счёта в разы. Второе — маршрутизация. Классификацию, извлечение полей и короткие ответы прекрасно тянет младшая модель, старшую стоит звать на действительно сложное. Третье — контроль длины ответа. Выход дороже входа в пять-шесть раз, поэтому «коротко и по делу» экономит буквально деньги. То же с «думающим» режимом: включать его на каждую мелочь незачем.

Где экономия обманчива

Лимиты вместо цены

Самый частый подвох подписок: цена осталась прежней, а сколько за неё дают — вопрос открытый. У ChatGPT Plus это порядка 160 сообщений старшей модели за трёхчасовое окно; у Claude Pro — пятичасовое окно плюс недельный потолок по всем моделям сразу. Anthropic с августа 2025 года меняла лимиты минимум трижды: добавила недельный кап, весной сузила окна в часы пик и в конце марта 2026-го признала, что пользователи упираются в потолок быстрее ожидаемого. Вывод неприятный, но честный: тариф — это цена плюс политика лимитов, которая может измениться без предупреждения. И сервис люди меняют чаще из-за лимитов, чем из-за качества ответов.

Дешёвая модель на сложной задаче

Экономия в двадцать раз легко превращается в перерасход, если задача не по зубам выбранной модели. Дешёвая модель на сложном вопросе не отказывается — она отвечает уверенно и неправильно, а вы платите за несколько итераций уточнений плюс своё время на проверку. По ощущениям сэкономили, по факту заплатили дважды. Правило простое: чем выше цена ошибки, тем меньше смысла экономить на модели. Договор, медицинский вопрос, код в прод — территория старших моделей. В Schai GPT уровень переключается прямо в диалоге, и это дешевле, чем переделывать.

Зависимость от одного поставщика

Дешёвая модель соблазняет переписать под неё все процессы: промпты под её манеру, форматы ответов под её особенности, интеграции под её API. А потом поставщик меняет тариф, вводит лимиты, снимает модель с обслуживания или становится недоступен в вашей юрисдикции — и переезд обходится дороже всей годовой экономии. Противоядие: держать промпты нейтральными, не завязываться на фирменные форматы там, где хватит обычного JSON, и хотя бы раз проверить сценарий на модели другого поставщика.

Цены умеют не только падать

Иллюстрация случилась ровно на этой неделе. DeepSeek, тот самый источник ценового давления, с 16 августа поднимает тарифы в разы и вводит деление на пиковые и непиковые часы: выход у младшей модели дорожает с 28 центов до 1,32 доллара за миллион токенов в пик, старшая уходит к 3,96 доллара в пик и вдвое дешевле вне его. Формулировка компании — «более разумно распределить ресурсы». Снижение цен, как видим, не закон природы, а результат конкурентной ситуации: она меняется, а с ней и цифры в счёте.
Дешевеет не «ИИ вообще», а конкретный уровень качества. Верхняя планка при этом дорожает — она просто уезжает вверх.

Что делать прямо сейчас

Обычному пользователю — пересмотреть подписку: возможно, хватит бесплатного уровня или среднего яруса за пять-восемь долларов, а вы по инерции платите за прошлогодний расклад. Небольшому бизнесу — считать не тариф, а стоимость конкретной задачи: прикиньте объём в токенах и умножьте на прайс. Начинайте с младшей модели и поднимайтесь только там, где качество проседает. Тем, кто строит что-то серьёзное, — заложить двух поставщиков сразу, включить кэширование контекста и следить за расходом на одну завершённую задачу, а не за ценой токена. И главное: ценовая война — окно возможностей, а не новая нормальность. Пока стороны борются за клиента перед выходом на биржу, стоит попробовать то, на что раньше не хватало бюджета. Schai GPT здесь удобен тем, что даёт пощупать разные уровни моделей на своих реальных задачах, не разбираясь в прайс-листах трёх провайдеров сразу.
1

Пока нет комментариев

Токен подешевел: что ценовая война ИИ даёт пользователю