Блог о безопасности FireAI

Автор FireAI Security & Research Team · Опубликовано

Сколько стоил ИИ-токен с 2022 по 2026 год: OpenAI, Anthropic и DeepSeek

Сколько стоил ИИ-токен с 2022 по 2026 год: OpenAI, Anthropic и DeepSeek

Токен — это примерно три четверти английского слова, объясняла собственная страница цен OpenAI ещё в 2022 году, сразу после того, как отмечала, что предложение из 35 токенов стоит долю цента. Эта формулировка едва ли выдерживает столкновение с 2026 годом: самые маленькие модели теперь стоят долю доли цента за токен, самые крупные — пятьдесят долларов за миллион выходных токенов, а три поставщика — OpenAI, Anthropic и DeepSeek — каждый по несколько раз снижали, повышали, делили и заново перекраивали свои цены. Каждая цифра ниже взята со страницы, которую мы открыли сами: либо с текущей страницы цен поставщика, либо со снимка той же страницы в Internet Archive на указанную дату. Там, где мы вычисляем соотношение, оба числа, из которых оно строится, приведены в том же абзаце.

OpenAI, с 2022 по 2026 год

В ноябре 2022 года на странице цен OpenAI были перечислены четыре базовые модели — Ada, Babbage, Curie и Davinci, — каждая с одинаковой ценой за любой токен независимо от того, был он частью промпта или вывода: разделения на вход и выход тогда ещё не было. Davinci, самая способная из четырёх, стоила 0,02 доллара за 1000 токенов. Текущая страница OpenAI с устаревшими моделями независимо подтверждает именно эту цифру — 20,00 доллара за миллион токенов — как цену, по которой text-davinci-003 (конкретная модель, построенная на этом тарифе) тарифицировалась вплоть до отключения в 2024 году. Четырьмя месяцами позже была запущена GPT-4 по цене 0,03 доллара за 1000 токенов промпта и 0,06 доллара за 1000 токенов вывода для версии с контекстом 8K, удваиваясь до 0,06 и 0,12 доллара для версии с контекстом 32K — впервые в публичных ценах OpenAI выходные токены стоили дороже входных. gpt-3.5-turbo была запущена в том же месяце по единой цене 0,002 доллара за 1000 токенов, тоже без разделения на вход и выход.

Официальные цены OpenAI. Строки «текущая» — на дату публикации этой статьи.
МодельВход, $/1МВыход, $/1МЦена по состоянию наИсточник
text-davinci-003$20.00$20.00нояб. 2022архивная страница цен
gpt-3.5-turbo (запуск)$2.00$2.00март 2023архивная страница цен
GPT-4, контекст 8K (запуск)$30.00$60.00март 2023архивная страница цен
gpt-4o-2024-05-13 (запуск)$5.00$15.00май 2024документация OpenAI по ценам
o1 (модель рассуждений)$15.00$60.00текущий прайс-листдокументация OpenAI по ценам
gpt-4o (текущая цена)$2.50$10.00текущаядокументация OpenAI по ценам
gpt-6-luna (самая дешёвая текущая)$0.10$0.50текущаядокументация OpenAI по ценам
gpt-6-astra (текущий флагман)$10.00$50.00текущаядокументация OpenAI по ценам

Два сравнения, оба построены только на приведённых выше строках: цена входа text-davinci-003 в 20,00 доллара против текущих 0,10 доллара у gpt-6-luna — это падение в 200 раз примерно за четыре года, если сравнивать самый дешёвый доступный тариф OpenAI в каждый момент времени. А исходная цена входа GPT-4 в 30,00 доллара против текущих 10,00 доллара у gpt-6-astra — это падение всего в 3 раза при сравнении флагмана с флагманом: дешёвый тариф падал куда быстрее дорогого. Сама gpt-4o была переоценена в сторону снижения после запуска — с 5,00/15,00 доллара в мае 2024 года до 2,50/10,00 доллара сегодня, — что является простым случаем, когда та же самая модель подешевела, вообще не изменив своих возможностей.

Anthropic, с 2023 по 2026 год

Самый ранний прайс-лист Anthropic для разработчиков, который нам удалось найти, — архивный PDF от июля 2023 года — оценивал Claude 2, запущенный в том же месяце, в 11,02 доллара за миллион входных токенов и 32,68 доллара за миллион выходных, и отмечал, что Claude 1 остаётся доступной по той же цене. Claude Instant, дешёвый тариф того времени, стоил 1,63 доллара на входе и 5,51 доллара на выходе. К началу 2024 года, до выхода Claude 3, архивный снимок показывает, что Claude 2.0 и 2.1 подешевели до 8,00/24,00 доллара, а Instant — до 0,80/2,40 доллара, — скромное снижение цен на существующую линейку. Claude 3, запущенная в марте 2024 года, полностью обнулила нижнюю границу диапазона: Haiku вышла по цене 0,25/1,25 доллара — намного ниже всего, что Anthropic предлагала раньше, — а Sonnet и Opus были запущены по 3,00/15,00 доллара и 15,00/75,00 доллара. Claude 3.5 Sonnet, тремя месяцами позже, была запущена ровно по той же цене 3,00/15,00 доллара, что и Claude 3 Sonnet, — случай, когда цена осталась неизменной, пока сама модель улучшалась.

Официальные цены Anthropic, Claude API.
МодельВход, $/1МВыход, $/1МЦена по состоянию наИсточник
Claude 1 / Claude 2 (одинаковая цена)$11.02$32.68июль 2023архивный PDF с ценами
Claude Instant$1.63$5.51июль 2023архивный PDF с ценами
Claude 2.0 / 2.1 (после снижения цены)$8.00$24.00февр. 2024архивный PDF с ценами
Claude 3 Haiku (запуск)$0.25$1.25март 2024архивная страница API
Claude 3 Sonnet (запуск)$3.00$15.00март 2024архивная страница API
Claude 3 Opus (запуск)$15.00$75.00март 2024архивная страница API
Claude 3.5 Sonnet (запуск)$3.00$15.00июнь 2024архивный снимок страницы цен
Haiku 4.5 (текущая самая дешёвая)$1.00$5.00текущаяцены Claude
Sonnet 5 (текущая)$2.00$10.00текущаяцены Claude
Fable 5.1 (текущий флагман)$10.00$50.00текущаяцены Claude

Здесь кривая не просто падает. Claude 3 Haiku была запущена по цене входа 0,25 доллара в марте 2024 года; текущая самая дешёвая модель Anthropic, Haiku 4.5, стоит 1,00 доллара — в четыре раза дороже за токен, чем дешёвый тариф двухлетней давности. Если смотреть на это отдельно, кажется, что ИИ подорожал. Если смотреть в контексте остальной статьи, картина другая: Anthropic сохранила цену за токен своего нижнего тарифа примерно неизменной или слегка возросшей, сделав этот тариф гораздо более способным, а также добавила новый, более дорогой флагманский тариф (Fable 5.1 по 10,00/50,00 доллара) выше того, что раньше было верхней границей — Opus. Линейка обзавелась новыми тарифами, а не просто равномерно подешевела.

DeepSeek и ценовой шок моделей рассуждений

DeepSeek вышла на этот рынок с ценами, уже значительно ниже, чем у двух конкурентов. В мае 2024 года её архивная страница цен показывает deepseek-chat на базе DeepSeek-V2 по единой цене 0,14 доллара на входе и 0,28 доллара на выходе — дешевле всего, что на тот момент предлагали OpenAI или Anthropic, до того как кто-либо из них выпустил токен дешевле 0,25 доллара. К декабрю 2024 года deepseek-chat был обновлён на месте до DeepSeek-V3, и на странице цен DeepSeek появилось разделение на попадание и промах кеша: архивный снимок показывает стандартную (после окончания акции) ставку в 0,07 доллара за вход при попадании в кеш, 0,27 доллара за вход при промахе и 1,10 доллара за выход. Затем, 20 января 2025 года, DeepSeek выпустила модель рассуждений R1 по цене 0,14 доллара за вход при попадании в кеш, 0,55 доллара при промахе и 2,19 доллара за выход — архивный снимок восемь дней спустя подтверждает эту цену, прямо исключённую из любых промоакционных скидок.

Официальные цены DeepSeek; текущие строки показывают тариф вне пиковых часов (DeepSeek, наоборот, делает скидку на непиковое время — см. ниже).
МодельВход, $/1М (попадание / промах кеша)Выход, $/1МЦена по состоянию наИсточник
DeepSeek-V2 (deepseek-chat)единая $0.14$0.28май 2024архивная страница цен
DeepSeek-V3 (deepseek-chat, стандартная ставка)$0.07 / $0.27$1.10дек. 2024архивная страница цен
DeepSeek-R1 (deepseek-reasoner, запуск)$0.14 / $0.55$2.19янв. 2025архивная страница цен
deepseek-flash (текущая, вне пика)$0.003 / $0.15$0.60текущаядокументация DeepSeek по ценам
deepseek-v4-pro (текущая, вне пика)$0.022 / $0.66$1.98текущаядокументация DeepSeek по ценам

Запуск R1 — самая резкая цифра во всей этой статье: 2,19 доллара за выход против 60,00 доллара за выход у o1 от OpenAI, сопоставимой модели рассуждений, — разрыв в 27 раз, обе цифры взяты из таблиц выше. Именно это сравнение сделало R1 темой, вышедшей далеко за пределы обычной аудитории разработчиков в январе 2025 года. Также стоит отметить, что говорят собственные цифры DeepSeek конкретно о рассуждениях: цена выхода R1 в 2,19 доллара примерно вдвое выше, чем 1,10 доллара у V3, — внутри одного и того же поставщика, в один и тот же момент времени. Рассуждение по цепочке мыслей не просто добавляет ценовой множитель на уровне API: собственная документация DeepSeek отмечает, что число выходных токенов модели рассуждений включает каждый токен её цепочки рассуждений, а не только итоговый ответ, так что запрос с рассуждением расходует гораздо больше выходных токенов, чем прямой, ещё до применения цены за токен. А текущие цены DeepSeek добавляют механизм, которым не пользуется ни один другой поставщик: ставки в часы пик примерно вдвое выше ставок вне пиковых часов для одной и той же модели — форма ценообразования по спросу, ближе к тарификации электричества, чем к фиксированному прайс-листу.

Закономерность, которую скрывают голые цифры

Если нанести цифры самого дешёвого доступного токена всех трёх поставщиков на одну временную шкалу, форма получится не плавной кривой. Дешёвый тариф OpenAI падал с 20,00 доллара (нояб. 2022) до сегодняшних 0,10 доллара практически монотонно. Дешёвый тариф Anthropic резко упал один раз — с 1,63 доллара (2023, Claude Instant) до 0,25 доллара (март 2024, Claude 3 Haiku), — а затем вырос обратно до 1,00 доллара (сейчас, Haiku 4.5), по мере того как этот тариф становился более способным. DeepSeek вышла на рынок уже дешёвой и такой осталась, добавив сверху ценообразование по времени суток. Кривые всех трёх поставщиков не похожи друг на друга, и ни одна из них не похожа на простое экспоненциальное снижение, если отслеживать конкретный тариф, а не «как бы ни называлась самая дешёвая модель в этом году».

Выход стоит дороже входа, и разрыв увеличился

При запуске GPT-4 в марте 2023 года выход стоил ровно вдвое дороже входа: 60,00 доллара против 30,00 доллара. Если посмотреть на текущие флагманские и средние модели у всех трёх поставщиков, разрыв увеличился: у gpt-6-astra он составляет 5 раз (50,00 против 10,00 доллара), Claude 3 Opus была запущена с разрывом в 5 раз (75,00 против 15,00 доллара) и сохранила его вплоть до Haiku 4.5 (5 раз, 5,00 против 1,00 доллара), а стандартная ставка DeepSeek-V3 — примерно 4 раза (1,10 против 0,27 доллара при промахе кеша). Обычное техническое объяснение — архитектурное, а не коммерческое: генерация выходных токенов происходит по одному, авторегрессивно, тогда как входные токены промпта можно обработать параллельно за один прямой проход, поэтому реальная вычислительная стоимость провайдера за выходной токен выше, чем за входной, и цены со временем сместились в сторону более точного отражения этого разрыва, чем изначальное, более округлое соотношение в 2 раза у GPT-4.

Скидки на кеш и пакетную обработку

Все три поставщика теперь дают скидку на токены, которые модель фактически уже видела. Текущая страница цен OpenAI указывает кешированный вход gpt-6-astra по 1,00 доллара против стандартной ставки входа в 10,00 доллара — скидка в 10 раз за повторное использование идентичного префикса промпта, — и отдельно указывает, что её Batch API обрабатывает запросы в течение 24-часового окна за половину стандартной синхронной цены для подходящих моделей. Текущие цены Anthropic показывают цену чтения из кеша промпта у Fable 5.1 в 0,25 доллара против стандартной ставки входа в 10,00 доллара — в 40 раз дешевле, — при этом запись в кеш стоит 12,50 доллара, с наценкой к стандартной ставке в 10,00 доллара, поскольку запись новой записи кеша требует реальной дополнительной работы в первый раз. Разделение DeepSeek на попадание и промах кеша, описанное выше, встроено в базовые цены, а не предлагается как отдельная функция: ставка попадания в кеш у R1 в 0,14 доллара против ставки промаха в 0,55 доллара — это разница примерно в 4 раза при каждом отдельном вызове, а не только при запросах с явным включением. Для любой нагрузки, повторяющей длинный системный промпт или фиксированный набор описаний инструментов во множестве вызовов — конвейер триажа безопасности, классифицирующий одну строку лога за другой по одним и тем же инструкциям, хороший пример, — эти скидки меняют, какой поставщик дешевле, сильнее, чем заявленная цена за токен.

Парадокс Джевонса: почему более дешёвые токены увеличили общие расходы

В 1865 году экономист Уильям Стэнли Джевонс опубликовал книгу «Угольный вопрос», в которой утверждал, что потребление угля в Британии выросло, а не упало, после того как более экономичный паровой двигатель Джеймса Уатта сделал работу на угле дешевле. Вот как обобщает этот аргумент статья в Википедии, напрямую цитируя Джевонса:

Это путаница понятий — полагать, что экономичное использование топлива равнозначно снижению его потребления. Истина прямо противоположна.

Уильям Стэнли Джевонс, 1865 год, по цитате в Википедии: парадокс Джевонса

Этот аргумент, впоследствии обобщённый далеко за пределы угля, состоит в том, что повышение эффективности использования ресурса снижает его фактическую цену, а более низкая цена увеличивает спрос сильнее, чем экономит выигрыш в эффективности, — так что общее потребление растёт. Согласно тому же обобщению в Википедии, именно этот аргумент широко приводился в начале 2025 года вокруг дешёвой модели R1 от DeepSeek, а среди упомянутых комментаторов, обсуждавших, сократит или увеличит радикально более дешёвый инференс ИИ общие ресурсы, тратящиеся на ИИ, были генеральный директор Microsoft Сатья Наделла и экономист Эрик Бриньолфссон. Здесь мы опираемся на этот вторичный обзор именных комментариев, а не на первичное экономическое исследование, измеряющее совокупный эффект, и утверждение о том, что расходы отрасли на ИИ в целом растут именно из-за более дешёвых токенов, а не вопреки отдельному, не связанному с этим буму спроса, — спорная интерпретация, а не устоявшийся статистический факт. Что таблицы цен выше подтверждают напрямую, так это предпосылку этого аргумента: один и тот же запрос, который в 2022 году стоил десятки долларов вычислений, сегодня может стоить центы — у любого поставщика, — а это именно тот вид обвала цен, который исторически предшествовал росту потребления, а не его снижению.

Что это значит для запуска ИИ локально вместо облака

Каждая цена в этой статье — это тарифицируемая, поштучная стоимость, которую выставляет компания, обязательно получающая ваш промпт, чтобы на него ответить, — именно так устроен вызов API. У модели, которая целиком работает на вашем собственном устройстве, нет счёта за токен после того, как вы один раз заплатили за неё или скачали её, и ей нечего никуда отправлять, потому что в пути запроса вообще нет удалённой конечной точки. Это не утверждение, что модели на устройстве сравнимы по возможностям с передовыми тарифами, оценёнными выше: модель, достаточно маленькая, чтобы комфортно работать на ноутбуке, не превзойдёт по рассуждению Fable 5.1 или gpt-6-astra. Это другой компромисс: фиксированная стоимость и твёрдая граница приватности в обмен на те возможности, которые помещаются в реально имеющуюся у вас память.

Этот компромисс не абстрактен — тот же самый выбор делает небольшая, узко специализированная модель на устройстве внутри программы безопасности. FireAI, файрвол HisnLabs для Mac, поставляется с опциональной локальной моделью, единственная задача которой — проверять соединение от приложения, для которого ещё нет правила, — задача с гораздо более узким охватом, чем что-либо из оценённого в таблицах выше, и такая, где модель работает прямо на Mac, а не вызывает ни один из этих API. Смысл настолько подробного разбора истории цен OpenAI, Anthropic и DeepSeek не в том, чтобы продать это архитектурное решение, а в том, чтобы сделать компромисс конкретным: облачные токены между 2022 и 2026 годом покупали намного больше возможностей за намного меньшие деньги, и на каждой из этих ценовых точек их использование по-прежнему означало отправку ваших данных на чужой сервер, чтобы получить ответ обратно.

Какое место здесь занимают FireAI и HisnLabs

None of this makes FireAI a cost story — it is a firewall, not a rented model — but the same bet sits underneath its own on-device reviewer: no per-token bill and nothing sent off the Mac, because the review happens locally instead of being shipped to a server.

FireAI — это собственный продукт HisnLabs: ИИ-файрвол, работающий прямо на вашем Mac. Он показывает простым языком каждое соединение, которое устанавливают ваши приложения, и позволяет вам решать, что покидает ваш Mac, — его ИИ работает локально, поэтому ваш трафик никогда не отправляется ни нам, ни кому-либо ещё. Команда исследователей безопасности HisnLabs — это те, кто поддерживает точность этих решений: они каталогизируют, какие домены являются обычной телеметрией, а какие — реальным сервисом, отслеживают страну и сеть, стоящие за соединением, и обучают локальную модель (функцию Autopilot) на реальных шаблонах трафика — и ничего из этого не покидает ваш Mac.

Вы можете прочитать о технических решениях, лежащих в его основе, или попробовать FireAI в течение 17 дней на странице FireAI от HisnLabs.

Источники