Подписка Claude выгоднее ChatGPT в 5 раз: разбор SemiAnalysis

SemiAnalysis измерила реальные лимиты ИИ-подписок Anthropic, OpenAI и других: как считали API-эквивалентную ценность, почему Opus 5.5 выгоднее GPT 6.1 Sol и что изменилось после урезания лимитов OpenAI.

Аналитики SemiAnalysis проверили лимиты всех популярных ИИ-подписок: Anthropic, OpenAI, Meta, SpaceXAI, MiniMax, Moonshot, Z.ai, Cursor и Cognition. Главный вывод вынесен в заголовок их отчета: на моделях среднего уровня подписка Claude дает примерно в пять раз больше ценности, чем аналогичный план OpenAI.

Разбираем, как считали, что изменилось после недавнего урезания лимитов у OpenAI и почему подписки вообще так важны для экономики ИИ-лабораторий.

Почему подписки важны для экономики лабораторий

Подписки остаются основным способом, которым частные пользователи и небольшие компании платят за ИИ. Они сильно субсидированы и окупаются в первую очередь как инструмент привлечения клиентов. По оценке SemiAnalysis, щедрые сбросы лимитов у OpenAI во многом объясняют недавний рост популярности Codex и заставили Anthropic несколько раз отказываться от планов урезать подписки.

Влияние на финансы при этом непропорционально большое. По грубой оценке аналитиков, у Anthropic подписки приносят около 10% выручки, но могут занимать больше 40% вычислительных мощностей для инференса и снижать среднюю выручку на мегаватт примерно на 36 млн долларов. Для OpenAI подписки еще важнее, потому что составляют большую долю выручки. Чтобы точно моделировать финансы ИИ-компаний, нужно понимать, как устроены лимиты.

Как устроены лимиты

Ежемесячный платеж фактически дает определенное число внутренних кредитов. Каждая комбинация модели и типа токена расходует их по-своему, причем соотношения могут сильно отличаться от цен API. Поэтому ценность плана нельзя назвать одной цифрой: она зависит от того, какую модель и под какую нагрузку вы используете. Кроме того, лаборатории регулярно меняют лимиты с выходом новых моделей и промоакциями, а могут поменять их и тихо, просто изменив стоимость токенов в кредитах.

Пользователь всего этого не видит. Ему показывают индикатор от 0 до 100% для пятичасового и недельного окна, иногда с отдельным счетчиком для топовой модели вроде Fable. Тарифы различаются только множителем относительно других планов того же провайдера. OpenAI, например, раньше обещала в Pro за 100 долларов в 5 раз больше использования, чем в Plus, а в Pro за 200 долларов в 20 раз больше, пока не урезала лимиты вдвое и не убрала эти формулировки со страницы тарифов.

Методика измерений

Токены в API оплачиваются по четырем типам: обычный ввод, запись в кэш, чтение из кэша и вывод. SemiAnalysis проводила отдельные эксперименты для каждого типа: серию одинаковых запросов, которые максимизируют один тип токенов и минимизируют остальные, и следила, как двигается индикатор лимита.

Для запросов на ввод и кэш использовали фрагмент «Войны и мира», потому что некоторые модели отказываются отвечать на большие блоки бессмысленного текста. Чтобы ввод не кэшировался, к каждому запросу добавляли случайную метку, а для чтения из кэша метку оставляли постоянной. Для вывода модели просили написать длинное техническое эссе: механические задания вроде «повтори слово 100 000 раз» они отказываются выполнять.

Индикатор двигается дискретно, на целый процент или кредит, и один запрос часто его не сдвигает. Поэтому аналитики считали токены между соседними сдвигами индикатора и отбрасывали неполные шаги в начале и в конце серии. Измерения продолжались, пока погрешность не опускалась до ±5%. Если чтение из кэша не сдвигало индикатор даже после 500 млн токенов, его считали бесплатным.

Дальше доля лимита на миллион токенов каждого типа пересчитывается в количество токенов за окно и за месяц. Месяц ограничен недельными лимитами, потому что пятичасовое окно за неделю сбрасывается много раз. Затем расход пересчитывается в доллары по ценам API для типичной агентной нагрузки, взятой из собственного использования SemiAnalysis в сентябре. Так получается API-эквивалентная стоимость подписки.

Пойманный A/B-тест

Во время отладки методики одна из трех одинаковых подписок одного провайдера показала примерно на 20% более низкие лимиты. Аккаунт был заметно старше остальных, и аналитики заподозрили, что лимиты зависят от возраста аккаунта. Провайдер объяснил, что этот аккаунт попал в «крайне маленький» A/B-тест, где проверяли, как лучше распределять момент достижения лимитов, и подчеркнул, что лимиты в целом не снижали. История показывает две вещи: провайдеры могут незаметно менять лимиты в любой момент, а методика SemiAnalysis достаточно чувствительна, чтобы это заметить.

OpenAI против Anthropic

На топовых моделях лимиты похожи. По данным отчета, план Anthropic за 200 долларов дает Fable 5.1 примерно на 2485 долларов по ценам API, а аналогичный план OpenAI исчерпывается после использования GPT-6 Astra примерно на 2897 долларов. Разница в том, что Fable можно использовать только на 50% общего лимита, и после этого у пользователя Claude остается еще половина лимита на другие модели.

Эта вторая половина решает все на среднем уровне, который обе компании позиционируют как основной для повседневной работы. Здесь, по оценке SemiAnalysis, Anthropic выигрывает с большим отрывом: Opus 5.5 на подписке Claude дает примерно в 5 раз больше API-эквивалентной ценности, чем GPT 6.1 Sol у OpenAI. Аналитики признают, что Sol заметно дешевле за токен, но разрыв остается огромным, даже если сравнивать просто количество токенов.

Отдельно в отчете оговаривается, что API-эквивалентная стоимость не учитывает эффективность моделей по токенам. Надежных данных о ней в индустрии пока нет, а популярные бенчмарки, по мнению SemiAnalysis, плохо отражают реальную работу с LLM.

Что изменилось у OpenAI

Неделей раньше OpenAI урезала тарифы. Измерения подтвердили, что API-эквивалентная ценность плана за 200 долларов упала вдвое: компания сократила число токенов на каждый уровень моделей. Для моделей класса Sol падение превысило 50%, потому что одновременно подешевел кэшированный ввод у 6.1 Sol. Подписки, купленные до изменений, сохраняют старые лимиты до 29 октября, новые сразу получают урезанные.

Новый план за 500 долларов дает всего на 21% больше Astra, чем старый план за 200 долларов, а для моделей Sol его API-эквивалентная ценность даже ниже. Главная фишка этого тарифа в режиме Ultrafast со скоростью около 300 токенов в секунду, его лимиты аналитики еще тестируют.

Раньше план за 200 долларов у OpenAI был заметно щедрее остальных по ценности на доллар: Pro за 100 долларов давал примерно вдвое больше Plus на Astra, а Pro за 200 долларов еще примерно вдвое больше. После изменений все планы Pro дают одинаковое количество токенов на доллар. У Anthropic ценность на доллар и раньше была одинаковой на всех тарифах.

Вывод SemiAnalysis звучит жестко для OpenAI: инди-разработчики долго хвалили ее за щедрые лимиты по сравнению с Anthropic, но сейчас это уже неправда. Единственный аргумент в пользу OpenAI в том, что у планов Pro нет пятичасового лимита и месячный объем проще выбрать целиком. По мнению аналитиков, это не компенсирует примерно четырехкратного преимущества Opus 5.5 по ценности.

Подстраивают ли лаборатории лимиты под снижение цен

Недавно обе компании заметно снизили цены. У Fable 5.1 чтение кэша подешевело на 75% по сравнению с Fable 5. У Opus 5.5 ввод и вывод подешевели на 20% по сравнению с Opus 5, а чтение кэша на 60%. У GPT 6.1 Sol чтение кэша подешевело на 50%.

OpenAI не увеличила лимиты Sol на плане за 200 долларов после выхода 6.1 Sol, поэтому API-эквивалентная ценность упала примерно на 30%. Anthropic не стала поднимать лимиты на Fable с выходом 5.1, но увеличила лимиты Opus после снижения цен 5.5: примерно на 20% на планах Max и примерно на 50% на плане Pro. Полностью компенсировать снижение цен API этого не хватило.

Две стратегии сокращения субсидий

Обе компании понимают, что маржа на подписках гораздо ниже, чем на API, и выбрали разные способы ее поднять. Anthropic снижает API-эквивалентную ценность для более дорогих моделей: между Sonnet 5.5 и Opus 5.5 разница небольшая, а у Fable 5.1 уже существенная.

По расчетам аналитиков, при полном использовании лимитов и 92% валовой маржи API подписка, выбранная целиком на Opus 5.5, дает валовую маржу около минус 369%, а на Fable 5.1 около 1%. При более реалистичной загрузке в 20% маржа поднимается до 6% и 80% соответственно. Иначе говоря, если бы все пользовались только Fable, у Anthropic уже была бы маржа уровня софтверной компании. Opus со временем будет дешеветь в обслуживании, а модели уровнем выше Fable, если вообще попадут в подписки, получат еще более скромные лимиты.

OpenAI выбрала радикальный путь и сразу урезала лимиты до уровня Fable на всех моделях. Ожидаемой волны возмущения, по наблюдению SemiAnalysis, почти не случилось: новости затерялись на фоне DevDay, который прошел на следующий день, а существующим подписчикам оставили старые лимиты еще на месяц.

Китайские подписки и сторонние сервисы

Китайские лаборатории, несмотря на нехватку вычислительных мощностей, тоже субсидируют подписки, но степень субсидий сильно различается от модели к модели. Ценность на доллар у них растет с уровнем тарифа и в среднем немного не дотягивает до примерно 12-кратной у OpenAI.

Сторонние обертки вроде Cursor и Devin от Cognition, по выводу SemiAnalysis, дают меньше ценности, чем подписки напрямую у OpenAI и Anthropic. Подробное сравнение доступно только платным подписчикам издания.

Что это значит для разработчиков

Если вы выбираете подписку для ежедневной работы с кодом, сравнивать стоит API-эквивалентную ценность для той модели, которой вы реально пользуетесь, а маркетинговые множители вроде «в 5 раз больше использования» мало что говорят. И стоит помнить, что лимиты меняются часто, иногда тихо, так что сегодняшний выгодный тариф через месяц может оказаться обычным.

Источник: отчет SemiAnalysis

Поделиться:

Ответить

Ваш адрес email не будет опубликован. Обязательные поля помечены *