Claude Opus 5 vs GPT-5.6: какую модель брать под API в 2026
Opus 5 и GPT-5.6 Sol официально стоят одинаково — $5 за 1M входа. В ProxyAPI на 06.08.2026 это 1516 ₽ против 800 ₽. Считаем цены, бенчмарки и наценку.
24 июля 2026 Anthropic выпустила Claude Opus 5 по цене предшественника — $5 за 1M входных и $25 за 1M выходных токенов, контекст 1M без надбавки за длину. 9 июля OpenAI открыла общий доступ к GPT-5.6, который состоит из трёх тиров: Sol ($5/$30), Terra ($2/$12) и Luna ($0,20/$1,20) — разброс цены внутри одного релиза в 25 раз. По независимым замерам ARC Prize Opus 5 выигрывает на ARC-AGI-1 (97,5% против 96,5%) и с большим отрывом на ARC-AGI-3 (30,16% против 7,78%), но проигрывает на ARC-AGI-2 при максимальном reasoning (90,4% против 92,5%). SWE-bench Verified ни Anthropic, ни OpenAI по этим моделям не публиковали — цифры вроде «96%» взяты из контент-ферм. Для бизнеса из России решающим оказывается не бенчмарк, а посредник: на прайсе ProxyAPI от 06.08.2026 Opus 5 идёт с наценкой ×3,74 к официальной цене, а GPT-5.6 Sol — всего ×1,93–1,97.
24 июля 2026 года Anthropic выпустила Claude Opus 5 — и не подняла цену. Вход остался $5 за миллион токенов, выход $25. Ровно столько же стоили Opus 4.8, 4.7, 4.6 и 4.5. За пятнадцать дней до этого, 9 июля, OpenAI открыла общий доступ к GPT-5.6, где вместо одной модели теперь три тира с ценами от $0,20 до $5 за миллион входных токенов — разброс в 25 раз внутри одного релиза.
Полтора месяца назад мы разбирали Fable 5 против Opus 4.8 и Sonnet 4.6. Та картина больше не работает. Opus 4.8 сместился с позиции «рабочая лошадка за $5», её занял Opus 5 по той же цене. Логика «доплачиваешь вдвое за Fable ради сложного кодинга» размылась: по заявлению Anthropic, на CursorBench 3.2 при максимальном effort Opus 5 отстаёт от пикового Fable 5 менее чем на 0,5% при вдвое меньшей стоимости задачи. А на стороне OpenAI выбор из одной модели превратился в выбор из трёх.
И есть третий сюжет, которого нет ни в одном англоязычном обзоре. Для бизнеса из России выбор между Opus 5 и GPT-5.6 — это не выбор модели, а выбор посредника. Наценка агрегаторов неодинакова по вендорам. Официально вход у Opus 5 и у GPT-5.6 Sol стоит одинаково — $5 за 1M. На прайс-листе ProxyAPI от 6 августа 2026 Opus 5 стоит 1516 ₽ за миллион входных токенов, а Sol — 800 ₽. Порядок моделей по цене в рублях просто не совпадает с порядком по цене в долларах.
Дальше — только подтверждаемые цифры: прайсы из документации вендоров, верифицированные результаты ARC Prize, замеры Artificial Analysis, публичные рублёвые прайс-листы агрегаторов. Отдельным блоком — какие из гуляющих по рунету цифр не подтверждаются ничем.
Что именно устарело после 24 июля
Три конкретных пункта.
Первое: Opus 4.8 покупать больше незачем. Opus 5 стоит столько же — $5 за 1M входа и $25 за 1M выхода — и, по заявлению Anthropic, более чем вдвое улучшает результат Opus 4.8 на внутреннем агентном бенчмарке Frontier-Bench v0.1 при меньшей стоимости задачи. Абсолютных чисел компания не приводит, только относительное утверждение. Но даже если оно завышено вдвое, платить ту же цену за старую модель смысла нет. У Opus 5 к тому же отдельный пул rate limits, не общий с линейкой Opus 4.x — миграция не отъедает лимиты у работающих сервисов.
Второе: доплата за Fable 5 схлопнулась на большинстве задач. Fable 5 стоит $10/$50 — ровно вдвое дороже Opus 5. Anthropic заявляет, что Opus 5 на CursorBench 3.2 отстаёт от пикового Fable 5 менее чем на 0,5% при половинной цене задачи, а на бенчмарке компьютерного управления OSWorld 2.0 даже превосходит лучший результат Fable 5 — примерно за треть его стоимости. Это вендорские заявления без чисел, проверить их снаружи нельзя. Но направление понятное: сценарий «берём Fable, потому что это единственный вариант для сложной агентной работы» стал куда менее очевидным.
Третье: у OpenAI теперь не модель, а линейка. GPT-5.6 состоит из трёх тиров с отдельными ID: gpt-5.6-sol (алиас gpt-5.6), gpt-5.6-terra и gpt-5.6-luna. Контекст у всех трёх одинаковый — 1 050 000 токенов, максимальный вывод 128 000, отсечка знаний 16 февраля 2026. Различаются они reasoning-мощностью и ценой. Разговор «GPT против Claude» теперь бессмыслен без указания тира.
Claude Opus 5: что известно точно
Начнём с того, что можно проверить в документации.
Цены. $5 за 1M входных токенов, $25 за 1M выходных. Prompt caching: запись кэша с TTL 5 минут — $6,25 (×1,25 к входу), с TTL 1 час — $10 (×2), чтение из кэша — $0,50 (×0,1). Арифметика простая: при пятиминутном TTL кэш окупается уже после первого чтения. Переплата за запись — 25% к обычному входу, чтение — вдесятеро дешевле входа, так что второй запрос с тем же префиксом уже в плюсе.
Batch API даёт 50% скидки на вход и выход: $2,50 и $12,50 за 1M. Скидки Batch и prompt caching складываются. Плюс на Batch API модели Opus 5, Opus 4.8, 4.7, 4.6, Sonnet 5 и Sonnet 4.6 поддерживают вывод до 300 000 токенов через бета-заголовок output-300k-2026-03-24 — против 128K в синхронном Messages API. Если вы генерируете длинные документы пачками, это единственный документированный способ выйти за 128K.
Контекст. 1 000 000 токенов, вывод до 128 000. Ключевая деталь, которую легко пропустить: полное окно тарифицируется по стандартной ставке, надбавки за длинный контекст нет вовсе. У OpenAI, как увидим ниже, она есть.
Fast mode. $10/$50 — ровно вдвое к базе, вывод по документации до 2,5 раза быстрее. Доступен только в первичном Claude API: ни на Amazon Bedrock, ни в Google Cloud, ни в Microsoft Foundry его нет. С Batch API несовместим — что логично, батчи и так асинхронные.
Две мелочи, которые считаются деньгами на агентных сценариях. Служебный системный промпт для tool use у Opus 5 занимает 286 токенов при tool_choice: auto/none — против 675 у Opus 4.7 и 290 у Opus 4.8. На тысячах вызовов инструментов это заметная строка в счёте. И минимальный кэшируемый префикс снижен до 512 токенов против 1024 у Opus 4.8: промпты, которые раньше просто не попадали в кэш, теперь кэшируются без единой правки в коде.
Отсечка знаний — май 2026. Надёжная граница знаний там же.
Про Opus 5 отдельно стоит держать в голове бухгалтерию сверх токенов. Веб-поиск у Anthropic стоит $10 за 1000 запросов, code execution даёт 1550 бесплатных часов в месяц на организацию и потом $0,05 за час на контейнер, Claude Managed Agents — $0,08 за час активной сессии сверх токенов. Плюс параметр inference_geo: "us" (гарантия обработки в США) для моделей 4.6 и новее умножает все категории токенов на 1,1 — вход, выход, запись и чтение кэша.
GPT-5.6: три тира вместо одной модели
Здесь придётся быть аккуратнее с датами. Системная карта OpenAI датирует превью 26 июня 2026 и говорит о более широком доступе «в ближайшие недели». Общая доступность в ChatGPT, Codex и API — 9 июля 2026, и эта дата подтверждается независимо: тем же числом ARC Prize датирует тест Sol, тем же числом Artificial Analysis публикует разбор. Превью и GA — разные события, смешивать их не надо.
Позиционирование тиров по документации OpenAI: Sol — для сложных рассуждений, кодинга и долгих агентных задач; Terra — сбалансированный тир с производительностью на уровне GPT-5.5 при вдвое меньшей цене; Luna — самый быстрый и дешёвый, под высокообъёмные задачи.
Цены на коротком контексте: Sol $5/$30, Terra $2/$12, Luna $0,20/$1,20 за 1M. Кэшированный вход — ровно 10% от цены входа: $0,50, $0,20 и $0,02 соответственно. Batch API — те же минус 50% на все три тира.
А вот дальше начинается то, чего у Anthropic нет. У GPT-5.6 действует отдельный тариф на длинный контекст: Sol $10 вход / $1 кэш / $45 выход, Terra $4/$0,40/$18, Luna $0,40/$0,04/$1,80. То есть ×2 по входу и ×1,5 по выходу.
В текстовом описании документации OpenAI сказано, что множитель длинного контекста — ×2 «на вход, запись кэша и выход». Числовая таблица на той же странице даёт по выходу ×1,5: Sol $30 → $45, Terra $12 → $18, Luna $1,20 → $1,80. Расхождение внутри одного документа. Считать бюджет надо по таблице, но заложить запас — по тексту.
Практический вывод: если ваш сценарий систематически уходит за порог длинного контекста, экономика GPT-5.6 меняется, а экономика Opus 5 — нет. У Anthropic окно на миллион токенов тарифицируется по единой ставке.
Таблица 1. Официальные цены за 1M токенов, август 2026
Курс ЦБ РФ на 05.08.2026 — 81,1291 ₽/$. Рублёвые значения — пересчёт по этому курсу, а не реальная цена покупки из России.
| Модель | Вход, $ | Выход, $ | Чтение кэша, $ | Batch вход/выход, $ | Вход, ₽ | Выход, ₽ |
|---|---|---|---|---|---|---|
| Claude Opus 5 | 5,00 | 25,00 | 0,50 | 2,50 / 12,50 | 406 | 2 028 |
| Claude Opus 5 Fast mode | 10,00 | 50,00 | — | недоступно | 811 | 4 056 |
| Claude Fable 5 | 10,00 | 50,00 | 1,00 | 5,00 / 25,00 | 811 | 4 056 |
| Claude Sonnet 5 (интро до 31.08.2026) | 2,00 | 10,00 | 0,20 | 1,00 / 5,00 | 162 | 811 |
| Claude Sonnet 5 (с 01.09.2026) | 3,00 | 15,00 | 0,30 | 1,50 / 7,50 | 243 | 1 217 |
| GPT-5.6 Sol | 5,00 | 30,00 | 0,50 | 2,50 / 15,00 | 406 | 2 434 |
| GPT-5.6 Terra | 2,00 | 12,00 | 0,20 | 1,00 / 6,00 | 162 | 973 |
| GPT-5.6 Luna | 0,20 | 1,20 | 0,02 | 0,10 / 0,60 | 16 | 97 |
Отдельно: у GPT-5.6 действует повышенный тариф на длинный контекст (Sol $10 вход / $45 выход, Terra $4/$18, Luna $0,40/$1,80). У Claude Opus 5 всё окно в 1M токенов тарифицируется по единой ставке — надбавки за длинный контекст нет.
Источники: платформа Claude, раздел Pricing, документация OpenAI, Pricing, ЦБ РФ.
Обратите внимание на строку выхода: Opus 5 отдаёт токены по $25, Sol — по $30. В долларах Claude на выходе дешевле примерно на 17%. Запомните это, к рублям вернёмся через два раздела.
Бенчмарки: что подтверждено, а что придумано
Тут придётся разочаровать половину рунета.
Ни Anthropic, ни OpenAI не опубликовали SWE-bench Verified для этих моделей. В анонсе Opus 5 от 24 июля этого бенчмарка нет вообще — там Frontier-Bench v0.1, CursorBench 3.2, OSWorld 2.0, Zapier AutomationBench и ARC-AGI-3. Системная карта GPT-5.6 упоминает SWE-bench, Terminal-Bench и GPQA, но числовых значений по ним не приводит. При этом по русско- и англоязычным SEO-сайтам гуляет цифра «96,0% SWE-bench Verified у Opus 5». Первоисточника у неё нет. Туда же — «Frontier-Bench 43,3%», «SWE-bench Pro 79,2%» и «knowledge-work Elo 1861». Из всего набора цифр, который эти сайты приписывают Opus 5, независимо подтверждается ровно одна — ARC-AGI-3, и та в первоисточнике равна 30,16%, а не округлённым 30,2%.
То же с «88,8% на Terminal-Bench 2.1 у Sol» — цифра живёт только во вторичных блогах.
Что подтверждается — сведено в таблицу.
Таблица 2. Подтверждённые бенчмарки: Claude Opus 5 против GPT-5.6 Sol
Включены только результаты, опубликованные автором бенчмарка или независимым верификатором. Всё, что публиковали сами вендоры в относительных формулировках, вынесено в примечание.
| Бенчмарк | Claude Opus 5 | GPT-5.6 Sol | Кто измерял | Дата теста |
|---|---|---|---|---|
| ARC-AGI-1 (max) | 97,5% | 96,5% | ARC Prize (verified) | 24.07 / 09.07.2026 |
| ARC-AGI-2 (max) | 90,4% | 92,5% | ARC Prize (verified) | 24.07 / 09.07.2026 |
| ARC-AGI-2 (high) | 88,3% | 85,4% | ARC Prize (verified) | 24.07 / 09.07.2026 |
| ARC-AGI-3 | 30,16% (high) | 7,78% (max) | ARC Prize (verified) | 24.07 / 09.07.2026 |
| Intelligence Index | не измерялся | 59 (max) | Artificial Analysis | 09.07.2026 |
| Coding Agent Index | не измерялся | 80 (max) | Artificial Analysis | 09.07.2026 |
| HealthBench Consensus | не публиковался | 95,5 | системная карта OpenAI | 26.06.2026 |
| SWE-bench Verified | не публиковался | не публиковался | — | — |
Примечание. Anthropic по Opus 5 публикует только относительные утверждения без абсолютных чисел: Frontier-Bench v0.1 — «более чем вдвое лучше Opus 4.8 при меньшей стоимости задачи»; CursorBench 3.2 — «в пределах 0,5% от пика Fable 5 при половинной цене»; OSWorld 2.0 — «выше пика Fable 5 при ~1/3 стоимости»; Zapier AutomationBench — «примерно в 1,5 раза выше следующей модели при той же цене задачи».
Источники: ARC Prize — Claude Opus 5, ARC Prize — GPT-5.6 Sol, Artificial Analysis, системная карта GPT-5.6, анонс Claude Opus 5.
Из этой таблицы следует не «Х победил», а более полезная вещь: счёт зависит от версии теста. На ARC-AGI-2 при максимальном reasoning впереди Sol — 92,5% против 90,4%. На том же ARC-AGI-2 в режиме high впереди Opus 5 — 88,3% против 85,4%. На ARC-AGI-3 Opus 5 опережает Sol примерно в 3,9 раза (30,16% против 7,78%) и держит лучший результат среди всех протестированных систем. При этом Sol стала первой моделью, выигравшей публичную игру ARC-AGI-3 — 87,1% на задаче FT09. Любая публикация вида «на ARC-AGI лидирует X» без указания версии и режима — просто шум.
Anthropic, кстати, в анонсе говорит о результате «втрое выше следующей модели» на ARC-AGI-3. По верифицированным данным ARC Prize отношение к лучшему результату Sol — примерно 3,9×. Возможно, «следующей моделью» у них была не Sol. Но повторять «ровно втрое» как измеренную цифру не стоит.
Два индекса Artificial Analysis — Intelligence Index (Sol max 59, Terra 55, Luna 51, при 60 у Fable 5 max) и Coding Agent Index (Sol 80, Terra 77, Luna 75) — опубликованы 9 июля, за две недели до релиза Opus 5. Сравнивать по ним Opus 5 с GPT-5.6 нельзя физически: на момент замера Opus 5 не существовало.
По агрегатору llm-stats.com Sol даёт 64,6% на SWE-bench Pro против 58,6% у GPT-5.5, 94,6% на GPQA против 93,6%, 91,5% на MRCR v2 (8 иголок) против 74,0% — и 83,0% на MMMU-Pro против 83,2%, то есть на мультимодальных задачах прироста нет вовсе. Это данные агрегатора, без разделения на самозаявленные и независимо проверенные, — берите как ориентир, а не как измерение.
Публичных бенчмарков качества русского языка нет ни у Anthropic, ни у OpenAI, ни у независимых верификаторов — ни для Opus 5, ни для GPT-5.6. Если русский критичен, единственный честный путь — собрать свой набор из 50–100 реальных примеров и прогнать оба варианта. Как это делается на практике, мы разбирали в статье про замену ChatGPT в России на материале MERA.
Подключить Opus 5 или GPT-5.6 без танцев с прокси
Настраиваем инференс под вашу задачу: выбор тира, prompt caching, batch-режим и расчёт бюджета в рублях до запуска.
Сколько это стоит из России
Теперь главное. Официальные прайсы для российской компании — это справочная информация, а не цена покупки. Россия и Белоруссия отсутствуют в списке поддерживаемых стран Anthropic — и для коммерческого API, и для Claude.ai; компания оставляет за собой право не обслуживать организации с преобладающим владением из стран вне списка. Практические последствия и обходные пути мы подробно разбирали в материале как подключить Claude в России, для OpenAI — в статье про API без VPN.
Реальная цена — это прайс агрегатора.
Таблица 3. Наценка агрегаторов на 6 августа 2026
Цены агрегаторов — с их публичных прайс-листов на 06.08.2026. Колонка «наценка» — расчёт: цена агрегатора, делённая на официальную цену по курсу ЦБ 81,1291 ₽/$.
| Модель | Официально, ₽ вход/выход | ProxyAPI, ₽ вход/выход | Наценка ProxyAPI | AITunnel, ₽ вход/выход | Наценка AITunnel |
|---|---|---|---|---|---|
| Claude Opus 5 | 406 / 2 028 | 1 516 / 7 579 | ×3,74 / ×3,74 | 1 000 / 5 000 | ×2,47 / ×2,47 |
| Claude Opus 4.8 | 406 / 2 028 | 1 516 / 7 579 | ×3,74 / ×3,74 | нет данных | — |
| Claude Sonnet 5 (интро) | 162 / 811 | 800 / 4 500 | ×4,93 / ×5,55 | нет данных | — |
| GPT-5.6 Sol | 406 / 2 434 | 800 / 4 700 | ×1,97 / ×1,93 | нет данных | — |
| GPT-5.6 Terra | 162 / 973 | 400 / 2 560 | ×2,47 / ×2,63 | нет данных | — |
| GPT-5.6 Luna | 16 / 97 | 60 / 360 | ×3,70 / ×3,70 | нет данных | — |
| GPT-5.5 | нет актуальной офиц. цены | 1 520 / 9 100 | — | нет данных | — |
Ключевое наблюдение: наценка не единая. Официально вход у Claude Opus 5 и GPT-5.6 Sol стоит одинаково — $5 за 1M. В ProxyAPI Opus 5 стоит 1 516 ₽, а Sol — 800 ₽. Подразумеваемый курс: ~303 ₽/$ для Claude и ~157–160 ₽/$ для GPT-5.6. Порядок моделей по цене в рублях не совпадает с порядком по цене в долларах.
Второе наблюдение: вводная скидка Anthropic на Sonnet 5 ($2/$10 до 31.08.2026) до российского покупателя не доходит — прайс ProxyAPI соответствует расчёту от базового тарифа $3/$15, а не от интро-цены.
Источники: прайс-лист ProxyAPI, страница Claude Opus 5 в AITunnel, курс ЦБ РФ.
Разница между площадками тоже неодинакова. Тот же Opus 5 в AITunnel стоит 1000/5000 ₽ — это ×2,47 к официальной цене, подразумеваемый курс 200 ₽/$, то есть примерно на треть дешевле, чем в ProxyAPI. На сайте площадки на 6 августа 2026 заявлены OpenAI-совместимый API на api.aitunnel.ru/v1, оплата рублями картой, минимальное пополнение 500 ₽ и работа без VPN. Все цены ProxyAPI — с НДС 5%.
Про сам рынок посредников: по разбору Sostav от мая 2026, ProxyAPI зарегистрирован как ИП, AITunnel — тоже как ИП, Polza AI — как ООО. Там же наценка ProxyAPI оценивалась примерно в 3× на флагманы; расчёт по действующему прайсу показывает, что единой наценки у площадки нет — ×3,74 на Claude и ×1,93–1,97 на Sol. Цены Polza AI, которые «практически на уровне официальных», в том же обзоре прямо помечены как подозрительные: возможная подмена моделей или использование «серых» аккаунтов.
Считать российского агрегатора официальным реселлером, партнёром или авторизованным дистрибьютором Anthropic или OpenAI нет оснований: подтверждений такого статуса нет ни у одной площадки. В феврале–марте 2026 сообщалось о случаях удаления российских аккаунтов без предупреждения, затрагивавших и бесплатные, и платные учётные записи; единственный источник этих сообщений — корпоративный блог агрегатора на Хабре, то есть сторона, заинтересованная в продаже обхода. Масштаб независимо не подтверждён. Отдельно: prompt caching и Batch API в прайс-листах ProxyAPI и AITunnel не заявлены — экономику через агрегатор считайте только по базовым ставкам, без скидок.
Таблица 4. Стоимость типовых бизнес-задач, август 2026
Расчёт редакции по официальным тарифам и прайсам агрегаторов; курс ЦБ 81,1291 ₽/$. Сценарии условные, без учёта платы за веб-поиск, code execution и время сессий Managed Agents.
Сценарий А. Разбор 1000 документов — 10 000 входных и 1 000 выходных токенов на документ (итого 10M вход + 1M выход).
| Модель / канал | Синхронно | Через Batch (−50%) |
|---|---|---|
| Claude Opus 5, официально | $75 (6 085 ₽) | $37,50 (3 042 ₽) |
| Claude Opus 5, ProxyAPI | 22 739 ₽ | пакетный режим не заявлен |
| Claude Opus 5, AITunnel | 15 000 ₽ | пакетный режим не заявлен |
| Claude Sonnet 5 (интро), официально | $30 (2 434 ₽) | $15 (1 217 ₽) |
| GPT-5.6 Sol, официально | $80 (6 490 ₽) | $40 (3 245 ₽) |
| GPT-5.6 Sol, ProxyAPI | 12 700 ₽ | — |
| GPT-5.6 Terra, официально | $32 (2 596 ₽) | $16 (1 298 ₽) |
| GPT-5.6 Terra, ProxyAPI | 6 560 ₽ | — |
| GPT-5.6 Luna, официально | $3,20 (260 ₽) | $1,60 (130 ₽) |
| GPT-5.6 Luna, ProxyAPI | 960 ₽ | — |
Сценарий Б. Чат-бот поддержки — 100 000 сообщений в месяц, 2 000 входных и 500 выходных токенов на сообщение (200M вход + 50M выход), без кэширования.
| Модель | Официально, $ | Официально, ₽ | Через ProxyAPI, ₽ |
|---|---|---|---|
| Claude Opus 5 | 2 250 | 182 540 | 682 150 |
| Claude Sonnet 5 (интро) | 900 | 73 016 | 385 000 |
| GPT-5.6 Sol | 2 500 | 202 823 | 395 000 |
| GPT-5.6 Terra | 1 000 | 81 129 | 208 000 |
| GPT-5.6 Luna | 100 | 8 113 | 30 000 |
Сценарий В. Один длинный агент-ран — 100k некэшированного входа, 400k чтений из кэша, 100k записей в кэш (5 мин), 60k выходных токенов.
| Модель | Расчёт | Итог |
|---|---|---|
| Claude Opus 5 | 0,1×$5 + 0,4×$0,50 + 0,1×$6,25 + 0,06×$25 | $2,83 (229 ₽) |
| GPT-5.6 Sol | 0,1×$5 + 0,4×$0,50 + 0,1×$5 + 0,06×$30 | $3,00 (243 ₽) |
| GPT-5.6 Terra | 0,1×$2 + 0,4×$0,20 + 0,1×$2 + 0,06×$12 | $1,20 (97 ₽) |
Важная структурная разница: у Anthropic запись в кэш стоит дороже обычного входа (×1,25 при TTL 5 минут, ×2 при TTL 1 час), у OpenAI в опубликованном прайсе отдельной надбавки за запись нет — есть только сниженная цена кэшированного входа. На коротких сессиях с редкими попаданиями это работает в пользу OpenAI, на длинных с высоким hit-rate разница нивелируется.
Источники цен: Claude Pricing, OpenAI Pricing, ProxyAPI, AITunnel.
Посмотрите на сценарий Б внимательно. В долларах Opus 5 дешевле Sol: 2 250 против 2 500. В рублях через ProxyAPI — 682 150 против 395 000, то есть Claude дороже примерно в 1,7 раза. Одна и та же нагрузка, один и тот же месяц, противоположный ответ. Это и есть главный практический вывод статьи: для российской компании выбор канала доступа влияет на счёт сильнее, чем выбор модели.
Что вышло рядом — коротко
Kimi K3 от Moonshot AI: открытая модель на 2,8 трлн параметров, анонсирована 16–17 июля 2026 (Simon Willison даёт 16-е, The Agent Report — 17-е), контекст 1M токенов, веса обещали к 27 июля (сам факт публикации мы не проверяли). По самозаявленным бенчмаркам обходит Opus 4.8 (max) и GPT-5.5 (high), но уступает Fable 5 и GPT-5.6 Sol. Для тех, кому важно держать данные внутри контура, это уже реальная опция — подробнее про экономику своего железа мы писали в разборе локального инференса.
Про Gemini 3.5 у нас только вторичные источники: они называют цену Flash в $1,50/$9,00 за 1M и относят запуск Gemini 3.5 Pro к следующему дню после анонса Kimi K3. До прайса Google мы не дошли, так что и цену, и дату считайте непроверенными — перед закладыванием в бюджет сверьтесь с Vertex AI Pricing.
Восемь ошибок при выборе между Opus 5 и GPT-5.6
Сравнивать «Claude» и «GPT» без указания тира
GPT-5.6 — это не модель, а три модели. Luna стоит $0,20 за 1M входа, Sol — $5. Разница в 25 раз. Фраза «мы перешли на GPT-5.6 и стало дешевле» без указания тира не значит ничего. И наоборот: если тестировали на Luna, а в продакшене включили Sol, счёт при том же профиле нагрузки вырастет в 25 раз.
Считать бюджет в долларах, покупая в рублях
Классика. Финдиректор берёт официальный прайс, умножает на курс ЦБ, получает 182 540 ₽ за месяц чат-бота на Opus 5 — а по счёту уходит 682 150 ₽. Наценка агрегатора не равномерна: ×3,74 на Claude, ×1,93–1,97 на Sol, ×3,70 на Luna. Считайте по прайсу той площадки, через которую реально платите, и с датой фиксации.
Верить цифре «96% SWE-bench Verified»
Её нет ни в анонсе Anthropic, ни в системной карте OpenAI. Обе компании по этим релизам SWE-bench Verified не публиковали. Цифра пришла из AI-контент-ферм и разошлась по рунету. Если вы обосновываете выбор модели перед руководством — не ссылайтесь на неё, вопрос «а где первоисточник» вы проиграете.
Читать «на ARC-AGI лидирует X» без версии
На ARC-AGI-2 при max впереди Sol (92,5% против 90,4%), на ARC-AGI-2 при high — Opus 5 (88,3% против 85,4%), на ARC-AGI-3 — Opus 5 с отрывом почти вчетверо. Три ответа на один вопрос. Любой обзор, который называет одного победителя, что-то от вас скрыл.
Сравнивать Opus 5 по индексам Artificial Analysis
Intelligence Index и Coding Agent Index за 9 июля не содержат Opus 5, потому что модели тогда не было. Вы увидите в таблице Sol 59 и Fable 5 60 — и захотите достроить туда Opus 5 по аналогии. Не надо, это будет выдумка.
Игнорировать надбавку за длинный контекст у GPT-5.6
Если ваши промпты систематически длинные, Sol на входе стоит не $5, а $10, и на выходе не $30, а $45. У Opus 5 такой надбавки нет вообще. На RAG с широким контекстом это переворачивает сравнение, которое в короткой таблице выглядело в пользу OpenAI.
Не включать prompt caching и Batch API
Чтение из кэша у Opus 5 стоит $0,50 против $5 обычного входа — вдесятеро дешевле, и при TTL 5 минут запись окупается с первого попадания. Batch снимает ещё 50%, скидки складываются. Разбор 1000 документов на Opus 5: $75 в лоб и $37,50 через батч. Отдельно проверьте порог кэширования — минимальный префикс у Opus 5 снижен до 512 токенов, часть ваших промптов начнёт кэшироваться сама, без правок.
Строить продакшен на аккаунте, который вам не принадлежит
Россия не входит в список поддерживаемых стран Anthropic. Статус авторизованного реселлера не подтверждён ни у одной площадки, и никакая из них не даёт гарантий по условиям использования вендора. Сообщалось о случаях удаления российских аккаунтов без предупреждения, включая платные. Минимум, что стоит заложить: абстракция над провайдером в коде, второй канал доступа наготове и запас по балансу, который не жалко потерять.
Чек-лист перед тем, как выбрать модель
- Посчитать реальный профиль нагрузки: сколько входных, выходных и кэшируемых токенов в месяц, а не «примерно много»
- Проверить, уходит ли типовой запрос за порог длинного контекста — от этого зависит, применима ли к GPT-5.6 надбавка ×2/×1,5
- Свести бюджет в двух валютах: по официальному прайсу и по прайсу той площадки, через которую вы платите, с датой фиксации
- Сравнить как минимум две площадки: на 06.08.2026 Opus 5 стоил 1516/7579 ₽ в ProxyAPI и 1000/5000 ₽ в AITunnel
- Не закладывать в расчёт Batch и prompt caching, если покупаете через агрегатор — там эти режимы не заявлены
- Прогнать кандидатов на 50–100 своих реальных примерах, особенно если задача на русском: публичных русскоязычных бенчмарков по этим моделям нет
- Проверить Terra и Luna, прежде чем брать Sol: Terra по документации OpenAI позиционируется на уровне GPT-5.5 при вдвое меньшей цене
- Убедиться, что в агентном сценарии учтены платежи сверх токенов: веб-поиск $10 за 1000 запросов, контейнеры $0,05 в час, Managed Agents $0,08 в час
- Заложить
inference_geoосознанно: значение"us"умножает все категории токенов на 1,1 - Спрятать провайдера за абстракцией в коде, чтобы переключение между Claude, GPT и открытой моделью занимало правку конфига, а не переписывание сервиса
Итого
Если считать в долларах, картина такая. Claude Opus 5 дешевле GPT-5.6 Sol на выходе ($25 против $30), не берёт надбавку за длинный контекст, даёт кэш-чтение по $0,50 и Batch со скидкой 50%, а по верифицированным данным ARC Prize с большим отрывом выигрывает на ARC-AGI-3 и на процентный пункт опережает Sol на ARC-AGI-1 (97,5% против 96,5%). GPT-5.6 отвечает шириной линейки: Terra за $2/$12 закрывает большинство прикладных задач, а Luna за $0,20/$1,20 делает экономически осмысленными сценарии, которые на флагманах просто не считаются — массовую классификацию, разметку, первичный разбор потока документов.
Если считать в рублях через агрегатор, всё переворачивается. На прайсе ProxyAPI от 6 августа 2026 месяц работы чат-бота на Opus 5 обходится в 682 150 ₽ против 395 000 ₽ на Sol — при том что в долларах Claude дешевле. Причина не в моделях, а в разной наценке посредника: ×3,74 на Anthropic и ×1,93–1,97 на OpenAI. Смена площадки меняет счёт сильнее, чем смена модели: тот же Opus 5 в AITunnel идёт по ×2,47. Поэтому первый вопрос при планировании бюджета — не «Claude или GPT», а «через кого и по какому прайсу на какую дату».
Отдельно про доверие к цифрам. По Opus 5 Anthropic принципиально публикует относительные формулировки без абсолютных значений — «более чем вдвое», «в пределах 0,5%», «примерно в 1,5 раза». Это вендорские заявления, и подавать их как измерения нельзя. OpenAI в системной карте GPT-5.6 упоминает SWE-bench, Terminal-Bench и GPQA, но чисел не даёт. Всё, что можно проверить снаружи на август 2026, — это ARC Prize, замеры Artificial Analysis (сделанные до релиза Opus 5) и HealthBench из системной карты. Остальное, что вы встретите в обзорах с точностью до десятых, скорее всего сочинено.
Практический вывод простой. Возьмите свою реальную нагрузку, прогоните её на трёх кандидатах — Opus 5, Sol и Terra, — сравните не бенчмарки, а долю пройденных тестов на своих данных и итоговый счёт в рублях по прайсу вашей площадки. Разница между тирами одного вендора часто оказывается больше, чем разница между вендорами, а разница между агрегаторами — больше, чем и то и другое вместе.
Посчитаем ваш инференс до запуска
Подберём модель и тир под реальный профиль нагрузки, настроим кэширование и батчи, покажем бюджет в рублях с фиксацией даты прайса.