AI-мощности·23 мин·6 августа 2026

Claude Opus 5 vs GPT-5.6: какую модель брать под API в 2026

Opus 5 и GPT-5.6 Sol официально стоят одинаково — $5 за 1M входа. В ProxyAPI на 06.08.2026 это 1516 ₽ против 800 ₽. Считаем цены, бенчмарки и наценку.

Команда autollab
Claude Opus 5 vs GPT-5.6: какую модель брать под API в 2026
Коротко

24 июля 2026 Anthropic выпустила Claude Opus 5 по цене предшественника — $5 за 1M входных и $25 за 1M выходных токенов, контекст 1M без надбавки за длину. 9 июля OpenAI открыла общий доступ к GPT-5.6, который состоит из трёх тиров: Sol ($5/$30), Terra ($2/$12) и Luna ($0,20/$1,20) — разброс цены внутри одного релиза в 25 раз. По независимым замерам ARC Prize Opus 5 выигрывает на ARC-AGI-1 (97,5% против 96,5%) и с большим отрывом на ARC-AGI-3 (30,16% против 7,78%), но проигрывает на ARC-AGI-2 при максимальном reasoning (90,4% против 92,5%). SWE-bench Verified ни Anthropic, ни OpenAI по этим моделям не публиковали — цифры вроде «96%» взяты из контент-ферм. Для бизнеса из России решающим оказывается не бенчмарк, а посредник: на прайсе ProxyAPI от 06.08.2026 Opus 5 идёт с наценкой ×3,74 к официальной цене, а GPT-5.6 Sol — всего ×1,93–1,97.

24 июля 2026 года Anthropic выпустила Claude Opus 5 — и не подняла цену. Вход остался $5 за миллион токенов, выход $25. Ровно столько же стоили Opus 4.8, 4.7, 4.6 и 4.5. За пятнадцать дней до этого, 9 июля, OpenAI открыла общий доступ к GPT-5.6, где вместо одной модели теперь три тира с ценами от $0,20 до $5 за миллион входных токенов — разброс в 25 раз внутри одного релиза.

Полтора месяца назад мы разбирали Fable 5 против Opus 4.8 и Sonnet 4.6. Та картина больше не работает. Opus 4.8 сместился с позиции «рабочая лошадка за $5», её занял Opus 5 по той же цене. Логика «доплачиваешь вдвое за Fable ради сложного кодинга» размылась: по заявлению Anthropic, на CursorBench 3.2 при максимальном effort Opus 5 отстаёт от пикового Fable 5 менее чем на 0,5% при вдвое меньшей стоимости задачи. А на стороне OpenAI выбор из одной модели превратился в выбор из трёх.

И есть третий сюжет, которого нет ни в одном англоязычном обзоре. Для бизнеса из России выбор между Opus 5 и GPT-5.6 — это не выбор модели, а выбор посредника. Наценка агрегаторов неодинакова по вендорам. Официально вход у Opus 5 и у GPT-5.6 Sol стоит одинаково — $5 за 1M. На прайс-листе ProxyAPI от 6 августа 2026 Opus 5 стоит 1516 ₽ за миллион входных токенов, а Sol — 800 ₽. Порядок моделей по цене в рублях просто не совпадает с порядком по цене в долларах.

Дальше — только подтверждаемые цифры: прайсы из документации вендоров, верифицированные результаты ARC Prize, замеры Artificial Analysis, публичные рублёвые прайс-листы агрегаторов. Отдельным блоком — какие из гуляющих по рунету цифр не подтверждаются ничем.

$5 / $25
Claude Opus 5 за 1M вход/выход
×3,74
наценка ProxyAPI на Opus 5
30,16%
ARC-AGI-3 у Opus 5 против 7,78% у Sol
81,1291 ₽
курс ЦБ РФ на 05.08.2026

Что именно устарело после 24 июля

Три конкретных пункта.

Первое: Opus 4.8 покупать больше незачем. Opus 5 стоит столько же — $5 за 1M входа и $25 за 1M выхода — и, по заявлению Anthropic, более чем вдвое улучшает результат Opus 4.8 на внутреннем агентном бенчмарке Frontier-Bench v0.1 при меньшей стоимости задачи. Абсолютных чисел компания не приводит, только относительное утверждение. Но даже если оно завышено вдвое, платить ту же цену за старую модель смысла нет. У Opus 5 к тому же отдельный пул rate limits, не общий с линейкой Opus 4.x — миграция не отъедает лимиты у работающих сервисов.

Второе: доплата за Fable 5 схлопнулась на большинстве задач. Fable 5 стоит $10/$50 — ровно вдвое дороже Opus 5. Anthropic заявляет, что Opus 5 на CursorBench 3.2 отстаёт от пикового Fable 5 менее чем на 0,5% при половинной цене задачи, а на бенчмарке компьютерного управления OSWorld 2.0 даже превосходит лучший результат Fable 5 — примерно за треть его стоимости. Это вендорские заявления без чисел, проверить их снаружи нельзя. Но направление понятное: сценарий «берём Fable, потому что это единственный вариант для сложной агентной работы» стал куда менее очевидным.

Третье: у OpenAI теперь не модель, а линейка. GPT-5.6 состоит из трёх тиров с отдельными ID: gpt-5.6-sol (алиас gpt-5.6), gpt-5.6-terra и gpt-5.6-luna. Контекст у всех трёх одинаковый — 1 050 000 токенов, максимальный вывод 128 000, отсечка знаний 16 февраля 2026. Различаются они reasoning-мощностью и ценой. Разговор «GPT против Claude» теперь бессмыслен без указания тира.

Claude Opus 5: что известно точно

Начнём с того, что можно проверить в документации.

Цены. $5 за 1M входных токенов, $25 за 1M выходных. Prompt caching: запись кэша с TTL 5 минут — $6,25 (×1,25 к входу), с TTL 1 час — $10 (×2), чтение из кэша — $0,50 (×0,1). Арифметика простая: при пятиминутном TTL кэш окупается уже после первого чтения. Переплата за запись — 25% к обычному входу, чтение — вдесятеро дешевле входа, так что второй запрос с тем же префиксом уже в плюсе.

Batch API даёт 50% скидки на вход и выход: $2,50 и $12,50 за 1M. Скидки Batch и prompt caching складываются. Плюс на Batch API модели Opus 5, Opus 4.8, 4.7, 4.6, Sonnet 5 и Sonnet 4.6 поддерживают вывод до 300 000 токенов через бета-заголовок output-300k-2026-03-24 — против 128K в синхронном Messages API. Если вы генерируете длинные документы пачками, это единственный документированный способ выйти за 128K.

Контекст. 1 000 000 токенов, вывод до 128 000. Ключевая деталь, которую легко пропустить: полное окно тарифицируется по стандартной ставке, надбавки за длинный контекст нет вовсе. У OpenAI, как увидим ниже, она есть.

Fast mode. $10/$50 — ровно вдвое к базе, вывод по документации до 2,5 раза быстрее. Доступен только в первичном Claude API: ни на Amazon Bedrock, ни в Google Cloud, ни в Microsoft Foundry его нет. С Batch API несовместим — что логично, батчи и так асинхронные.

Две мелочи, которые считаются деньгами на агентных сценариях. Служебный системный промпт для tool use у Opus 5 занимает 286 токенов при tool_choice: auto/none — против 675 у Opus 4.7 и 290 у Opus 4.8. На тысячах вызовов инструментов это заметная строка в счёте. И минимальный кэшируемый префикс снижен до 512 токенов против 1024 у Opus 4.8: промпты, которые раньше просто не попадали в кэш, теперь кэшируются без единой правки в коде.

Отсечка знаний — май 2026. Надёжная граница знаний там же.

Про Opus 5 отдельно стоит держать в голове бухгалтерию сверх токенов. Веб-поиск у Anthropic стоит $10 за 1000 запросов, code execution даёт 1550 бесплатных часов в месяц на организацию и потом $0,05 за час на контейнер, Claude Managed Agents — $0,08 за час активной сессии сверх токенов. Плюс параметр inference_geo: "us" (гарантия обработки в США) для моделей 4.6 и новее умножает все категории токенов на 1,1 — вход, выход, запись и чтение кэша.

GPT-5.6: три тира вместо одной модели

Здесь придётся быть аккуратнее с датами. Системная карта OpenAI датирует превью 26 июня 2026 и говорит о более широком доступе «в ближайшие недели». Общая доступность в ChatGPT, Codex и API — 9 июля 2026, и эта дата подтверждается независимо: тем же числом ARC Prize датирует тест Sol, тем же числом Artificial Analysis публикует разбор. Превью и GA — разные события, смешивать их не надо.

Позиционирование тиров по документации OpenAI: Sol — для сложных рассуждений, кодинга и долгих агентных задач; Terra — сбалансированный тир с производительностью на уровне GPT-5.5 при вдвое меньшей цене; Luna — самый быстрый и дешёвый, под высокообъёмные задачи.

Цены на коротком контексте: Sol $5/$30, Terra $2/$12, Luna $0,20/$1,20 за 1M. Кэшированный вход — ровно 10% от цены входа: $0,50, $0,20 и $0,02 соответственно. Batch API — те же минус 50% на все три тира.

А вот дальше начинается то, чего у Anthropic нет. У GPT-5.6 действует отдельный тариф на длинный контекст: Sol $10 вход / $1 кэш / $45 выход, Terra $4/$0,40/$18, Luna $0,40/$0,04/$1,80. То есть ×2 по входу и ×1,5 по выходу.

В текстовом описании документации OpenAI сказано, что множитель длинного контекста — ×2 «на вход, запись кэша и выход». Числовая таблица на той же странице даёт по выходу ×1,5: Sol $30 → $45, Terra $12 → $18, Luna $1,20 → $1,80. Расхождение внутри одного документа. Считать бюджет надо по таблице, но заложить запас — по тексту.

Практический вывод: если ваш сценарий систематически уходит за порог длинного контекста, экономика GPT-5.6 меняется, а экономика Opus 5 — нет. У Anthropic окно на миллион токенов тарифицируется по единой ставке.

Таблица 1. Официальные цены за 1M токенов, август 2026

Курс ЦБ РФ на 05.08.2026 — 81,1291 ₽/$. Рублёвые значения — пересчёт по этому курсу, а не реальная цена покупки из России.

МодельВход, $Выход, $Чтение кэша, $Batch вход/выход, $Вход, ₽Выход, ₽
Claude Opus 55,0025,000,502,50 / 12,504062 028
Claude Opus 5 Fast mode10,0050,00недоступно8114 056
Claude Fable 510,0050,001,005,00 / 25,008114 056
Claude Sonnet 5 (интро до 31.08.2026)2,0010,000,201,00 / 5,00162811
Claude Sonnet 5 (с 01.09.2026)3,0015,000,301,50 / 7,502431 217
GPT-5.6 Sol5,0030,000,502,50 / 15,004062 434
GPT-5.6 Terra2,0012,000,201,00 / 6,00162973
GPT-5.6 Luna0,201,200,020,10 / 0,601697

Отдельно: у GPT-5.6 действует повышенный тариф на длинный контекст (Sol $10 вход / $45 выход, Terra $4/$18, Luna $0,40/$1,80). У Claude Opus 5 всё окно в 1M токенов тарифицируется по единой ставке — надбавки за длинный контекст нет.

Источники: платформа Claude, раздел Pricing, документация OpenAI, Pricing, ЦБ РФ.

Обратите внимание на строку выхода: Opus 5 отдаёт токены по $25, Sol — по $30. В долларах Claude на выходе дешевле примерно на 17%. Запомните это, к рублям вернёмся через два раздела.

Бенчмарки: что подтверждено, а что придумано

Тут придётся разочаровать половину рунета.

Ни Anthropic, ни OpenAI не опубликовали SWE-bench Verified для этих моделей. В анонсе Opus 5 от 24 июля этого бенчмарка нет вообще — там Frontier-Bench v0.1, CursorBench 3.2, OSWorld 2.0, Zapier AutomationBench и ARC-AGI-3. Системная карта GPT-5.6 упоминает SWE-bench, Terminal-Bench и GPQA, но числовых значений по ним не приводит. При этом по русско- и англоязычным SEO-сайтам гуляет цифра «96,0% SWE-bench Verified у Opus 5». Первоисточника у неё нет. Туда же — «Frontier-Bench 43,3%», «SWE-bench Pro 79,2%» и «knowledge-work Elo 1861». Из всего набора цифр, который эти сайты приписывают Opus 5, независимо подтверждается ровно одна — ARC-AGI-3, и та в первоисточнике равна 30,16%, а не округлённым 30,2%.

То же с «88,8% на Terminal-Bench 2.1 у Sol» — цифра живёт только во вторичных блогах.

Что подтверждается — сведено в таблицу.

Таблица 2. Подтверждённые бенчмарки: Claude Opus 5 против GPT-5.6 Sol

Включены только результаты, опубликованные автором бенчмарка или независимым верификатором. Всё, что публиковали сами вендоры в относительных формулировках, вынесено в примечание.

БенчмаркClaude Opus 5GPT-5.6 SolКто измерялДата теста
ARC-AGI-1 (max)97,5%96,5%ARC Prize (verified)24.07 / 09.07.2026
ARC-AGI-2 (max)90,4%92,5%ARC Prize (verified)24.07 / 09.07.2026
ARC-AGI-2 (high)88,3%85,4%ARC Prize (verified)24.07 / 09.07.2026
ARC-AGI-330,16% (high)7,78% (max)ARC Prize (verified)24.07 / 09.07.2026
Intelligence Indexне измерялся59 (max)Artificial Analysis09.07.2026
Coding Agent Indexне измерялся80 (max)Artificial Analysis09.07.2026
HealthBench Consensusне публиковался95,5системная карта OpenAI26.06.2026
SWE-bench Verifiedне публиковалсяне публиковался

Примечание. Anthropic по Opus 5 публикует только относительные утверждения без абсолютных чисел: Frontier-Bench v0.1 — «более чем вдвое лучше Opus 4.8 при меньшей стоимости задачи»; CursorBench 3.2 — «в пределах 0,5% от пика Fable 5 при половинной цене»; OSWorld 2.0 — «выше пика Fable 5 при ~1/3 стоимости»; Zapier AutomationBench — «примерно в 1,5 раза выше следующей модели при той же цене задачи».

Источники: ARC Prize — Claude Opus 5, ARC Prize — GPT-5.6 Sol, Artificial Analysis, системная карта GPT-5.6, анонс Claude Opus 5.

Из этой таблицы следует не «Х победил», а более полезная вещь: счёт зависит от версии теста. На ARC-AGI-2 при максимальном reasoning впереди Sol — 92,5% против 90,4%. На том же ARC-AGI-2 в режиме high впереди Opus 5 — 88,3% против 85,4%. На ARC-AGI-3 Opus 5 опережает Sol примерно в 3,9 раза (30,16% против 7,78%) и держит лучший результат среди всех протестированных систем. При этом Sol стала первой моделью, выигравшей публичную игру ARC-AGI-3 — 87,1% на задаче FT09. Любая публикация вида «на ARC-AGI лидирует X» без указания версии и режима — просто шум.

Anthropic, кстати, в анонсе говорит о результате «втрое выше следующей модели» на ARC-AGI-3. По верифицированным данным ARC Prize отношение к лучшему результату Sol — примерно 3,9×. Возможно, «следующей моделью» у них была не Sol. Но повторять «ровно втрое» как измеренную цифру не стоит.

Два индекса Artificial Analysis — Intelligence Index (Sol max 59, Terra 55, Luna 51, при 60 у Fable 5 max) и Coding Agent Index (Sol 80, Terra 77, Luna 75) — опубликованы 9 июля, за две недели до релиза Opus 5. Сравнивать по ним Opus 5 с GPT-5.6 нельзя физически: на момент замера Opus 5 не существовало.

По агрегатору llm-stats.com Sol даёт 64,6% на SWE-bench Pro против 58,6% у GPT-5.5, 94,6% на GPQA против 93,6%, 91,5% на MRCR v2 (8 иголок) против 74,0% — и 83,0% на MMMU-Pro против 83,2%, то есть на мультимодальных задачах прироста нет вовсе. Это данные агрегатора, без разделения на самозаявленные и независимо проверенные, — берите как ориентир, а не как измерение.

Публичных бенчмарков качества русского языка нет ни у Anthropic, ни у OpenAI, ни у независимых верификаторов — ни для Opus 5, ни для GPT-5.6. Если русский критичен, единственный честный путь — собрать свой набор из 50–100 реальных примеров и прогнать оба варианта. Как это делается на практике, мы разбирали в статье про замену ChatGPT в России на материале MERA.

Подключить Opus 5 или GPT-5.6 без танцев с прокси

Настраиваем инференс под вашу задачу: выбор тира, prompt caching, batch-режим и расчёт бюджета в рублях до запуска.

Обсудить задачу

Сколько это стоит из России

Теперь главное. Официальные прайсы для российской компании — это справочная информация, а не цена покупки. Россия и Белоруссия отсутствуют в списке поддерживаемых стран Anthropic — и для коммерческого API, и для Claude.ai; компания оставляет за собой право не обслуживать организации с преобладающим владением из стран вне списка. Практические последствия и обходные пути мы подробно разбирали в материале как подключить Claude в России, для OpenAI — в статье про API без VPN.

Реальная цена — это прайс агрегатора.

Таблица 3. Наценка агрегаторов на 6 августа 2026

Цены агрегаторов — с их публичных прайс-листов на 06.08.2026. Колонка «наценка» — расчёт: цена агрегатора, делённая на официальную цену по курсу ЦБ 81,1291 ₽/$.

МодельОфициально, ₽ вход/выходProxyAPI, ₽ вход/выходНаценка ProxyAPIAITunnel, ₽ вход/выходНаценка AITunnel
Claude Opus 5406 / 2 0281 516 / 7 579×3,74 / ×3,741 000 / 5 000×2,47 / ×2,47
Claude Opus 4.8406 / 2 0281 516 / 7 579×3,74 / ×3,74нет данных
Claude Sonnet 5 (интро)162 / 811800 / 4 500×4,93 / ×5,55нет данных
GPT-5.6 Sol406 / 2 434800 / 4 700×1,97 / ×1,93нет данных
GPT-5.6 Terra162 / 973400 / 2 560×2,47 / ×2,63нет данных
GPT-5.6 Luna16 / 9760 / 360×3,70 / ×3,70нет данных
GPT-5.5нет актуальной офиц. цены1 520 / 9 100нет данных

Ключевое наблюдение: наценка не единая. Официально вход у Claude Opus 5 и GPT-5.6 Sol стоит одинаково — $5 за 1M. В ProxyAPI Opus 5 стоит 1 516 ₽, а Sol — 800 ₽. Подразумеваемый курс: ~303 ₽/$ для Claude и ~157–160 ₽/$ для GPT-5.6. Порядок моделей по цене в рублях не совпадает с порядком по цене в долларах.

Второе наблюдение: вводная скидка Anthropic на Sonnet 5 ($2/$10 до 31.08.2026) до российского покупателя не доходит — прайс ProxyAPI соответствует расчёту от базового тарифа $3/$15, а не от интро-цены.

Источники: прайс-лист ProxyAPI, страница Claude Opus 5 в AITunnel, курс ЦБ РФ.

Разница между площадками тоже неодинакова. Тот же Opus 5 в AITunnel стоит 1000/5000 ₽ — это ×2,47 к официальной цене, подразумеваемый курс 200 ₽/$, то есть примерно на треть дешевле, чем в ProxyAPI. На сайте площадки на 6 августа 2026 заявлены OpenAI-совместимый API на api.aitunnel.ru/v1, оплата рублями картой, минимальное пополнение 500 ₽ и работа без VPN. Все цены ProxyAPI — с НДС 5%.

Про сам рынок посредников: по разбору Sostav от мая 2026, ProxyAPI зарегистрирован как ИП, AITunnel — тоже как ИП, Polza AI — как ООО. Там же наценка ProxyAPI оценивалась примерно в 3× на флагманы; расчёт по действующему прайсу показывает, что единой наценки у площадки нет — ×3,74 на Claude и ×1,93–1,97 на Sol. Цены Polza AI, которые «практически на уровне официальных», в том же обзоре прямо помечены как подозрительные: возможная подмена моделей или использование «серых» аккаунтов.

Считать российского агрегатора официальным реселлером, партнёром или авторизованным дистрибьютором Anthropic или OpenAI нет оснований: подтверждений такого статуса нет ни у одной площадки. В феврале–марте 2026 сообщалось о случаях удаления российских аккаунтов без предупреждения, затрагивавших и бесплатные, и платные учётные записи; единственный источник этих сообщений — корпоративный блог агрегатора на Хабре, то есть сторона, заинтересованная в продаже обхода. Масштаб независимо не подтверждён. Отдельно: prompt caching и Batch API в прайс-листах ProxyAPI и AITunnel не заявлены — экономику через агрегатор считайте только по базовым ставкам, без скидок.

Таблица 4. Стоимость типовых бизнес-задач, август 2026

Расчёт редакции по официальным тарифам и прайсам агрегаторов; курс ЦБ 81,1291 ₽/$. Сценарии условные, без учёта платы за веб-поиск, code execution и время сессий Managed Agents.

Сценарий А. Разбор 1000 документов — 10 000 входных и 1 000 выходных токенов на документ (итого 10M вход + 1M выход).

Модель / каналСинхронноЧерез Batch (−50%)
Claude Opus 5, официально$75 (6 085 ₽)$37,50 (3 042 ₽)
Claude Opus 5, ProxyAPI22 739 ₽пакетный режим не заявлен
Claude Opus 5, AITunnel15 000 ₽пакетный режим не заявлен
Claude Sonnet 5 (интро), официально$30 (2 434 ₽)$15 (1 217 ₽)
GPT-5.6 Sol, официально$80 (6 490 ₽)$40 (3 245 ₽)
GPT-5.6 Sol, ProxyAPI12 700 ₽
GPT-5.6 Terra, официально$32 (2 596 ₽)$16 (1 298 ₽)
GPT-5.6 Terra, ProxyAPI6 560 ₽
GPT-5.6 Luna, официально$3,20 (260 ₽)$1,60 (130 ₽)
GPT-5.6 Luna, ProxyAPI960 ₽

Сценарий Б. Чат-бот поддержки — 100 000 сообщений в месяц, 2 000 входных и 500 выходных токенов на сообщение (200M вход + 50M выход), без кэширования.

МодельОфициально, $Официально, ₽Через ProxyAPI, ₽
Claude Opus 52 250182 540682 150
Claude Sonnet 5 (интро)90073 016385 000
GPT-5.6 Sol2 500202 823395 000
GPT-5.6 Terra1 00081 129208 000
GPT-5.6 Luna1008 11330 000

Сценарий В. Один длинный агент-ран — 100k некэшированного входа, 400k чтений из кэша, 100k записей в кэш (5 мин), 60k выходных токенов.

МодельРасчётИтог
Claude Opus 50,1×$5 + 0,4×$0,50 + 0,1×$6,25 + 0,06×$25$2,83 (229 ₽)
GPT-5.6 Sol0,1×$5 + 0,4×$0,50 + 0,1×$5 + 0,06×$30$3,00 (243 ₽)
GPT-5.6 Terra0,1×$2 + 0,4×$0,20 + 0,1×$2 + 0,06×$12$1,20 (97 ₽)

Важная структурная разница: у Anthropic запись в кэш стоит дороже обычного входа (×1,25 при TTL 5 минут, ×2 при TTL 1 час), у OpenAI в опубликованном прайсе отдельной надбавки за запись нет — есть только сниженная цена кэшированного входа. На коротких сессиях с редкими попаданиями это работает в пользу OpenAI, на длинных с высоким hit-rate разница нивелируется.

Источники цен: Claude Pricing, OpenAI Pricing, ProxyAPI, AITunnel.

Посмотрите на сценарий Б внимательно. В долларах Opus 5 дешевле Sol: 2 250 против 2 500. В рублях через ProxyAPI — 682 150 против 395 000, то есть Claude дороже примерно в 1,7 раза. Одна и та же нагрузка, один и тот же месяц, противоположный ответ. Это и есть главный практический вывод статьи: для российской компании выбор канала доступа влияет на счёт сильнее, чем выбор модели.

Что вышло рядом — коротко

Kimi K3 от Moonshot AI: открытая модель на 2,8 трлн параметров, анонсирована 16–17 июля 2026 (Simon Willison даёт 16-е, The Agent Report — 17-е), контекст 1M токенов, веса обещали к 27 июля (сам факт публикации мы не проверяли). По самозаявленным бенчмаркам обходит Opus 4.8 (max) и GPT-5.5 (high), но уступает Fable 5 и GPT-5.6 Sol. Для тех, кому важно держать данные внутри контура, это уже реальная опция — подробнее про экономику своего железа мы писали в разборе локального инференса.

Про Gemini 3.5 у нас только вторичные источники: они называют цену Flash в $1,50/$9,00 за 1M и относят запуск Gemini 3.5 Pro к следующему дню после анонса Kimi K3. До прайса Google мы не дошли, так что и цену, и дату считайте непроверенными — перед закладыванием в бюджет сверьтесь с Vertex AI Pricing.

Восемь ошибок при выборе между Opus 5 и GPT-5.6

Сравнивать «Claude» и «GPT» без указания тира

GPT-5.6 — это не модель, а три модели. Luna стоит $0,20 за 1M входа, Sol — $5. Разница в 25 раз. Фраза «мы перешли на GPT-5.6 и стало дешевле» без указания тира не значит ничего. И наоборот: если тестировали на Luna, а в продакшене включили Sol, счёт при том же профиле нагрузки вырастет в 25 раз.

Считать бюджет в долларах, покупая в рублях

Классика. Финдиректор берёт официальный прайс, умножает на курс ЦБ, получает 182 540 ₽ за месяц чат-бота на Opus 5 — а по счёту уходит 682 150 ₽. Наценка агрегатора не равномерна: ×3,74 на Claude, ×1,93–1,97 на Sol, ×3,70 на Luna. Считайте по прайсу той площадки, через которую реально платите, и с датой фиксации.

Верить цифре «96% SWE-bench Verified»

Её нет ни в анонсе Anthropic, ни в системной карте OpenAI. Обе компании по этим релизам SWE-bench Verified не публиковали. Цифра пришла из AI-контент-ферм и разошлась по рунету. Если вы обосновываете выбор модели перед руководством — не ссылайтесь на неё, вопрос «а где первоисточник» вы проиграете.

Читать «на ARC-AGI лидирует X» без версии

На ARC-AGI-2 при max впереди Sol (92,5% против 90,4%), на ARC-AGI-2 при high — Opus 5 (88,3% против 85,4%), на ARC-AGI-3 — Opus 5 с отрывом почти вчетверо. Три ответа на один вопрос. Любой обзор, который называет одного победителя, что-то от вас скрыл.

Сравнивать Opus 5 по индексам Artificial Analysis

Intelligence Index и Coding Agent Index за 9 июля не содержат Opus 5, потому что модели тогда не было. Вы увидите в таблице Sol 59 и Fable 5 60 — и захотите достроить туда Opus 5 по аналогии. Не надо, это будет выдумка.

Игнорировать надбавку за длинный контекст у GPT-5.6

Если ваши промпты систематически длинные, Sol на входе стоит не $5, а $10, и на выходе не $30, а $45. У Opus 5 такой надбавки нет вообще. На RAG с широким контекстом это переворачивает сравнение, которое в короткой таблице выглядело в пользу OpenAI.

Не включать prompt caching и Batch API

Чтение из кэша у Opus 5 стоит $0,50 против $5 обычного входа — вдесятеро дешевле, и при TTL 5 минут запись окупается с первого попадания. Batch снимает ещё 50%, скидки складываются. Разбор 1000 документов на Opus 5: $75 в лоб и $37,50 через батч. Отдельно проверьте порог кэширования — минимальный префикс у Opus 5 снижен до 512 токенов, часть ваших промптов начнёт кэшироваться сама, без правок.

Строить продакшен на аккаунте, который вам не принадлежит

Россия не входит в список поддерживаемых стран Anthropic. Статус авторизованного реселлера не подтверждён ни у одной площадки, и никакая из них не даёт гарантий по условиям использования вендора. Сообщалось о случаях удаления российских аккаунтов без предупреждения, включая платные. Минимум, что стоит заложить: абстракция над провайдером в коде, второй канал доступа наготове и запас по балансу, который не жалко потерять.

Чек-лист перед тем, как выбрать модель

  • Посчитать реальный профиль нагрузки: сколько входных, выходных и кэшируемых токенов в месяц, а не «примерно много»
  • Проверить, уходит ли типовой запрос за порог длинного контекста — от этого зависит, применима ли к GPT-5.6 надбавка ×2/×1,5
  • Свести бюджет в двух валютах: по официальному прайсу и по прайсу той площадки, через которую вы платите, с датой фиксации
  • Сравнить как минимум две площадки: на 06.08.2026 Opus 5 стоил 1516/7579 ₽ в ProxyAPI и 1000/5000 ₽ в AITunnel
  • Не закладывать в расчёт Batch и prompt caching, если покупаете через агрегатор — там эти режимы не заявлены
  • Прогнать кандидатов на 50–100 своих реальных примерах, особенно если задача на русском: публичных русскоязычных бенчмарков по этим моделям нет
  • Проверить Terra и Luna, прежде чем брать Sol: Terra по документации OpenAI позиционируется на уровне GPT-5.5 при вдвое меньшей цене
  • Убедиться, что в агентном сценарии учтены платежи сверх токенов: веб-поиск $10 за 1000 запросов, контейнеры $0,05 в час, Managed Agents $0,08 в час
  • Заложить inference_geo осознанно: значение "us" умножает все категории токенов на 1,1
  • Спрятать провайдера за абстракцией в коде, чтобы переключение между Claude, GPT и открытой моделью занимало правку конфига, а не переписывание сервиса

Итого

Если считать в долларах, картина такая. Claude Opus 5 дешевле GPT-5.6 Sol на выходе ($25 против $30), не берёт надбавку за длинный контекст, даёт кэш-чтение по $0,50 и Batch со скидкой 50%, а по верифицированным данным ARC Prize с большим отрывом выигрывает на ARC-AGI-3 и на процентный пункт опережает Sol на ARC-AGI-1 (97,5% против 96,5%). GPT-5.6 отвечает шириной линейки: Terra за $2/$12 закрывает большинство прикладных задач, а Luna за $0,20/$1,20 делает экономически осмысленными сценарии, которые на флагманах просто не считаются — массовую классификацию, разметку, первичный разбор потока документов.

Если считать в рублях через агрегатор, всё переворачивается. На прайсе ProxyAPI от 6 августа 2026 месяц работы чат-бота на Opus 5 обходится в 682 150 ₽ против 395 000 ₽ на Sol — при том что в долларах Claude дешевле. Причина не в моделях, а в разной наценке посредника: ×3,74 на Anthropic и ×1,93–1,97 на OpenAI. Смена площадки меняет счёт сильнее, чем смена модели: тот же Opus 5 в AITunnel идёт по ×2,47. Поэтому первый вопрос при планировании бюджета — не «Claude или GPT», а «через кого и по какому прайсу на какую дату».

Отдельно про доверие к цифрам. По Opus 5 Anthropic принципиально публикует относительные формулировки без абсолютных значений — «более чем вдвое», «в пределах 0,5%», «примерно в 1,5 раза». Это вендорские заявления, и подавать их как измерения нельзя. OpenAI в системной карте GPT-5.6 упоминает SWE-bench, Terminal-Bench и GPQA, но чисел не даёт. Всё, что можно проверить снаружи на август 2026, — это ARC Prize, замеры Artificial Analysis (сделанные до релиза Opus 5) и HealthBench из системной карты. Остальное, что вы встретите в обзорах с точностью до десятых, скорее всего сочинено.

Практический вывод простой. Возьмите свою реальную нагрузку, прогоните её на трёх кандидатах — Opus 5, Sol и Terra, — сравните не бенчмарки, а долю пройденных тестов на своих данных и итоговый счёт в рублях по прайсу вашей площадки. Разница между тирами одного вендора часто оказывается больше, чем разница между вендорами, а разница между агрегаторами — больше, чем и то и другое вместе.

Посчитаем ваш инференс до запуска

Подберём модель и тир под реальный профиль нагрузки, настроим кэширование и батчи, покажем бюджет в рублях с фиксацией даты прайса.

Запустить расчёт

Похожие статьи