50 Intelligence · $0.033 / task
Сколько интеллекта
стоит одна задача.
Мне важна стоимость решённой задачи. Поэтому здесь рядом стоят две цифры: Intelligence Index и средняя цена одной задачи.
Каждая точка показывает среднюю стоимость одной задачи в Artificial Analysis Intelligence Index. Чем выше и левее точка, тем выгоднее модель.
34 → 52 от low до max
$3.689 / task · без effort ladder
Интеллект и стоимость одной задачи
Выбирай модели и effort. Линия соединяет уровни одной модели, поэтому сразу видно, сколько качества покупает следующий уровень рассуждения.
Luna хорошо реагирует на effort
У Luna Intelligence Index растёт с 34 на low до 52 на max, а цена задачи увеличивается примерно в 5,4 раза. Самый большой скачок даёт high. XHigh добавляет ещё 3 пункта, max ещё 2.
Для большинства моих обычных задач я бы начал с Luna high. На XHigh перешёл бы там, где три дополнительных пункта могут повлиять на результат.
Terra иногда можно пропустить
На графике эти пары дают одинаковый Intelligence Index при разной цене. Для своей задачи я всё равно проверил бы их на небольшом тесте.
Что даёт дополнительное рассуждение
Здесь видно, сколько баллов Intelligence Index добавляет каждый effort-уровень и как при этом меняется цена. Для Sonnet 5 уровни показаны отдельно, потому что AA пока не измерила четыре из них в этом индексе.
Если у тебя только Claude, я бы оставил Sonnet 5 моделью по умолчанию, а Opus 5 включал для самых сложных задач. Sonnet от low до xhigh появится на графике, когда AA опубликует измерения.
Все точки и цена задачи
В таблице указана средняя стоимость одной задачи Intelligence Index в USD. Для Sonnet 5 доступны low, medium, high и xhigh, но AA пока не опубликовала по ним benchmark-значения. Поэтому я вынес их отдельно.
| Модель / effort | Интеллект | Цена / задача | К baseline | Источник |
|---|---|---|---|---|
| GPT-5.6 Lunalow | 34 | $0.009 / task | +0 pts · 1.0× | AA ↗ |
| GPT-5.6 Lunamedium | 39 | $0.012 / task | +5 pts · 1.3× | AA ↗ |
| GPT-5.6 Lunahigh | 47 | $0.022 / task | +13 pts · 2.5× | AA ↗ |
| GPT-5.6 Lunaxhigh | 50 | $0.033 / task | +16 pts · 3.6× | AA ↗ |
| GPT-5.6 Lunamax | 52 | $0.049 / task | +18 pts · 5.4× | AA ↗ |
| GLM-5.3 Flashreference | 57 | $0.090 / task | справочно | AA ↗ |
| GPT-5.6 Terralow | 41 | $0.096 / task | +0 pts · 1.0× | AA ↗ |
| GPT-5.6 Terramedium | 47 | $0.12 / task | +6 pts · 1.3× | AA ↗ |
| Gemini 3.7 Flashlow | 51 | $0.16 / task | +0 pts · 1.0× | AA ↗ |
| GPT-5.6 Sollow | 51 | $0.18 / task | +0 pts · 1.0× | AA ↗ |
| GPT-5.6 Terrahigh | 50 | $0.23 / task | +9 pts · 2.4× | AA ↗ |
| Gemini 3.8 Flashlow | 52 | $0.24 / task | +0 pts · 1.0× | AA ↗ |
| Gemini 3.7 Flashmedium | 53 | $0.26 / task | +2 pts · 1.6× | AA ↗ |
| GPT-5.6 Solmedium | 56 | $0.29 / task | +5 pts · 1.6× | AA ↗ |
| GPT-5.6 Terraxhigh | 53 | $0.32 / task | +12 pts · 3.3× | AA ↗ |
| Gemini 3.7 Flashhigh | 56 | $0.40 / task | +5 pts · 2.5× | AA ↗ |
| Gemini 3.8 Flashmedium | 57 | $0.41 / task | +5 pts · 1.7× | AA ↗ |
| GPT-5.6 Solhigh | 57 | $0.43 / task | +6 pts · 2.4× | AA ↗ |
| Claude Opus 5low | 52 | $0.43 / task | +0 pts · 1.0× | AA ↗ |
| GPT-5.6 Terramax | 57 | $0.53 / task | +16 pts · 5.5× | AA ↗ |
| Gemini 3.8 Flashhigh | 59 | $0.58 / task | +7 pts · 2.4× | AA ↗ |
| GPT-5.6 Solxhigh | 59 | $0.63 / task | +8 pts · 3.5× | AA ↗ |
| Claude Opus 5medium | 59 | $0.72 / task | +7 pts · 1.7× | AA ↗ |
| GPT-5.5high | 55 | $0.82 / task | справочно | AA ↗ |
| GPT-5.6 Solmax | 61 | $0.95 / task | +10 pts · 5.3× | AA ↗ |
| Claude Opus 5high | 61 | $1.23 / task | +9 pts · 2.9× | AA ↗ |
| Claude Sonnet 5max | 55 | $1.72 / task | справочно | AA ↗ |
| Claude Opus 5xhigh | 63 | $1.80 / task | +11 pts · 4.2× | AA ↗ |
| Claude Opus 5max | 63 | $2.34 / task | +11 pts · 5.4× | AA ↗ |
| Claude Fable 5max | 62 | $3.14 / task | справочно | AA ↗ |
| Claude Fable 5.1max | 66 | $3.69 / task | справочно | AA ↗ |
Как считать эти цифры
Artificial Analysis складывает стоимость input, cache hit, cache write, reasoning и answer tokens, делит результат на число задач и учитывает вес каждого теста. Эти цифры помогают сравнить модели на одном наборе тестов. Цена вашей задачи может отличаться, особенно для сортировки папок, миграции базы или ночного прогона агента.
Данные: Artificial Analysis comparison ↗ · срез 2026-09-03