Для кого: solo-разработчики, пользователи Cursor/Codex и тимлиды, получившие доступ к GPT-5.6 — Sol, Terra и Luna выходят одновременно, но стратегия маршрутизации неочевидна. Вывод: дефолт июля — «Terra primary + Luna routing + Sol для сложных задач», а не массовый переход на Sol. Прогоните все три тира на изолированном Mac до смены production. Ниже: обзор тиров, три ловушки маршрутизации, матрица Sol/Terra/Luna, шесть шагов внедрения, цитируемые якоря цен и руководство по покупке.
Оглавление
Тиры GPT-5.6: Sol — флагман, Terra — баланс, Luna — скорость
OpenAI анонсировала GPT-5.6 в конце июня 2026 и открыла API и Codex в первую июльскую неделю. Новая номенклатура связывает номер поколения с уровнем возможностей: Sol (солнце) — флагман, Terra (земля) — ежедневный баланс, Luna (луна) — скорость и экономия.
Sol · флагманское reasoning и Agent-спринты
Эксклюзивный max reasoning и режим Ultra sub-Agent. Для планирования 50+ шагов, глубокого дебага и security-аудитов. Развёртывания Cerebras в июле достигают 750 tok/s — при максимальной стоимости за Token.
Terra · дефолт для coding и review
Производительность на уровне GPT-5.5 примерно за половину стоимости. Поддерживает контекст 1.5M Token с alignment fixes. Сюда направляйте ~70% ежедневного трафика.
Luna · маршрутизация, классификация, batch
Самый быстрый и дешёвый в семействе. Intent routing, lint-подсказки, batch-сводки и pre-screening Agent. Не заменяет multi-step reasoning Sol — но резко снижает $/task.
Три ловушки при выборе Sol, Terra или Luna
- Маршрутизация всего на Sol сжигает бюджет. Output Sol — $30/M Token. Режим Ultra порождает sub-Agents со stacked billing. Lint и routing через Sol могут поднять месячные расходы в 5–8× относительно Terra.
- Terra как Sol. У Terra нет Ultra sub-Agents и max reasoning. Сложные multi-repo рефакторинги через Terra вызывают retry, дороже чем сразу на Sol. См. руководство по окну запуска GPT-5.6.
- Luna для long context. У Luna ограниченная глубина окна. Review репозитория выше 500K Token — Terra или Sol. Luna классифицирует и chunk'ит, а не ведёт полный анализ.
Матрица Sol / Terra / Luna: какой тир для июльских нагрузок?
Сопоставляйте нагрузку с тиром. Избегайте крайностей: «самый дорогой = лучший» и «самый дешёвый = достаточно».
| Нагрузка | Рекомендуемый тир | Почему | Избегать |
|---|---|---|---|
| Agent-планирование 50+ шагов | Sol + Ultra | Sub-Agent parallelism, max reasoning | Terra / Luna |
| Ежедневный coding и PR review | Terra | ≈ GPT-5.5 quality, половина стоимости | Весь трафик на Sol |
| Анализ репо 1.5M Token | Terra или Sol | Long window + alignment fixes | Luna |
| Intent routing / batch-классификация | Luna | Минимальный $/request | Sol |
| Latency-sensitive Copilot | Luna → Terra upgrade | Быстрый Luna; эскалация при необходимости | Только Sol |
| Compliance / offline-сегменты | Local MLX fallback | Zero egress | Любой cloud-тир |
Production-wide Sol
Пиковое качество, но Ultra sub-Agents и max reasoning делают $/успешную задачу непредсказуемым. Когда DeepSeek и другие режут цены в июле, у вас нет A/B data для переговоров по бюджету.
Terra primary + Luna routing + Sol sprints (рекомендуется)
70% Terra daily, 20% Luna pre-screen, 10% Sol hard problems. Арендуйте выделенный M4, прогоните тот же harness на всех трёх тирах, затем настройте ratios по логам $/pass-rate.
Технические параметры тиров GPT-5.6
- Sol Ultra: sub-Agent parallelism; публичный score Terminal-Bench 2.1 — 91.9% (Sol Ultra).
- Terra context: до 1.5M Token с alignment fixes — см. обзор OpenAI июль 2026.
- Luna latency: минимальный p95 для routing и classification; не подходит для whole-repo analysis.
- Cerebras Sol: до 750 tok/s в раннем доступе — для latency-sensitive Copilot.
Шесть шагов: настройка маршрутизации GPT-5.6 в июле
- Подтвердите доступ к API tier: проверьте, попала ли организация в первую июльскую волну. Sol Ultra может требовать отдельной заявки.
- Зафиксируйте три типа benchmark task: long Agent runs (Sol), daily PR review (Terra), batch routing (Luna) — по руководству по окну GPT-5.6.
- Provision изолированного Mac node: SSH на M4, установите Cursor, Codex CLI и Ollama/MLX fallback по руководству по удалённой разработке.
- Parallel A/B по тирам: те же 10 production prompts на Sol, Terra и Luna. Логируйте p95 latency, pass rate и $/успешную задачу.
- Настройте smart routing: Luna для простых задач; низкая confidence → Terra. Только «sprint»-очередь использует Sol Ultra.
- Опубликуйте routing memo: tier ratios, budget caps и retest dates в team wiki — не в gut feel одного инженера.
Цитируемые якоря: цены и параметры Sol / Terra / Luna
Итоги: маршрутизация тиров побеждает дефолт «только Sol»
С выходом GPT-5.6 в июле Sol, Terra и Luna — не простая цепочка замены. Это многоуровневая система маршрутизации: Terra для daily work, Luna для pre-screening, Sol только когда max reasoning и Ultra sub-Agents оправдывают стоимость.
Parallel A/B на изолированном Mac testbed — с логами $/успешной задачи — защищает июльский API-бюджет лучше, чем погоня за release cadence OpenAI. Local MLX fallback держит CI в rate-limit weeks. См. руководство по локальному LLM на M4 для hybrid math.
Руководство по покупке: (1) задайте ratios Terra/Luna/Sol из матрицы → (2) откройте Тарифы и цены и выберите M4 с 16 ГБ+ RAM → (3) Арендуйте Mac сейчас и подключитесь по SSH в тот же день → (4) прогоните three-tier A/B плюс MLX fallback benchmarks только на арендованном узле → (5) на четвёртом месяце сравните utilization с порогом $106.9/мес. перед покупкой железа. Больше материалов на Технические идеи и главной.
До широкого rollout Sol/Terra/Luna — benchmark всех трёх тиров на одном изолированном M4
Тарифы 16 ГБ/24 ГБ, SSH и VNC в день заказа. Parallel Sol, Terra, Luna и MLX fallback — докажите ROI логами $/task до изменения production routing.