Связанное: окно запуска GPT-5.6, OpenAI июль 2026, тарифы vpshalo. Рекомендуемый tier для параллельного A/B трёх моделей: 512 ГБ / 24 ГБ.
Три барьера после split на Sol / Terra / Luna
1. Неверный default routing. ChatGPT по умолчанию использует Terra, API-документация перечисляет три endpoint. Agent pipeline с hardcoded model id теряет низкую задержку Sol и 1.5M контекст Luna — вы платите за tier, который не используете.
2. Cost avalanche на Luna. Luna открывает 1.5M token context. RAG pipeline, автоматически заполняющий окно, умножает spend в 8–15× vs Sol. Без tier alerts июльский invoice часто превышает forecast на 40–60%.
3. Alignment fix с разной интенсивностью. Все три tier получили alignment fix, но refusal boundaries и JSON-schema validation отличаются. Sol агрессивнее пропускает tool calls; Luna строже к jailbreak — один prompt даёт три разных output без tier-aware routing.
Матрица возможностей Sol / Terra / Luna
| Tier | Позиционирование | Context cap | Типичный сценарий | Относительная цена |
|---|---|---|---|---|
| Sol | Low-latency inference | 128K | Real-time Agent · high-frequency tool call · support bot | Минимум (~40% от Terra) |
| Terra | Balanced default | 512K | General chat · code completion · medium RAG | Базовый (1×) |
| Luna | Megacontext flagship | 1.5M | Legal/medical full-corpus · ultra-long spec analysis | Максимум (8–15× vs Sol) |
Логика имён: Sol — «солнце», скорость и энергия; Terra — «земля», универсальность; Luna — «луна», длинный цикл и глубокий reasoning. Общая база GPT-5.6; различия — context tier, глубина inference и pricing.
Технический принцип: четыре отличия для инженеров
- Latency stratification: Sol P95 first-token на 35–50% быстрее Terra; Luna медленнее из-за long-context prefill. Real-time Agent — Sol first.
- Tool call policy: Sol поддерживает более высокий parallel tool call ceiling; Luna строже валидирует schema — ниже failure rate на complex JSON, выше latency.
- Alignment fix intensity: Terra — baseline ChatGPT alignment; Sol чуть мягче ради speed; Luna — strictest, под compliance-sensitive workloads.
- Hybrid routing: production pattern «Sol для tool loop + Terra для summary + Luna только fallback» снижает total spend на 40–55% vs single-tier default.
Матрица решений: какой tier под ваш workload?
| Профиль команды | Рекомендуемый tier | Метод валидации |
|---|---|---|
| Real-time Agent / support bot | Sol primary | 24h shadow traffic на vpshalo M4, measure P95 |
| General SaaS chat | Terra default | Compare refusal rate vs GPT-5.5 baseline |
| Legal / medical megacontext RAG | Luna (start at 128K) | Escalate only on retrieval fail; 80% budget alert |
| Multi-tier A/B squad | All three parallel | 512 ГБ / 24 ГБ cloud Mac sandbox |
| Mobile + Xcode parallel dev | Sol + Terra hybrid | Cloud Mac runs Agent; local только UI build |
| Compliance re-certification | Luna staging · Terra prod | Dedicated sandbox — zero client-facing conflict |
Шесть шагов SOP: выбор и rollout Sol / Terra / Luna
- Шаг 1 — Snapshot GPT-5.5 baseline. Зафиксируйте P50/P95, tool call success rate и tokens per task за 7 дней — anchor для сравнения трёх tier.
- Шаг 2 — Provision isolated test host. Откройте vpshalo, tier Mac mini M4 512 ГБ / 24 ГБ. Tier A/B никогда не на production laptop.
- Шаг 3 — Same-trace replay на три tier. Прогоните anonymized production prompts через Sol, Terra, Luna; log latency, refusal и schema errors side by side.
- Шаг 4 — Define hybrid routing rules. Agent loop → Sol; user-visible reply → Terra; megacontext → Luna fallback only.
- Шаг 5 — Cost caps и rollback flags. Task spend >2× baseline → auto down-tier; error rate >2% → revert GPT-5.5.
- Шаг 6 — Week-2 July review. По measured ROI продлите или cancel vpshalo. Tier OpenAI меняются quarterly — sandbox capability must stay disposable.
Цитируемые ориентиры для architecture review
FAQ: Sol / Terra / Luna для builders
Q: Какой tier выбирают пользователи ChatGPT? Приложение default — Terra; Plus может переключить Luna для ultra-long threads. API developers маршрутизируют сами.
Q: Достаточно ли только Terra? Для MVP — да, но Agent latency и Luna-level RAG cost пострадают. Минимум Sol+Terra dual routing.
Q: Зачем арендовать Mac mini M4 для tier test? Monthly rent = isolated SSH, zero capex, cancel после benchmark — production environment остаётся чистым.
Итог: три tier — не marketing; routing определяет июльский invoice
GPT-5.6 GA означает: Sol — speed, Terra — general, Luna — megacontext. Пока вы не прогнали один trace через все три tier, benchmark в документации — шум.
Winning path: snapshot baseline → isolated Mac → triple replay → hybrid routing → data-driven traffic flip. Команды с disposable sandbox ship в launch week; команды на production laptop пишут postmortem.
Рекомендация по покупке: откройте vpshalo, tier Mac mini M4 512 ГБ / 24 ГБ, подключитесь по SSH. Запустите Sol/Terra/Luna tier sandbox сегодня — daily-driver Mac остаётся чистым, cancel после scorecard. Превратите tier confusion в tested routing, не July invoice shock.