1. Workload Parameters
Live Compute
24 seats
18 concurrent
45M tokens
Full-Stack Codex & API
Hybrid agent & IDE
Workspace & Chat
Interactive direct seats
Headless CI/CD
High TPM bursting
Enterprise Agent
Long-context retrieval
Tier Provisioning Status
Fully Provisioned (Plus & Business General Rollout Active)
GPT-6 Astra General Rollout Status
Work/Codex Seats
24
Dedicated seat allocations
API Pool Quota (TPM)
2,500,000
Tokens Per Minute headroom
Cost Optimization
32%
Vs unrouted pure API spend
2. Astra Reactive Routing Architecture
Hybrid Work/Codex direct integration with API fallback on rate burst
3. OpenAI GPT-6 Astra Tier Availability Matrix
| Tier | Rollout Status | Work/Codex Direct | API Access | Target Concurrency | Context Limit |
|---|
4. Migration Readiness Manifest & CI/CD Config