GPT-6 Astra перешла из статуса ограниченного превью в общедоступный режим в OpenAI API. Цена указана как $10 за миллион входных токенов и $50 за миллион выходных токенов для короткого контекста — без изменений по сравнению с ценой на момент анонса.

Что изменилось

3 сентября Astra была представлена как ограниченное превью для доверенных партнёров. Теперь модель указана на публичной странице цен как доступная — переход занял дни, а не недели или месяцы, которые обычно требуются для таких превью.

Задокументировано одно ограничение: быстрый режим недоступен для GPT-6 Astra при резидентности данных в ЕС. Команды, направляющие запросы через европейские эндпоинты по соображениям комплаенса, получают модель, но не низколатентный режим работы.

Почему оговорка про ЕС важна

Резидентность данных для многих европейских организаций — не опциональная возможность, а условие, при котором использование поставщика моделей из США вообще допустимо. Функция, доступная везде, кроме как за границей резидентности, создаёт двухуровневый опыт, при котором команды с самыми строгими требованиями получают самое медленное обслуживание.

Это стоит воспринимать скорее как инфраструктурный сигнал, чем как политический. Быстрый режим обычно зависит от конкретного оборудования в конкретных регионах, и воспроизвести такую конфигурацию внутри ЕС занимает больше времени, чем просто переключить настройку.

Где это находится сейчас

В линейке OpenAI Astra стоит на вершине по цене $10/$50, GPT-5.6 Sol предлагается по промо-цене $4/$20 до 21 ноября, Terra — по $2/$12, а Luna — по $0.20/$1.20 внизу линейки. Разница в 50 раз между самой дешёвой и самой дорогой моделью в одном семействе — диапазон шире, чем был в отрасли год назад.

Региональная обработка данных влечёт наценку в 10% для моделей, выпущенных начиная с 5 марта 2026 года, поэтому цена Astra в ЕС выше базовой — и при этом медленнее.

Что делать

Если вы тестируете Astra из Европы, проводите бенчмарки на эндпоинте с резидентностью, а не на стандартном — показатели, полученные на американском эндпоинте, будут отличаться от тех, что вы получите в продакшене. Для всех остальных решение сводится к обычному вопросу о моделях высшего уровня: стоит ли ответ $50 за миллион выходных токенов для конкретной задачи, или модель, которая в десять раз дешевле, закрывает разрыв.