Федеральные ведомства и защищенные организации государственного сектора, работающие в закрытых облачных периметрах, теперь могут использовать новейшую архитектуру искусственного интеллекта от OpenAI. Компания Amazon Web Services объявила о запуске моделей OpenAI GPT-5.6 Terra и Luna на базе Amazon Bedrock в регионах AWS GovCloud (US-West) и AWS GovCloud (US-East). Это внедрение интегрирует передовой механизм инференса OpenAI, разработанный специально для удовлетворения строгих требований безопасности, производительности и надежности, непосредственно в секретные и регулируемые государством цифровые среды.
Интеллект и уровни возможностей нового поколения
Представление семейства GPT-5.6 устанавливает новый стандарт вычислительной эффективности и интеллекта моделей, позволяя техническим командам быстрее решать сложные проблемы и извлекать больше полезной информации на один токен. Новая архитектура разделена на два отдельных уровня возможностей, разработанных с учетом баланса между операционными требованиями и стоимостью:
- Terra: Обеспечивает производительность на уровне GPT-5.5 при ровно вдвое меньших операционных затратах, соблюдая баланс между глубоким рассуждением и экономической выгодой.
- Luna: Оптимизирована для быстрого и максимально доступного инференса, предлагая самую низкую цену в линейке продуктов для высокопроизводительных операционных задач.
Расширенные рабочие нагрузки и увеличенные контекстные окна
Модели GPT-5.6, созданные для работы со сложными техническими конвейерами, позволяют разработчикам и исследователям развертывать изощренные рабочие среды. Системные архитекторы могут создавать автономные агенты для написания кода, проводить долгосрочный анализ в таких областях, как геномика и молекулярная биология, а также выполнять передовые операции в сфере кибербезопасности. Поддержку этих ресурсоемких задач обеспечивает колоссальное контекстное окно на 1 миллион токенов, доступное на Amazon Bedrock. Это обширное окно позволяет моделям обрабатывать целые кодовые базы программного обеспечения, исчерпывающие административные документы и истории многошагового выполнения агентов в рамках одного запроса API, анализируя широкие объемы информации без разбиения данных на части или деградации контекста.
Экономичность за счет кэширования промптов
Для снижения растущих финансовых затрат на крупномасштабные агентские операции GPT-5.6 вводит нативную поддержку кэширования промптов с использованием явных контрольных точек кэша. Когда повторяющийся контекст структурируется в итеративных рабочих процессах агентов, повторяющиеся данные тарифицируются со скидкой в 90 %. Этот механизм кэширования предотвращает накопление расходов по мере масштабирования организации в условиях высокой нагрузки.
Развертывание и региональная доступность
Специалисты и разработчики государственного сектора, имеющие допуск к использованию GovCloud, могут получить доступ к новым моделям напрямую через консоль Amazon Bedrock или с помощью Responses API, используя эндпоинт bedrock-mantle. Подробные инструкции относительно параметров регионального развертывания можно найти в документации по региональной доступности Amazon Bedrock.
Источник: Оригинальная статья





