OpenAI опубликовала отдельный материал про рабочую сторону GPT-6 Astra: модель уже раздана в ChatGPT Work, Codex и API, компания называет её лучшей у себя в работе с компьютером, браузером, кодом, кибербезопасностью и наукой. Там же впервые названы цены на API и результаты замеров против GPT-5.6 Sol и Claude Fable 5.1. Первоисточник - запись в блоге OpenAI. Общий релиз модели и отчёт о безопасности мы разбирали раньше: кому доступна Astra и что в отчёте.
Главный упор - работа без интеграций
Смысл, который OpenAI продаёт бизнесу, простой. Обычно, чтобы модель приносила пользу, компания сначала готовит данные, перестраивает процессы и пишет интеграции. Astra в ChatGPT Work и Codex умеет писать код и работать в тех же приложениях, что и человек, даже если у приложения нет API.
В подтверждение приводят пару примеров изнутри компании. Разработчики и маркетинг собрали ролик Developer First Impressions из трёх часов многокамерного материала, он набрал больше 550 тысяч просмотров за 4 дня. Инженеры нашли через Astra узкое место в выделении памяти, из-за которого тормозили сессии Codex в тестовой среде: смена аллокатора дала задержку хода в 25 раз меньше при примерно на 30% большем пике памяти.
Цифры, которые назвали
- Excel. На задачах Financial Modeling World Cup Astra проходит их через управление компьютером примерно в четыре раза быстрее человека-победителя (данные чемпионата Microsoft Excel 2023 года).
- Terminal-Bench 4.0 - тест агентов на сложных задачах в терминале. У Astra 57,9%, у GPT-5.6 Sol 37,3%, у Claude Fable 5.1 55,8%. При этом оценочная стоимость задачи через API у Astra ниже примерно на 9% и 63% соответственно.
- Внутренний тест безопасности при работе с компьютером. Нежелательные исходы вроде утечки конфиденциальных данных, слишком широкой раздачи дашборда или удаления данных случаются на 89% реже, чем у GPT-5.6 Sol, и на 74,7% реже, чем у Claude Fable 5.1.
Отдельно OpenAI пишет, что модель обучали укладываться в меньшее число токенов и делать меньше повторных попыток, то есть экономия идёт не только с ценника, но и с расхода на задачу.
Цена и контроль
Цены API стартуют с $10 за миллион входных токенов и $50 за миллион выходных. Для подходящих клиентов на поддерживаемых эндпоинтах доступен режим Zero Data Retention, он выдаётся по одобрению.
Для компаний добавили админские настройки: разрешённые сайты и десктопные приложения, управление загрузками и выгрузками, контроль истории браузинга. Плюс политики подтверждения, когда перед значимым действием нужно одобрение, и автоматическая проверка подозрительных вызовов инструментов. В ChatGPT Desktop появились корпоративные плагины Oracle Analytics, Power BI, Navan и Avalara.
Что это значит для нас
Речь тут про рабочий контур: ChatGPT Work, Codex и API. Обычным подписчикам Plus и Pro это напрямую ничего не меняет, доступ к самой модели идёт по общему графику раскатки из прошлых новостей.
Практический вывод для тех, кто платит из России, один: цены на API названы в долларах, и оплата российской картой в OpenAI не проходит - платёж отклоняет сама площадка, независимо от банка. Подписка ChatGPT Plus и Pro есть в нашем каталоге на витрине ChatGPT, оплата картой РФ или СБП.
Коротко
- Astra уже работает в ChatGPT Work, Codex и API.
- Terminal-Bench 4.0: 57,9% против 37,3% у GPT-5.6 Sol и 55,8% у Claude Fable 5.1.
- API от $10 за миллион входных и $50 за миллион выходных токенов.
- Новые админ-настройки, политики подтверждения и плагины Oracle Analytics, Power BI, Navan, Avalara.
Обсуждение
0 комментариев