Forklog
2026-09-04 07:56:26

OpenAI открыла ограниченный доступ к GPT-6 Astra

3 сентября OpenAI выпустила новую флагманскую ИИ-модель GPT-6 Astra. Компания начала развертывание для ограниченного круга организаций в рамках программы Trusted Access и в ближайшие дни откроет доступ для пользователей ChatGPT Plus, Pro, Business и Enterprise, а также в OpenAI API и Amazon Bedrock. This is GPT-6 Astra.Anything you can do on a computer, Astra can do for you. Fast. pic.twitter.com/gDd0IsewJw— OpenAI (@OpenAI) September 3, 2026 Microsoft начала предоставлять модель через программу ограниченного доступа Microsoft Foundry в Azure. Доступ для участвующих клиентов расширят в скором времени. По данным OpenAI, Astra превосходит GPT-5.6 Sol во многих представленных компанией тестах на работу с компьютером, программирование, научные задачи и кибербезопасность. При этом в некоторых бенчмарках модели Anthropic показывают более высокие результаты. В OpenAI уточнили, что в сравнительных таблицах приводят максимальные результаты при любом уровне вычислительных усилий. Тесты моделей GPT проводились в исследовательской среде или через API, поэтому показатели доступных пользователям версий могут отличаться. Расширенные возможности Согласно релизу, GPT-6 Astra способна самостоятельно работать с браузером и приложениями: заполнять формы, обновлять записи в CRM, искать информацию, редактировать документы, анализировать данные и тестировать программное обеспечение. На офлайн-подмножестве OSWorld 2.0 с частичной оценкой, которое проверяет выполнение задач в графическом интерфейсе, Astra набрала 72,6% против 65,7% у GPT-5.6 Sol. В моделировании задержки OpenAI Astra выполняла такие задания примерно на 47% быстрее: около 40 минут на задачу против 75 минут у GPT-5.6 Sol. Источник: OpenAI. На Agents’ Last Exam, где ИИ решает сложные профессиональные задачи в реальных программах, результат составил 59,3%. GPT-5.6 Sol получил 53,6%, Claude Opus 5 — 55,5%. Источник: OpenAI. В ScreenSpot-Pro, оценивающем понимание элементов компьютерного интерфейса, Astra показала 92,7% против 76,9% у GPT-5.6 Sol. Источник: OpenAI. OpenAI также представила экспериментальный механизм сохранения контекста в Codex. Astra может вести заметки между заполненными контекстными окнами и искать требования или результаты тестов в предыдущих сообщениях и результатах работы инструментов. Сейчас функцию необходимо самостоятельно включить в config.toml. В ближайшие недели OpenAI планирует сделать ее стандартной для Astra. Код, математика и наука В Terminal-Bench 4.0 для агентного программирования GPT-6 Astra получила 57,9%. Для сравнения, GPT-5.6 Sol набрала 37,3%, Claude Fable 5.1 — 55,8%. Источник: OpenAI. На FrontierCode 1.1 Extended новая модель достигла 64,5%, на научном Terminal-Bench Science 0.1 — 64,6% против 22,4% у GPT-5.6 Sol и 52,6% у Claude Fable 5.1. В FrontierMath Tier 4 модель набрала 97,6%. По заявлению разработчиков, Astra помогла улучшить два результата в теории простых чисел: в первом случае снизила верхнюю границу промежутка между бесконечным числом пар простых чисел с 240 до 186, во втором —изменила один из членов оценки больших промежутков между простыми числами, остававшийся неизменным более 80 лет. Источник: OpenAI. В Humanity’s Last Exam с инструментами Astra получила 57,2%, уступив Claude Fable 5.1 с 65%. Критический уровень кибервозможностей GPT-6 Astra стала первой моделью OpenAI, достигшей уровня Critical по кибервозможностям в рамках Preparedness Framework. Без продакшн-ограничений она получила 100% на ExploitBench против 78,5% у GPT-5.6 Sol. На ExploitGym результаты составили 42,4% и 30,3% соответственно. На внутреннем наборе ExploitBench (июнь–август 2026) из 20 недавно раскрытых уязвимостей высокой степени опасности в V8, охватывающем 13 стабильных версий Chrome, Astra добилась выполнения произвольного кода в 39% случаев. GPT-5.6 Sol показала 11,5%. Источник: OpenAI. В экспертных испытаниях Astra без продакшн-защиты использовала неизвестные уязвимости для выполнения произвольного кода в защищенных браузерах и создавала эксплойты для повышения привилегий в защищенных операционных системах. «Способность Astra выявлять и разрабатывать эксплойты для zero-day может помочь находить и устранять слабые места, но одновременно требует более строгих мер безопасности», — отметили в компании. В выпущенной версии действуют дополнительные ограничения. Astra будет отказываться от продвинутых киберзадач, включая создание proof-of-concept-эксплойтов. Более широкий доступ для защитных сценариев компания намерена постепенно предоставлять через OpenAI Daybreak. Разработчики также внедрили дополнительный мониторинг рассуждений и действий модели. Система классификаторов должна выявлять потенциально несанкционированное поведение и автоматически останавливать соответствующие действия. OpenAI признала, что письменная цепочка рассуждений Astra хуже поддается мониторингу, чем у GPT-5.6 Sol. Этот вывод основан преимущественно на состязательных тестах, в которых модель прямо побуждали уклоняться от наблюдения. Компания связывает результат со способностью Astra лучше управлять письменными рассуждениями в простых задачах и решать их за меньшее число текстовых шагов. На сложных заданиях модель, по оценке разработчика, пока испытывает трудности при попытке скрыть необходимые для решения рассуждения. https://forklog.com/news/ai/issledovateli-predupredili-o-snizhenii-nablyudaemosti-astra $1 млрд на киберзащиту Одновременно с релизом Astra OpenAI объявила программу Daybreak for Frontline Defenders объемом $1 млрд. В эту сумму компания включила субсидируемый доступ к моделям и продуктам Daybreak, обучение, техническую поддержку и партнерские программы. В первую очередь инициативу запустят в США для операторов водоснабжения и электросетей, властей штатов и муниципалитетов, региональных и местных банков, некоммерческих организаций и разработчиков открытого ПО с ограниченными ресурсами на кибербезопасность. В ближайшие недели программу планируют расширить на страны-партнеры. «У защитников есть окно возможностей: оно сужается, и ИИ нужно использовать для устранения пробелов в безопасности раньше атакующих», — заявили в OpenAI. Daybreak уже используют специалисты примерно из 2000 одобренных организаций и рабочих пространств. Daybreak Blue предназначен для стандартных защитных задач, а Daybreak Red предоставляет проверенным организациям доступ к специализированным кибермоделям для более чувствительных сценариев. Доступ и стоимость Пользователи ChatGPT Pro, Business и Enterprise также получат доступ к отдельной версии GPT-6 Astra Pro. Чем она отличается от базовой, в OpenAI не уточнили. Администраторы Enterprise должны самостоятельно включить Astra для своих рабочих пространств. Для разработчиков модель появится в OpenAI API под идентификатором gpt-6-astra. Согласно документации, контекстное окно составляет 1,05 млн токенов, максимальный объем ответа — 128 000 токенов. Дата отсечения знаний — 30 апреля 2026 года. Стандартная цена составляет $10 за 1 млн входных и $50 за 1 млн выходных токенов. Кешированный ввод стоит $1 за 1 млн токенов, запись в кеш — $12,5. Для запросов объемом свыше 272 000 входных токенов тарифы на ввод и кеширование удваиваются, а стоимость вывода увеличивается в 1,5 раза для всего запроса. Ускоренный режим работает до двух раз быстрее стандартного и стоит вдвое дороже применимого тарифа. Напомним, в августе OpenAI временно замедлила масштабирование новых ИИ-моделей и на две недели приостановила обучение с подкреплением новейших систем, предназначенных для последующего развертывания. https://forklog.com/exclusive/ai/chelovek-kak-vremennaya-mera

Get Crypto Newsletter
Read the Disclaimer : All content provided herein our website, hyperlinked sites, associated applications, forums, blogs, social media accounts and other platforms (“Site”) is for your general information only, procured from third party sources. We make no warranties of any kind in relation to our content, including but not limited to accuracy and updatedness. No part of the content that we provide constitutes financial advice, legal advice or any other form of advice meant for your specific reliance for any purpose. Any use or reliance on our content is solely at your own risk and discretion. You should conduct your own research, review, analyse and verify our content before relying on them. Trading is a highly risky activity that can lead to major losses, please therefore consult your financial advisor before making any decision. No content on our Site is meant to be a solicitation or offer.