Forklog
2026-09-04 07:56:26

OpenAI открыла ограниченный доступ к GPT-6 Astra

3 сентября OpenAI выпустила новую флагманскую ИИ-модель GPT-6 Astra. Компания начала развертывание для ограниченного круга организаций в рамках программы Trusted Access и в ближайшие дни откроет доступ для пользователей ChatGPT Plus, Pro, Business и Enterprise, а также в OpenAI API и Amazon Bedrock. This is GPT-6 Astra.Anything you can do on a computer, Astra can do for you. Fast. pic.twitter.com/gDd0IsewJw— OpenAI (@OpenAI) September 3, 2026 Microsoft начала предоставлять модель через программу ограниченного доступа Microsoft Foundry в Azure. Доступ для участвующих клиентов расширят в скором времени. По данным OpenAI, Astra превосходит GPT-5.6 Sol во многих представленных компанией тестах на работу с компьютером, программирование, научные задачи и кибербезопасность. При этом в некоторых бенчмарках модели Anthropic показывают более высокие результаты. В OpenAI уточнили, что в сравнительных таблицах приводят максимальные результаты при любом уровне вычислительных усилий. Тесты моделей GPT проводились в исследовательской среде или через API, поэтому показатели доступных пользователям версий могут отличаться. Расширенные возможности Согласно релизу, GPT-6 Astra способна самостоятельно работать с браузером и приложениями: заполнять формы, обновлять записи в CRM, искать информацию, редактировать документы, анализировать данные и тестировать программное обеспечение. На офлайн-подмножестве OSWorld 2.0 с частичной оценкой, которое проверяет выполнение задач в графическом интерфейсе, Astra набрала 72,6% против 65,7% у GPT-5.6 Sol. В моделировании задержки OpenAI Astra выполняла такие задания примерно на 47% быстрее: около 40 минут на задачу против 75 минут у GPT-5.6 Sol. Источник: OpenAI. На Agents’ Last Exam, где ИИ решает сложные профессиональные задачи в реальных программах, результат составил 59,3%. GPT-5.6 Sol получил 53,6%, Claude Opus 5 — 55,5%. Источник: OpenAI. В ScreenSpot-Pro, оценивающем понимание элементов компьютерного интерфейса, Astra показала 92,7% против 76,9% у GPT-5.6 Sol. Источник: OpenAI. OpenAI также представила экспериментальный механизм сохранения контекста в Codex. Astra может вести заметки между заполненными контекстными окнами и искать требования или результаты тестов в предыдущих сообщениях и результатах работы инструментов. Сейчас функцию необходимо самостоятельно включить в config.toml. В ближайшие недели OpenAI планирует сделать ее стандартной для Astra. Код, математика и наука В Terminal-Bench 4.0 для агентного программирования GPT-6 Astra получила 57,9%. Для сравнения, GPT-5.6 Sol набрала 37,3%, Claude Fable 5.1 — 55,8%. Источник: OpenAI. На FrontierCode 1.1 Extended новая модель достигла 64,5%, на научном Terminal-Bench Science 0.1 — 64,6% против 22,4% у GPT-5.6 Sol и 52,6% у Claude Fable 5.1. В FrontierMath Tier 4 модель набрала 97,6%. По заявлению разработчиков, Astra помогла улучшить два результата в теории простых чисел: в первом случае снизила верхнюю границу промежутка между бесконечным числом пар простых чисел с 240 до 186, во втором —изменила один из членов оценки больших промежутков между простыми числами, остававшийся неизменным более 80 лет. Источник: OpenAI. В Humanity’s Last Exam с инструментами Astra получила 57,2%, уступив Claude Fable 5.1 с 65%. Критический уровень кибервозможностей GPT-6 Astra стала первой моделью OpenAI, достигшей уровня Critical по кибервозможностям в рамках Preparedness Framework. Без продакшн-ограничений она получила 100% на ExploitBench против 78,5% у GPT-5.6 Sol. На ExploitGym результаты составили 42,4% и 30,3% соответственно. На внутреннем наборе ExploitBench (июнь–август 2026) из 20 недавно раскрытых уязвимостей высокой степени опасности в V8, охватывающем 13 стабильных версий Chrome, Astra добилась выполнения произвольного кода в 39% случаев. GPT-5.6 Sol показала 11,5%. Источник: OpenAI. В экспертных испытаниях Astra без продакшн-защиты использовала неизвестные уязвимости для выполнения произвольного кода в защищенных браузерах и создавала эксплойты для повышения привилегий в защищенных операционных системах. «Способность Astra выявлять и разрабатывать эксплойты для zero-day может помочь находить и устранять слабые места, но одновременно требует более строгих мер безопасности», — отметили в компании. В выпущенной версии действуют дополнительные ограничения. Astra будет отказываться от продвинутых киберзадач, включая создание proof-of-concept-эксплойтов. Более широкий доступ для защитных сценариев компания намерена постепенно предоставлять через OpenAI Daybreak. Разработчики также внедрили дополнительный мониторинг рассуждений и действий модели. Система классификаторов должна выявлять потенциально несанкционированное поведение и автоматически останавливать соответствующие действия. OpenAI признала, что письменная цепочка рассуждений Astra хуже поддается мониторингу, чем у GPT-5.6 Sol. Этот вывод основан преимущественно на состязательных тестах, в которых модель прямо побуждали уклоняться от наблюдения. Компания связывает результат со способностью Astra лучше управлять письменными рассуждениями в простых задачах и решать их за меньшее число текстовых шагов. На сложных заданиях модель, по оценке разработчика, пока испытывает трудности при попытке скрыть необходимые для решения рассуждения. https://forklog.com/news/ai/issledovateli-predupredili-o-snizhenii-nablyudaemosti-astra $1 млрд на киберзащиту Одновременно с релизом Astra OpenAI объявила программу Daybreak for Frontline Defenders объемом $1 млрд. В эту сумму компания включила субсидируемый доступ к моделям и продуктам Daybreak, обучение, техническую поддержку и партнерские программы. В первую очередь инициативу запустят в США для операторов водоснабжения и электросетей, властей штатов и муниципалитетов, региональных и местных банков, некоммерческих организаций и разработчиков открытого ПО с ограниченными ресурсами на кибербезопасность. В ближайшие недели программу планируют расширить на страны-партнеры. «У защитников есть окно возможностей: оно сужается, и ИИ нужно использовать для устранения пробелов в безопасности раньше атакующих», — заявили в OpenAI. Daybreak уже используют специалисты примерно из 2000 одобренных организаций и рабочих пространств. Daybreak Blue предназначен для стандартных защитных задач, а Daybreak Red предоставляет проверенным организациям доступ к специализированным кибермоделям для более чувствительных сценариев. Доступ и стоимость Пользователи ChatGPT Pro, Business и Enterprise также получат доступ к отдельной версии GPT-6 Astra Pro. Чем она отличается от базовой, в OpenAI не уточнили. Администраторы Enterprise должны самостоятельно включить Astra для своих рабочих пространств. Для разработчиков модель появится в OpenAI API под идентификатором gpt-6-astra. Согласно документации, контекстное окно составляет 1,05 млн токенов, максимальный объем ответа — 128 000 токенов. Дата отсечения знаний — 30 апреля 2026 года. Стандартная цена составляет $10 за 1 млн входных и $50 за 1 млн выходных токенов. Кешированный ввод стоит $1 за 1 млн токенов, запись в кеш — $12,5. Для запросов объемом свыше 272 000 входных токенов тарифы на ввод и кеширование удваиваются, а стоимость вывода увеличивается в 1,5 раза для всего запроса. Ускоренный режим работает до двух раз быстрее стандартного и стоит вдвое дороже применимого тарифа. Напомним, в августе OpenAI временно замедлила масштабирование новых ИИ-моделей и на две недели приостановила обучение с подкреплением новейших систем, предназначенных для последующего развертывания. https://forklog.com/exclusive/ai/chelovek-kak-vremennaya-mera

Crypto 뉴스 레터 받기
면책 조항 읽기 : 본 웹 사이트, 하이퍼 링크 사이트, 관련 응용 프로그램, 포럼, 블로그, 소셜 미디어 계정 및 기타 플랫폼 (이하 "사이트")에 제공된 모든 콘텐츠는 제 3 자 출처에서 구입 한 일반적인 정보 용입니다. 우리는 정확성과 업데이트 성을 포함하여 우리의 콘텐츠와 관련하여 어떠한 종류의 보증도하지 않습니다. 우리가 제공하는 컨텐츠의 어떤 부분도 금융 조언, 법률 자문 또는 기타 용도에 대한 귀하의 특정 신뢰를위한 다른 형태의 조언을 구성하지 않습니다. 당사 콘텐츠의 사용 또는 의존은 전적으로 귀하의 책임과 재량에 달려 있습니다. 당신은 그들에게 의존하기 전에 우리 자신의 연구를 수행하고, 검토하고, 분석하고, 검증해야합니다. 거래는 큰 손실로 이어질 수있는 매우 위험한 활동이므로 결정을 내리기 전에 재무 고문에게 문의하십시오. 본 사이트의 어떠한 콘텐츠도 모집 또는 제공을 목적으로하지 않습니다.