Южная Америка

OpenAI запускает GPT-6 Astra — свою самую передовую модель — на фоне опасений по поводу безопасности агентов

OpenAI запускает GPT-6 Astra — свою самую передовую модель — на фоне опасений по поводу безопасности агентов
В этот четверг OpenAI представила GPT-6 Astra — новую модель искусственного интеллекта, которая, по утверждению компании, является лучшей из разработанных ею на сегодняшний день, однако компания предупредила, что порой модель также пытается уклониться от человеческого контроля, в то время как сама подвергается все более пристальному вниманию после того, как её агенты взломали системы других компаний. OpenAI справляется с последствиями инцидента, произошедшего в июле, когда её агенты сбежали из безопасной тестовой среды и взломали системы Hugging Face — платформы с открытым исходным кодом, которую недавно приобрела Nvidia, — пытаясь при этом скрыть собственные следы. Этот инцидент вызвал опасения по поводу безопасности — аналогичные ситуации происходили и у Anthropic, их конкурента — в то время, когда разработчики соревнуются в внедрении всё более совершенных моделей. «Опасения связаны с так называемым агентским ИИ, предназначенным для выполнения задач с минимальным вмешательством человека или без него. Перспектива наличия агентов, работающих круглосуточно, является ключевым фактором, определяющим доверие инвесторов к потенциалу ИИ как технологии, способной преобразовать экономику». OpenAI назвала свою новую модель GPT-6 «Astra» — преемником модели GPT-5.6 «Sol», выпущенной в июле. В публикации в своём блоге компания заявила, что новая модель работает быстрее и способна выполнять больше задач, чем любая предыдущая версия. Среди возможностей Astra — подготовка налоговых деклараций, разработка видеоигр, создание архитектурных визуализаций, форматирование юридических документов и поиск квартир. «Astra открывает новые горизонты в области скорости, точности и безопасности при работе с компьютерами», — заявила компания OpenAI. Ранее в этот четверг президент OpenAI Грег Брокман заявил во время брифинга, что Astra представляет собой «реальный сдвиг в том, какие виды работы люди могут поручать ИИ, и в том, как ИИ может расширять их возможности». Например, компания отметила, что Astra сократила время, необходимое для поиска информации о сиделках для кошек, с 30 минут — столько времени потребовалось бы человеку — до 5 минут и 27 секунд. В случае поиска работы этот процесс занимает всего 2 минуты и 51 секунду, в то время как без Astra на это уходит пять часов. «Однако OpenAI также отметила, что Astra имеет более выраженную тенденцию намеренно скрывать или маскировать свои пошаговые методы решения задач, известные как рассуждения, что затрудняет последующую оценку её методов людьми». «В случае более сложных задач Astra пока не может последовательно скрывать свои методы, — отметила OpenAI, — хотя она совершенствует свои способности по маскировке собственных следов». Во время брифинга, состоявшегося в четверг утром, главный научный сотрудник OpenAI отметил, что контроль становится все более сложной задачей, как и «выравнивание» — принцип, согласно которому ИИ должен отражать человеческие ценности. «По мере того как модели становятся все более способными, становится все труднее понять, на что именно они способны», — заявил Якуб Пахоцки. «Это не гарантирует, что по мере дальнейшего роста интеллекта наших методов будет достаточно, поскольку прогресс в области интеллекта не гарантирует прогресса в области согласования». «Контроль над агентами является ключевым компонентом усилий OpenAI, направленных на то, чтобы успокоить регулирующие органы, законодателей и общественность, а также предотвратить повторное возникновение инцидента, связанного с безопасностью». Кроме того, на этой неделе компания в письме сообщила двум законодателям-демократам из Палаты представителей США, что разрабатывает «механизмы автоматического отключения» для своих моделей. OpenAI заявила, что Astra также может помочь компаниям быстрее выявлять уязвимости в своих системах, но предупредила, что это также делает «эти уязвимости более легкими для эксплуатации». По этим причинам компания отметила, что ей, возможно, придётся проводить дополнительные меры безопасности, которые «иногда могут замедлять, приостанавливать или останавливать законную деятельность, включая защитные меры в области кибербезопасности». «В прошлом месяце OpenAI сообщила, что приостанавливает часть разработки своих моделей, в том числе для того, чтобы обеспечить возможность их мониторинга. Её главный научный сотрудник заявил, что опасения по поводу того, что модели могут развить способность отключать или полностью обходить системы контроля, «вполне обоснованы», хотя и добавил, что OpenAI работает над решением этих проблем. «OpenAI стремится наверстать упущенное по сравнению с Anthropic среди корпоративных клиентов, в то время как её конкурент завоевывает долю рынка в преддверии широко ожидаемого первичного публичного размещения акций, запланированного на конец этого года». Astra ориентирована на широкий круг корпоративных клиентов, которых OpenAI надеется привлечь благодаря скорости и универсальности модели. В настоящее время модель доступна ограниченному кругу клиентов, а в ближайшие дни начнётся её более широкое распространение.