Codex от OpenAI теперь видит интернет: браузер Chrome в руках ИИ

Когда ИИ-программист выходит в интернет
Помните, как мы восхищались ИИ, который умеет писать код? Это было вчера. Сегодня OpenAI сделала следующий логичный - и довольно тревожный по масштабу - шаг: Codex получил доступ к браузеру Chrome. Теперь агент не просто генерирует код в вакууме, он может открыть браузер, залезть в документацию, проверить, как работает сайт, и - что критически важно - взаимодействовать с реальным веб-интерфейсом в процессе работы.
Это не просто фича. Это принципиально другая архитектура работы с кодом.
Что изменилось и почему это не рядовое обновление
До этого момента Codex существовал в относительно изолированной среде - он работал с тем контекстом, который ему давали: файлы, инструкции, история чата. Браузер меняет все. Теперь агент может самостоятельно:
- Искать актуальную документацию по библиотекам и API прямо в процессе написания кода - Тестировать веб-приложения - открывать страницы, кликать по элементам, проверять поведение - Получать данные из реального мира - курсы, новости, статусы сервисов - все, что нужно для задачи
Для разработчика это означает, что Codex перестает быть "умным автодополнением" и превращается в полноценного junior-разработчика, который сам лезет в Stack Overflow и MDN, когда не знает ответа. Только делает это за секунды.
Контекст: гонка агентов накаляется
OpenAI выпускает это обновление в момент, когда рынок AI-агентов для разработки буквально кипит. Cursor с его агентным режимом, GitHub Copilot Workspace, Devin от Cognition - все они пытаются занять нишу "ИИ, который реально делает работу, а не просто подсказывает".
Но доступ к браузеру - это то, чего большинство конкурентов либо не имеют, либо реализуют через костыли. Devin давно умеет работать с браузером, и именно это сделало его громким анонсом в 2024 году. OpenAI фактически догоняет Cognition в этом конкретном аспекте - но с несравнимо большей базой пользователей и интеграцией в экосистему ChatGPT.
Мое мнение: интеграция с Chrome - это не техническая победа сама по себе, это сигнал рынку. OpenAI говорит: "Мы строим не ассистента, мы строим агента, который работает".
Как это работает на практике
Представьте типичный сценарий: вы просите Codex написать интеграцию с каким-нибудь платежным API. Раньше агент работал с тем, что знал из обучающих данных - а значит мог предложить устаревший синтаксис или несуществующий метод. Теперь он открывает документацию API прямо в Chrome, читает актуальную версию и пишет код под нее.
Или другой кейс: тестирование фронтенда. Codex пишет React-компонент, открывает его в браузере, видит, что кнопка не работает, возвращается в код и чинит. Все это - без участия человека в цикле.
Это звучит как магия, но технически это комбинация уже известных вещей: computer use (управление интерфейсом), браузерная автоматизация типа Playwright или Puppeteer, и LLM, который всем этим управляет. Новизна - в том, что OpenAI интегрировала это в свой флагманский продукт для разработки.
Что это значит для российских пользователей
Честный ответ: Codex в полном агентном режиме с браузером - это функционал, доступный через ChatGPT Pro или API. Доступ из России без VPN по-прежнему ограничен - OpenAI не работает напрямую с российскими картами и IP-адресами. Для тех, кто уже решил вопрос с подпиской через третьи страны или использует API с прокси - обновление доступно.
Альтернативы на российском рынке? GigaChat от Сбера в агентном режиме пока сильно отстает по возможностям. Yandex GPT в связке с браузерными инструментами - интересная история, но до уровня Codex с Chrome дистанция значительная.
Риски, о которых никто не говорит вслух
Браузерный доступ у ИИ-агента - это не только удобство, это новая поверхность атаки. Агент, который умеет кликать по страницам и вводить данные, теоретически уязвим к prompt injection через веб-контент: злоумышленник может разместить на странице скрытые инструкции, которые агент выполнит.
OpenAI наверняка думала об этом - изолированная среда, ограничения на действия, логирование. Но история с AI-агентами показывает: чем больше возможностей, тем больше неожиданных векторов. Это не повод не использовать технологию, но повод не давать агенту доступ к продакшн-среде без надзора.
Мой вывод
Открытие браузера для Codex - это момент, когда AI-программирование переходит из категории "умная помощь" в категорию "автономная работа". Это не революция за один день, но очень четкий вектор: через год-два разработчик будет ставить задачу, а агент - сам разбираться с документацией, тестировать, итерировать.
Вопрос не в том, случится ли это. Вопрос в том, кто окажется в центре этой экосистемы - OpenAI, Anthropic с их Claude-агентами, или кто-то, кого мы еще не знаем. Пока что OpenAI делает правильные ходы.
Похожие новости
H Company выпустила Holo4: агент для компьютера за $0.08 за задачу
H Company открыла веса Holo4 - двух моделей для управления компьютером, которые набирают 85.2% на OSWorld и обходят GPT-5.5 по соотношению цены и результата.
Nvidia SoL-Pi режет расходы на токены кодящих агентов почти вдвое
Исследователи Nvidia научили систему SoL-Pi автоматически оптимизировать управляющий слой агентов - и получили минус 49% токенов без потери качества.
Microsoft Copilot получил агента Autopilot и оплату по факту использования
Microsoft разделила Copilot на три раздела и запустила автономного агента Autopilot на базе OpenClaw - теперь он работает в облаке без участия пользователя.