Прочел на РБК лонгрид руководителя “Яндекс Браузера” Ильи Шибанова о том, как меняется браузинг в эпоху ИИ, и вспомнил про свой пост из прошлого года, который внезапно оказался пророческим. Пост был написан под выход браузера Atlas от OpenAI и в нем я:
— сомневался, что OpenAI вытянет Atlas;
— ИИ-браузинг как концепция продолжит развиваться, просто пользователи останутся в тех браузерах, к которым привыкли.
Что ж, так оно и вышло. Atlas закрывается 9 августа, вместо него OpenAI будет развивать ИИ-расширение для Chrome. Аналогичное расширение давно есть у Anthropic, браузерный же рынок в основном поделен между старыми игроками: Chrome, “Яндекс Браузер”, Edge, Brave – все добавляют ИИ-функции. Как исключение выделю Comet – маленькая Perplexity смогла то, что не получилось у OpenAI, и успешно развивает свой ИИ-браузер.
Объяснение такой ситуации, на мой взгляд, простое: команды, которые работают над браузерами годами, лучше знают, какой новый опыт нужен пользователям и как его упаковать. По словам Ильи, пересказ, перевод или выделение главного – давно уже гигиенический минимум, обязательный для каждого браузера. Открыв страницу, теперь можно запустить диалог с ИИ-ассистентом – задать ему вопросы по теме, попросить найти дополнительный контекст, проверить факты и т. д.
Следующий этап – “бесшовная работа” с контекстом. Каждый сталкивался с ситуацией: работаешь над темой, открыл уже 40+ вкладок, а этого мало. Со временем встроенные в браузер нейросети научатся работать с подобными массивами источников: не нужно будет ходить по множеству вкладок, выискивая отдельные подробности, а достаточно просто задать вопрос нейронке.
Все это вновь приводит нас к концепции Zero UI, которую придумали еще в середине 2010-х и которая обрела вторую жизнь в эпоху ИИ. Идея простая: сложные интерфейсы с кнопками, менюшками и вкладками постепенно заменятся на ИИ-интерфейсы: текстовый, голосовой или графический – зависит от ситуации.
К чему-то похожему на Zero UI мы рано или поздно придем, но каким маршрутом – вопрос открытый. OpenAI и Anthropic сейчас сосредоточились на “инструментах для решения вопросов” – личных и рабочих. Чат-боты, агенты для кодинга и интеллектуальной работы – свободная ниша, да еще и растущая с огромной скоростью.
Но огромный объем задач мы продолжаем решать в браузерах и операционных системах – потребление контента, выбор и покупка товаров, планирование поездок. Здесь встроенный в браузер агент привычнее, и Илья рассказывает, как он работает: получив задачу, нейросеть сама сравнит предложения, укажет на лучшие, а если пользователь разрешит – то заполнит все формы и совершит покупку.
Такие агенты уже функционируют – в том же “Яндекс Браузере” есть функция “найти дешевле”, когда агент собирает лучшие предложения, предлагая тебе сделать финальный выбор.
Но и работы предстоит еще много. Одно направление – безопасность, так как теоретически агенту могут подсунуть prompt injection, убедив купить этот конкретный товар, а не конкурента. Второе – психология пользователя. Мне, например, всегда доставляло удовольствие самому сравнивать и выбирать товары, а затем нажимать кнопку. Поэтому какое-то время лучше будет даже промежуточное решение: агент выполняет работу, пользователь за ней наблюдает (или, как минимум, за ключевыми этапами) и принимает финальное решение сам.
В лонгриде Ильи еще много интересных подробностей, как преображаются браузеры в эпоху ИИ – обязательно почитайте, это полезно и для профессиональной работы, и для тех, кто использует нейронки в повседневных делах.