
В недавнем интервью с Коройем Кавукджуглу, старшим вице-президентом и главным архитектором ИИ Google DeepMind, обсуждаются важные изменения в подходе компании к искусственному интеллекту. Кавукджуглу подчеркивает, что Google все больше рассматривает Gemini не просто как чат-бота, а как полноценного ИИ-агента. Это изменение в восприятии особенно актуально на фоне заявлений генерального директора Сундара Пичая о том, что агентный ИИ — это будущее поиска.
Переход к агентному ИИ
Кавукджуглу отметил, что вдохновение для этого изменения пришло из области программирования, которое стало ключом к разработке программного обеспечения, использованию инструментов и агентным рабочим процессам. Основная цель теперь заключается не в том, чтобы создать модель, которая лучше отвечает на вопросы, а в том, чтобы разработать систему, способную действовать от имени и вместе с человеком.
В интервью, проведенном Логаном Килпатриком, Кавукджуглу не стал углубляться в детали "архитектурных инноваций", намекнув на то, что в компании происходят важные изменения. Тем не менее, он подробно рассказал о том, как Google сосредоточился на агентном ИИ. "Мы учились на примере запуска версии 3.0, понимая, что такое программирование и программная инженерия, а также как работать с инструментами, которые люди используют каждый день. В итоге мы стремимся превратить модель в агента", — отметил он.
Обучение и развитие
Кавукджуглу подчеркнул, что в процессе обучения модели они сделали много выводов о том, как обучить агента, который может кодировать вместе с пользователем. Он добавил, что с каждым новым шагом процесс становится быстрее, и в любой исследовательской работе существуют параллельные направления, которые развиваются одновременно. "Мы пытаемся объединить все эти знания и улучшения, чтобы лучше понять, что значит выполнять агентные действия и рабочие процессы", — сказал он.
Эволюция подходов к ИИ
В ходе обсуждения Кавукджуглу упомянул, что хотя происходит революционное изменение, основные шаги в создании ИИ не изменились. "Мы по-прежнему используем глубокое обучение, предварительное обучение, методы обучения с подкреплением и оптимизации, основанные на тех же принципах, что и раньше", — отметил он. Изменения касаются среды, в которой работает ИИ, что требует от моделей способности интерпретировать намерения, справляться с неопределенностью и сотрудничать с людьми.
Улучшение агентных рабочих процессов
Килпатрик также отметил, что Gemini 3 достиг определенной границы, но эта граница сместилась в сторону агентного кодирования и возможностей, схожих с действиями агента. Кавукджуглу согласился, что им еще предстоит многому научиться в области агентных действий и рабочих процессов, добавив, что работа над Gemini 3.5 помогла лучше понять, как люди взаимодействуют с агентами. "Я чувствую, что мы лучше понимаем потребности пользователей, когда они работают с агентом, который помогает им в выполнении задач", — сказал он.
Важнейшие улучшения в ИИ
Когда Килпатрик спросил Кавукджуглу о самом важном улучшении в ИИ, тот ответил, что если бы у него была волшебная палочка, он бы сделал модели более интеллектуальными. "Чем более умными становятся модели, тем лучше они выполняют свои задачи и делают это более интуитивно", — добавил он.
Заключение
Google DeepMind и сама Google переходят от простого предоставления ответов к помощи пользователям в выполнении задач. Все продукты Google, от Gmail до Google Sheets и Maps, направлены на то, чтобы помочь людям достигать своих целей. Кавукджуглу объяснил, что ИИ-модели концептуально становятся не просто чат-ботами, а также агентами, что отражает изменения во всем Google, включая поиск.
Комментарии (0)