[00:01] свои кредитные карты. Такое ощущение, что вы окончательно утратили право собственности. Представьте, что у вас есть искусственный общий интеллект (AGI) в облаке. Если вы можете выполнять всё более сложные рабочие процессы, что послужит толчком для создания такой системы? Мы все чаще видим, что ИИ будет подсказывать [00:13] , это предвкушение будущего. Крайне важно, чтобы агент имел полный контроль над своим собственным исходным кодом. Тогда агент сможет просто разрешить изменения, внесенные вышестоящим звеном. Таким образом, агент может решить, что следует делать, а что нет. А если агент [00:25] то цикл разработки сокращается примерно в 10 раз . Получается, что больше работать над системой, чем над бизнесом. подумала: "О, ребята, а вы хотите буррито позже?" Поэтому я просто захожу в Telegram и [00:37] пишу: "Хорошо, закажите мне пять буррито". Пришлите мне скриншот. Ладно, мне понравилось. Задача состоит в том, кто сможет описать свои цели в наиболее вкус. Вы бы провели пальцем влево или вправо? Это просто волшебно. [00:50] Это Магнус Мюллер, соучредитель и генеральный директор Browserless, чрезвычайно популярного фреймворка с открытым исходным кодом, который позволяет агентам использовать браузер так же, как это делают люди. В этом подкасте мы обсуждаем, почему ваш агент должен напоминать вам о необходимости подсказок, как [01:04] будет выглядеть интерфейс AGI и как Магнус управляет всем своим бизнесом из Telegram. Если вы хотите быть в авангарде развития искусственного интеллекта, обязательно досмотрите до конца. Магнус, значит, ты один из соучредителей и генеральный директор Browserless. [01:17] браузеров? Я не так уж часто пользуюсь своим настольным компьютером. Как я уже говорил, большую часть времени, когда я работаю за ноутбуком, я нахожусь в браузере. Но новую вещь, BrowserHassive, примерно 3 недели назад. Это как навык, который вы подключаете [01:32] к Cloud Code или Codex. По сути, вы запрашиваете подтверждение, и это управляет браузером очень надежным способом. Возможно, это потому, что вы уже доверяете Cloud Code это потому, что вы уже доверяете Cloud Code . И теперь это доверие переходит к [01:45] запустили. Люди стали доверять ей свои кредитные карты. . Просто отправляет фотографию, а затем говорит: «Хорошо, займитесь этим за меня». Или запишите меня на получение водительских прав. Или, например, мой сооснователь, Крагер, он всегда [01:59] товары в интернете, заходит на Reddit , ищет полезную информацию, колонки лучше всего купить? И вот теперь Cloud Code с браузерным модулем просматривает лучшую колонку, сравнивает предложения на Amazon, отправляет скриншоты, и [02:13] чувствует, что это именно тот процесс, который он бы сам осуществил. И он мне чем-то волшебным. И кстати, если вы хотите сделать это самостоятельно и позволить вашему безопасном режиме, я создал новый пользовательский навык, который вы [02:26] можете просто скопировать и вставить в своего ИИ-агента. в этом подкасте. Повторюсь, это совершенно бесплатно. Итак, прокрутите страницу вниз под видео Один из основателей Hugging Face сказал мне, что не нашел ни одной задачи, [02:39] сейчас главный вопрос: что это значит? Потому что, когда я основал Browserless, я подумал: если можно надежно управлять браузером с помощью ИИ, и мы — крупнейшая компания на планете. Но, как оказалось, это же [02:52] волшебно, правда? Но всё равно создаётся ощущение, что, в общем-то , ничего по сути не изменилось. Для дальше? Какой интерфейс лучше всего подходит для этой технологии? Какой же взаимодействия с компьютером? Так что, это просто истина, что, как и [03:05] перемены, они происходят медленнее, чем люди ожидают, так и адаптация людей занимает больше времени, а другое, какой-то другой блокировщик, может быть, всё ещё платежами, количество вещей, которых, по сути, [03:18] не хватает агентам, можно пересчитать по пальцам одной руки. Как вы упомянули, проблема с Возможно, это аутентификация для разных... ну, знаете, я думаю, что кнопка "Я не робот" уже легко нажалась. Возможно, это похоже на создание [03:31] не знаю. Как вы думаете, есть ли еще какие-то серьезные препятствия? препятствия. Например, для аутентификации мы можем использовать Browserless, локальный браузер. Это по-прежнему кнопка захвата изображения. Например, у нас есть скрытый [03:45] браузер в облаке. Таким образом, если вы используете нас через Telegram или облачное хранилище, это также решает большинство задач, выполняемых онлайн. Я думаю, главная проблема скорее в интерфейсе. Вопрос в том, [03:58] что именно вы хотите, чтобы подтолкнули этих агентов? Представьте, что у вас есть искусственный общий интеллект (AGI) в сложные рабочие процессы, то для чего вы создадите такую ​​систему? Вы рассказываете им о своих целях? Возможно, раньше вашей целью было немного изменить свой сайт, но теперь, [04:12] сайт. Например, вам нужно больше клиентов. Ага. Да, бизнес- цель меня устраивает, пусть я решу вопрос с дистрибуцией. пришел к выводу, что главная сложность заключается в том, чтобы придумать [04:27] В новом репозитории, с которым мы сейчас экспериментируем, мы перевернули всё с ног на голову и позволили искусственному интеллекту задавать вам вопросы. Кстати, вот о чём хотите предоставить коду Клода доступ к вашей базе данных, чтобы он мог вносить в нее изменения, но [04:41] понимает вашу схему, не знает, какие у вас политики RLS, и ничего не знает о вашей базе данных. Именно поэтому Superbase выпустила Agent Skills. С помощью нового навыка Superbase вы можете взять любого агента, например, Claude X, Claude [04:55] Code или Cursor, и мгновенно превратить его в эксперта по работе с вашей базой данных. И самое приятное, что навыки Superbase полностью имеют открытый исходный код. Вы устанавливаете его одной командой, и агент получает полное представление о документации Superbase, так [05:07] что любые изменения SQL выполняются с первой попытки без ошибок. Это также способствует закреплению важных в производстве закономерностей. RLS применяется ко всем открытым схемам, средства вызова безопасности применяются к представлениям, и отсутствуют " осиротевшие" миграции. Честно говоря, я [05:20] Superbase разрабатывает продукты для мира, где весь ваш код будет написан агентами искусственного интеллекта . Они инвестируют в экосистему, навык полностью бесплатный и с открытым исходным кодом, и он работает со всеми основными агентами ИИ. Поэтому, если вы позволяете ИИ [05:33] вносить изменения в вашу базу данных, пожалуйста, установите это обновление до того, как ваш агент совершит находится в описании, начать можно бесплатно , и примерно через 30 секунд у вас будет более компетентный агент. И спасибо компании Superbase за спонсорство [05:46] Итак, у нас есть возможность общаться с агентом через Telegram. А нам, в принципе, всё равно насчёт упряжи. Как и подписка. Это совершенно не проблема. Но [06:00] понятно? Так что вы можете отправить мне сообщение с моего телефона. масштабную цель. Например, сделать мой стартап успешным. Похоже, здесь процесс в основном сводится к тому, что вы сначала подключаете несколько своих сервисов, хорошо? [06:13] Одним щелчком мыши можно подключиться к Gmail, Slack, Notion, Linear, GitHub — к любому сервису, где хранятся ваши контакты и данные. А потом ты получаешь одну из этих коробок, понятно? Это как машина, которая работает круглосуточно и без выходных. Здесь вы можете [06:27] Code. Затем вы подключаете Telegram, и после этого можете отправлять сообщения своему экземпляру Cloud Code или любому другому используемому вами инструменту. подключено, я просто говорю этому агенту запустить цикл, проверять [06:43] каждые полчаса и предлагать, что он должен для меня сделать. По сути, я говорю: я больше не хочу вас подсказывать, просто предлагайте свои варианты. Например, здесь он видит мой WhatsApp, понятно? И оно видит: "А стоит ли мне ответить [06:56] этому человеку в WhatsApp?" Или у меня здесь один канал с циклами роста, понятно? По сути, я говорю: «Хорошо, помогите мне развиваться». И затем здесь, по сути, говорится: «Хорошо, стоит ли мне предложить [07:08] клиенту отправить сообщение с предложением использовать Browser Harness?» И вот что я могу увидеть. Вот такое сообщение и будет. И я могу сказать: «Хорошо, мне Я вижу, что использование браузера уже было раньше, но я, по сути, хочу [07:22] Browser Harness на Browser use, а затем снова на Browser Harness, хорошо? говорю: «Отправить сейчас же». Теперь я могу управлять всем своим стартапом, Да, потому что я просто говорю этому агенту: "Хорошо, я знаю". Вчера вечером [07:38] мне это подсказало, не знаю, сколько всего мне нужно. И, как я уже сказал, я, просто взглянув на сообщение, за 3 секунды должен понять, о чём идёт речь, чтобы решить, да или нет, или предоставить больше [07:51] контекста. И мне очень-очень нравится этот новый интерфейс, потому что мне нужно всего лишь нажимать кнопки, верно? А если мне захочется увидеть больше, я смогу найти источник. Конечно, мы можем сделать его немного лучше, но [08:04] я думаю, что это действительно сильно изменит внешний вид интерфейса, потому что Тебе просто нравится листать профили? Хорошо, да, мне это нравится. Нет, не делай этого. Это, это, это просто Да, мне интересно, как выглядит оптимальный интерфейс, верно? Потому что, исходя из [08:18] основных принципов, это должно быть наилучшим способом передачи информации человеку. И в некотором смысле эти мессенджеры уже очень хорошо установлены у всех, поэтому это удобно. Но мне интересно, может быть, это что-то [08:30] действительно стратегическая игра, где вы видите свои ресурсы, своих свои предложения, уведомления, может быть, интерфейс в стиле Civilization. Что вы Да, я начал с Telegram, потому что в нём уже встроено сотни полезных функций. Очень-очень [08:46] знаете, передать кому-то в руки, чтобы посмотреть, насколько это полезно. А если это окажется действительно полезным, то позже я смогу изменить интерфейс на приложение, чтобы иметь больше Это потрясающе. Тогда, да. Самое безумное, что [09:01] это со мной случилось, это то, что мой соучредитель пожаловался в Slack, что Codex использует слово "browser use" в качестве названия внутри Codex. Это сбивает с толку, понятно? Сейчас я работаю в агентстве, у нас тут много дел, они следят за моим Slack и всем остальным. Итак, мне предложили: «Привет, я только что увидел, что ваш [09:16] соучредитель пожаловался. Стоит ли мне написать команде Codex в личные сообщения на X и на электронную почту, чтобы узнать, могут ли они изменить название?» Да, давайте начнём , хорошо? Итак, выяснилось: «О, этот человек, работавший над Pirate, который раньше занимался Pirate, теперь в команде Codex». [09:30] немного запутано. Можете переименовать?» Через два дня он прислал ответ: «О, позвольте мне поговорить с командой. Зачем вам это нужно? Это вас смущает или нет?» Я только что открыл свою электронную почту и вижу письмо от [09:43] "Так, что же здесь произошло?" По сути, мне не хватало контекста в том, что делал мой агент. И это такое необычное, совершенно новое ощущение, потому что кажется, будто ты окончательно утратил право собственности. Знаете, когда [09:56] отправляешь запрос, чувствуешь себя хозяином всего процесса. Но когда агент отправляет первое сообщение, вы чувствуете себя уже не столько владельцем. Вы чувствуете себя скорее наемным работником. И это очень-очень странное чувство, правда? Вы начинаете [10:09] меньше заботиться. И ваш результат ответит: «Хорошо, позвольте мне поговорить с командой». А через 3 дня мой агент сообщает мне: «О, проблема решена. Codex переименован в браузер». Я спросил своего агента: «Хорошо, как такое может быть? Почему?» И я сказал: «Извините, я [10:24] только что увидел твит от человека, где я написал, что он браузер"». Я подумал: «Хорошо, но это же не официальный открытый ИИ. Может, этот человек я получил ещё один, верно? А потом, спустя [10:36] электронное письмо, в котором говорилось: «Извините за задержку с ответом. Мы просто переименовали его. И я подумал: «Как же это безумно, что агент, по сути, сделал это полностью самостоятельно, решил пройти весь процесс и сказал мне об этом еще до того, как [10:50] парень из Codex мне об этом сказал, увидев случайный твит в сети плагин для браузера». Да. То есть, это предвкушение будущего. Так что кто сможет описать свои цели самым абстрактным образом на высоком уровне [11:04] переменная — это вкус, верно? Вы бы смахнули влево или вправо? Да, вроде того. Да, я бы сказал, что да. Цель высокого уровня, да, я имею в виду, что сделать свой стартап успешным, а затем просто агент давал бы мне идеи и упрощал бы [11:18] мне их понимание. И это очень интересно, потому что теперь это психологическая игра. Мой агент начал предлагать мне разные вещи, а я просто думаю: «Ладно, мне это все равно ». Идеи приходят от кого-то другого. В [11:30] противном случае. Например, если эти идеи исходят от вас самих, даже если это одна и та же её и сказали: «О, это хорошая идея». Гораздо проще поддержать свою собственную идею, чем идею другого человека. И теперь мне нужно [11:42] попросить своего агента попытаться убедить меня в важности его идеи. То есть, он должен объяснить, насколько сильно это повлияет на мою цель. И он должен попытаться договориться со мной, и его цель — чтобы я нажал «принять», [11:55] максимально простым для понимания. Да, это увлекательно. Зачем вы вообще создали этот браузер? Примерно 10 лет назад я автоматизировал свой небольшой онлайн-бизнес. И я из тех людей, которые могут потратить 100 [12:07] часов на автоматизацию чего-то, что сэкономит им 1 час. И однажды я подумал: «Как же мучительно создавать скрипты автоматизации». Затем веб-сайт меняется, и ваш скрипт автоматизировать процесс генерации автоматизации, чтобы можно было быстрее создавать скрипты [12:22] ?» В то время мы были в Цюрихе, в университете, жили в коворкинге, спали на диване и обедали вместе и подумали: [12:34] сказать компьютеру, что он должен сделать, и он бы это сделал?» И мы подумали: Anthropic только что запустились». И мы подумали: «На 100% уверены, что они это построят». «Все этого хотят». Но мы подумали: «Насколько сложно будет [12:48] просто это построить?» Так начался наш первый совместный проект, который мы реализовали за выходные Это же удивительно. Многие люди на самом деле боятся, что OpenAI и Anthropologie заменят их. Что бы вы сказали основателям, которые [13:00] моделей заменит это»? Что бы вы им сказали? мы знали: «Окей, это так круто». « Все хотят это построить». Так что мы уверены, что они это построят. Но я просто подумал: «Хорошо, насколько это будет сложно?» [13:15] А потом, оглядываясь назад, если подумать, что больше года назад, когда я думал, что они на 100% это сделают, они это сделали. Но я думал, лучше и что это уже будет работать намного лучше. Так что, я думаю, если [13:28] вы хотите увидеть что-то в реальности, вам не следует ждать, пока это сделает кто-то Да, конечно. И еще, возможно, это сила небольшой фокус-группы, а не задач. В нашей области, особенно, мы [13:41] агностики, нам не особо важна оснастка или модель. Вы можете из нашей библиотеки. И я думаю, это Почему вы сделали это открытым исходным кодом? Для нас это было очевидно. Грегор должен был [13:54] писать свою магистерскую диссертацию в Беркли. И было ясно, что это что-то вроде Побочный проект. В эти выходные мы работали над проектом всего два дня. подумали: «А давайте запустим это на Hacker News, хорошо?» Я никогда раньше не запускал [14:06] ничего успешного на Hacker News. И мы просто сказали: «Хорошо, открытый или закрытый?» О, для Hacker News, хорошо, было бы логично, если бы это было открыто. Поэтому мы просто зашли на GitHub и выбрали открытый исходный код. Решение заняло всего две минуты. Но теперь, [14:18] оглядываясь назад, я думаю, что исходный код. Просто невероятно здорово иметь такое сообщество, когда люди, например, случайные пользователи, говорят: «О, они попробовали библиотеку». И потом [14:32] это очень нравится. Да, я имею в виду, в последнее время, особенно в этом году, мы видим гораздо больше проектов с открытым исходным кодом , которые появляются и становятся невероятно популярными. Так вы думаете, что эта тенденция сохранится, и все больше и больше [14:44] или как вы это видите? Да, я думаю, что если у вас есть очень умный ИИ, назовем его AGI, вы можете превратить любое программное обеспечение в открытый исходный код. программное обеспечение с закрытым исходным кодом, пожалуйста, сделайте его открытым для меня». Потому что В этом плане [14:58] вы увидите много программного обеспечения с открытым исходным кодом . Будет очень легко переходить от закрытого программного обеспечения к открытому. Понятно. То есть, по сути, преимущество заключается в том, чтобы быть первым проектом с открытым исходным кодом и, так сказать, попасть в обучающие данные [15:11] этих моделей, так что они становятся доступными по умолчанию, и другие люди могут создавать на их основе форки Нет, я не уверен, насколько мы уже используем обучающие данные. Мне кажется, пока не очень много. Я думаю, что преимущество быть первым определенно есть. Люди [15:24] хотят чего-то очень простого, что просто работает, верно? Например, в начале использования браузеров в нашем файле README было видео, и вы могли очень быстро понять, как выглядит интерфейс, как работает библиотека. Это [15:36] было огромным преимуществом по сравнению с аналогичными библиотеками, которые уже существовали в то время. Это было просто очень-очень просто. Да, вы показываете занятым людям то, что раньше не работало. Это и вызвало у людей огромный интерес, а затем, [15:48] например, такие люди, как вы, начали снимать видео, и это стало своего рода циклом ажиотажа, я бы сказал, а затем примерно через год Год назад, например, я записал демо-версию, где мой ИИ мог подавать заявки на работу за меня. Демо-версия была ужасного качества. [16:02] Видно было мое имя и адрес электронной почты. Это был какой-то подарок, плохого качества, я его выложил, и ничего не произошло, понятно? через три недели, люди начали [16:16] использовать эту демо-версию, добавлять её в свои видео и говорить: «О, теперь ИИ может подавать заявки на работу». И поскольку некоторые ютуберы это сделали, другие тоже подхватили эту идею, и всё это взорвалось. Но я бы сказал, что это в основном спорные [16:28] «О, стоит ли это делать?» «Нужен ли нам теперь ИИ для проверки заявок?» И в то же время, просто оказаться в нужное время. Если, например, связать ваш проект с его с ним: «О, теперь вы можете использовать Deep Seek с браузером». Или вы можете использовать [16:43] Operator в нашей библиотеке. Да, да. Для управления браузером. Такая связь с текущими тенденциями очень помогла нам Да, так вы думаете, что основателям нужно больше сосредоточиться на маркетинге и [16:55] продукте? Две недели назад мы провели эксперимент в компании, где, по сути, сказали каждому члену команды: «У вас есть неделя, и ваша цель — создать новый стартап с нуля, с нуля, и [17:08] сколько вы сможете заработать, хорошо?» И, по сути, цель состоит в том, чтобы автоматизировать зарабатывать для вас деньги. Для всех это было так: « О, потому что для всех наших инженеров создать подсказку, создать веб-сайт — это очень здорово». Но, безусловно, [17:22] распространение было для большинства самой сложной частью. Они говорили: «Это...» Самое великое Понятно. Хорошо, значит, у вас раньше был стартап, верно? Он не был таким вы научились на том стартапе и что вы сделали по-другому в [17:35] Думаю, меня эта идея определенно больше вдохновляет . Раньше мы пытались оптимизировать светофоры. Понятно? И я пытался найти в этом смысл и сказать: «О, мы можем сэкономить столько CO2 в мире». Но [17:49] всякий раз, когда я проходил мимо светофора, я смотрел на него и чувствовал, что мне это неинтересно, это не очень-то меня вдохновляло, мое сердце не загоралось. Как я уже говорил, я мог бы потратить 100 [18:02] часов на автоматизацию чего-то, что в итоге окажется совершенно бесполезным, просто потому что я люблю сам процесс автоматизации. Работа над этим на самом деле доставляет удовольствие, я бы сказал, мне это очень помогло. И это [18:15] о нем другим людям и действительно поддержать его. Так что, можно сказать, соответствие продукта основателю привело к соответствию продукта рынку. Раньше нас было четверо. Что касается соучредителей, я также не могу рекомендовать их, поскольку [18:29] мы, работая параллельно. И поэтому у нас было соучредителями. Мы начали вместе на хакатоне, как и предыдущий стартап на хакатоне. И поэтому не было четкого решения: «О, я хочу стать соучредителем с этим [18:44] человеком». Скорее, это было так: «Хорошо, мы вместе выиграли хакатон, давайте просто продолжим работать над этим». Это привело к множеству конфликтов между соучредителями, я бы сказал. Новый стартап определенно был более [18:56] вместе?» Да, я думаю, многие успешные люди, венчурные инвесторы, предприниматели, рекомендуют работать с человеком хотя бы один-два года, потому что вы знаете, что будете проводить с этим человеком весь день, каждый день [19:10] на самом деле мы раньше не работали вместе. Так что, возможно, нам немного и я бы сказала, что профессионалы используют это, когда мы начинали. Конечно, вначале мы очень много работали, и я сказала, что мы жили в [19:24] коворкинге, верно? Я стирала свою одежду там, где стирают бездомные, буквально жили там. Определенно, что очень помогает чувствовать себя воодушевленными вместе, так это когда вы растете, верно? Если вы растете, даже если вы не [19:37] рост с незнакомым человеком , это как-то сильно вас сближает мы работали над этим 2 года, и никакого прогресса, ни один город, который действительно дал бы нам деньги, ни инвесторов, ничего. Думаю, это [19:53] очень-очень сложно. Итак, вы уехали из Цюриха в Сан-Франциско, верно? Да, мы попали в YC год назад. Именно там мы сказали: «Хорошо, давайте сделаем Хорошо, давайте разберем это. Во-первых, YC Combinator, что послужило вашей главной [20:05] преимущество вы увидели? Для меня это показалось очень естественным. Я раньше жил в Сан- Франциско. Всю свою жизнь до этого я просто спал в коворкингах, занимался разработкой проектов, о личностном развитии или создании стартапов. Поэтому [20:20] находиться в такой благоприятной среде было очень естественно. Это как в воскресенье, когда я иду в церковь, я там со многими верующими, и поездка в Сан-Франциско — это как поход в но я иду в церковь, потому что там есть другие христиане, понимаете? А [20:32] в Сан-Франциско просто, ну, другие агенты-строители здесь, и это Понятно. В чем тогда разница между людьми, которые добиваются успеха, и теми, кто не добивается? Очевидно, первое, что нужно, это иметь готовую систему и [20:44] вас есть 100 человек с такой же системой. Это просто вопрос вкуса? Или какие еще переменные будут присутствовать? Как вы думаете, это будет в будущем? всё сами, всю работу, и даже придумывать идеи для развития компании? [20:59] какие будут подсказки? Что вы будете подсказывать системе? Ведь разве люди всё ещё не являются создателями первоначальной идеи? очень плохо получается мыслить нестандартно. [21:11] Например, эта штука с Кодексом... я не сам догадался, что это возможно. Люди хорошо умеют принимать решения и, я думаю, брать на себя Например, если я сейчас отправлю сообщение, скажем, в Cursor, я всё равно [21:24] да, я беру на себя ответственность. А мой глупое сообщение, и меня заблокируют. Так что это своего рода вопрос вкуса в этом уравнении. Но я... [21:37] DeepMind, верно? Они хотят... Решать научные проблемы человечества. Например , рак, биологические проблемы, термоядерный синтез. В общем, есть много проблем, которые мы, как человечество, хотим решить, верно? Думаю, здесь у нас есть [21:51] система искусственного интеллекта, которая может решать действительно сложные проблемы, которые люди до сих Получается, мы будем больше работать над системой, чем над агентскую компанию, структуру или [22:05] Честно говоря, в этой агентской системе вы определяете свои высокоуровневые цели. Вы говорите: «Хорошо, создайте агентство в Telegram». А потом она спрашивает: « Моя цель — сделать мой стартап успешным». И она начинает [22:18] мозговой штурм. И когда вы говорите: «Хорошо, нет, мне это не нужно», в моем базе данных навыков. Таким образом, она запоминает ваши предпочтения. Оно помнит: «О, тебе наплевать на твои запросы на слияние в GitHub, но тебя больше волнует дистрибутив». [22:32] видео, а затем спрошу: «Стоит ли мне опубликовать это видео на X?» Я просто думаю, что для нашего бизнеса это в некоторой степени вопрос контекста, верно? Но я думаю, что когда я подключаю Gmail, Slack, [22:47] WhatsApp, там содержится большая часть моей информации. Иногда бывают такие вещи, ладно, я сижу в машине, и, может быть, мне бы очень хотелось иметь здесь небольшой микрофон, чтобы... Я тоже так думал. Это необходимо. Итак, хорошо. Таким образом, между ними самими [23:02] , вероятно, определяется, кто лучше всех понимает мир. Кто лучше всех разбирается в социальных процессах, рынках и бизнесе? Я определенно чувствую, что сейчас в сфере ИИ-агентов [23:14] все основатели компаний движутся в одном направлении . Кажется, все хотят создать идеального ИИ- помощника. Я бы сказал, что конкуренция становится намного, намного сильнее, потому что ИИ становится очень универсальным, поэтому вы внезапно начинаете пересекаться со [23:27] множеством других предприятий. Я верю, я действительно верю в себя и свою команду, мы просто живем в будущем, играем с этими инструментами, [23:39] переживаем проблемы, с которыми сталкиваемся, живя в будущем, а затем решаем эти проблемы. Может быть, сейчас дело в интерфейсе, в том, как мне всё протестировать Ага. Я верю, что таким образом мы сможем создать [23:53] нечто поистине волшебное, что вызовет у людей сильное привыкание и любовь. Если следовать этому процессу, то, может быть, через 3 месяца все так сделают, использует основную библиотеку, то она, по сути, теперь встроена в основную модель [24:08] Но я думаю, что, живя в будущем и решая проблемы, с которыми вы столкнетесь в будущем, если вы решите постоянно этим заниматься, вы всегда сможете создать и расширить границы возможного. [24:20] мозговой штурм для стартапов, знаете ли? Постарайтесь действительно выложиться на полную через 3 или 6 через 10 лет вы окажетесь в положении, подобном Google Glass, верно? Кажется, еще Вы упомянули, что время использования браузера было выбрано правильно, но, знаете, [24:35] время в сфере ИИ, очевидно, будет течь по-другому . Тогда вы сможете предвидеть проблемы, которые люди сегодня не замечают. Знаете, например, сейчас у нас в [24:50] следить за всем этим, верно? На самом деле, это не совсем нормально для компании иметь так много внутреннего программного обеспечения, особенно если оно создано верно? Таким образом, [25:05] репозиториев GitHub, сотнями фронтендов и бэкендов? Как вы поддерживаете всё в актуальном состоянии ? Как управлять сотнями агентов? Что такое оптимальный пользовательский интерфейс? между ними, верно? Возникает много новых проблем, и я думаю, [25:18] Многие из них, вероятно, представляют собой стартапы с многомиллиардным оборотом, верно? сейчас сталкиваюсь, понятно? Теперь у каждого есть свой круглосуточно работающий бот, понятно? становятся похожи на машины в облаке. Они [25:33] Это как работать в облаке, но при этом весь код находится там. Так что я могу просто сказать: «О, мне не нравится, как вы мне отправляете сообщения в Telegram. Пожалуйста, я знаю, замените их на одни только смайлики, верно?» А затем, по сути, [25:47] код моих локальных ботов меняется, потому что агент может просто модифицировать свою собственную кодовую базу. Но допустим, мы внедряем новую функцию в основной код ботов, и хотим, чтобы каждый пользователь имел к ней доступ, [26:01] верно? Но внезапно возникают конфликты, потому что локальный пользователь, агент, изменил свой собственный исходный код, и теперь есть изменения в вышестоящем проекте, верно? Хорошо. Я не знаю, обычные обновления программного обеспечения для этого не предназначены, верно? [26:14] существует всего один поток, но теперь он может расходиться во многих разных направлениях. Хорошо, а как нам это решить? Например, в нашем случае мы сказали: «Хорошо, давайте сделаем так, чтобы у [26:29] которым общаются люди, был полный контроль над собственным исходным кодом. Потому что тогда агент сможет просто разрешать агент может просто решить: «О, я могу это подтянуть, но не это». [26:43] Таким образом, агент может решать, что нужно делать, а что нет. И я также могу сказать своему агенту в Telegram: «Мне не нравится этот сервер Telegram». Я хочу, чтобы ты отправляла мне смайлик каждый раз, когда я тебе пишу , хорошо? Теперь агент может внести [26:57] изменения в свой локальный исходный код и напрямую отправить исправление в общедоступный репозиторий, к которому имеют доступ все . Если объединить все это в одном месте, например, в агенте, с которым вы взаимодействуете или который использует браузер, [27:11] собственную среду разработки, то цикл разработки ускорится примерно в 10 раз . Раньше в браузерах всегда был отдельный агент, который отслеживал все следы использования браузера. Это правильно? Это неправильно? [27:24] разных агента, которые проводили оценку, один агент, который непосредственно выполнял работу, и другой, который затем исправлял ошибки. Магистр права — это же судья, верно? Это как если бы друг с другом. Это намного медленнее, чем если бы у вас был только один агент, и [27:39] вы могли бы просто спросить, что пошло не так, а он бы ответил: «О, я не смог увидеть скриншот». Там просто написано: «Исправьте это». Оно видит: «О, здесь в коде ошибка». Оно толкает, и это абсолютно правильно, потому что оно может исправить себя само. [27:51] вы используете для разработки? Кого вы используете в качестве личного агента? вы используете в качестве личного агента? Поэтому я до недавнего времени использовал SuperSet для создания множества рабочих деревьев. Я не стартап из YC, но, [28:05] честно говоря, сейчас я всё делаю через Telegram. Как и в Telegram, у меня есть вот эта коробка, которую я показывал вам раньше, она работает круглосуточно. Это как один клик — и вы получаете круглосуточный доступ к облачному сервису. А теперь в Telegram у меня есть разные [28:19] темы на форуме, и эти разные темы — это просто разные сессии агентов. Мне нравятся оба варианта. Иногда Codex работает немного быстрее, поэтому я предпочитаю этот вариант. В [28:33] «Хорошо, создайте новое агентство. Предлагайте мне, что бы вы хотели для меня сделать». А потом я просто нажимаю « принять» или « не принять». И я просто встаю. Для взаимодействия с браузером я использую [28:47] исключительно BrowserHassive. Например, вчера мы лазали в скалодроме, и я подумала: "О, ребята, а вы хотите буррито на ужин?" Они ответили утвердительно, поэтому я просто зашёл в Telegram и написал: «Хорошо, закажите мне пять буррито». [29:00] И скажите: «Пришлите мне скриншот перед покупкой, чтобы я убедился, что всё правильно, верно?» Так оно и есть, делает то, что делает , я продолжаю подниматься, карты. Я говорю: "Хорошо, мне понравилось ". Я говорю: "Покупайте". И это покупает мне то, что мне нужно [29:14] ". Я говорю: "Покупайте". И это покупает мне то, что мне нужно . Таким образом, для взаимодействия с браузером мы в основном используем этот инструмент, называемый "браузерным симулятором". вы понимаете, использование браузера в качестве хранилища данных гораздо популярнее, чем [29:28] недавно. Думаю, стоит затронуть различия, и, возможно, можно будет продемонстрировать настройку на экране, чтобы люди могли увидеть, как ею пользоваться. Да , безусловно. Это просто супер, настройка очень-очень простая. Понимаете, [29:42] для начала вам нужно всего лишь указать вашему агенту, например, OpenClaw, Hermes или codex.local (независимо от того, какой вы используете), просто перейти в BrowserWharsh, в публичный репозиторий GitHub и настроить его [29:55] публичный репозиторий GitHub и настроить его самостоятельно, хорошо? Как будто открытые когти или, например . По браузером, если вы запустите её локально. Итак [30:10] , это вот эта штука, которую выпустила компания Google, и которая позволяет подключаться к вашему браузеру Chrome через CDP. браузеру Chrome через CDP. А вот что удивительно, [30:23] хорошо? Этот ремень безопасности, этот ремень безопасности для браузера, — самый маленький ремень безопасности, который вы когда-либо видели, понятно? Это примерно 600 строк кода. Оно невероятно маленькое. И это [30:37] браузером. Потому что, как я объяснил ранее, агент может модифицировать свою собственную систему. Например, система хочет загрузить файл, видит, что инструмента для загрузки файлов нет [30:51] , агент просто записывает его, и после этого файл можно загрузить. Или, допустим, вы заходите на веб-сайт, и там находится сложный междоменный iframe. Агент, поскольку он видит всю свою собственную кодовую базу и, будучи очень маленьким, [31:05] может изменять только свой собственный код. И с помощью этого можно решить любую задачу. Как и в браузере, здесь множество частных например, в основном браузере кто-то жалуется: [31:17] «О, там есть поле для подписи. Хорошо, мой агент не может подписать на этом сайте, потому что нужно заполнить форму подписи, понятно?» Ага. И это практически невозможно, например, у вас нет инструмента, чтобы нарисовать, скажем, определенные волновые [31:29] функции в координатах. Но этот агент может просто создать собственный инструмент для выполнения подобных движений, а затем решить любую сложную задачу в браузере. Именно это делает его таким надежным. Ага. Я имею в виду, это как идея определения [31:43] отталкиваясь от основных принципов, а затем позволяя Таким образом, практически всё, что можно преобразовать в код, поддаётся решению. Да, вроде того. Да, именно так. Да, и вот здесь, например, мы [31:58] говорим: «Хорошо, если, например, я не знаю, допустим, кто-то хочет распечатать страницу, хорошо? Крайний случай, на который часто жалуются в браузерах, например. Тогда один агент может просто разобраться в этом [32:11] и опубликовать навык, как другие могут его использовать. Позвольте мне показать вам здесь один, например, диалог, хорошо? Есть эти встроенные диалоги в браузере. Например, «О, вы хотите разрешить поделиться своим [32:24] местоположением?» И для обычных агентов браузера это очень, очень сложно, потому что они на самом деле не видят этих оповещений. Но теперь этот агент, поскольку он может модифицировать свой собственный интерфейс, например, выяснил: «О, если это, [32:38] я имею в виду, разные методы, он может решить эти проблемы». Затем система просто публикует его в репозитории, и после этого у всех есть доступ к этим навыкам, позволяющим обрабатывать различные граничные случаи. Поэтому в следующий раз, когда возникнет подобная нестандартная ситуация, [32:52] взаимодействие с ней будет происходить гораздо быстрее. Так почему же именно сейчас используется браузерный инструмент? Раньше это было невозможно? основном это связано с улучшением программных агентов. [33:07] Я могу вам это показать. Например, это всё, что есть, понятно? Это, по сути, один файл. А здесь, например, используется метод переключения верхней части, хорошо? Всё это очень-очень маленькое. Таким образом, агенту необходимы очень хорошие [33:20] агенту необходимы очень хорошие навыки программирования, чтобы комбинировать эти различные функции для взаимодействия с браузером. В основном дело в понимании. . Год назад я не знаю, [33:33] потратили ли мы столько времени на написание командной строки в GPT-4 , как вызывать нужна ли была гораздо большая степень абстракции по сравнению с тем, что было год назад. Но теперь, по сути, ремни безопасности уже не имеют такого уж большого значения. Например, если вы используете Cloud [33:49] Code или Codex, нам это не особо важно, потому что базовые модели становятся настолько хорошими, что это просто перестает иметь значение. Вы можете просто написать код PC. [34:01] Итак, если мы заглянем в будущее, как это будет выглядеть? Разве модель не должна сама это усвоить? Или это просто как-то встроено? Да [34:14] , безусловно. На 100% так работает, это просто волшебство и очень надежно. Я имею в виду, что в облачном коде (Cloud Code Codex) они на 100% сделают здесь то же самое. Так в чём же твоя сильная сторона в этом деле? В моей сильной стороне — [34:29] Ага. Поэтому я считаю, что нужно жить будущим, и мы будем строить все, чего нам не хватает. И прямо сейчас, хорошо, следующее, что вам нужно, это круглосуточно работающие в облаке агенты, которые смогут выполнять за вас различные задачи и способствовать успеху вашего стартапа [34:41] мы и отправляем. Мы отправляем туда агента, работающего круглосуточно и без выходных. В нем хранятся все ваши данные для аутентификации, все ваши контакты и все ваши профили браузера. [34:56] И да, прямо сейчас мы экспериментируем, чтобы определить, какой интерфейс лучше всего подойдет для этой браузерной платформы. Это Telegram? Это собственное приложение? Это потому, что оно постоянно мне это предлагает? В настоящее время моя основная стратегия заключается в том, что мне [35:09] нужен агент, который сам подскажет, что он хочет для меня сделать. А потом я просто Сделайте это. Но разве опасность не в том, что вы рискуете потерять свой авторитет генерального директора? Если агент сам генерирует все идеи, разве это [35:23] Да, одобрение — это часть полномочий генерального директора , верно? Хорошо, мне эта идея нравится. Ага. Но я думаю, что самые большие проблемы по-прежнему заключаются в том, что, будучи генеральным директором, вы должны уметь Но я имею в виду, что вы все равно ставите цели, верно? Я имею в виду, вы ставите цели [35:39] понимаете? Да, намного, намного выше. Раньше я, возможно, ставил перед собой цель: «Хорошо, давайте создадим веб-сайт». И теперь, очевидно, я поставил цель: хорошо, давайте привлечем пользователей. Всё просто выходит на новый уровень. [35:53] На каждом уровне так много всего, знаете, столько всего подразумевается. Давайте, например, привлечём что-то, что нужно пользователям, верно? А потом, как и со всеми этими вещами, вам даже не нужно ничего объяснять, потому что у агента просто будет [36:07] это сделать. Да, это очень интересно. Вы перестаёте заботиться о многих вещах, которые раньше вас очень волновали. Два года , вы бы уделили много внимания, например, этой небольшой анимации, и так далее [36:21] вы отождествляете себя с этим. Но теперь, если ваш агент посоветует вам: «А может, нажимаю «да», после чего меня совершенно не интересуют никакие функции этого сайта. Таким образом, [36:37] честно говоря, мне это пока не совсем нравится. И я думаю, как я могу изменить систему, чтобы чувствовать себя полноправным владельцем этих идей. прошлого? Или вы считаете, что это необходимо по какой-то [36:52] Я думаю, что все более совершенные системы искусственного интеллекта определенно будут лишать нас свободы действий, особенно когда они будут нас об этом просить. И они нам подсказывают, например, на складе Amazon, понятно? У вас уже есть [37:06] планированием, а затем люди ходят в гарнитурах, и система ИИ говорит им: «Эй, идите сюда, возьмите этот товар и идите туда» . Таким образом, люди, по сути, руководствуются указаниями искусственного интеллекта. И я думаю, что сейчас, когда ИИ очень [37:21] умный и все более и более способный, мы все чаще видим, что ИИ будет нам помогать. И мы, по сути, являемся инструментом, востребованным в сфере искусственного интеллекта. ИИ, способными работать круглосуточно, а значит, они гораздо, гораздо более [37:34] вещей. И мы, по сути, являемся лишь узким местом в уравнении, обеспечивающем круглосуточную работу ИИ. Так что это, конечно, значительно повышает продуктивность, но пока значительно повышает продуктивность, но пока [37:48] как я уже говорил, я перестал обращать внимание на вещи. Я остановился. И вот, я думаю, как мне изменить это, с психологической точки зрения, как это может не говорит: "Стоит ли мне это строить?" Но "Стоит ли нам это строить?" Или, я знаю, [38:01] я прямо сейчас экспериментирую с этим каждый день, как я могу сделать так, чтобы у меня оставалось ощущение, что я по-прежнему являюсь владельцем идей, которые мне предлагаются. вам предоставляется два варианта выбора. То есть, в каком-то смысле, это уже с этим связано. Но, знаете, может быть, [38:16] вместо того, чтобы просто подсказать идею, это подскажет вопрос, который и вы все еще чувствовали себя ее владельцем? Мне следует отправить запрос? Мне следует отправить запрос? Может быть. [38:30] ИИ, если бы он захотел, чтобы вы стали инструментом, который он использует, всё равно, в своих хотел бы, чтобы вы о нём заботились, верно? Потому что если вы неравнодушны к этому, вы если вы делаете что-то относительно небольшое, если ИИ приходится [38:43] полагаться на человека, у него все равно будет стимул максимально вовлекать человека в процесс . Ммм. Да, это определенно существует. Ммм. Да, это определенно существует. [38:55] момент, потому что мой ИИ начал предлагать мне вещи, которые меня не интересуют. Это как групповой чат, где вы получаете сотни сообщений, а вы просто игнорируете Верно? И поэтому я, по сути, начал стимулировать его к [39:09] самостоятельности. Моё агентство называется "агентство". Ваша цель — добиться того, чтобы я принял как можно больше ваших идей. Если вы пришлете мне слишком много, я просто мало информации, я просто проигнорирую [39:22] понятным и полезным для меня. Это почти как предсказание следующего слова, понимаете? Например, прогнозирование следующей идеи, прогнозирование следующих бизнес- В этом столько всего заложено, правда? Как, например, прелесть LLM-моделей, которые, ну, вы понимаете, на [39:36] следующий токен. Возможно, это тот же самый эквивалент и для этого случая. Да, мне нужно убедиться, что эти идеи полезны. И вот, например, если ваш друг или я предлагаю вам [39:50] свою следующую идею, вам просто всё равно. Тебе плевать . Разве что мне удастся рассказать вам об этом так, чтобы вам это действительно стало интересно. Итак, теперь магистерской программе необходимо подумать о том, как заинтересовать пользователя идеей, которая [40:04] я знаю, что нужно понимать психологию. Необходимо психику и поймите, что лежит в основе вашей мотивации. Почему вы Вы делаете это ради статуса? Это становится страшно, чувак. [40:19] Ага. Таким образом, LLM необходимо понять скрытую мотивацию и сказать вам: «О, если вы нажмете здесь на эту кнопку или на «да», то получите, я не знаю, столько-то новых подписчиков, и это даст вам [40:31] одобрение, знаете, любовь, привязанность, что угодно». LLM нужно это понять, чтобы убедить вас Да, у этого парня будет, [40:44] базы данных SQL, которая отображает, по сути, ваш человеческий мозг. Или даже дальше, как ДНК, по сути. В конце концов... И в то же время это Потому что если это скучно, то, что мне это предлагает, [40:57] я просто больше не захожу в Telegram и не использую его. Но если это вызывает привыкание, и я чувствую, что каждый раз, когда я, не знаю, нажимаю «принять», я делаю прогресс и у меня появляется что-то новое, я не знаю... Я думаю, мы можем создать систему, которая будет [41:10] же время очень продуктивной. Да. Я имею в виду, это решение на триллион долларов , понимаете. Но в то же время происходит и обратное изменение, верно? Например, я [41:22] знаю многих людей, которые полностью отказались от создания короткого контента. И если также видим это на примере быстрых изменений, когда, например, год назад или что-то в этом отправлять короткие запросы и постоянно вносить небольшие изменения. Теперь же вы ставите перед собой [41:34] более масштабную цель, верно? В рамках Codex, который может работать 12 почти как вы сказали, нужно абстрагироваться выше, верно? Это Нужно задать цель и набор проверяемых [41:49] конечных результатов, которые позволят достичь этой цели. Так что, разве вы не видите обратное изменение: от TikTok, где короткие видеоролики — это всего лишь платформа, к более масштабным целям, [42:02] результат, вы... Может быть, достаточно отправлять всего одно предложение в неделю. Потому что, опять же, узкое место — это постоянное пролистывание влево и вправо. Знаете, если вы хорошо сформулируете желаемый пролистывать влево и вправо. Человек всегда является [42:16] Нет, но в данном случае я хочу быть ограничивающим фактором . По сути, я говорю ему: не отправляй электронные письма, не занимайся пиаром, спрашивай у меня одобрение, прежде чем другие люди увидят это. Но теоретически я мог бы просто сказать: никогда не [42:30] спрашивай у меня одобрения, просто отправляй электронные письма от моего имени, и я буду нужным. Да, это простой пример, верно? Например, если у вас есть чёткая цель по дефициту калорий, и вы хотите достичь 200 [42:42] граммов белка, я бы больше доверял ИИ в плане честности при Верно? Это то, что я с удовольствием полностью делегирую. То же самое, что и укажете 20 важных для вас вещей , установите бюджет, местоположение, я же [42:56] не хочу просматривать варианты, как на Airbnb, верно? Так что сейчас это возможно, если у вас есть хороший личный специалист, но, как . И вопрос в том, где этому конец? Сколько из этих [43:09] мы действительно хотим полностью делегировать ИИ ? Я закончил, так что я выполняю ваш первый пункт. Я думаю, что цель Codex волшебная. сейчас работаю, очень похож. [43:22] Вы определяете цель, и агент работает над ней. И поскольку Codex может быть полностью отделен на вашем локальном компьютере, никто другой не видит, над чем вы на самом деле работаете она связана с распространением, все немного по- другому. Вот почему мне нужно [43:37] промежуточное согласование. И вы спрашиваете, хорошо, связь с кратким контентом здесь. Я думаю, это очень Разница в том, что это все равно в некотором смысле повышает мою [43:50] Просто нужно сделать это так, чтобы мне было приятно, чтобы это выглядело красиво, чтобы это вызывало привыкание, чтобы я был в восторге. Но при этом это было бы полезно, верно? В основном, цель состоит в том, чтобы мой стартап был более [44:03] Просто да. Нужно разработать это таким образом, чтобы это немного вызывало привыкание, чтобы мгновенно... Ну, тогда это будет как видеоигра. Потому что я думаю, что видеоигры продаются как... да, да. [44:16] недавно кто-то из моей команды на хакатоне создал облачный код внутри Minecraft. Так что это отличается, как животные в Minecraft, которые были разными агентами. [44:28] Он мог убивать их, кликать на них, чтобы общаться с ними, что-то для него. Я думаю, что мы будем делать это и дальше, потому что это становится намного проще и абстрактнее, скоро у нас будут [44:40] где вы действительно продуктивны. Да, я имею в виду, что vibe coding — это огромный сдвиг в сторону, знаете, веселой работы. Конечно, как предприниматели, всех остальных, потому что есть исследования, где 80% людей ненавидят свою [44:55] работу, верно? Но это первая волна, когда что-то создаешь, и это весело. Но это сложно, я бы сказал. я бы сказал, скоро станет намного веселее . Но это [45:09] не максимальный уровень веселья. Это все еще нормально. Мне нужно убедить себя зайти туда, кликнуть, чтобы посмотреть, действительно ли это полезные предложения? Но я думаю, скоро у нас будет место, [45:21] это действительно вызовет привыкание. Хорошо, Магнус. Итак, мы достигли отметки в 1 час. Поэтому я хочу уважать ваше время. Куда нам следует направлять людей вы хотите продвигать? Я хочу, чтобы они попробовали мое агентство. [45:36] Они должны зайти туда. Они могут попросить своего агента решить задание для агентов на самостоятельно. А затем они должны попробовать... Ящик. Они получают круглосуточный сервис бесплатно. Подключают Telegram. Подключают их облачный [45:51] код или кодекс. И тогда вы можете отправлять сообщения через Telegram. Попробуйте написать, например, «Начать агентство и предлагать мне варианты», а затем укажите свою цель. Затем просто почувствуйте, что агент начнет вам предлагать, что это даст вам, [46:07] и вы просто нажмете «да» или «нет». И вы увидите, действительно ли это полезно. Я бы с удовольствием послушал несколько историй. И я хочу улучшить это, потому что я думаю, что для меня это интерфейс будущего, когда мне просто нужно провести пальцем, [46:20] Да, посмотрим. Может быть, через 3 месяца мы все будем листать деньги. Да. я собираюсь разместить ссылку на информацию под видео. [46:36] Быстро, если вы хотите получить доступ ко всему, что упоминается в этом видео, включая использование браузера, новый браузерный движок. Репозиторий, а также пользовательский навык агента для покупок, чтобы ваш агент мог безопасно использовать кредитную карту и [46:48] совершать онлайн-покупки за вас, — все это будет доступно по первой ссылке below the video. It's completely free. Just go below the video and grab it now.