[00:01] агент. Ну, как и другие агенты, они могут обновлять файлы Markdown или создавать для них пользовательский интерфейс, который бы показывал пользователю, что нужно сделать. Таким образом, это своего рода новая самообновляющихся агентов. Да, этот агент гораздо более динамичен в [00:15] агента показать вам что-либо, он вам это покажет. создательницей Space Agent и основательницей Agent Zero. А сегодня мы хотим Здравствуйте, Дэвид. Давайте сразу перейдем к делу. Объясните, что [00:30] это такое и как люди могут этим пользоваться. Моя цель заключалась в том, чтобы предоставить агенту доступ ко всем его уровням. Это распространённая проблема с другими агентами: у вас есть агент, работающий на VPS где-то на Python или Node.js, а затем [00:44] вы общаетесь с ним через WhatsApp или Telegram. Агент действует на нескольких уровнях, и обычно он может воздействовать только на один или, может быть, два из них. Оно может установить что-то на серверную часть, что-то там сделать, [00:58] но оно не может реально изменить то, как отображается информация в WhatsApp, потому что WhatsApp. Оно может прислать вам картинку или написать сообщение, но на этом, пожалуй, всё Таким образом, пользовательский интерфейс очень ограничен. Да, и то же самое относится к использованию [01:13] веб-интерфейса. Например, у Agent Zero очень богатый веб-интерфейс, но если агент захочет сделать что-то особенное в веб-интерфейсе, ему придётся либо сгенерировать изображение на бэкэнде и отправить его на фронтенд, либо внести изменения [01:27] на уровне бэкэнда и попросить перезагрузить страницу или что-то подобное. Даже агенты, доступные из браузера, по-прежнему ограничены тем уровнем, на котором Итак, пожалуй, давайте сразу перейдем к Space Agent. [01:39] Да, и в этом главное отличие Space Agent, потому что Space Agent работает на стороне клиента, на фронтенде, в среде выполнения JavaScript. Таким образом, агент может фактически изменять страницу, на которой он отображается. А как [01:53] пространствами. В общем , извините, что прерываю, но это, по сути, первый самообновляющийся агент. В отличие от других агентов, создавать навыки. Они не могут создать пользовательский интерфейс, который бы наглядно показывал пользователю, что [02:06] парадигма самосовершенствующихся и самообновляющихся агентов. Да, этот агент гораздо более динамичен в плане общения. Когда вы попросите вам это покажет. Например, у нас есть несколько готовых примеров, чтобы вы могли составить [02:20] представление, например, цены, графики, новости и все остальное, или ежедневная панель мониторинга. Оно даже может отображать и воспроизводить их в браузере . Таким образом, что бы вы ему ни приказали сделать, у него есть система пространств и виджетов, позволяющая отображать что угодно по запросу, [02:35] Хорошо, давайте начнём с пустого пространства, как, Итак, это пустое пространство. Вот что отображается пользователю при первом входе в Space Agent, и, возможно, нам следовало начать с главного [02:48] преимущества агента, работающего в браузере, а именно с возможности запуска агента непосредственно в браузере. Да, никакой настройки, очень просто. Если вы хотите попробовать Space Agent, вы можете посмотреть наш репозиторий на GitHub. Там есть большая [03:00] кнопка «Попробовать вживую прямо сейчас», которая перенаправит вас на наш сайт space-agent.ai, конечно же, с открытым исходным кодом и бесплатно. Где вы можете просто... Ну, сегодня не знают, например, крупные компании [03:13] знаете, компьютеры Perplexity полностью закрытые. Да, Space Agent бесплатно. Да, и всего двумя кликами вы получаете временный гостевой аккаунт и можете бесплатно попробовать Space Agent. Вам нужно [03:26] всего лишь указать свой API-ключ для того поставщика LLM, которого вы хотите использовать. Я могу показать вам два способа общения агента. Я могу просто спросить, какая погода в Праге, и система должна ответить [03:41] в чате, а затем я могу указать ей показать мне погоду в виджете. Сейчас я использую свернутый режим чата, поэтому вижу только ответы оператора, но могу развернуть его на весь экран, если хочу посмотреть [03:56] историю переписки. В первый раз агент просто ответил, потому что я просто когда я сказал ему: «Покажи мне», он сгенерировал виджет, основанный на погоде. Это Opus. Хорошо. Итак, всё это — пользовательский [04:09] Да, я могу прямо сейчас показать вам, как на самом деле работает агент, потому что это довольно интересно. Это необработанная история коммуникации. Вот как агент может это увидеть на самом деле. Итак, пользователь получает сообщение: «Какая [04:23] погода в Праге?» А это — необработанный ответ магистра права. Здесь нет форматирования, нет JSON, нет вызова инструментов. Это текст, который генерирует агент. Сначала Сейчас запрашиваю погоду в Праге». Это отображается в всплывающем окне чата или в [04:39] истории переписки. Затем используется специальный токен, и всё, что происходит после автоматически выполняется в браузере с помощью JavaScript. Это также делает его чрезвычайно эффективным с точки зрения использования токенов Ага, например, проверка погоды, включая ответ, в том числе [04:53] включая ответ, в том числе первый ответ, стоила 97 токенов. Затем подобном этому, что также эффективно с точки зрения использования токенов, и отвечает мне, просто эффективно с точки зрения использования токенов, и отвечает мне, просто не используя токен JavaScript. На этом [05:06] цикл разговора завершается. Итак, агент отвечает в виде обычного текста, как в верно? Без специального форматирования, дополнительные поля. Если агенту просто нужно ответить, он отвечает, и [05:20] в ответе нет ни одного лишнего токена. Если требуется использовать JavaScript, используется этот код. Это два жетона. Подчеркивания — это один токен, JavaScript — другой токен, а затем снова JavaScript. Экранирование JSON не требуется [05:33] , ничего, что добавило бы дополнительные токены. Это максимально эффективно, насколько это возможно. И мы видим, что для создания виджета потребовалось всего около Ага. Я имею в виду, в эпоху, когда самые современные модели становятся все дороже [05:46] на примере Opus, но теперь даже GPT-4.5 Pro стоит около 180 долларов за миллион выпущенных токенов. Думаю, люди начнут больше интересоваться токеномикой и тем, какие инструменты и агенты позволяют [05:59] не хотят тратить тысячи долларов в месяц на проведение вычислений. очень интересно. Я не написал ни строчки. Я создал первый набросок задания, а затем настроил автоматизированный поиск в Codex, чтобы постоянно [06:15] по три новые версии. Один вариант будет консервативным и ограничится несколькими изменениями, другой — потребует изменений среднего масштаба, а третий — будет совершенно непредсказуемым. И для проверки было создано множество полноценных наборов тестов . Затем я проверил это [06:28] вручную. Я сказал ему: «В этих сценариях он дает сбой . Создай новые тестовые примеры для этих сценариев. Включи их в тестовую среду». И так продолжалось несколько дней . И я не знаю, это уже версия номер 250. И [06:41] она постоянно оптимизировалась, чтобы стать более эффективной с точки зрения использования токенов и надежной в наших всё в порядке. Итак, давайте покажем еще несколько вещей, на которые способен Космический Агент. Мы можем создать полноценный пример. Мы можем разработать полноценный сценарий использования. Но я бы хотел [06:53] сегодня. Конечно. Просто краткая демонстрация. Итак, я начал с приложения для заметок. Мне хотелось посмотреть, как несколько виджетов будут взаимодействовать друг с другом, если разместить их на одном пространстве. Итак, у меня есть один пункт для списка. Кстати, это [07:06] пространство очень динамично. Вы можете изменять размер всего, перемещать все, переставлять. Это также может сделать за вас агент. Таким образом, эта сетка может быть практически бесконечной. Таким образом, агент может создавать для вас огромные панели мониторинга или огромные массивы данных [07:20] Таким образом, для тех, кто этого не понимает, это означает, что вы можете разработать желаемый пользовательский интерфейс для любого типа задач с нуля. Да, вам это не обязательно размещать их на сервере. Space Agent работает в браузере. И всё это — [07:33] всего лишь несколько секунд кода на JavaScript. В моем представлении будущее операционных систем будет таким: практически не останется приложений и встроенных интерфейсов. Потому что если вы можете сказать агенту, например: «Проверьте мою почту и покажите мне письма, отсортированные по [07:47] приоритету», и он просто откроет вам окно со списком ваших писем. Зачем нужны кнопки для сортировки, правда? Зачем нужны кнопки для перемещения, удаления или ответа на сообщения, если можно просто [07:59] сказать своему агенту, и экран автоматически перезапишется на лету? Итак, первый пример — это приложение для заметок, и в итоге получилось действительно отличное приложение для заметок. Вы можете управлять папками и переименовывать их. Вы можете редактировать. Вы можете редактировать заметки визуально. [08:13] При необходимости можно преобразовать в формат Markdown . Оно поддерживает копирование и вставку изображений, вложений и т.д. Так что да, по моим меркам это полноценное приложение для заметок. Ещё одно преимущество локального браузера заключается в том, что данные остаются вашими, верно? [08:27] Вам не обязательно куда-то это отправлять. Очевидно, что если вы используете бесплатную версию, то она размещается на том же хостинге, что и серверная часть. Так что, как вы понимаете, вы можете использовать репозиторий с открытым исходным кодом еще одно преимущество того, что все находится в браузере. [08:39] Ага-ага. Я могу быстро объяснить, как это работает. Браузер сам по себе не может управлять работает. Браузер сам по себе не может управлять файлами в операционной системе хоста. браузера. Таким образом, у нас есть очень тонкий бэкэнд- слой на Node.js, который управляет [08:53] правами доступа пользователей, учетными записями пользователей и хранилищем файлов. А если вы скачаете нативное приложение, то все это будет объединено в одном приложении. Таким образом, связь с нашими серверами или чем-либо еще отсутствует. И бэкэнд, и фронтенд — всё это [09:05] объединено в одном приложении. Если вы размещаете его самостоятельно, то делаете это либо на локальном компьютере, либо на VPS, и подключаетесь к нему через браузер. Таким образом, они могут работать на одной и той же [09:18] машине, или же бэкэнд может располагаться на виртуальном сервере ( VPS). Это также дает вам возможность использовать несколько пользователей, поскольку Space Agent с самого начала оптимизирован для работы множества пользователей на одном сервере, а также [09:32] включает в себя управление правами доступа и группами пользователей, а также общие функции для групп пользователей и т. д. Да, и третий способ — это наш демонстрационный сайт. Затем серверная часть находится на нашем сервере. Я никому не рекомендую использовать его для [09:46] сохранения данных, поскольку это демонстрационный сервер. Файлы рано или поздно будут удалены. Итак, мой лучший совет — скачайте нативное приложение, и всё останется локально, всё будет на вашем компьютере. Ещё сегодня я попробовал [09:59] панель мониторинга видеонаблюдения. Я выбрал несколько случайных общедоступных IP-камер, и, похоже, все они находятся в Соединенных Штатах. Но если у вас дома или на какой-либо другой территории установлены камеры, за которыми вы хотите следить, вы можете просто создать [10:14] агенту. И кстати, просто для понимания ситуации, сколько времени ушло на строительство? Потому что люди могут предположить, что это долго или, знаете, что это было быстро. Это произошло быстро. Я [10:26] потратил немало времени, выбирая подходящие камеры, которые действительно что-то показывают, потому что агент выбрал несколько камер наугад, и поначалу они казались статичными . Но, знаете, сама эта штука была создана, наверное, за [10:38] минуту-две. На создание приложения для заметок ушло немного больше времени, потому что у меня было больше инструкций, и мы внесли больше правок. Я хотел, чтобы переименование происходило более плавно, и чтобы по умолчанию использовался переименование происходило более плавно, и чтобы по умолчанию использовался [10:53] довольно много правок. На это у меня ушло, наверное, минут десять. И эти панели мониторинга, они подводят меня к тому, в чем Space Agent действительно преуспевает, а именно в организации других процессов. Поскольку пользовательский интерфейс может быть очень динамичным, это [11:09] идеальное решение для мониторинга или управления другими системами. Например, если у вас где-то работают еще 10 агентов, и вы можете другой агент будет управлять ими от вашего имени. Это [11:23] может сэкономить вам много времени. И здесь я подключил Space Agent к своему экземпляру Agent Zero, работающему на моем локальном компьютере, точно так же, как и Space Agent. И я здесь сделал две вещи. Я поручил агенту создать новый интерфейс чата, который будет [11:38] использовать API Agent Zero для связи с ним. Таким образом, если я отправлю сюда сообщение "привет", система будет ждать ответа от Agent Zero в контейнере Docker и отправит сообщение обратно мне. А это, по сути, встроенное окно браузера. Итак, это полный [11:53] веб-интерфейс Agent Zero. Мы здесь не используем никаких API или сокращений. Это полноценный браузер. И агент по-прежнему может управлять им как браузером. На самом деле, он отлично справляется с могу сказать: [12:06] проверьте настройки Agent Zero, есть ли обновления. браузер, которым вы пользуетесь, верно? Там, вовне. Да, я был действительно удивлен, насколько хорошо и быстро это работает. Потому что, когда я что-то разрабатываю, я всегда начинаю [12:21] с минимальной версии, с самого простого набора необходимых для работы компонентов, а затем смотрю, где возникают проблемы, и начинаю добавлять в нее необходимые вещи для их решения. И всего создается очень быстро, верно? Поскольку внутри ничего нет, всё [12:34] очень просто, и работает быстро. Но потом вы обнаруживаете, что здесь возникают сбои, и здесь тоже, и требуется память и так далее. И вы начинаете добавлять новые функции, и в конечном итоге это неизбежно замедляет работу системы. Но здесь, к моему большому [12:46] удивлению, мне практически ничего не понадобилось добавлять . Оно просто отлично работало с самого начала . Принцип работы заключается в том, что мы преобразуем страницу для агента в формат, который выглядит следующим образом. Таким образом, агент не видит HTML-код [13:02] всё преобразуется в ссылки, например, кнопка и её номер, текст здесь — кнопка ошибки 51. Поэтому он видит, что есть кнопка отмены [13:14] с номером 51, и она оформлена красным цветом как ошибка. Оно может видеть поля ввода, ползунки, любые интерактивные элементы, а также весь текст на странице. Таким образом, когда устройство хочет нажать кнопку, оно просто отправляет команду, например, « [13:26] нажмите кнопку 25», и получает новую транскрипцию страницы, информацию о том, что изменилось. Вероятно, мы сможем это увидеть здесь. Да, именно так работает агент, верно? 19 токенов, просто сообщают мне об открытии самообновления, теперь [13:39] пробел в браузере, щелчок по кнопке браузера номер один, кнопка номер 47. Вот и все. И это вызывает исследование автомобилей? Отчасти и то, и другое. Отчасти и то, и другое, но [13:51] большую часть работы я выполнил сам. Поэтому я нашел в интернете библиотеку, которая преобразует HTML в Markdown, и значительно отредактировал ее с помощью ИИ, чтобы получить формат, в котором каждому интерактивному элементу присваивается порядковый номер, а [14:08] текст остается текстом. А затем мы продолжали итерации, нам приходилось проводить множество оптимизаций и решать множество частных случаев, потому что, хотя веб-технологии могут показаться несложными, индексировать веб-сайты крайне сложно. [14:23] У вас так много разных вложенных элементов, таких как природе замкнуты. В некоторых случаях теневой DOM создается исключительно для предотвращения парсинга. Поэтому нам даже пришлось внедрить некоторые обходные пути в [14:39] сам процесс рендеринга браузера, чтобы он автоматически открывал все элементы веб-сайта и делал их пригодными для парсинга . Да, это была большая работа. Частично это заслуга искусственного интеллекта, частично — моя собственная, но в итоге всё работает безупречно. Как видите, сейчас у нас 13,6 тысяч [14:53] токенов. То есть мы добавили всего лишь около двух тысяч токенов? раньше мы кое-что делали с этим пространством, и это потому, что мы не храним подобную информацию в истории, ведь как [15:08] только состояние страницы исчезает, она нам больше не нужна Да, это может сбить с толку и израсходовать много жетонов, верно? Это примерно 2000 токенов. Именно поэтому мы используем это временное пространство, [15:22] то есть контекст, который часто меняется, мы всегда помещаем в самый конец запроса после последней точки останова кэширования, чтобы он не кэшировался и разговора. Таким образом, когда агент редактирует виджеты, мы всегда загружаем последнее [15:38] и помещаем его во временный объект. Таким образом, агент всегда может видеть исходный код виджета, с которым он работает, но он не остается в истории, расходуя токены через ход, потому что именно это и приводит к накоплению, верно? Нет [15:52] проблем, если вы загружаете 2000 токенов, чтобы показать страницу агенту, но если вы сохраните это в истории, то добавите 2000 токенов навсегда. А если агент пролистает, например, пять страниц, вы добавите 10 000 токенов к каждому ходу [16:04] А если начать удалять, то нарушится кэширование. Это еще одна да, если вы трогаете что-то в истории, вы аннулируете кэш, и вам снова придётся платить больше. Таким образом, мы поддерживаем цены на [16:19] токены на минимально возможном уровне, обеспечивая максимальную эффективность и Думаю, нам следует чаще использовать функции, аналогичные тем, что применяются в режиме реального времени . Людям действительно нужно увидеть, насколько легко обновлять контент, создавать пользовательские элементы интерфейса, [16:33] настраивать внешний вид, а также изменять некоторые встроенные функции давайте либо начнем с нуля, либо воспользуемся одним из готовых шаблонов и модифицируем его. Вам решать. Да, давайте начнём. Может быть, мы могли бы провести [16:47] тоже довольно интересно. Я тоже сегодня это сделал, и мне хотелось посмотреть, сможет ли агент создать пользовательский интерфейс, который будет напрямую связан с агентом, чтобы интерфейс мог взаимодействовать [16:59] с агентом, а агент — с интерфейсом. Я создал этот исследовательский модуль и уже протестировал его на Agent Zero и GPT 5.5. Космический агент создал и GPT 5.5. Космический агент создал [17:13] специальные инструкции для космоса. Это еще один момент. Для каждого помещения можно задать индивидуальные инструкции. Итак, если в этом есть какие-то особенности, вы можете дать соответствующие указания агенту. Давайте проведём здесь небольшой тест. Например, о [17:29] мифах Клода. Итак, я могу создать Мифос и описать, что такое Мифос Клода и чем он отличается от других. И я могу очистить чат, чтобы начать с я могу очистить чат, чтобы начать с чистого листа. И если я нажму кнопку « [17:44] Начать исследование», агент фактически получит сообщение из пользовательского интерфейса и браузер. И здесь начинается обновление шаблона исследования. На каждом этапе программа обновляет план, данные о сборе источников, заметки, резюме, а также [17:59] исследования на основе шаблона и инструкций. В данный момент он уже использует браузер. Ссылка ведет на статью об антропологии на сайте BBC. Вероятно, он проверит еще один или два сайта. Таким образом, для любого типа рабочего процесса или задачи [18:14] вы можете создать нужный вам пользовательский интерфейс , а не ограничиваться, например, предопределенным веб-интерфейсом. Все в порядке. Я постараюсь свести это к минимуму. Да, у нас уже есть некоторый прогресс. Хорошо, нам не нужно [18:27] ждать полной версии. Агент будет продолжать обновлять файл исследования, но уже сейчас всё выглядит неплохо. Это антропогенная модель ИИ, специально ориентированная на кибербезопасность , с ограниченным доступом и профилем риска двойного назначения . Хорошо, похоже, система всё поняла, и дело [18:40] это изменить? Возможно, стоит добавить больше форматирования или цветов в результаты исследования. Хорошо. Возможно, мы сможем преобразовать его в PDF или Конечно. Да, давайте так и сделаем. Добавьте кнопку «Экспорт в PDF», которая позволит [18:56] Добавьте кнопку «Экспорт в PDF», которая позволит преобразовать файл в распечатку. Что-то вроде Итак, чат состоит из трех разных этапов , верно? Вот, например, бокам, верно? Да . Это нужно только в том случае, если вы хотите скрыть [19:09] Я обычно использую компактную модель, потому что на экране обычно много всего происходит . Поэтому я не хочу, чтобы полная история стала препятствием. Меня больше всего интересует, что скажет агент сейчас. Все в порядке. Да, и у нас есть еще кое-какие элементы [19:22] форматирования. Да, у нас есть таблицы, ссылки, а что делает PDF-файл? Хорошо, это преобразует его в печатный вариант. Да, но, похоже, это диалог, который я использую в печатном виде. Скорее всего, это не [19:35] отобразится, но я, вероятно, смогу сохранить это в формате PDF здесь. Хорошо, я бы изменил форматирование, мне не очень нравится шрифт, но да, это PDF-файл с результатами исследования. И я думаю, главное, что нужно еще раз подчеркнуть, это добавление функции [19:47] . Да, я воспринимаю это как должное. потратили на это столько времени за последние три-четыре недели, но это же Это совершенно отличается от других [19:59] готовых компонентов пользовательского интерфейса. Всё это создано с нуля. Таким образом, ваше пространство может быть Да, мы можем это здесь увидеть. Вот код, благодаря которому это стало возможным. Нет, это виджет для чтения, вот этот. Это код, который агент использовал для добавления [20:14] PDF-файла для скачивания и для форматирования файла . Да, и самое замечательное в возвращаюсь, оно всё ещё здесь. Когда я обновляю страницу, она всё ещё здесь. Обычно, если агент редактирует DOM самой HTML-страницы, он [20:29] исчезает после обновления страницы, но принцип работы этих виджетов таков, что агент не создает виджет самостоятельно. Это создаёт функцию, которая затем создаёт виджет. Таким образом, мы сохраняем функцию, способную воссоздать виджет, [20:44] и затем можем воссоздать его с помощью этой кнопки или путем перезагрузки страницы в был. Думаю, давайте сделаем ещё один вариант с нуля и попробуем добавить множество разных элементов пользовательского интерфейса, чтобы люди [20:58] добавления доски Канбан. Хорошо, давайте создадим доску Канбан. Нужно что-то конкретное или просто привести пример? Сделайте его в стиле Trello, очень красочным. Хорошо. Так же, как и Trello, он красочный. Мы [21:13] Хорошо. Так же, как и Trello, он красочный. Мы будем добавлять новые функции, поэтому помните о необходимости сделать его расширяемым. Хорошо, давайте посмотрим. Это может занять минуту. Полагаю, кода. Но, знаете, люди могут использовать более [21:27] , безусловно. Когда я начинал разработку, я использовал GPT-5.4-mini. Это не так уж и умно. Оно, безусловно, не было таким же надежным, как сонеты Клода или [21:39] опусы Клода, но давало практически мгновенный отклик. Да, я просто хотел сказать, что если вы отправите 5.4-mini сообщение "привет", то получите ответ "привет" примерно через около того. Ага. Но, как показали [21:52] Gemma 4 оказалась лучше, верно? Да , безусловно. Это было как минимум на одном уровне работает локально. Да , хорошо. У нас здесь есть доска Канбан . Можно ли его перетащить? Нет. Мы можем переименовать его. Хорошо, это же билеты, [22:07] Хорошо. Хорошо, теперь, возможно, стоит добавить что-то график движения акций. Хорошо. Все в порядке. График цены акций Google или Microsoft. А Google — это [22:23] Хорошо, Алфавит. Да, Google. Хорошо. Интересно, откуда берутся цены, ведь большинство API имеют ограничения. Я считаю, что Yahoo Finance работает хорошо. Посмотрим. Агент 0 обычно [22:37] использует Yahoo Finance в Python. Я думаю, это еще одна концепция, похожая на захват информации из обучающих данных, потому что тогда будущие Ага. А потом, что касается [22:49] Supabase. Хорошо, похоже, всё получилось. это одно из преимуществ запуска агента в браузере, поскольку код выполняется в вашем браузере, а не в центре обработки данных, на VPS, и поэтому вас не [23:05] Ага. Верно. Это огромный недостаток, задачи с VPS. Ага. адреса, которые поступают из центров обработки данных. [23:17] другое. Давайте сыграем в игру «Змейка». Все в порядке. ограничения Space Agent? Например, для чего бы вы его только не использовали? Я бы не стал использовать его для чего-либо, требующего доступа к операционной системе, [23:31] например, для установки пакетов Linux, верно? Если вам нужно сделать что-то на низком уровне , например, запустить сервер, это невозможно. Если вам нужно запустить сервер для тестирования вашего Node-приложения или чего-то подобного, вам, вероятно, [23:45] лучше выбрать Agent Zero, поскольку он может сделать все это за вас. В ней установлена собственная операционная система Linux. Я бы не стал использовать это для фоновых задач, потому что у нас таких пока нет. В настоящий момент, поскольку это работает на стороне клиента, [23:59] требуется, чтобы клиентская часть была запущена. Таким образом, вы не можете выключить компьютер фоновом режиме. Даже если вы разместите его на VPS, агент все равно будет работать и выполняться способ выполнять фоновые задачи . Возможно, мы этого не сделаем, [24:15] которые могут это сделать, верно? Возможно, нам не нужно всё дублировать. Посмотрим . Посмотрим, чего хотят люди. Так что, думаю, это будет полезно для тех, кто , напишем в комментариях, что вам понравилось , как вы это используете, и [24:29] , безусловно. Определенно. Думаю, сейчас мы знаем примерно 5% его потенциала, на что он способен. Мы тут занимаемся всякими случайными вещами, и я занимаюсь случайными вещами последние 4 недели, с тех пор как начал это разрабатывать. Но, за исключением [24:46] примера с «Агентом-ноль» или примера с исследованиями, я здесь не делаю ничего полезного это новой парадигмой. Ага. Это совершенно новая вещь, и мне Могу себе представить, что другим это еще сложнее. Ладно, [25:02] похоже, это какая-то сломанная игра в "Змейку", потому что я вижу только еду. Оно также захватывает и захватывает мой ввод, что неправильно. Поэтому я закрываю эту тему. [25:15] я закрываю эту тему. Хвоста не было, еды тоже, и устройство захватывает Хвоста не было, еды тоже, и устройство захватывает ввод с клавиш, даже когда не находится в фокусе. Значит, эти пространства существуют постоянно, верно? Таким образом, у людей может быть отдельное пространство для [25:29] различных целей. В принципе, подходит для любого конкретного случая использования. Даже не нужно группировать категории вашей жизни по отдельным пространствам. Вы можете иметь сотни помещений. Они ничего вам не будут стоить. Это просто папка на [25:44] диске, и все эти виджеты и прочее хранятся в текстовых файлах, поэтому на каждое место уходит всего несколько килобайт. Хорошо, давайте Хорошо. Да, и я даже могу пользоваться клавиатурой. [25:57] Хороший. Возможно, стоит попробовать использовать его в качестве музыкального инструмента, например, мини-синтезаторный пэд. Да, я уже сделал это сегодня. Где это? Пошаговый секвенсор. Э-э, Итак, у нас есть пошаговый секвенсор, с помощью которого можно добавлять различные инструменты на [26:12] разных долях такта. У вас есть панель управления звуком, а также гитара для свободной игры, где вы можете импровизировать с помощью секвенсора. ? Ну, я думаю, минут десять. Я [26:25] начал с секвенсора, затем добавил регуляторы, а потом и гитару. Секвенсор работал быстро, этого хватило на один снимок. работал быстро, этого хватило на один снимок. [26:38] добавлять такие функции, как сохранение и загрузка, изменение длины вкладки и т.д. А потом мне захотелось добавить что-то приятное и наглядное, например, эти регуляторы. А потом я перебирать аккорды. Позвольте мне попробовать сказать ему, чтобы он добавил что-нибудь в булочку. [26:55] Я только что проделал нечто подобное с Opus 4.6, и это получилось с первого раза теперь будет делать, создаст ли еще один виджет или просто добавит Так что это, вероятно, один из самых простых способов для людей, не [27:10] слишком разбирающихся в ИИ, ощутить его мощь, верно? Потому что люди, которые смотрят мой канал и канал Agent Zero , входят в 1% самых заинтересованных людей. Они не являются бесплатными пользователями ChatGPT. Таким образом, многие из этих людей до сих пор [27:22] не знают о возможностях этих программистов. А вот и оно. Хороший. верхних октавах, но, знаете, это исправимо. Посмотрите на графику. Что у нас есть? Нет, это можно исправить. [27:34] Да, расширяем его. Расширение решило проблему. Это странно. Хорошо. и родственников, не разбирающихся в технике и искусственном интеллекте, и показать им всю мощь возможностей, которые открываются благодаря простому вводу английских слов в Space Agent. [27:48] Да, это как вводный препарат для начинающих специалистов по искусственному интеллекту . Да, безусловно. Вам не разбираться в зависимостях терминала. Вам не нужно знать, как работает искусственный интеллект. Вам понадобится API-ключ для OpenRouter или любого другого сервиса. [28:04] для OpenRouter или любого другого сервиса. Ага. вывод. Или, если у вас мощный компьютер, вы можете выполнить локальный вывод. Вы можете выполнить локальный вывод. У нас также [28:17] есть специальная панель, где вы можете загрузить модель и протестировать её прямо здесь, в чате. Я не уверен, будет ли оно скачиваться или просто... Да, оно Ага. После загрузки файл [28:32] довольно быстро загружается в память. Но вам понадобится мощная видеокарта. подходящая для любой модели формата ONNX от Hugging Face. Здесь представлены совместимые модели кнопок, и это перенаправит вас [28:47] в репозиторий сообщества. В этот формат переведено около 1100 моделей. Gemma 4. Потому что для того, чтобы, например, написать код на JavaScript и понять командную строку системы, всё ещё нужна хорошая модель. [29:02] Ага. Ага. Генетические системы — это не простые вещи. Это совершенно другое дело, чем запускать модель в Ollama и общаться с Хорошо, давайте поговорим немного подробнее о [29:15] создать Space Agent? Ого . С чего начать? В моей голове постоянно крутится множество мыслей и идей, и со временем некоторые из них соединяются и [29:29] начинают казаться эффективными и согласованными. И я хотел добиться нескольких целей. Мне хотелось создать что-то вроде Agent Zero, что было бы проще для восприятия и понимания. [29:42] Как я уже говорил, мне также нужен был агент, способный полностью контролировать себя, не только серверную часть, но и иметь полный доступ ко всему. Я нечасто об этом говорила, но дело не только в помещениях. Агент способен [29:57] полностью самоизменяться. Вся система построена на модулях, и агент может разрабатывать модулях, и агент может разрабатывать собственные модули в процессе работы. И это можно сделать для каждого пользователя отдельно. Таким образом, я могу создавать для себя новые модули, [30:15] другой модуль. И я могу создать тысячи модулей самостоятельно. Они будут храниться в моей пользовательской папке и не повлияют на других пользователей системы, если это многопользовательская система. И мы можем сделать то же самое для каждой группы пользователей или [30:29] глобально в системе. Так что дело не только в помещениях. Это полноценная среда разработки, способная к саморасширению. И ещё, это то, что сложно сделать, например, в фильме «Агент Зеро». Агент Зеро способен расширять свои возможности. В нём [30:43] есть система плагинов и всё такое, но он всё равно работает на бэкэнде на Python, а это сопряжено с некоторыми нюансами, такими как установка зависимостей, разрешение конфликтов зависимостей и многое другое. Таким образом, все это работает [30:55] исключительно на стороне клиента. Таким образом, это не создает дополнительной нагрузки на сервер. Вот почему, например, [31:09] . У нас загрузка ЦП составляет около 2%, а памяти — 6%, потому что основная работа бэкэнде. Например, когда у вас появилась эта идея, как именно то, что нужно, правильная парадигма? Да, это [31:24] отличный вопрос, потому что я с самого начала знал, что для многоплатформенным и работать без установки. В итоге было решено, что, по сути, нет другой платформы, кроме браузера, [31:38] которая могла бы работать без установки на всех операционных системах, верно? В разных операционных системах используется разное управление окнами и разная отрисовка браузер — единственная платформа, которая имеет [31:50] абсолютно одинаковую среду выполнения JavaScript на всех платформах, включая мобильные устройства, — единый стандарт рендеринга, разработанный за годы создания HTML, CSS и JavaScript. Так что, да. Думаю, с самого первого дня я понимал, [32:05] если уж я собираюсь это создавать, то это должно быть в браузере. А потом я начал решать проблемы, потому что их было очень много. Браузеры великолепны, потому что обеспечивают потрясающую кросс-совместимость, но в то [32:20] же время интернет — очень опасное пространство. Таким образом, значительная часть защиты пользователя обеспечивается самим браузером. Это и не позволяет красть данные из других [32:34] приложений и т. д. Так что это тоже здорово, но у этого есть множество ограничений, таких как проблемы с междоменными запросами. Например, нельзя отображать другие веб-сайты во фрейме, расположенном внутри другой страницы. На некоторых сайтах, например, в Википедии, можно [32:48] отображать текст Википедии внутри другой страницы, но Google, YouTube и практически все остальные современные веб-сайты это заблокируют . Так что, да. Что ж, я начал прибегать к множеству обходных путей, чтобы это исправить. Но да, в итоге всё получилось. Браузер [33:01] отлично работает в нативном приложении, потому что там мы можем использовать возможности Electron для смягчения многих из этих барьеров безопасности. Мы также можем использовать имеющийся у нас бэкэнд-слой в Node.js для защиты от CORS. Мы можем использовать проксирование [33:15] через бэкэнд и удалить заголовки CORS. Да, мы решаем проблемы по одной за раз. Мы добрались сюда. Итак, как же вам удалось разработать его так быстро? Например, вы использовали инструменты искусственного интеллекта? И если да, то каков ваш [33:27] Да, я здесь не написал ни единой строчки кода. Я использовал Codex для всего. Таким образом, весь код этого проекта был создан компанией Codex . Начать я с . Начать я с создания иерархии файлов agents.md и [33:43] структуры документации для Codex. Существует корневой файл agents.md, который агент видит агент, — это документы. Документация — самая важная часть этого проекта, потому что проблема с программированием ИИ заключается в том, что оно не может вместить [33:59] весь объем проекта в контекстное окно, верно? Таким образом, чем больше ваш код, тем больше агент начинает выполнять избыточные действия, писать новые вещи с нуля или переопределять предыдущие настройки и т. д. Поэтому весь этот [34:16] рабочий процесс ИИ начинается с того, что агент документирует все в системы. Все уровни или только основные папки? Все уровни. По сути, все разрабатываемые на данный момент процессы [34:30] документируются в файле agents.md. Итак, когда я говорю агенту, например, зайти в файловый менеджер, который у нас есть в Space Agent, и что-то там изменить, в модуле файлового менеджера есть файл agent.md, который агент может [34:44] прочитать и сразу увидеть, как работает файловый менеджер, каковы его основные принципы, почему он работает именно так, чего делать не следует и т. д. Поэтому людям следует просто использовать этот подход в разработке. Верно? Потому что в [34:56] будущем оптимизация кодовой базы для агентов станет гораздо важнее. Да , я просто хочу уточнить, что это не только для космических агентов. Это подход, которому люди должны следовать и впредь. Это как в [35:08] документации, где говорится, что у людей не должно быть никаких токенов в голове? Любые невысказанные предпочтения, ничего подобного не должно быть у них в голове. Все файлы должны быть Ага. К сожалению, мы еще не достигли цели. У [35:20] меня всё ещё были сотни случаев, когда мне приходилось поправлять агента, когда я видел, что он принимает неверное решение. И даже после того, как все было сделано, я все еще [35:32] нахожу способы оптимизации. Конечно, это еще не идеально, но гораздо лучше, чем было год или два назад. И, безусловно, гораздо, гораздо лучше использовать такой подход, когда у агента есть документация по всему. [35:44] А если ему нужно что-то изменить, он сначала проверяет документацию и понимает, и снова. И они будут разгоняться всё быстрее и быстрее. Как и за последние 24 часа, мы получили GPT-5.5 и DeepSeek-V4. GPT-5.5 [35:58] значительно превосходит 5.4 в контексте длинных текстов. Поэтому я думаю, что многие из этих через 3-6 месяцев. Да, это необходимо. Это единственный путь вперед. Когда я начал разрабатывать Agent Zero Two два года назад, примерно в это время [36:11] Zero Two два года назад, примерно в это время , мне потребовалось около трех месяцев интенсивной разработки, чтобы выпустить первую версию, которая была только с интерфейсом командной строки. Его возможности были весьма ограничены. И весь код в ядре Agent Zero [36:25] в ядре Agent Zero до сих пор написан вручную. Я создал Space Agent за 4 недели, примерно за 25 дней. MVP был быстрее. Это длилось около двух недель. , но MVP представлял собой всего лишь одну страницу с чатом, которая [36:38] помещений, не было внутренней инфраструктуры, там вообще ничего не было. И в нём гораздо больше функций, чем в Agent 0 на старте. Итак, у нас было... И я это сделала, я это сделала в одиночку. Таким образом, ускорение явно присутствует. [36:52] Если бы я писал Space Agent вручную, это, вероятно, заняло бы у меня около года, может быть, больше, а может и больше. Таким образом, ускорение составит как минимум в 12-20 раз. Да, безусловно, безусловно. Э-э, я всё ещё не думаю, что стоит [37:07] система требовала ручного тестирования, это заняло бы десятилетия, Да, да, безусловно. Я всё ещё не думаю, что программирование умерло. Я думаю, что программирование станет одним из важнейших навыков в будущем, потому что мы — [37:21] последнее поколение программистов, которые занимались настоящим ручным кодированием, верно? И я могу мгновенно распознать ошибочные решения ИИ. Я могу мгновенно выявлять неэффективность, и если система идет по неверному пути, я могу сразу сказать: «Нет, [37:34] безопасно или масштабируемо», или что-то в этом роде. И, как я уже говорил, я делал это сотни раз в процессе разработки. Я всегда даю ему задание, а затем наблюдаю за тем, что он делает. У меня открыто около шести окон Codex CLI, и я [37:48] всегда быстро проверяю, что делает каждое из них, и просто ищу ошибки. Я не делаю ничего, кроме как пытаюсь выявлять неэффективность и Так что, я полагаю, почему именно Codex, а не Cloud Code или что-то другое? [38:00] возможно, это личное дело. Возможно, это просто личное предпочтение. Я попробовал оба варианта, и Cloud Code меня не устроил. Я не говорю, что это вина Cloud Code. Возможно, дело в навыках, но я очень быстро понял, что Codex [38:15] гораздо лучше справляется именно с этим, следуя иерархии файлов agents.md, постоянно обновляя их и, что наиболее важно, следуя инструкциям внутри. Когда я попробовал использовать Claude Code, он часто начинал делать [38:31] что-то странное, а потом забывал обновлять документацию. И вот, например, я помню случай, когда Клод Код два часа безуспешно пытался исправить CSS-код на кнопке, сделав около 20 итераций. Например, выравнивание кнопки на веб- [38:46] странице. И оно всегда сообщало мне, что всё готово и исправлено. И я обновила страницу . И вам, наверное, пришлось тем временем продать ? Думаю, я делал это на тарифе за 20 долларов, [38:58] потому что тогда просто тестировал. Я воспользовался тарифом Codex за 200 долларов, который предоставляет Но да , я решил, что это что-то грандиозное. Например, OpenAI запустила тарифный план с максимальной ценой в 100 долларов. И я думаю, что разница [39:12] между этим планом и планом Клода на 100 долларов просто беспрецедентна. В тарифном плане Claude за 100 долларов вы можете достичь лимитов за день интенсивного программирования, если захотите. Например, если вы одновременно запускаете несколько кодов Клода с Opus 4.7 и [39:24] позволяет получить гораздо больше результатов при тех же затратах. И я согласен, мой опыт совпадает с вашим. Ну, мне нравится, как Клод всё объясняет, с ним проще общаться, и, может быть, мы начнём какой-нибудь проект, например, возьмём у него [39:37] интервью, чтобы обсудить идеи. Но как только начинается настоящая работа, требующая сложных изменений, масштабных рефакторингов или серьезных ошибок, Codex становится намного лучше. Да, Кодекс не идеален. Иногда я [39:49] да, я должен признать, это очень-очень хорошо. А за 200 долларов в месяц вы получаете гораздо, гораздо больше пользы. Давайте уточним еще два момента. Во-первых, [40:01] как людям следует относиться к Агенту Зеро и Космическому Агенту? Существует ли какая-либо Это два разных продукта? Это два разных продукта, разработанных одной и той же работать над новыми интеграциями и т.д. [40:16] Но оба этих продукта достаточно универсальны и динамичны, чтобы между ними не требуется никакой особой связи. Это совершенно разные продукты, предназначенные для совершенно разных целей, не обязательно для разных пользователей, но для [40:32] разных задач. Я считаю, что большинство пользователей Agent Zero будут одновременно использовать Space Agent для разных задач, потому что Space Agent более задач, потому что Space Agent более динамичен, легковесен и ближе к [40:44] пользователю. Он гораздо более склонен к сотрудничеству, чем Агент Зеро. Агенту Zero дано указание работать в фоновом режиме и не беспокоить пользователя никакими вопросами. То есть, если вы дадите ему команду что-то сделать, он будет продолжать это делать, пока не выполнит, верно? Оно [40:56] не остановится и не спросит вас что-либо, потому что работает в Docker-контейнере на бэкэнде, и если оно остановится, чтобы задать вам вопрос, вы, возможно, никогда не ответите, и что тогда? Таким образом, Space Agent знает, что работает с пользователем на стороне клиента [41:09] интернете или где-то ещё, она просто меня. Я не могу этого сделать». Верно? Итак, вы нажимаете на CAPTCHA, или авторизуетесь, или вероятно, не показали, но браузер полностью интерактивен. Итак, [41:24] увижу важную вещь. Зайдите на google.com, агент сможет вас найти я тоже могу это сделать. Верно? Таким образом, мы можем сотрудничать, не расходясь во мнениях. Итак, напоследок я хотел бы показать вам настройку с нуля. Как это сделать? Возможно, мы [41:38] знаю. Но, как и для обычных людей, если они перейдут на сайт space-agent.ai ( ссылка ниже), как это выглядит и куда им нужно ввести ключ API? Таким образом, вы можете начать либо с репозитория, нажав кнопку «Попробовать вживую сейчас», либо с [41:52] space-agent.ai. Есть гостевой аккаунт, нажмите «Продолжить», и всё. И это одна из первых кнопок, которую вы увидите: установить временный API-ключ. И по умолчанию используется OpenRouter, потому что OpenRouter — это отличный сервис. [42:05] Это даёт вам доступ ко всем моделям OpenAI, Anthropic, Google. подписок. Вы платите только за те кредиты, которые фактически используете. А вот поле для ввода ключа API. Поэтому я собираюсь использовать OpenRouter AI. Здесь я уже [42:20] OpenRouter AI. Здесь я уже авторизован. Поэтому перейду к ключам API. Думаю, всё дело в настройках. Это создаст API-ключ в OpenRouter. Тогда я смогу поместить его сюда, и всё должно сразу заработать . Таким образом, Соннет проявляет большую [42:33] характером. Ага. Но, кстати, вот это да! Да, это действительно хорошо. Ладно, я этого не ожидал. На самом деле, первое пространство, созданное для новых пользователей, называется Big Bang, и там есть такие [42:46] инструкции. Это совершенно новый пользователь, и это его первый опыт, поэтому будьте более терпимы и покажите ему что-нибудь впечатляющее и т.д. Но Соннет действительно выводит всё хвастаться. Ага. На данный момент Sonnet представляет собой удачное сочетание [42:59] Ага. Ага. Посмотрим, выпустят ли они сразу Sonnet 4.7 или Sonnet 5. Да, для всего этого видео мы использовали Opus 4.7 будь то передовая или на ступень ниже. Старайтесь не [43:12] и тому подобное. Ага. Ну, большинство людей по-прежнему будут использовать бесплатные модели, но да, сейчас так принято. У них, возможно, не самые ожидать. Ещё одна важная функция, которую я реализовал в Space Agent и которая является [43:27] довольно уникальной для агентов, — это функция путешествия во времени. Мы создаём для каждой пользовательской директории и каждой директории группы отдельный репозиторий Git, который автоматически отслеживает внесённые вами изменения. Вы создаёте новые [43:40] всё, что вы делаете, автоматически отслеживается в репозитории Git на диске. Это позволяет вам путешествовать во времени. Например, если я захочу вернуться на 2 часа назад , я могу просто сделать это, и это отменит все изменения, внесенные за последние 2 [43:54] часа. Теперь у меня здесь меньше места, и я могу просто вернуться в настоящее или отменить отдельные изменения. Это довольно уникальная особенность агентов с искусственным интеллектом, что-то сломаете с помощью агента с ИИ, вы бы использовали другого агента или ИИ-помощника для [44:11] Ага. Здесь, если вы что-то сломаете, вы просто вернетесь в прошлое и исправите это. Ещё один важный момент — это наличие режима администратора, который позволяет исправить проблему, если что-то полностью сломается, если внести изменения, которые полностью нарушат [44:24] отрисовку всего веб-сайта, и даже не откроют окно путешествия во времени, просто перейдя в режим администратора. Административный режим открывается в режиме разделенного экрана, как показано на изображении, где слева находится постоянно отображаемый административный [44:37] интерфейс, являющийся частью встроенного программного обеспечения платформы. Поэтому ситуация не вы видите стандартного космического агента. И отсюда я могу поговорить с агентом и позволить ему исправить [44:50] фреймворк. Я могу заходить в файлы. Я могу использовать функцию перемещения во времени прямо отсюда, в административной панели. Отсюда я могу управлять установленными модулями. Таким образом, даже если вы полностью сломаете что-то, и пользовательский интерфейс даже не запустится, у вас все равно будет способ [45:04] Да, я думаю, в этом и заключается опасность использования космического агента, например, полного JavaScript: иногда это может выйти за рамки разумного и, знаете, испортить текстовое поле ввода, загрузку файлов из сторонних источников или что-то еще. Вы говорите, что нужно использовать административный агент, чтобы он [45:18] Да, именно так. На самом деле, любой агент может сломать себя, даже агент номер ноль. Если программа удалит какую-либо зависимость Python или что-то критическое, это может привести к полному сбою, и тогда потребуется ручная работа для исправления. Вот тут-то и [45:30] с отладкой у новичков, понимаете. Приходится использовать что-то другое, чтобы выяснять, в чем проблема. Да, в этом и прелесть Space Agent — всё Даже если у вас установлено автономное приложение, или вы запускаете его в [45:45] облаке или на демонстрационной стороне, при открытии Space Agent в новом окне или новой вкладке вас всегда встречает сообщение « Введите Space» или «Войдите в режим администратора». Таким образом, эти страницы статичны. Они всегда ждут, когда вы зайдете в админку [45:58] Все в порядке. Итак, куда, по-моему, следует обращаться пользователям: к репозиторию GitHub или напрямую Ну, они взаимосвязаны, поэтому пользователи могут перейти непосредственно на сайт. На сайте нет никакой дополнительной [46:10] в репозитории GitHub. Если вы перейдете на сайт space-agent.ai, вы можете нажать кнопку GitHub здесь, или присоединиться к нашему Discord-серверу, учетной записи X или сайту agent zero. Здесь вы также можете скачать нативное приложение или ознакомиться с [46:24] руководством по его самостоятельному размещению, но, в общем, вся информация будет точно такой же, как и в репозитории GitHub. Самый простой способ начать — попробовать . Ага. И расскажите нам в [46:39] комментариях, как вы его используете, для чего, а также, я думаю, предложите Да, это очень ценно. Все в порядке. Спасибо, Ян, и, guess we'll see how people use it. >> Thank you very much.