Grok Bot для инженерии
@ai_longreadsИнженер SpaceXAI рассказывает, как он выстроил целую команду AI-ботов на базе Grok Bot, которые самостоятельно управляют облачными агентами, пишут код, проводят код-ревью и мерджат PR — масштабируя работу с 15 одновременных агентов до 200+.
Это AI-перевод статьи, сделанный каналом Про AI: Лучшие Статьи и Исследования.
Grok Bot для инженерии
Grok Bot for Engineering Автор: Lingxi Li Оригинальный текст:
Я инженер SpaceXAI, и я создаю Grok Bot с помощью Grok Bot.
Представьте Grok Bot как высококвалифицированного инженерного стажёра с собственными компьютерами, который умеет управлять кодинг-агентами и учиться на вашем стиле работы. Он стал моим лучшим инженерным напарником — поддерживает рабочий процесс, пока я в отъезде, сплю или на совещаниях. Больше не нужно держать ноутбук постоянно включённым, больше не нужно переключаться между несколькими агентами — только результаты, соответствующие моим стандартам, именно так, как мне нужно.
Как команда, создающая Grok Bot, мы получили доступ раньше всех и используем его в повседневной работе. Мы поражены тем, как быстро теперь можем выпускать продукт и насколько выросла продуктивность нашей команды:
- @poteto отправил 2000+ PR за прошлый месяц.
- @baltaaazr и @shaoruu построили фундамент Grok Bot за четыре недели — с помощью Grok Bot.
- Я создал Grok Bot iOS v0 за три недели, с высокой производительностью и отточенным дизайном, используя только Grok Bot.
- Каждый член команды теперь выдаёт существенные результаты каждый день, а не раз в несколько недель.
Чем больше я работаю с Grok Bot, тем сильнее хочу передать эту суперсилу вам.
Мои инженерные боты
У меня пять инженерных ботов, каждый специализируется на своей области:
- Baltata отвечает за общий мобильный слой Grok Bot и всё, что связано с Grok Bot на iOS.
- Shaoruru отвечает за десктопный клиент Grok Bot и CI/CD.
- Hogan отвечает за инфраструктуру и расследует пользовательские проблемы с неясной принадлежностью.
- Craig отвечает за Grok Bot на Android и активно работает над тем, чтобы довести его до релиза.
- Quill отвечает за harness (оболочку) Grok Bot и делает это на высочайшем уровне.
Все они могут работать в областях друг друга, но у каждого своя система памяти и ограниченный контекст. Они показывают лучшие результаты, когда сфокусированы на одном домене, потому что спецификации и принципы проектирования, которые они несут, гораздо точнее в рамках их основной области.
Каждый бот может создавать облачных агентов Cursor, читать транскрипты, проверять доказательства, приложенные к PR, и отправлять follow-up сообщения, ставя их в очередь или прерывая текущий процесс. Это открывает полноценный agentic (агентный) рабочий процесс от начала до конца. Он покрывает то, чем я занимался каждый день в Cursor, когда постоянно переключался между облачными агентами. Теперь мои боты управляют ими точно так же, как я бы это делал.
Когда они получают задачу — от меня или из Slack — они запускают облачного агента с подключёнными скиллами и подробным промптом, описывающим, что нужно сделать и какие доказательства ожидаются. Они также умеют разумно подключать дополнительные скиллы на основе моих персональных указаний: /lingxi-design для визуальной работы, /react-native-best-practices для аудита качества кода, /lingxi-review для оценки архитектуры, /lingxi-product — когда нужно принять продуктовое решение.
Grok Bot может также запускать облачных агентов на ваших собственных рабочих машинах, например на запасном Mac mini (благодаря Grok Bot вам больше не нужно держать выделенную машину дома включённой 24/7 для OpenClaw).
Если ваши рабочие процессы требуют VPN-доступа или особых конфигураций машины, вы можете сделать эту машину приватным воркером Cursor Cloud и попросить Grok Bot запускать на ней облачных агентов. Это открывает больше возможностей, например запуск iOS Simulator и получение скриншотов от ваших агентов.
Grok Bot может отслеживать транскрипт облачного агента и артефакты (например, скриншоты), уведомлять вас по завершении, ставить сообщения в очередь или прерывать работу, если что-то пойдёт не так. Вы можете описать свои требования как угодно, например: «ты обязан проверить, что скриншот содержит запрошенные изменения, с доказательством до и после», и Grok Bot будет работать, пока цель не будет достигнута.
Ключ к поддержанию работоспособности вашей инженерной команды Grok Bot — это полноценная обратная связь. Облачные агенты могут делать скриншоты, поэтому Grok Bot использует свою мультимодальность для подтверждения того, что визуальные изменения были применены, и возвращает задачу, если результат не соответствует запросу.
Тестирование диктовки — хороший пример такой обратной связи в действии. Мы подключили голосовой API SpaceXAI к системному аудиовходу/выходу облачного агента. Поскольку агент имеет доступ и к произнесённому слову, и к транскрипту, мы можем использовать эти сигналы для тестирования функциональности speech-to-speech во всей линейке продуктов и создания ещё более интересных возможностей.
Иногда агент сталкивается с нестабильностью окружения и зависает, пока вы не отправите follow-up промпт. Grok Bot снимает эту нагрузку с вас, оставаясь на связи с процессом и разблокируя агента настолько агрессивно, насколько это возможно. Каждый раз, когда я проверяю статус, всё в порядке. С тех пор как я начал использовать Grok Bot, разовые сбои практически никогда до меня не доходят — за исключением случаев, когда у Grok Bot нет прав безопасности для самостоятельного исправления.
И помните: всё теперь на расстоянии одного сообщения. Хотите, чтобы они пробовали 10 раз перед тем, как передать задачу вам? Просто скажите это.
Масштабирование за пределы контекстного окна
Чтобы мои боты могли отслеживать работу за пределами контекстного окна и чтобы мне было легко просматривать прогресс без прокрутки длинных чатов, каждый инженерный бот управляет общей базой данных Notion.
Каждые 30 минут они просматривают базу данных и проверяют каждый PR на:
- Комментарии Bugbot или обнаруженные уязвимости — проверяют, является ли каждое замечание обоснованным.
- Упавшие CI-пайплайны.
- Конфликты при мердже.
Если находят что-то не так, они немедленно направляют follow-up моему облачному агенту для исправления и переводят строку обратно в статус «Working» в базе Notion.
Если всё в порядке, они помечают задачу как «Ready for Review» и автоматически запускают код-ревью, уделяя особое внимание качеству кода и потенциальным упущениям.
Если ревью показывает высокую уверенность и радиус воздействия мал, PR мерджится автоматически. В остальных случаях я проверяю код и доказательства, когда возвращаюсь, и решаю — мерджить или дать обратную связь.
Почти каждое утро я обнаруживаю задачи, готовые к мерджу. Качество кода соответствует моим стандартам, визуальная часть попадает в мою «сладкую точку», а доказательства чётко показывают, что было протестировано. Больше задач решается с первого раза, что позволяет мне сосредоточиться на более сложных проблемах, более высоких планках производительности, более тщательной визуальной полировке и масштабных архитектурных решениях.
До Grok Bot я мог вручную управлять 15 облачными агентами одновременно. Теперь мой флот управляет более чем 200 одновременно, и мы можем масштабироваться дальше, если потребуется.
Grok Bot управляет мини-организацией
Помимо инженерии, в организации есть множество операционных задач: онбординг новых инженерных ботов, распространение нужных знаний, проведение постмортемов при инцидентах (например, когда PR был недостаточно тщательно проверен) и проведение ежедневных встреч для синхронизации.
Всем этим занимается Jenny — мой руководитель операций и единственный бот в команде, который не пишет код.
Каждое утро в 5 часов Jenny проводит встречу 1:1 с каждым ботом в команде, чтобы пересмотреть наш playbook (свод правил), выявить блокеры и закрепить атмосферу, к которой я стремлюсь. Я убедился, что это очень эффективно. Мои боты редко забывают мои сложные рабочие процессы, даже спустя много недель.
Когда бот допускает ошибку — например, недостаточно настойчиво добивается реальной цели — я говорю ему обратиться к Jenny для анализа причин и постмортема. Jenny разбирается в рассуждениях, которые привели к проблеме, затем обновляет playbook и объявляет об изменениях остальным инженерным ботам, чтобы та же ошибка не повторилась.
Когда мне нужно расширить команду, я прошу Jenny провести онбординг новых участников. Jenny создаёт нового бота в моей организации, делится правилами нашей инженерной команды и просит Hogan и остальных помочь с адаптацией.
Цель полноценной инженерной системы в Grok Bot — минимизировать повторения. Делегируйте свои задачи Grok Bot, чтобы сосредоточиться на более сложных и глубоких проблемах.
Бонусные сценарии использования Grok Bot
Мы спроектировали Grok Bot модульным образом, поэтому с ним можно сделать многое для построения собственной мини-инженерной организации. Вот два моих любимых сценария.
Ночные аудиты
Каждую ночь в 3 часа мои инженерные боты бодрствуют: чистят кодовую базу, улучшают качество кода, удаляют мёртвую логику, ускоряют загрузку приложения и уменьшают размер бандла.
Каждое утро я получаю свежую порцию PR, которые поддерживают наш код чистым, без «шлака» и масштабируемым. Это превратило поддержку кода в ежедневную рутину, а не в то, чем мы занимаемся лишь время от времени.
Ещё идеи для ночных аудитов:
- Аудиты безопасности для выявления проблем, которые команда могла пропустить в кодовой базе.
- Аудиты времени сборки CI/CD, чтобы не допускать нездорового роста времени сборки.
- Аудиты интернационализации для закрытия пробелов, когда фичи выпускаются только на одном языке.
- Аудиты паритета, чтобы избежать расхождений, когда команда разрабатывает несколько клиентов (iOS vs. десктоп) и фичи попадают только на одну сторону.
- Обзорные аудиты, которые отслеживают PR, смерженные за последние 24 часа в интересующей вас области, а затем возвращают высокоуровневую сводку и отобранный список PR для ревью.
И мой любимый промпт из всех: «У тебя шесть часов сегодня ночью. Создавай что хочешь. Развлекайся!»
Мне интересно, что бы вы запустили в своих ночных аудитах. Уверен, что есть идеи, которые я бы с удовольствием позаимствовал.
Процесс срочности P0
Облачные агенты иногда работают медленно. Им нужно запуститься, настроить окружение, подождать, прогнать тесты и итерировать. А иногда результат нужен немного быстрее.
Поэтому я создал процесс срочности P0 для моих инженерных ботов. Когда я говорю, что задача имеет приоритет P0, они запускают временную рутину, которая проверяет транскрипт каждые пять минут, отслеживает прогресс и рассуждения, и проактивно направляет облачного агента, когда тот начинает тратить время впустую.
Это оказалось очень эффективным. Когда мне нужны срочные результаты — будь то исследование кодовой базы или критический баг-фикс — достаточно сказать «это P0», чтобы работа выполнялась значительно быстрее.
Учтите, что это может сжигать токены (токены) гораздо быстрее, чем вы думаете, поэтому используйте только для настоящей срочности.
Уроки и советы по работе с Grok Bot
- Дайте облачным агентам полноценную обратную связь: Важно дать им сигналы о том, что делать дальше без вас. Они должны уметь запускать dev-инстанс и управлять стеком от начала до конца (например, через Chrome DevTools, CLI или Apple Accessibility). Если не могут — попросите их самостоятельно пройти флоу, разблокировать себя настолько агрессивно, насколько возможно, и упаковать полученные знания в переиспользуемый скилл репозитория.
- Относитесь к Grok Bot как к талантливому стажёру: Если вам трудно коммуницировать с Grok Bot по инженерным задачам, относитесь к нему как к талантливому стажёру. Просите его сделать «домашнюю работу», изучить области, в которых он ещё не эксперт, и обращаться к тому, как другие инженеры решают задачи. Не нужно вызывать скиллы. Не нужно длинных промптов. Просто общайтесь.
- Избегание повторений — ключевой принцип: По мере того как ИИ становится мощнее, важно делегировать повторяющиеся задачи и сосредотачиваться на более глубоких и сложных проблемах, которые агент не может легко решить. Если вы замечаете, что делаете что-то больше одного раза в день и это следует чёткому паттерну, обсудите с вашими ботами, как они могут помочь.
- Ежедневные встречи для ботов чрезвычайно эффективны: Повторение ключевых моментов ежедневно помогает им удерживать сложные рабочие процессы, пока они жонглируют множеством задач. Поскольку контекстное окно не может вместить всё, ежедневное напоминание — полезный толчок, который избавляет вас от повторений.
- Будьте более отстранёнными: Подобно самоуправляемым автомобилям, работа с ботами — это процесс выстраивания доверия. Вместо того чтобы делать всё самим, подумайте, когда они будут работать гладко, а когда могут вызвать проблемы. Давайте им достаточно свободы для отправки кода, когда это безопасно, и будьте более осторожны в зонах повышенного риска. Но не останавливайте их от попыток только потому, что они ошибались раньше. Продолжайте экспериментировать и думать о том, как помочь им расти.
- Пусть они оркестрируют вместе: Боты способны на большее, чем вы думаете. Чтобы ещё меньше вмешиваться в операции ботов, полезно построить pipeline (пайплайн) ревью ошибок ботов (например, операционный бот, который общается с ботами и анализирует их цепочки рассуждений), чтобы одни и те же ошибки не повторялись дважды.
Готовы принять инженерного бота в свою организацию? Попробуйте Grok Bot и покажите мне, что они создадут.
Подпишитесь на канал и каждый день читайте лучшие материалы про AI переведенные на русский!
Нашли интересную статью для перевода? Пришлите нашему боту: @ailongreadsbot