Daily MaverickThe likely Agoa extension is positive for South Africa’s agriculturePunchOsun poll: Your strides paid off, NGF hails Adeleke’s re-electionCNN TürkTürkiye ve 7 ülkeden İsrail'e tepkiESPN DeportesFalla el relevo de Jays, Yankees se despega en la séptima con producción de CaballeroThe Jerusalem PostJewish educators should stop relying on archaeology to prove Israel’s history - opinionוואלהארה"ב שוקלת סנקציות על שופט בברזילESPNPitcher, surgery pioneer Tommy John dies at 83RTP DesportoPichardo sente a idade mas já tem agenda até Los Angeles2028InquirerSenators should explain P24-billion ‘leadership fund’ – AbanteSky TG24Sardegna, barchino di migranti travolge ragazza su un sup durante sbarco: 18enne grave
The Daily Newsstand · Free, Always
Sunday, August 16, 2026

Пул-реквестов от ИИ стало вчетверо больше за полгода. Кто их читает?

Translate

Представьте мейнтейнера open-source-проекта, который утром смотрит на очередь пул-реквестов — присланных на проверку предложений изменить код. Их вдвое больше, чем месяц назад, и заметная часть подписана агентами: Claude Code, Codex, Cursor. Это не гипербола: по данным The Information, число пул-реквестов от ИИ-агентов на GitHub выросло примерно с 4 млн в месяц в сентябре 2025 года до более чем 17 млн в марте 2026-го — вчетверо за полгода. Каждый из них кто-то должен прочитать, собрать, прогнать через тесты и решить, вливать ли в основную ветку. Вопрос: кто именно.

Ответ на него на прошлой неделе дал венчурный рынок. В один день, 12 августа, сразу два стартапа, которые продают не написание кода, а его проверку, объявили о раундах: CodeRabbit привлек $143 млн при оценке $1,5 млрд, а Blacksmith — $45 млн при оценке $550 млн. Почти $190 млн за один день в категорию, которой три года назад почти не существовало. Логика такая: писать код стало дешево — не бесплатно, за токены и подписки по-прежнему платят, но все равно выходит в разы дешевле, чем раньше. А вот читать и проверять его человек не стал ни быстрее, ни дешевле. Узкое место разработки сместилось с производства на контроль.

Это видно и по цифрам. По данным Anthropic, больше 80% ее кода теперь пишет модель. Опрос Sonar показывает, что 61% разработчиков регулярно получают от ИИ код, который выглядит правильным, но которому нельзя доверять, а 38% считают, что ревьюить ИИ-код труднее, чем человеческий (обратного мнения — 27%). Самым важным навыком эпохи ИИ участники опроса назвали умение проверять сгенерированное.

Два стартапа занимаются двумя разными видами проверки. CodeRabbit — чтением, то есть код-ревью: раньше коллега смотрел на ваше изменение и искал подозрительное, теперь смотрит агент. Устроен он совсем не как "модель читает дифф и пишет комментарии". Сооснователь и CEO Харджот Гилл сам называет продукт не агентным циклом, а конвейером, где львиная доля работы — подготовка контекста. Открывается пул-реквест — задача встает в очередь (в пике 10 ревью в секунду). Репозиторий клонируется в одноразовую изолированную виртуалку, проект собирается, разом отрабатывают больше 20 линтеров и статических анализаторов — программ, которые ищут ошибки в коде, не запуская его. Дальше дешевые модели собирают 10–15 сигналов — сам дифф, граф связей кода, тикеты из Jira, логи упавших проверок, накопленные предпочтения команды — и сжимают их в бриф: файл на 4000 строк превращается в несколько задетых функций. Только после этого передовая модель расследует изменение, причем не через заранее описанные инструменты, а буквально пишет команды для терминала в изолированной песочнице: открывает файлы, ищет, где вызывается измененная функция, гоняет тесты. И финальный этап — отдельная модель-судья, которая проверяет каждую находку по собранному контексту и отбрасывает необоснованные. Всего в конвейере семь-восемь моделей, и пользователь не видит, какая из них что делает. Главная архитектурная ставка — живой граф связей кода вместо поиска похожих фрагментов: дорогой баг обычно живет в файле, которого в диффе нет, а похожий код — еще не значит зависимый.

Казалось бы, ровно такую функцию проще всего встроить в самого агента, который код пишет. И лаборатории это сделали. Anthropic 9 марта запустила Code Review для Claude Code: пять параллельных агентов смотрят на изменение с разных углов, каждая находка получает оценку уверенности, публикуются только те, что выше порога; по собственным данным компании доля пул-реквестов с замечаниями выросла с 16% до 54% при менее чем 1% ошибок. Но ревью от Anthropic с большой вероятностью работает на модели того же семейства, что и модель, которая писала код, а модели одного семейства делят одни и те же слепые пятна. CodeRabbit гоняет ансамбль моделей разных производителей плюс отдельного судью — и упорно повторяет слово "независимый" в каждом релизе. Плюс прозаические преимущества: четыре Git-платформы против одного GitHub у Anthropic, фиксированная цена за пользователя против $15–25 за одно ревью по токенам и доступность любым командам, а не только клиентам тарифов Team и Enterprise.

Плюс вместе с раундом CodeRabbit объявил, что перестает быть просто ревьюером и становится "слоем управления изменениями" (Agentic Change Management). Новый модуль Triage оценивает входящие пул-реквесты по ценности, риску, срочности и готовности: важное отправляет людям, низкорисковое — в автоматические конвейеры, дубли и сырое — вон из очереди. То есть компания, разбогатевшая на чтении кода, теперь продает ответ на вопрос из заголовка: людям достается только то, что требует суждения, остальное читают машины. Масштаб для таких амбиций уже есть: 17 тысяч клиентов, включая Nvidia, BMW и Adyen, больше 2 млн ревью в неделю, выручка выросла в пять раз за год.

Blacksmith отвечает за второй вид проверки — не чтение, а прогон. Это CI, continuous integration: конвейер автоматических проверок, в котором каждое изменение заставляет машину заново собрать программу и прогнать сотни или тысячи тестов, и только зеленый результат пропускают дальше. Тесты надо на чем-то физически выполнять, и стандартный вариант — GitHub Actions от Microsoft, где платят за минуты работы серверов; таких минут в начале 2026 года набегало до 2,1 млрд в неделю против 500 млн в 2023-м. Blacksmith начинался как замена этим серверам: одна строчка в настройках — и те же тесты бегут на его машинах, по заявлению компании вдвое быстрее и вдвое дешевле. Секрет в железе: тесты — это цепочка последовательных шагов, которую не раздать тысяче ядер, поэтому важна скорость одного ядра. А быстрые и дешевые одиночные ядра стоят в игровых процессорах, на которых и гоняет CI Blacksmith.

По данным компании, число CI-задач растет на 5–10% каждую неделю с начала 2026 года, и Blacksmith прямо связывает это с Claude Code и Codex: агент, который сам чинит и перепроверяет код, гоняет тесты чаще, чем человек. Число клиентов за год выросло с 800 до 6000, деньги раунда пойдут в основном в железо — компания хочет нарастить мощности в десять раз. Есть и агентная надстройка, Codesmith: BB смотрит на упавшую проверку, ставит диагноз и коммитит исправление. Риск для Blacksmith — политика Microsoft: весь бизнес пристроен к чужой экосистеме GitHub, и хозяин площадки в любой момент может поменять правила или обновить свои серверы.

Скептических аргументов хватает. Независимый аудит проекта Lychee по 28 проверенным пул-реквестам разложил комментарии CodeRabbit так: 35% реально полезны, 21% придирки, 15% бесполезны. Бенчмарки категории противоречат друг другу: три замера за полгода назвали три разных лучших инструмента. Защита CodeRabbit — чисто программная: Перроне прямо пишет, что очередь, серверная обвязка и генерация команд в песочнице воспроизводятся за выходные, а не переносится только система оценки моделей, знающая, какая из восьми годится под какую подзадачу, и настроенный судья; лаборатория с большим бюджетом такое заливает деньгами. И оценка в $1,5 млрд при рынке ревью-сервисов, который аналитики 360iResearch оценивают в $3 млрд, — это ставка не на долю рынка, а на то, что категория станет чем-то большим.

Так кто читает 17 миллионов пул-реквестов? Все реже — люди. Все чаще — ансамбли моделей, судьи и диспетчеры очередей, а человеку оставляют кнопку "влить" и ответственность за то, что произойдет после. Осталось выяснить, переживет ли независимый судья тот день, когда каждая лаборатория встроит своего. Возможно, ценность независимости в проверке — вещь институциональная, как аудитор, который не работает в проверяемой компании. А возможно, удобство встроенного, как обычно, победит чистоту.

P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.

View the original on Хабр

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.