Три итерации AI-native: что мы узнали и достаточно ли исследования
Рекомендация: завершить широкий разведочный поиск на третьей итерации. Перед окончательным выпуском закрыть ограниченный набор дефектов проверки и сводки, а следующую содержательную работу направить на применение накопленного к реальным…
Заголовок источника
Три итерации AI-native: что мы узнали и достаточно ли исследования
О статусе материала
review
Рекомендация: завершить широкий разведочный поиск на третьей итерации. Перед окончательным выпуском закрыть ограниченный набор дефектов проверки и сводки, а следующую содержательную работу направить на применение накопленного к реальным процессам. Четвёртая широкая итерация сейчас даст преимущественно дополнительные примеры; главные неизвестные — полная экономика, ответственность, работа с ошибками и самостоятельное повторение улучшений — требуют данных конкретных организаций.
Это рекомендация автора разбора, не решение владельца о принятии или закрытии задачи. Итерация 2 принята по карточке; итерация 3 и E7 остаются в review. Новое исследование, исправление выпущенных реестров, пилоты и мониторинг в рамках этого разбора не запускались.
Связанные материалы: приоритетный бэклог с условиями запуска; проверка данных и ограничения анализа. Ниже — оценка пригодности корпуса для решений проекта, а не рейтинг отраслей по реальному распространению ИИ.
1. Что дают три итерации вместе
| Слой | Что накоплено | Для какого решения полезно | Чего из него не следует |
|---|---|---|---|
| Ранняя разведка первой итерации | 333 предварительно самостоятельных кандидата, 268 сущностей источников и 285 профилей; 152 приоритетные сущности | Найти организации, авторов, материалы и направления | Что все кандидаты внедрили ИИ или добились заявленного результата |
| Строгий слой первой итерации, E4–E7 | 125 засчитанных исходов, 77 медицинских; 28 подробных разборов; 30 работ свежего слоя | Понять реальные исходы и механизмы неудач в изученных условиях | Что выборка представляет рынок; что каждый исход — причинная оценка финансового эффекта. Для 19 случаев остаются решения о правилах отбора |
| Итерация 2 | 76 практик, 26 подходов, 40 работ, 90 профилей источников | Увидеть B2B/B2C, производство, ВЭД, Россию/Китай и методы трансформации | Что эффект каждого случая независимо измерен или что подход внедрён |
| Итерация 3 | 97 практик, из них 87 с установленным ИИ-компонентом и 10 смежной цифровизации; 26 досье, 15 подходов, 20 работ, 37 профилей | Разобрать строительную цепочку и конкретные изменения управления | Что представлены все отрасли/страны или доказан переход организаций целиком к AI-native |
Общую сумму «проверенных кейсов» не считаем: разные сущности, повторные наблюдения и уровни доказательности. 92 связи третьей итерации с прежним корпусом полезны для навигации, но ещё не означают завершённую дедупликацию: некоторые связи same_material ведут на профиль издателя или автора, а не на тот же материал.
Прогресс заметен: первая итерация дала строгий, но смещённый в медицину слой; вторая вернула широту бизнес-практик; третья раскрыла строительные стадии и стала различать внедрение инструмента и изменение управления. Теперь можно обсуждать, что именно меняется, а не только перечислять платформы и обещания.
2. Основные выводы о предмете
ИИ уже меняет работу, но «AI-native компания» остаётся неоднозначной единицей
В третьей итерации 72 записи описывают операцию, 21 — сквозной процесс, три — операционную модель, одна — неустановленную глубину. У всех трёх записей с меткой operating_model изменение управления не установлено. При этом среди остальных записей есть десять узких изменений ролей/прав/кадровых правил, одно — без установленного ИИ-компонента. Поэтому простая лестница «операция → процесс → вся компания» недостаточна.
Для проекта полезнее оценивать отдельно масштаб процесса, автономию системы, изменение ролей и прав, глубину измерения и повторяемость улучшения. Это аналитическое предложение по результатам корпуса, не готовый внешний стандарт зрелости. Система с малой автономией может изменить организацию работы; множество автономных агентов ещё не означает новую операционную модель.
Управленческие изменения видны, но их нельзя свести к передаче подписи агенту
One NZ — пример владельцев результата и границ решений; Italgas — ролей и организационной инфраструктуры; Moderna — объединения функций; BNY — супервизоров цифровых работников; NatWest — заявленного сокращения межкомандных передач. Они различаются по предмету, стадии и силе подтверждения. Перенос права подписи — только один возможный признак изменения, особенно специфичный для строительства и регулируемых процессов.
Контрольное чтение MIT CISR о правах решений подтверждает полезность разложения решения на постановку, действие и обучение. Это качественное исследование с интервью, включая материал, согласованный One NZ; оно не превращает цифры компании в независимую оценку эффекта.
Экономика по-прежнему слабее описания технологии
У 80 из 97 практик третьей итерации эффект маркирован как заявление источника, у 17 данных об эффекте нет. Полного TCO конкретной компании не даёт ни одно из 26 досье по оценке тематического обзора. Нет основания выводить среднюю окупаемость, универсальное сокращение штата или обязательный рост выручки на сотрудника.
Первоначальный вопрос о высокопроизводительных AI-native компаниях и экономике «малой команды — большой выручки» остаётся частично открытым. Новые рамки и кейсы агентов не заменяют сопоставимые выручку/маржу, штат, подрядчиков, расходы на вычисления, период и стадию бизнеса. Этот вопрос стоит вынести в отдельный ограниченный финансово-операционный разбор только если он нужен для следующего решения проекта.
Доказательства отрицательных исходов полезны, но доли успеха вычислять нельзя
В корпусе есть реальные откаты, ошибки, кадровые конфликты и ограничения автономии. Однако первая итерация целенаправленно собирала верифицируемые исходы, вторая и третья — публичные практики. Вендоры отбирают успешные истории, регуляторы — нарушения, исследователи — доступные для измерения процессы. Доля неудач в такой совокупности не оценивает вероятность неудачи внедрения на рынке.
Агентная экономика пока раскрыта лучше как архитектура, чем как экономика транзакций
Собраны A2A/AP2/ACP, инфраструктурные подходы и отдельные агентные процессы. Этого достаточно для карты возможностей. Для утверждений о массовом взаимодействии агентов как экономических участников не хватает наблюдаемых объёмов транзакций, модели доверия/разрешений, договорной ответственности, стоимости исключений и распределения выгоды. Это отдельная гипотеза наблюдения, не установленная неизбежная траектория всей экономики.
3. Карта отраслевого покрытия
«Достаточно» ниже означает достаточно для ориентирования и выбора процессов, не для инвестиционного или внедренческого решения. Числа третьей итерации — записи, а не уникальные компании; сведения прежних итераций не прибавляются к ним.
| Отрасль / область | Основание в корпусе | Оценка достаточности и остаток |
|---|---|---|
| Строительство, генподряд и специальные работы | I3: 47 практик, 40 ИИ, все 10 стадий | Обзорная карта достаточна. Недостаточно для российского генподрядчика на площадке, связного проекта от плана до сдачи, Last Planner+ИИ и именованных откатов |
| Промышленное производство | I2: 20 практик; I3: организационные и инженерные примеры | Достаточно для набора механизмов. Слабее экономика всего производства, малые предприятия, межфункциональное закрепление эффекта |
| Энергетика и коммунальные услуги | I3: 7 практик; прежние ранние кандидаты | Направление раскрыто; отраслевой охват неравномерен. Сети, управление активами, контроль автономии требуют проверки под конкретный процесс |
| Нефть и газ | I3: 7 практик | Есть содержательный выбор процессов; публичные эффекты преимущественно заявлены компаниями |
| Агро и пищевая цепочка | I3: 4 agriculture, все CN; 5 food_chain, включая 3 RU | Пищевая цепочка и китайское хозяйство раскрыты частично. Российское растениеводство/животноводство с именованным хозяйством остаётся пробелом |
| Эксплуатация недвижимости / полевой сервис | I3: 5 real_estate_fm + 1 field_service; эксплуатация также в стройке | Есть HVAC/заявки/обслуживание; слабее управление подрядчиками, SLA, полный ремонтный цикл и передача здания в эксплуатацию |
| Торговля, B2B/B2C | I1: ритейл; I2: 12 B2B, 19 B2C | Достаточно для ориентирования. B2B/B2C — отношения и процессы, не самостоятельные отрасли; Европа и тендеры РФ раскрыты неравномерно |
| ВЭД, логистика, склады и транспорт | I2: 14 ВЭД; I3: 7 warehousing_transport; I1: транспортные исходы | Хороший набор отдельных процессов. Слабее платежные агенты ВЭД и единая цепочка через несколько организаций |
| Банки и страхование | I2: обслуживание/финансирование/агенты; I3: досье банков и страховщиков | Содержательно представлены лучше, чем показывает один отраслевой practice-ID I3. Нельзя выводить отсутствие отрасли из одного реестра практик |
| Телеком | I2: клиентские и сетевые практики; I3: 5 практик и One NZ | Достаточно для сравнения управления клиентским и сетевым процессом; экономика и масштаб полномочий часто не раскрыты |
| Профессиональные услуги | Deloitte/Harvey в прежних слоях; I3: 4 практики | Есть основание для обсуждения знаний и качества; инженерный консалтинг, ценообразование услуги и ответственность партнёра раскрыты слабо |
| ПО и цифровые продукты | I1: Copilot и разработки; I2: агентные инциденты/продажи | Есть исходы и механизмы. Полная операционная экономика AI-native фирмы отдельно не установлена |
| Медицина | I1: 77 из 125 исходов | Широко по клиническим задачам, узко по управлению организацией. Новый массовый добор сейчас не нужен |
| Образование, госсектор, HR | I1: отдельные функции/исходы; I3: труд и организационные исследования | Есть функциональные примеры, не полноценные отраслевые операционные модели |
| Гостиницы/туризм | I3: метка hospitality у McDonald's и Taco Bell | Гостиницы фактически не покрыты этими записями: это общественное питание. Приоритет зависит от будущего применения |
| Добыча вне металлургической цепочки, фармпроизводство, вода/отходы, страхование отдельных рисков, малые бытовые услуги | Фрагменты и смежные сюжеты | Бэклог; полного нового прохода без конкретного решения не требуется |
Географически усилены Россия и Китай: I3 — 22 и 19 практик соответственно. США — 23, Европа — 16, прочие — 13, неизвестно — 4. Это не репрезентативное распределение рынка. Латинская Америка, Африка, Индия и Ближний Восток не исследованы систематически; нехватка материалов на доступном языке/домене влияет на картину. Размер компаний также не нормализован достаточно для отдельного вывода о МСБ. Широкую аудиторию проекта из-за этого не сужаем.
4. Что осталось в операционной модели
| Компонент | Что уже можно обсуждать | Что неизвестно / ограничено |
|---|---|---|
| Владелец результата | Именованные владельцы и структура CoE/бизнеса | Граница полномочий и ответственность не во всех случаях описаны; спикер публикации не обязательно владелец |
| Процесс до/после | Сокращение передач и автоматизация отдельных стадий | Часто описано только «после», нет сопоставимой базы |
| Права и исключения | Рекомендация, исполнение, подтверждение, ограниченная автономия | В 7/26 досье q3 = UNKNOWN; ещё 2 CONFLICT и 2 HYPOTHESIS |
| Роли, структура, навыки | Новые супервизоры, объединение функций, обучение | Не всегда отделены внедрённые изменения от планов; мотивация и карьерные последствия слабее технологии |
| Бюджет и полная стоимость | Отдельные бюджеты, вычисления, ресурсы поддержки | q5 = UNKNOWN в 10/26; наличие другого статуса не означает полного TCO |
| Метрики | Заявленные время, качество, масштаб и экономия | Причинный эффект и перенос на другую организацию не установлены |
| Контроль и откат | Отдельные ограничения, люди в контуре, доступы | q7 = UNKNOWN в 14/26; даже в SOURCE_CLAIM может быть только часть ответа |
| Повторение и стандарт | Frame–Act–Learn, методические PDSA/PDCA, отдельные процедуры | q8 = UNKNOWN в 7/26; регулярный форум, релиз модели или обучение сотрудников не равны циклу изменения процесса |
Значения — из пересчёта статусов полей, без превращения самоотчёта в подтверждённый факт. Досье объединяют 21 company_change и пять объектов иных типов (метод, руководство, рамки, экономика); сравнивать их нужно внутри типа. Эти 26 записей не являются 26 внедрёнными операционными моделями.
В исходной матрице 19 полей со статусом UNKNOWN показаны галочкой «известно». Причина техническая: known() проверяет только, начинается ли текст с английского unknown. Например, фраза «Явной процедуры … источники не описывают» ошибочно считается известным ответом. Кроме исправления этой ошибки, полезно заменить бинарную галочку на четыре значения: описано / частично / гипотеза или конфликт / неизвестно, а составной вопрос разделить на подпункты. Сплошную новую исследовательскую итерацию это не требует.
5. Источники и готовность к мониторингу
Первоначальная задача сбора источников выполнена в существенной части: есть международная база, научные материалы, X, российский Telegram, YouTube, китайские источники и архивы. Но собранный каталог ещё не равен работающей системе наблюдения.
I3 добавила 37 профилей: 33 новых и четыре обновлённых; 8 priority, 25 watch, 4 discovery. В них 41 запись способа обновления, 32 имеют tested=true; преобладает обычная веб-страница, RSS/API в этом новом наборе не представлены. Это не утверждение об их отсутствии в первой/второй итерации. Открытие страницы не проверяет регулярный сбор, инкрементальные обновления и восстановление.
Из 37 профилей I3 независимо проверено 12, из них у пяти последний вердикт major; 25 — только авторская проверка. Аудитория неизвестна у 28 профилей по читательскому отчёту, частоты наблюдения в основном рекомендованы на основании разового просмотра. X в I3 специально не расширялся; база второй итерации содержит 26 X-профилей и 30 Telegram-профилей. Новые Telegram-профили не следует механически складывать с прежними без сверки сущностей.
Предлагаю пилот мониторинга 20–30 источников на два цикла: научные/методические, компании-практики, RU Telegram, Китай, X/YouTube и контрпримеры. Конкретный состав выбирать из общего каталога по полезности для текущего вопроса, повторяемости публикаций и доступности. Измерять не число загрузок, а долю полезных новых материалов, повторы, задержку, ошибки доступа и стоимость одной полезной находки. Это проект следующей работы AIN-ORG-003, не подключение подписок сейчас.
Архив I3: 476 позиций доступа, 351 сохранённый файл, 339 уникальных хешей содержимого. Все 351 файла найдены и совпали с записанным SHA-256. Остальные 125 позиций — ограничения/ошибки/выжимки, не полноценные оригиналы. Целостность архива установлена; полнота прочтения и истинность утверждений от этого не следуют. У научных работ I3: 12 full_text, 6 partial, 2 abstract_only.
6. Качество исследования и границы выводов
Достоинства: сохранены оригиналы и версии; появились явные отрицательные/смешанные случаи; отделены AI-функция и цифровизация; есть разборы ролей, источников и заинтересованности; российские и китайские материалы не растворены в англоязычной базе. Все 14 файлов, перечисленных в manifest I3, совпали с его хешами при текущей проверке.
Требуют закрытия:
- 26 записей с последним major: 11 практик, 7 досье, 2 подхода, одна работа, 5 источников. Авторы заявили исправления, но независимого подтверждения последней версии нет. Остальные последние вердикты: 21 ok, 91 minor, 57 записей вне выборки. «Проверено 71%» — охват проверки, не доля успешно закрытых записей. Список ID сохранён в рабочих материалах.
- Матрица известного/неизвестного: 19 ошибочных галочек, описанных выше. Они завышают впечатление полноты досье.
- Семантика связей: минимум несколько same_material фактически означают того же издателя/автора. Например, I3-DOS-01, I3-DOS-02 и I3-OA-01 ссылаются на I2-SRC-0085 (MIT CISR). Нужна корректная связь
published_by/same_source; иначе автоматическое объединение исказит счётчики. - Слишком широкие выводы: из корпуса не следует, что ассистирующий режим всегда дешевле/безопаснее, что рынок почти не решает проблему управления или что метод проекта будет уникальным. Это гипотезы для проверки. Источник может не раскрывать внутреннюю процедуру, хотя она существует.
- Неравномерная глубина: десять стадий строительства покрыты разными организациями, не одной сквозной стройкой. Отсутствие подрядчика после двух запросов — ограничение поиска, не отсутствие внедрения. Компания с отраслевой меткой не обязательно представляет ключевой отраслевой процесс.
Доля проверок выросла с 46% в I2 до 71% в I3 из-за повторяющихся ошибок авторов. Значит, увеличение числа параллельных пакетов перестало быть главным способом улучшить результат. В следующей работе важнее принимать небольшой пакет по точным цитатам и стадиям, отдельно проверять смысл изменения и только затем масштабировать сбор. ИИ-проверка другим экземпляром модели полезна, но не является внешним человеческим аудитом.
Точечная внешняя проверка отраслевой базы согласуется с осторожным чтением: в опросе RICS 2025 45% респондентов сообщали об отсутствии внедрения, 34% — о ранних пилотах. Это опрос респондентов за конкретный период, не оценка всех строительных организаций и не основание переносить цифры на 2026 год без обновления. Витрина кейсов показывает возможности, а не типичную фирму.
7. Можно ли завершить исследовательскую фазу
| Решение | Достаточность сейчас |
|---|---|
| Сформировать понятийную карту и объяснить варианты применения | Да, с оговорками и раздельными слоями |
| Выбрать 2–3 процесса для изучения в доступных компаниях | Да; выбирать по доступу к владельцу и данным, не по популярности отрасли |
| Сделать черновик диагностической рамки и карты цифровой роли | Да; рамка будет гипотезой, проверяемой в работе |
| Обещать определённый ROI, сокращение штата или гарантированный AI-native переход | Нет |
| Заявить уникальность метода, доказанный спрос и готовность компаний платить | Нет; исследование этого не проверяло |
| Запустить полноценный мониторинг всей базы | Пока нет: нужен единый рабочий набор, проверка коннекторов и расписания |
| Передавать весь пакет как полностью проверенный | Нет: сначала закрыть конкретные замечания и корректно обозначить непроверенное |
Не рекомендую новую широкую итерацию 4. Альтернатива — адресный добор — имеет смысл только под выбранный процесс, доступную компанию, публичное утверждение или реально восстановленный доступ к источнику. Повтор тех же запросов ради ещё десяти кейсов не закрывает основной дефицит знания.
8. Следующий маршрут проекта
- Закрыть выпуск I3 ограниченным пакетом качества. Независимо проверить исправления 26 major, исправить матрицу и типы связей в новой версии, пересобрать затронутые выводы. Если часть замечаний не закрывается — убрать соответствующие утверждения из опорного набора, сохранив в резерве. Ориентир 3–6 продуктивных часов — предположение до просмотра всех findings, не обещание.
- Собрать компактный рабочий набор для методологии. 12–15 разборов, показывающих разные механизмы и неудачи: строительные документы/контроль, производство, продажи/сервис, финансы/сверки, роли и решения. Число — предлагаемый формат, не новая квота исследования. У каждого — конкретный вопрос к пилоту, а не только история успеха.
- Проверить проблему и механизм на доступных организациях. Предложение: 6–8 интервью владельцев процессов в 2–3 организациях; затем выбрать 1–2 процесса с повторяемым результатом и доступной базой. Не начинать с обещания полной трансформации компании. Контактов и приглашений в этой работе не было.
- Пройти два цикла изменения. Первый — с методической поддержкой, второй — с большей самостоятельностью команды. Сравнивать качество, время, полную стоимость, нагрузку и способность команды объяснить/изменить правило. Это непосредственно проверит замысел видения проекта, а не только работоспособность ИИ.
- Параллельно — небольшой пилот мониторинга. AIN-ORG-003: два цикла на 20–30 источниках, затем решение о расширении. Полная конвертация архива и подключение всех каналов для начала пилота не нужны.
Пилотный процесс выбирать по семи признакам: повторяемая задача и измеримый результат; доступ к данным «до»; владелец с полномочиями; понятная роль человека; возможность ограниченного испытания; видимые затраты контроля; польза для затронутых людей. Это не ограничение аудитории размером бизнеса. В строительстве возможен документооборот ПТО; в других компаниях — обработка заказа, предложение или сверка. Выбор отрасли и конкретных компаний пока не сделан.
Рабочая гипотеза продукта: помочь руководителю выбрать обоснованное изменение, распределить роли, проверить полную стоимость и закрепить следующий самостоятельный цикл. Корпус делает такую гипотезу содержательнее, но не доказывает спрос, дополнительность или преимущество перед существующим консалтингом/обучением/внутренней командой. Именно это теперь стоит проверять.
9. Что остаётся за владельцем
Принятие I3 и E7, решение по трём историческим правилам отбора и выбор следующего прикладного шага — отдельные решения. Текущее поручение выполнено как анализ и рекомендация. Бэклог сохраняет темы без превращения их в автоматически запущенные задачи; проверка объясняет, какие выводы пересчитаны, какие проверены по источникам и какие являются суждением автора.