{"id": "CN-CASE-01", "company": "美的集团 (Midea Group)", "country": "CN", "process": "Кросс-функциональная работа: производственное планирование на фабрике стиральных машин в Цзинчжоу и другие сценарии (дом, офис, склад, логистика, медицина)", "ai_role": "Более 13 000 агентов ежедневно; «агентная фабрика» в Цзинчжоу, по описанию в СМИ", "outcome": "success", "evidence_level": "C", "metric_claim": "2025: 13 000+ агентов, экономия рабочего времени более 15 млн часов, экономия затрат 700 млн юаней; в Цзинчжоу производительность выросла на 80%+, скорость реакции планирования на 90%.", "period": "2025 (данные отчётности за год, публикации от 2026-03-31)", "baseline": "В статье фигурируют 180 и 700 млн юаней; база по периоду не установлена. Отношение 3,89 раза, прирост 288,9%, а не +389%. База других показателей неизвестна.", "primary_url": "https://finance.sina.com.cn/roll/2026-03-31/doc-inhswpmy2083990.shtml", "secondary_url": "https://finance.sina.com.cn/wm/2026-03-31/doc-inhswpmy2071458.shtml", "independence_note": "Оба URL — публикации Sina Finance об одном заявлении компании от 2026-03-31, они не независимы друг от друга. Годовой отчёт и официальные материалы Midea не открывались.", "limitations": "Проверены вторичные публикации о заявлении компании; годовой отчёт не прочитан. В тексте встречается неточное «свыше 4 раз»; фактическая арифметика 700/180=3,89. Метод подсчёта экономии и длительность не установлены.", "source_ids": [], "raw_worker_evidence_level": "C", "claimed_outcome": "success", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": ["Отчёт по первому СМИ опубликован 30.03, статья 31.03. «+389%» в проверенном тексте нет; есть ошибочное «свыше 4 раз». Год 2024 для базы не подтверждён. Разделить групповые метрики и конкретный завод."]}
{"id": "CN-CASE-02", "company": "не раскрыта (китайский листинговый производитель прецизионных автокомпонентов)", "country": "CN", "process": "Оптимизация технологического процесса, планирование производства, мониторинг исполнения", "ai_role": "Три агента (процессов, планирования, мониторинга исполнения), замыкающих производственный контур", "outcome": "success", "evidence_level": "D", "metric_claim": "Время подготовки детали 20→5 мин; выполнение плана 50%→90%; время корректировки плана 2 ч→5 мин.", "period": "unknown", "baseline": "Значения до внедрения в самом отчёте, дата и длительность замеров не указаны", "primary_url": "https://news.qq.com/rain/a/20260907A03LPW00", "secondary_url": null, "independence_note": "Один вторичный источник (отчёт think tank), компания не названа, второго подтверждения нет.", "limitations": "Кейс анонимный, независимой проверки нет, методика замеров и период не раскрыты. Кандидат для дальнейшей верификации.", "source_ids": ["CN-SRC-01"], "raw_worker_evidence_level": "D", "claimed_outcome": "success", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": ["Не засчитывать идентифицированным кейсом или подтверждённым китайским успехом до раскрытия компании и периода."]}
{"id": "CN-CASE-03", "company": "伊利集团 (Yili Group)", "country": "CN", "process": "Продажи / руководство для торгового персонала (в прочитанном тексте обозначено как «sales guidance»)", "ai_role": "Агент для сопровождения продаж; детали архитектуры и объёма не прочитаны", "outcome": "success", "evidence_level": "D", "metric_claim": "Заявлен рост показателя заказов/продаж на консультанта на 26,02%, не среднего чека. Точный знаменатель, период и метод не установлены.", "period": "unknown", "baseline": "unknown", "primary_url": "https://cloud.tencent.com/developer/article/2625505", "secondary_url": null, "independence_note": "Отчёт выпущен совместно Tencent Cloud (вендор), Tencent Research Institute и Gartner, независимого подтверждения нет.", "limitations": "Yili — производитель молочных продуктов, а не ритейлер. Это ближайший прочитанный кейс к каналу продаж, полноценного кейса ритейла с проверенным эффектом ИИ в этом пакете нет. Период и база не указаны.", "source_ids": ["CN-SRC-02"], "raw_worker_evidence_level": "D", "claimed_outcome": "success", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": ["Убрать среднюю сумму заказа: заявлен результат продаж/заказов на консультанта, единица не раскрыта. Community-пост не первичный отчёт."]}
{"id": "RU-CASE-01", "company": "Сбер (Сбербанк)", "country": "Россия", "process": "Закупки: подготовка заявки, проверка бюджета, формирование документов; отдельные направления — экспертиза конкурсной документации и автономные закупки до 500 тыс. руб.", "ai_role": "ИИ-агенты, сопровождающие сотрудника на этапах закупки: формируют документы, проверяют бюджет, определяют источники финансирования. В отдельном направлении агент ведёт автономные закупки малого объёма.", "outcome": "success", "evidence_level": "C", "metric_claim": "Время подготовки заявки на закупку сократилось в 12 раз: с 60 до 5 минут (заявление Т. Скворцова)", "period": "Период измерения не указан. Заявление сделано на ПМЭФ-2026, публикация 05.06.2026", "baseline": "60 минут на подготовку заявки до внедрения (по заявлению Сбера)", "primary_url": "https://ria.ru/20260605/sber-2097141856.html", "secondary_url": "https://www.cnews.ru/news/line/2026-06-05_ot_zayavki_do_oplaty_sberbank", "independence_note": "Оба материала пересказывают заявление Сбера, независимой проверки нет. Страница CNews найдена только в поиске и не читалась.", "limitations": "Шкала уровней доказательности в задании не определена. Использую: A — независимая проверка, B — первичные данные компании с методикой, C — заявление компании с цифрами без методики, D — вторичный пересказ или ожидаемый эффект. Первичный релиз Сбера не открывался. Не проверены: выборка заявок, доля сложных заявок, качество результата, включена ли ручная проверка. Число агентов (17) и опору на GigaChat я видел только в выдаче поиска.", "source_ids": ["RU-SRC-04", "RU-SRC-07"], "raw_worker_evidence_level": "C", "claimed_outcome": "success", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": ["RIA is secondary publisher; failed independent access, no VERIFIED outcome "]}
{"id": "RU-CASE-02", "company": "X5 Group", "country": "Россия", "process": "Ритейл: прогноз спроса и пополнение запасов, ценообразование и ассортимент, рекомендации, компьютерное зрение на полках, клиентский ассистент, внутренние операционные процессы", "ai_role": "Платформа AI Core; ML-модели для прогноза, цен и рекомендаций; компьютерное зрение; GalyaGPT; внутренний ассистент X5 CoPilot; агенты, созданные сотрудниками (ACE X5 / AgentOps)", "outcome": "success", "evidence_level": "C", "metric_claim": "Около 5 млрд руб. дополнительной операционной прибыли от ИИ-решений в 2025 году; 32 тыс.+ сотрудников используют X5 CoPilot, 2 300+ агентов, 150 тыс.+ запросов", "period": "2025 год (релиз от 01.06.2026)", "baseline": "Не указан на прочитанной странице. Методика расчёта прироста неизвестна.", "primary_url": "https://www.x5.ru/en/news/x5-generates-rub-5-bln-in-additional-operating-profit-through-ai-solutions/", "secondary_url": "https://telecomdaily.ru/news/2026/06/01/x5-retail-group-ii-dobavil-gruppe-5-mlrd-rub-operacionnoy-pribyli", "independence_note": "Вторичная ссылка (TelecomDaily) найдена поиском, не читалась. Судя по названию, это пересказ того же релиза, то есть не независимое подтверждение.", "limitations": "Самоотчёт компании. Не разделены вклад отдельных решений, атрибуция прибыли и эффект от изменения процессов. Русская версия релиза не открывалась.", "source_ids": ["RU-SRC-03"], "raw_worker_evidence_level": "C", "claimed_outcome": "success", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": ["Company report includes general methods but no independently checked outcome "]}
{"id": "RU-CASE-03", "company": "Норникель", "country": "Россия", "process": "Промышленные и бизнес-процессы: более 100 ИИ-агентов в 30 бизнес-процессах (по Коммерсанту, 19.05.2026)", "ai_role": "ИИ-агенты как часть более широкой программы ML и компьютерного зрения", "outcome": "unknown", "evidence_level": "D", "metric_claim": "Ожидаемый эффект в течение нескольких лет сопоставим с результатами ML и компьютерного зрения и составляет свыше 100 млн долларов в год. Формулировка неоднозначна, это ожидание, а не измеренный результат.", "period": "Заявлено как эффект за несколько лет вперёд; фактический период не указан", "baseline": "Не указан", "primary_url": "https://www.kommersant.ru/doc/8671549", "secondary_url": null, "independence_note": "Единственный источник — материал Коммерсанта со слов компаний. Независимой проверки нет. Цифры компании, а не редакции.", "limitations": "Кейс-кандидат. Не подтверждены измеренный результат, базовый уровень и определение «агент». Норникель нужно проверить по первичным материалам компании. В том же материале другие компании (АЛРОСА) на стадии пилота.", "source_ids": ["RU-SRC-07"], "raw_worker_evidence_level": "D", "claimed_outcome": "unknown", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": ["Keep forecast separate from actual achieved effect "]}
{"id": "US-CASE-01", "company": "Procter & Gamble", "country": "US (участники из Европы и США)", "process": "Разработка продуктовых идей, упаковки и розничных стратегий в одно- дневных воркшопах для реальных бизнес-единиц P&G", "ai_role": "Генеративный ИИ (GPT-4/4o) как «киберколлега» для индивидов и для пар «коммерческий + R&D»", "outcome": "success", "evidence_level": "C", "metric_claim": "Индивидуальные участники с ИИ достигли качества не хуже команд без ИИ: 0,37 против 0,24 стандартного отклонения; команды с ИИ — 0,39; группы с ИИ работали на 12–16% быстрее (по посту Моллика)", "period": "Одно- дневные воркшопы; даты проведения на прочитанной странице не найдены (пост от 2025-03-22)", "baseline": "Индивиды без ИИ и команды без ИИ в рамках рандомизированного полевого эксперимента (776 специалистов)", "primary_url": "https://www.oneusefulthing.org/p/the-cybernetic-teammate", "secondary_url": "https://papers.ssrn.com/sol3/papers.cfm?abstract_id=5188231", "independence_note": "P&G — партнёр исследования, Моллик — соавтор; полностью независимой верификации нет. Ссылка на SSRN получена со страницы поста и не открывалась.", "limitations": "Оценивается качество идей в воркшопе, а не финансовые показатели или запуск продуктов. Прочитан пересказ автора, а не сама статья. Кейс — кандидат, автоматически не верифицирован.", "source_ids": ["US-SRC-04"], "raw_worker_evidence_level": "B", "claimed_outcome": "success", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": ["C, кандидат экспериментального положительного результата. Не финансовый успех P&G. Период можно уточнить как лето 2024 по словам поста past summer от марта 2025, с пометкой вывода, пока статья не прочитана."]}
{"id": "US-CASE-02", "company": "Andon Labs (магазин Andon Market, Сан-Франциско; кафе Andon Café, Стокгольм)", "country": "US; Sweden", "process": "Управление персоналом и операциями торговой точки: отпуска, дисциплина, повышение зарплаты, найм, увольнение", "ai_role": "Агент-менеджер «Luna» (Claude) в магазине с апреля 2026 года; ИИ-агенты как руководители 5 сотрудников в двух точках в течение 4 месяцев", "outcome": "mixed", "evidence_level": "C", "metric_claim": "Одобрены 26 из 26 запросов на отпуск; 0 предупреждений при 27 опозданиях; один сотрудник уволен через 8 недель после систематических опозданий (17 из 23 смен); в сценарии найма все 21 прогон рекомендовали взять кандидата с слабыми рекомендациями", "period": "Магазин под управлением агента с апреля 2026 года; наблюдение 4 месяца; публикации 2026-08-04 и 2026-08-14", "baseline": "Сравнение с решениями реальных сценариев при повторе на разных моделях; контрольной группы с человеком-менеджером нет", "primary_url": "https://andonlabs.com/blog/ai-bosses-2", "secondary_url": "https://spectrum.ieee.org/andon-labs-agentic-ai-businesses", "independence_note": "Оператор, автор и работодатель — Andon Labs (поддерживается Y Combinator). IEEE Spectrum виден только в выдаче поиска и не открывался, поэтому независимого подтверждения нет.", "limitations": "Мало участников (5), один эпизод увольнения, сотрудники защищены гарантиями работодателя. Это полевой эксперимент стартапа-лаборатории, а не рядовое коммерческое внедрение. Кейс — кандидат, автоматически не верифицирован.", "source_ids": ["US-SRC-06"], "raw_worker_evidence_level": "C", "claimed_outcome": "mixed", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": ["Разделить source_country, case_locations=[US,Sweden], actual_observations и simulation_replays. Outcome mixed / C / candidate. Пять сотрудников и четыре месяца — ограниченный опыт, не автономность всей компании и не финансовый успех.", "Магазин США и кафе Швеции, наблюдения и сценарные повторы необходимо разделять; это не доказательство прибыльности автономной компании."]}
{"id": "US-CASE-03", "company": "Не названа на прочитанной странице (компания с поддержкой клиентов)", "country": "unknown", "process": "Клиентская поддержка в чате: решение обращений", "ai_role": "Генеративный ИИ-ассистент в диалоге для агентов поддержки", "outcome": "success", "evidence_level": "C", "metric_claim": "Ранняя версия: 5179 работников, +14%; поздняя аннотация: 5172, +15%. Не сводить в один расчёт. Название и страна компании неизвестны.", "period": "Точный период наблюдения не прочитан; статья выпущена в апреле 2023 (ревизия ноябрь 2023)", "baseline": "Агенты без доступа к инструменту; детали дизайна (в т.ч. поэтапный запуск) в аннотации не прочитаны", "primary_url": "https://www.nber.org/papers/w31161", "secondary_url": null, "independence_note": "Рабочая статья NBER экономистов Brynjolfsson, Li, Raymond; связь с компанией-поставщиком инструмента на прочитанной странице не раскрыта и не проверялась.", "limitations": "Прочитана только аннотация. Компания и страна не определены. Рабочая статья, по прочитанному не рецензированная. Кейс — кандидат, автоматически не верифицирован.", "source_ids": ["US-SRC-07"], "raw_worker_evidence_level": "B", "claimed_outcome": "success", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": ["C, кандидат. Старую версию 5179/+14% сохранить исторически; arXiv v2 от 2024-11-06 сообщает 5172/+15%. Не смешивать выборку, цифры и дату версий. Страна и название компании остаются unknown; не угадывать."]}
{"id": "EU-CASE-01", "company": "Klarna", "country": "Sweden", "process": "клиентская поддержка в чатах", "ai_role": "ИИ-ассистент, обрабатывающий обращения клиентов (по релизу — возвраты и платёжные вопросы не проверялись); позже поддержка вновь дополнена людьми", "outcome": "mixed", "evidence_level": "C", "metric_claim": "Корпоративные заявления 2024: 2,3 млн диалогов, трудовой эквивалент 700 агентов, прогноз улучшения прибыли $40 млн. Эквивалент не увольнения, прогноз не реализованная экономия. В 2025 усиливается человеческая поддержка при продолжающейся работе ИИ.", "period": "2024-02 – 2025-05 (по датам двух прочитанных материалов)", "baseline": "Время решения обращения: 11 минут до внедрения (заявление компании); остальные базовые линии не раскрыты", "primary_url": "https://www.klarna.com/international/press/klarna-ai-assistant-handles-two-thirds-of-customer-service-chats-in-its-first-month/", "secondary_url": "https://www.customerexperiencedive.com/news/klarna-reinvests-human-talent-customer-service-AI-chatbot/747586/", "independence_note": "CX Dive включает прямой ответ представителя и пересказ Bloomberg; независимого измерения эффекта нет. Возможность человеческой поддержки была заявлена ещё в 2024.", "limitations": ["Метрики не аудировались; «$40 млн» — оценка самой компании.", "Причины падения качества и масштаб найма людей не проверены по первичным данным; текст CX Dive прочитан через обработанное изложение.", "Более поздние цифры из блогов в поиске не проверены и не включены.", "Кандидат в кейсы, автоматически не верифицирован."], "source_ids": ["EU-SRC-05"], "raw_worker_evidence_level": "C", "claimed_outcome": "mixed", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": [" CX Dive includes direct spokesperson email plus secondhand Bloomberg quotations; not independent outcome measurement"]}
{"id": "EU-CASE-02", "company": "HM Revenue & Customs (HMRC)", "country": "UK", "process": "повседневная работа сотрудников с документами и текстами (конкретные задачи HMRC в прочитанном изложении не перечислены)", "ai_role": "ассистент Microsoft 365 Copilot, выданный сотрудникам как лицензия (не автономный агент)", "outcome": "mixed", "evidence_level": "C", "metric_claim": "Самооценка экономии около 60 мин/неделю после поправки примерно 20%; опрос 1364 из 3000 случайно выданных лицензий, ещё 500 распределены отдельно. Объективный причинный эффект на выпуск не установлен.", "period": "сентябрь–декабрь 2024; публикация 2026-07-09", "baseline": "Строгого объективного baseline в прочитанном изложении нет; в основном самооценки и данные Viva Insights по использованию", "primary_url": "https://www.gov.uk/government/publications/evaluation-report-phase-3-trial-of-microsoft-copilot/evaluating-the-impact-of-microsoft-copilot-in-hmrc", "secondary_url": null, "independence_note": "DBT — другое ведомство и другой эксперимент; не независимая проверка HMRC.", "limitations": ["PDF DBT не читался; выводы по DBT взяты из заметки блога.", "Не подтверждено, был ли в HMRC контрольный набор без лицензий; из прочитанного видно только случайное распределение 3 000 из 3 500 лицензий.", "Данные в основном самооценка; рост продуктивности в результатах не доказан.", "Это офисный ассистент, не агентная система и не промышленность/ритейл.", "Кандидат в кейсы, автоматически не верифицирован."], "source_ids": ["EU-SRC-03"], "raw_worker_evidence_level": "B", "claimed_outcome": "mixed", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": [" "], "case_type": "смежный пример офисного ассистента, не AI-native компания"}
{"id": "OTHER-CASE-01", "company": "Grab Holdings", "country": "Singapore", "process": "Аналитическая функция: механические аналитические задачи (подготовка данных, алерты, отчётность, SQL-запросы, ответы на вопросы по метрикам)", "ai_role": "Внутренние ИИ-агенты (система Spartan: более 50 навыков и 120 аналитических фреймворков) с лестницей автономии L2–L5; ответственность за определения метрик, причинную интерпретацию и бизнес-решения остаётся у людей", "outcome": "success", "evidence_level": "C", "metric_claim": "44→30% — доля механических задач среди закрытых тикетов, не нагрузка/время. Оценка 230–470 дней контрфактическая; другие эффекты — самоотчёт Grab.", "period": "2026-02…2026-06", "baseline": "44% закрытых аналитиками тикетов относились к механическим задачам в феврале 2026; 30% — в июне. Это не доля трудозатрат.", "primary_url": "https://engineering.grab.com/how-ai-is-transforming-analytics", "secondary_url": "https://www.infoq.com/news/2026/08/grab-ai-analytics-agents/", "independence_note": "Основной источник — пост самой компании (автор Maanas Prabhakar). Вторичная ссылка (InfoQ, 2026-08-17) пересказывает тот же пост и не является независимой проверкой.", "limitations": ["Метрики самоотчётные, аудита нет.", "Авторы сами пишут, что ожидают ошибок и что прогресс «неровный», поэтому outcome «success» отражает заявленную динамику, а не подтверждённый постоянный результат.", "Это реальное внедрение внутри компании, не симуляция и не эксперимент.", "Кандидат, не автоматически верифицированный кейс."], "source_ids": ["OTHER-SRC-01"], "raw_worker_evidence_level": "B", "claimed_outcome": "success", "verified_outcome": null, "verification_status": "candidate", "claim_status": "SOURCE_CLAIM", "counted_in_120": false, "review_notes": ["Оставить как candidate / SOURCE_CLAIM, reported_outcome=success; verified_outcome не присваивать. 230–470 дней — контрфактическая оценка, не измеренная экономия. Метрики cycle time и долей self-service присутствуют в первичном тексте."]}
