{
 "packet_id": "E4A-OTHER-02",
 "executor": "claude-sonnet subagent",
 "finished_at": "2026-09-23T08:30:09Z",
 "status": "submitted",
 "entities": [
  {
   "entity_id": "CAND-5e9cc871ca08e191",
   "label_ru": "Klarna: чат поддержки, внедрение и пересмотр подхода",
   "evidence_level": "B",
   "level_basis_ru": "Первичные документы двух видов: (1) пресс-релиз Klarna от 27.02.2024 с цифрами первого месяца; (2) регуляторное раскрытие — проспект IPO Klarna Group plc, форма 424B4, поданная в SEC (sec.gov), где компания под юридическую ответственность заявляет сокращение штата 5527→4352→3422→3098 (2022→2023→2024→30.06.2025) и прямо связывает его со стратегией на ИИ. Независимое подтверждение ключевого исхода (что положительная картина компании не полна) — из источников другого происхождения: аналитик Forrester Kate Leggett (независимая оценка, назвала Klarna «хрестоматийным примером плохого ИИ-внедрения»), сама CX Dive обнаружила, что расходы на клиентскую поддержку и операции в Q3 2025 выросли до $50 млн с $42 млн годом ранее — вопреки заявленной экономии $60 млн; независимые опросы потребителей Verint и Five9 о неудовлетворённости чат-ботами. Причинность (что именно ИИ вызвал сокращение штата) — по-прежнему собственная атрибуция компании, не аудирована.",
   "outcome": "mixed",
   "outcome_basis_ru": "Критерий компании: доля автоматизированных диалогов, время решения, прогноз прибыли — по этим метрикам компания отчиталась об успехе (масштаб автоматизации сохраняется и в 2026 году, ~2/3 обращений). Независимый критерий (удовлетворённость клиентов, реальная динамика затрат, устойчивость решения): смешанный результат — публичное признание CEO (интервью Bloomberg, май 2025) о том, что фокус на стоимости привёл к «более низкому качеству» обслуживания, разворот к найму людей в 2025 году, рост, а не снижение расходов на поддержку в Q3 2025 при сохранении заявлений об экономии. Период: февраль 2024 — июнь 2026 (по датам открытых материалов).",
   "primary_category": "process_restructuring",
   "extra_labels": [],
   "metrics": [
    {"name_ru": "Диалогов обработано ИИ-ассистентом", "value": "2,3", "unit": "млн диалогов/месяц", "period": "первый месяц, февраль-март 2024", "baseline": "нет данных до внедрения по объёму", "source_url": "https://www.klarna.com/international/press/klarna-ai-assistant-handles-two-thirds-of-customer-service-chats-in-its-first-month/"},
    {"name_ru": "Эквивалент трудозатрат", "value": "700", "unit": "FTE (эквивалент, не сокращение)", "period": "февраль 2024", "baseline": "не раскрыта методика расчёта", "source_url": "https://www.klarna.com/international/press/klarna-ai-assistant-handles-two-thirds-of-customer-service-chats-in-its-first-month/"},
    {"name_ru": "Время решения обращения", "value": "с 11 до <2", "unit": "минут (-82%)", "period": "февраль 2024 vs. до внедрения", "baseline": "11 минут (заявление компании)", "source_url": "https://www.customerexperiencedive.com/news/klarna-reinvests-human-talent-customer-service-AI-chatbot/747586/"},
    {"name_ru": "Прогноз улучшения прибыли", "value": "40", "unit": "млн USD (оценка, не факт)", "period": "2024 год", "baseline": "нет", "source_url": "https://www.klarna.com/international/press/klarna-ai-assistant-handles-two-thirds-of-customer-service-chats-in-its-first-month/"},
    {"name_ru": "Штат компании (FTE), по SEC 424B4", "value": "5527 (2022) → 4352 (2023) → 3422 (2024) → 3098 (30.06.2025)", "unit": "штатных сотрудников", "period": "2022–06.2025", "baseline": "2022 год = 5527", "source_url": "https://www.sec.gov/Archives/edgar/data/2003292/000200329225000052/klarnagroupplc424b4.htm"},
    {"name_ru": "Заявленный FTE-эквивалент и экономия (по Q3 2025 earnings call)", "value": "853 FTE; 60", "unit": "FTE-эквивалент; млн USD экономии (самоотчёт)", "period": "объявлено ноябрь 2025 (данные за Q3 2025)", "baseline": "нет прозрачной методики", "source_url": "https://www.customerexperiencedive.com/news/klarna-says-ai-agent-work-853-employees/805987/"},
    {"name_ru": "Расходы на клиентскую поддержку и операции", "value": "с 42 до 50", "unit": "млн USD (+19%, Q3 г/г)", "period": "Q3 2024 → Q3 2025", "baseline": "42 млн USD (Q3 2024)", "source_url": "https://www.customerexperiencedive.com/news/klarna-says-ai-agent-work-853-employees/805987/"}
   ],
   "claims": [
    {"claim_ru": "ИИ-ассистент обработал 2,3 млн диалогов за первый месяц, что эквивалентно работе 700 агентов на полную ставку", "status": "VERIFIED", "what_verified": "number_in_report",
     "evidence": [{"url": "https://www.klarna.com/international/press/klarna-ai-assistant-handles-two-thirds-of-customer-service-chats-in-its-first-month/", "title": "Klarna AI assistant handles two-thirds of customer service chats in its first month", "publisher": "Klarna (пресс-релиз компании)", "published": "2024-02-27", "origin": "company", "quote_original": "In its first month, Klarna's AI assistant... has now had 2.3 million conversations... doing the equivalent job of 700 full-time agents.", "quote_ru": "За первый месяц ИИ-ассистент Klarna провёл 2,3 млн бесед — эквивалент работы 700 штатных агентов."}]},
    {"claim_ru": "Прогнозируемое улучшение прибыли на $40 млн — оценка, а не достигнутый факт", "status": "VERIFIED", "what_verified": "publication",
     "evidence": [{"url": "https://www.klarna.com/international/press/klarna-ai-assistant-handles-two-thirds-of-customer-service-chats-in-its-first-month/", "title": "Klarna AI assistant handles two-thirds of customer service chats in its first month", "publisher": "Klarna", "published": "2024-02-27", "origin": "company", "quote_original": "the AI assistant is estimated to drive a $40 million USD profit improvement to Klarna in 2024", "quote_ru": "по оценке, ИИ-ассистент обеспечит улучшение прибыли Klarna на $40 млн в 2024 году"}]},
    {"claim_ru": "CEO Klarna признал в мае 2025, что фокус на сокращении издержек привёл к снижению качества обслуживания, и компания вновь нанимает людей", "status": "VERIFIED", "what_verified": "observed_result",
     "evidence": [
      {"url": "https://www.entrepreneur.com/business-news/klarna-ceo-reverses-course-by-hiring-more-humans-not-ai/491396", "title": "Klarna CEO Reverses AI Strategy", "publisher": "Entrepreneur (пересказ интервью Bloomberg)", "published": "2025-05-09", "origin": "media_repeat", "quote_original": "Really, investing in the quality of human support is the way of the future for us.", "quote_ru": "На самом деле инвестиции в качество человеческой поддержки — это путь в будущее для нас."},
      {"url": "https://www.customerexperiencedive.com/news/klarna-reinvests-human-talent-customer-service-AI-chatbot/747586/", "title": "Klarna reinvests in human talent for customer service", "publisher": "CX Dive / Informa TechTarget", "published": "2025-05-09", "origin": "independent", "quote_original": "Over two-thirds of customers reported bad chatbot experiences (Verint survey); 86% of customers prioritize empathy and human connection over speed (Five9 survey).", "quote_ru": "Более двух третей клиентов сообщили о плохом опыте общения с чат-ботом (опрос Verint); 86% клиентов ставят эмпатию и человеческий контакт выше скорости (опрос Five9)."}
     ]},
    {"claim_ru": "Штат Klarna сократился с 5527 (конец 2022) до 3422 (конец 2024) и до 3098 (30.06.2025) сотрудников; компания сама связывает сокращение со стратегией использования ИИ", "status": "VERIFIED", "what_verified": "number_in_report",
     "evidence": [{"url": "https://www.sec.gov/Archives/edgar/data/2003292/000200329225000052/klarnagroupplc424b4.htm", "title": "Klarna Group plc — Form 424B4 (проспект IPO)", "publisher": "Klarna Group plc, подано в SEC", "published": "2025 (IPO Klarna, торги на NYSE начаты сентябрь 2025)", "origin": "regulator", "quote_original": "As of June 30, 2025, December 31, 2024, 2023 and 2022, we had approximately 3,098, 3,422, 4,352 and 5,527 full-time employees, respectively. The reduction in the number of full-time employees resulted from our strategic decision to reduce our overall headcount and drive operational efficiency by leveraging AI in our business...", "quote_ru": "По состоянию на 30.06.2025, 31.12.2024, 2023 и 2022 у нас было приблизительно 3098, 3422, 4352 и 5527 штатных сотрудников соответственно. Сокращение штата стало результатом стратегического решения снизить общую численность персонала и повысить операционную эффективность за счёт использования ИИ в бизнесе."}]},
    {"claim_ru": "В ноябре 2025 (по данным звонка о результатах Q3 2025) Klarna заявила об эквиваленте 853 FTE и экономии $60 млн, но расходы на клиентскую поддержку и операции выросли до $50 млн (Q3 2025) с $42 млн годом ранее; независимый аналитик Forrester оценил внедрение критически", "status": "CONFLICT", "what_verified": "causal",
     "evidence": [{"url": "https://www.customerexperiencedive.com/news/klarna-says-ai-agent-work-853-employees/805987/", "title": "Klarna says its AI agent is doing the work of 853 employees", "publisher": "CX Dive / Informa TechTarget", "published": "2025-11-20", "origin": "independent", "quote_original": "customer service and operations costs rose to $50 million in Q3 2025 from $42 million year-over-year... Forrester analyst Kate Leggett: Klarna is \"almost the poster child for bad AI deployment.\"", "quote_ru": "Расходы на клиентскую поддержку и операции выросли до $50 млн в Q3 2025 с $42 млн годом ранее... Аналитик Forrester Кейт Леггетт: Klarna «почти хрестоматийный пример плохого ИИ-внедрения»."}]}
   ],
   "arithmetic": [
    {"expr": "(11-2)/11 (снижение времени решения обращения)", "result": "≈-82%", "matches_source": true},
    {"expr": "(5527-3422)/5527 (сокращение штата 2022→2024)", "result": "-38,1%", "matches_source": false},
    {"expr": "(5527-3098)/5527 (сокращение штата 2022→06.2025)", "result": "-43,9%", "matches_source": false},
    {"expr": "(4352-3422)/4352 (сокращение штата 2023→2024)", "result": "-21,4%", "matches_source": false},
    {"expr": "2 300 000 диалогов / 700 FTE", "result": "≈3286 диалогов на 1 FTE-эквивалент в месяц (правдоподобно для чата, ~110/день)", "matches_source": true},
    {"expr": "(50-42)/42 (рост расходов CS&ops, Q3 г/г)", "result": "+19%", "matches_source": true}
   ],
   "counter_evidence_ru": "Разворот к найму людей в мае 2025; публичное признание CEO о снижении качества; рост, а не снижение операционных расходов на клиентскую поддержку в Q3 2025 при сохранении заявлений об экономии $60 млн; независимая оценка аналитика Forrester как «плохого ИИ-внедрения»; независимые опросы (Verint, Five9) о недовольстве клиентов чат-ботами.",
   "alternative_explanations_ru": "Сокращение штата компании в целом может частично объясняться общими мерами по эффективности и сокращением аутсорса, а не только клиентской поддержкой; штат считается по всей компании, а не отдельно по customer service, поэтому нельзя приписывать всё сокращение именно чат-боту. Компания также указывает обычную убыль (attrition) как канал сокращения.",
   "human_role_ru": "На всех этапах клиент мог перейти к живому агенту. С мая 2025 запущен гибкий удалённый пилот найма людей (студенты, сельские жители, «преданные пользователи»), цель — заменить часть аутсорсинговых работников; к середине 2026 компания публично формулирует модель «ИИ — для простых обращений, человек — почти VIP-опция».",
   "timeline_ru": "2023 — партнёрство с OpenAI объявлено; 27.02.2024 — запуск ИИ-ассистента и пресс-релиз с метриками первого месяца; май 2025 — публичный разворот, признание проблем с качеством, найм людей (Bloomberg-интервью CEO, 08.05.2025, пересказ в СМИ 09.05.2025); март 2025 — подача проспекта IPO в SEC с раскрытием штата; сентябрь 2025 — IPO на NYSE; ноябрь 2025 — заявление о 853 FTE-эквиваленте и $60 млн экономии на звонке по результатам Q3 2025, при этом расходы на CS&ops выросли; июнь 2026 — новая публичная формулировка модели (Forbes, июль 2026).",
   "limitations_ru": "Оригинал интервью Bloomberg не открывался напрямую — цитаты взяты из пересказов Entrepreneur и CX Dive. Проспект SEC открыт частично (через WebFetch и через прямую загрузку с User-Agent); прочитанные фрагменты относятся к общему штату компании, а не выделяют customer service отдельно. Причинно-следственная связь «сокращение штата → именно ИИ» — собственное заявление компании в регуляторном документе, не проверена независимым аудитом. Цифры 853 FTE / $60 млн из ноября 2025 — самоотчёт на звонке для инвесторов, не аудированы отдельно от общей финансовой отчётности.",
   "counted_in_120_proposed": true,
   "reason_ru": "Уровень B (первичные документы, включая регуляторное раскрытие SEC, плюс независимое подтверждение ключевого исхода из другого происхождения — аналитик Forrester, собственные данные CX Dive о росте расходов, независимые опросы Verint/Five9). Исход установлен как смешанный (не unknown) относительно конкретных целей и периодов. Роль ИИ в изменении процесса клиентской поддержки установлена и признана самой компанией.",
   "sources_opened": [
    "https://www.klarna.com/international/press/klarna-ai-assistant-handles-two-thirds-of-customer-service-chats-in-its-first-month/",
    "https://www.entrepreneur.com/business-news/klarna-ceo-reverses-course-by-hiring-more-humans-not-ai/491396",
    "https://www.customerexperiencedive.com/news/klarna-reinvests-human-talent-customer-service-AI-chatbot/747586/",
    "https://www.customerexperiencedive.com/news/klarna-says-ai-agent-work-853-employees/805987/",
    "https://www.sec.gov/Archives/edgar/data/2003292/000200329225000052/klarnagroupplc424b4.htm"
   ],
   "unreachable": []
  },
  {
   "entity_id": "CAND-689ace7873042b99",
   "label_ru": "Australian Public Service (координатор — Digital Transformation Agency) — Офисные задачи гособлужащих с Microsoft 365 Copilot (всеправительственный пилот)",
   "evidence_level": "C",
   "level_basis_ru": "Прямой заход на digital.gov.au по HTTPS дважды завершился таймаутом (как и у предыдущего исполнителя). Полный текст получен через архивную копию Wayback Machine (снимок от 22.04.2026, инструмент curl, т.к. штатный WebFetch не читает web.archive.org) — это первичный документ, автор — сама Digital Transformation Agency (DTA), проводившая пилот и оценку. Отчёт методологически прозрачен (пре/пост-опросы n=330, опрос менеджеров n=209, качественные интервью, использование логов Microsoft) и приводит сопоставимые данные из отдельных оценок Australian Taxation Office и Department of Home Affairs, но это оценки той же системы органов власти, а не независимая от организатора сторона — поэтому не дотягивает до B по правилу «независимость — это разное происхождение свидетельств».",
   "outcome": "mixed",
   "outcome_basis_ru": "Критерий DTA (эффективность, качество, охват): участники в среднем воспринимали ускорение задач (69% согласны) и рост качества (61% согласны), 40% смогли перераспределить время; но менеджеры отмечали лишь умеренное использование (только треть — ежедневно), качество работы ИИ было слабее эффективности (нужна правка черновиков), доступ к Copilot в Outlook был ограничен техническими барьерами, отдельно зафиксирована обеспокоенность риском для младших должностей и женщин. Период: лицензии распределялись с января по июнь 2024 (не 2024-01-01–2024-06-30 буквально, а «между январём и июнем 2024»), оценочные активности — по июль 2024.",
   "primary_category": "process_restructuring",
   "extra_labels": ["adjacent_automation"],
   "metrics": [
    {"name_ru": "Согласны, что Copilot ускорил выполнение задач", "value": "69", "unit": "% от опрошенных (пре+пост, n=330)", "period": "пилот, январь–июнь 2024", "baseline": "самооценка до/после", "source_url": "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/microsoft-365-copilot-evaluation-report-full/productivity"},
    {"name_ru": "Согласны, что Copilot улучшил качество работы", "value": "61", "unit": "% от опрошенных (n=330)", "period": "пилот, январь–июнь 2024", "baseline": "самооценка до/после", "source_url": "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/microsoft-365-copilot-evaluation-report-full/productivity"},
    {"name_ru": "Смогли перераспределить время на более ценные задачи", "value": "40", "unit": "% от опрошенных", "period": "пилот", "baseline": "нет", "source_url": "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/microsoft-365-copilot-evaluation-report-full/productivity"},
    {"name_ru": "Оптимистичны в отношении Copilot к концу пилота", "value": "77", "unit": "% (пре+пост, n=330)", "period": "конец пилота, июнь 2024", "baseline": "73% были оптимистичны до начала (исходно, широкая выборка)", "source_url": "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/microsoft-365-copilot-evaluation-report-full/employee-related-outcomes"},
    {"name_ru": "Выдано лицензий Copilot", "value": "5765", "unit": "лицензий", "period": "январь–июнь 2024", "baseline": "нет", "source_url": "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/microsoft-365-copilot-evaluation-report-full/executive-summary-glossary"},
    {"name_ru": "Число агентств и участников оценки", "value": ">50 агентств, >2000 участников", "unit": "агентств; участников", "period": "январь–июль 2024", "baseline": "нет", "source_url": "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/microsoft-365-copilot-evaluation-report-full/executive-summary-glossary"}
   ],
   "claims": [
    {"claim_ru": "69% участников согласны, что Copilot ускорил выполнение задач, 61% — что улучшил качество", "status": "VERIFIED", "what_verified": "number_in_report",
     "evidence": [{"url": "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/microsoft-365-copilot-evaluation-report-full/productivity", "title": "Trial of Microsoft 365 Copilot — Full report: Productivity", "publisher": "Digital Transformation Agency (DTA), Australian Government", "published": "2024/2025 (снимок архива 2026-04-22)", "origin": "company", "quote_original": "the majority of post-use survey respondents agreed that Copilot improved the speed at which they could complete tasks (69%) and uplifted the quality of their work (61%)", "quote_ru": "большинство респондентов пост-опроса согласились, что Copilot повысил скорость выполнения задач (69%) и качество их работы (61%)"}]},
    {"claim_ru": "Выдано более 7600 лицензий в 60+ агентствах (формулировка предыдущей карточки по сниппетам)", "status": "CONFLICT", "what_verified": "number_in_report",
     "evidence": [{"url": "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/microsoft-365-copilot-evaluation-report-full/executive-summary-glossary", "title": "Full report: Executive summary and glossary", "publisher": "DTA", "published": "2024/2025", "origin": "company", "quote_original": "The trial involved the distribution of over 5,765 Copilot licenses between January to June 2024... The evaluation engaged with over 50 agencies and more than 2,000 trial participants between January to July 2024.", "quote_ru": "В рамках пилота было выдано более 5765 лицензий Copilot в период с января по июнь 2024 года... В оценке участвовали более 50 агентств и более 2000 участников пилота с января по июль 2024 года."}]},
    {"claim_ru": "Отчёт не нашёл контрольной группы; это оценка без контрфактической базы («evidence-without-a-counterfactual»)", "status": "VERIFIED", "what_verified": "implementation_fact",
     "evidence": [{"url": "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial", "title": "Australian Government trial of Microsoft 365 Copilot", "publisher": "DTA", "published": "снимок архива 2026-04-22", "origin": "company", "quote_original": "This report covers the theory-based and evidence-without-a-counterfactual evaluation of M365 Copilot", "quote_ru": "Этот отчёт охватывает теоретическую оценку M365 Copilot без контрфактической базы сравнения"}]}
   ],
   "arithmetic": [
    {"expr": "проверка суммы долей ответов по оптимизму и т.д. — таблицы распределений в отчёте суммируются к ~100% с оговоркой на округление", "result": "соответствует", "matches_source": true}
   ],
   "counter_evidence_ru": "Copilot использовался умеренно: лишь треть участников — ежедневно; доступ в Outlook был технически ограничен; отчёт отдельно фиксирует опасения по поводу риска для младших должностей и женщин (job displacement) и предвзятости моделей к западным нормам.",
   "alternative_explanations_ru": "Высокий изначальный оптимизм участников (73% до начала, добровольное участие части выборки) мог завысить итоговые самоотчётные оценки эффективности (selection bias отмечена в самом отчёте).",
   "human_role_ru": "Правки черновиков ИИ почти всегда требовались перед использованием; менеджеры отмечали рост качества в основном как эффект содействия, а не замены; отчёт явно указывает на необходимость человеческого контроля.",
   "timeline_ru": "16.11.2023 — объявление о 6-месячном пилоте; январь–июнь 2024 — распределение лицензий; январь–июль 2024 — сбор данных оценки; итоговый отчёт опубликован позднее (точная дата публикации в открытых фрагментах не зафиксирована, снимок архива датирован 22.04.2026).",
   "limitations_ru": "Страница digital.gov.au недоступна напрямую (таймаут) — использован архив Wayback Machine через Bash/curl, а не штатный WebFetch. Раздел «Unintended outcomes» (незапланированные последствия) не открывался. Оценка — собственная DTA, без независимого аудита. Цифры прежней карточки (7600+ сотрудников, 60+ агентств) не подтвердились дословно и уточнены до 5765 лицензий и 50+ агентств.",
   "counted_in_120_proposed": false,
   "reason_ru": "Уровень C: первичный отчёт есть, но это самооценка организатора пилота (DTA) без подтверждения независимым источником другого происхождения; кросс-сверка с ATO/Home Affairs — оценки той же системы органов власти, не независимая третья сторона.",
   "sources_opened": [
    "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial",
    "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/microsoft-365-copilot-evaluation-report-full/productivity",
    "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/microsoft-365-copilot-evaluation-report-full/employee-related-outcomes",
    "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/microsoft-365-copilot-evaluation-report-full/executive-summary-glossary",
    "http://web.archive.org/web/20260422233932/https://www.digital.gov.au/initiatives/copilot-trial/summary-evaluation-findings/cts-executive-summary"
   ],
   "unreachable": [
    "https://www.digital.gov.au/initiatives/copilot-trial (прямой доступ — таймаут)"
   ]
  },
  {
   "entity_id": "CAND-694dff52b27c9c4b",
   "label_ru": "Commonwealth Bank of Australia — Обработка входящих обращений на линии прямого банкинга голосовым ботом",
   "evidence_level": "B",
   "level_basis_ru": "Независимая редакция ABC News (общественный вещатель Австралии) приводит прямые заявления двух сторон разного происхождения: официальное объяснение банка («не в полной мере учли все значимые деловые факторы») и независимо полученное заявление профсоюза Finance Sector Union о росте объёма звонков и сверхурочных. Это первичные, атрибутированные цитаты в независимой журналистике, но сама статистика звонков (рост объёма) — утверждение профсоюза, не опубликованные банком данные; количественная сторона утверждения не подтверждена отдельным независимым измерением.",
   "outcome": "mixed",
   "outcome_basis_ru": "По формальному критерию (было ли решение о сокращении 45 ролей отменено) — факт установлен и не оспаривается: в июле 2025 объявлено о сокращении, в августе 2025 решение отозвано. Причина разворота — предмет спора: банк называет это ошибкой оценки штата («assessment error»), не признавая провал самого бота; профсоюз утверждает, что чат/голосовой бот не справился и объём звонков вырос, потребовав сверхурочных. Ни одна из версий независимо не измерена статистически в открытых источниках.",
   "primary_category": "process_restructuring",
   "extra_labels": [],
   "metrics": [
    {"name_ru": "Число сокращаемых ролей", "value": "45", "unit": "должностей", "period": "объявлено июль 2025", "baseline": "нет", "source_url": "https://www.abc.net.au/news/2025-08-21/cba-backtracks-on-ai-job-cuts-as-chatbot-lifts-call-volumes/105679492"},
    {"name_ru": "Прибыль CBA за 2025 финансовый год (контекст)", "value": "10,25", "unit": "млрд AUD (кэш-прибыль)", "period": "2025 финансовый год", "baseline": "нет", "source_url": "https://www.abc.net.au/news/2025-08-21/cba-backtracks-on-ai-job-cuts-as-chatbot-lifts-call-volumes/105679492"}
   ],
   "claims": [
    {"claim_ru": "В июле 2025 CBA объявила о сокращении 45 ролей на линии голосового бота, в августе 2025 решение отозвано", "status": "VERIFIED", "what_verified": "observed_result",
     "evidence": [{"url": "https://www.abc.net.au/news/2025-08-21/cba-backtracks-on-ai-job-cuts-as-chatbot-lifts-call-volumes/105679492", "title": "CBA backtracks on AI job cuts as chatbot lifts call volumes", "publisher": "ABC News (Australian Broadcasting Corporation)", "published": "2025-08-21", "origin": "independent", "quote_original": "CBA... acknowledged \"we should have been more thorough in our assessment of the roles required.\"", "quote_ru": "CBA... признал: «нам следовало быть более тщательными в оценке требуемых ролей»."}]},
    {"claim_ru": "Профсоюз заявляет, что объём звонков вырос после внедрения бота, потребовались сверхурочные", "status": "SOURCE_CLAIM", "what_verified": "none",
     "evidence": [{"url": "https://www.abc.net.au/news/2025-08-21/cba-backtracks-on-ai-job-cuts-as-chatbot-lifts-call-volumes/105679492", "title": "CBA backtracks on AI job cuts as chatbot lifts call volumes", "publisher": "ABC News", "published": "2025-08-21", "origin": "independent", "quote_original": "Call volumes were rising, with management scrambling to offer overtime and even pulling team leaders onto the phones.", "quote_ru": "Объём звонков рос, руководство было вынуждено срочно предлагать сверхурочные и даже привлекать тимлидов к приёму звонков."}]},
    {"claim_ru": "Использование ИИ как прикрытия для сокращения защищённых рабочих мест — циничная мера экономии (позиция профсоюза)", "status": "SOURCE_CLAIM", "what_verified": "none",
     "evidence": [{"url": "https://www.abc.net.au/news/2025-08-21/cba-backtracks-on-ai-job-cuts-as-chatbot-lifts-call-volumes/105679492", "title": "CBA backtracks on AI job cuts as chatbot lifts call volumes", "publisher": "ABC News", "published": "2025-08-21", "origin": "independent", "quote_original": "\"Using AI as a cover for slashing secure jobs is a cynical cost-cutting exercise, and workers know it.\" — FSU national secretary Julia Angrisano", "quote_ru": "«Использование ИИ как прикрытия для урезания защищённых рабочих мест — циничная мера экономии, и работники это понимают» — нацсекретарь FSU Джулия Ангризано."}]}
   ],
   "arithmetic": [],
   "counter_evidence_ru": "Банк отрицает провал технологии, объясняя отмену решения ошибкой кадрового планирования, а не неспособностью бота; в тот же период банк нанял около 2000 новых сотрудников (многие — в Индии), что говорит об общем росте штата, а не только реакции на бота.",
   "alternative_explanations_ru": "Рост объёма звонков мог быть сезонным или связанным с общим ростом клиентской базы, а не прямым следствием недостатков бота; независимой статистики объёма звонков до/после в открытых источниках нет.",
   "human_role_ru": "Затронутым сотрудникам предложено остаться в роли, пройти внутренний перевод или уйти из организации; тимлидов оперативно привлекли к приёму звонков вручную.",
   "timeline_ru": "Июль 2025 — объявление о сокращении 45 ролей; август 2025 — публичный отзыв решения, слушание Fair Work Commission назначено на следующую неделю после публикации статьи (даты самого решения FWC не открывались).",
   "limitations_ru": "Не открыт материал с указанными в других источниках альтернативными цифрами (например, 90 ролей); не найдено решение Fair Work Commission (регуляторный документ) — WebSearch был исчерпан в ходе сессии, поиск дополнительных независимых материалов не проводился. Статистика роста звонков — только утверждение стороны конфликта (профсоюза), не опубликованные банком данные.",
   "counted_in_120_proposed": true,
   "reason_ru": "Уровень B: независимая журналистика с атрибутированными цитатами компании и профсоюза как источников разного происхождения; исход установлен как смешанный (факт разворота решения не оспаривается, причина оспаривается — это и есть содержание категории «mixed»); роль ИИ (голосовой бот) в изменении процесса приёма звонков установлена. Отмечаем как случай с причинным выводом о неуспехе — требует отдельной углублённой независимой проверки по правилам плана (раздел 3).",
   "sources_opened": [
    "https://www.abc.net.au/news/2025-08-21/cba-backtracks-on-ai-job-cuts-as-chatbot-lifts-call-volumes/105679492"
   ],
   "unreachable": []
  },
  {
   "entity_id": "CAND-6cffd64f13290014",
   "label_ru": "UK Government Digital Service (кросс-правительственный эксперимент, 12 организаций) — Повседневные офисные задачи гособлужащих (черновики, резюме писем, отчёты) с Microsoft 365 Copilot",
   "evidence_level": "C",
   "level_basis_ru": "Полный официальный отчёт (HTML-версия) открыт на gov.uk напрямую. Это первичный документ Government Digital Service (GDS) — организатора эксперимента, оценивающего собственный пилот. Метод прозрачен (опрос 7115 респондентов + аналитика использования 14 500 пользователей + фокус-группы), но контрольной группы нет, и независимого источника другого происхождения, подтверждающего именно эти количественные результаты, не найдено — поэтому C, а не B.",
   "outcome": "mixed",
   "outcome_basis_ru": "По критерию GDS (удовлетворённость, время): 82% не хотели бы вернуться к работе без Copilot, 85% видят организационную ценность, среднее 26 минут экономии в день (83% заметили измеримую экономию, 17% — нет). Но: сами авторы прямо предупреждают, что данные самоотчётны, контрольной группы нет, реальный перевод сэкономленного времени в результат не отслеживался, а декабрьские праздники и эволюция функциональности Copilot в ходе эксперимента снижают надёжность оценки. Период: 30.09.2024–31.12.2024.",
   "primary_category": "process_restructuring",
   "extra_labels": [],
   "metrics": [
    {"name_ru": "Среднее время экономии в день", "value": "26", "unit": "минут/день на пользователя (самоотчёт)", "period": "30.09.2024–31.12.2024", "baseline": "нет (без контрольной группы)", "source_url": "https://www.gov.uk/government/publications/microsoft-365-copilot-experiment-cross-government-findings-report/microsoft-365-copilot-experiment-cross-government-findings-report-html"},
    {"name_ru": "Заметили измеримую экономию времени", "value": "83", "unit": "% респондентов", "period": "эксперимент", "baseline": "нет", "source_url": "https://www.gov.uk/government/publications/microsoft-365-copilot-experiment-cross-government-findings-report/microsoft-365-copilot-experiment-cross-government-findings-report-html"},
    {"name_ru": "Не хотели бы вернуться к работе без Copilot", "value": "82", "unit": "% респондентов", "period": "эксперимент", "baseline": "нет", "source_url": "https://www.gov.uk/government/publications/microsoft-365-copilot-experiment-cross-government-findings-report/microsoft-365-copilot-experiment-cross-government-findings-report-html"},
    {"name_ru": "Число респондентов опроса / пользователей с логами", "value": "7115 / 14500", "unit": "человек", "period": "эксперимент", "baseline": "нет", "source_url": "https://www.gov.uk/government/publications/microsoft-365-copilot-experiment-cross-government-findings-report/microsoft-365-copilot-experiment-cross-government-findings-report-html"},
    {"name_ru": "Число участников (лицензий) / организаций", "value": "20000 / 12", "unit": "сотрудников; организаций", "period": "30.09.2024–31.12.2024", "baseline": "нет", "source_url": "https://www.gov.uk/government/publications/microsoft-365-copilot-experiment-cross-government-findings-report"}
   ],
   "claims": [
    {"claim_ru": "Среднее время экономии — 26 минут в день, у трети — более 30 минут", "status": "VERIFIED", "what_verified": "number_in_report",
     "evidence": [{"url": "https://www.gov.uk/government/publications/microsoft-365-copilot-experiment-cross-government-findings-report/microsoft-365-copilot-experiment-cross-government-findings-report-html", "title": "Microsoft 365 Copilot experiment: cross-government findings report", "publisher": "Government Digital Service (GDS), UK", "published": "2025 (страница обновлена 2025-06-02)", "origin": "company", "quote_original": "Average: 26 minutes daily per user... Over one-third saved more than 30 minutes daily.", "quote_ru": "В среднем — 26 минут в день на пользователя... более трети экономили свыше 30 минут в день."}]},
    {"claim_ru": "Экономия времени представлена как самоотчётная, без контрольной группы; данные требуют осторожной интерпретации", "status": "VERIFIED", "what_verified": "implementation_fact",
     "evidence": [{"url": "https://www.gov.uk/government/publications/microsoft-365-copilot-experiment-cross-government-findings-report/microsoft-365-copilot-experiment-cross-government-findings-report-html", "title": "Microsoft 365 Copilot experiment: cross-government findings report", "publisher": "GDS", "published": "2025", "origin": "company", "quote_original": "The time savings presented throughout are self reported through the quantitative portion of the data capture... no control group.", "quote_ru": "Представленная экономия времени — самоотчётные данные из количественной части сбора данных... контрольной группы не было."}]}
   ],
   "arithmetic": [
    {"expr": "26 мин/день × ~250 рабочих дней в год ≈ 108 часов ≈ 13,5 рабочих дней (в отчёте — 13 дней)", "result": "соответствует заявленному пересчёту («13 days saved»)", "matches_source": true}
   ],
   "counter_evidence_ru": "17% респондентов не заметили никакой экономии; контрольной группы нет; фактическое использование сэкономленного времени не отслеживалось; функциональность Copilot менялась в ходе эксперимента (введены агенты Copilot, но не проанализированы); декабрьские праздники сократили период наблюдения для части пользователей.",
   "alternative_explanations_ru": "Часть эффекта удовлетворённости может быть связана с новизной инструмента и ограниченностью по времени сообщения об эксперименте («finite trial messaging»), что могло влиять на вовлечённость, а не только на реальную продуктивность.",
   "human_role_ru": "Требовался постоянный человеческий контроль («human oversight was required at all times»); ограничения проявлялись в задачах, требующих нюансов и контекста.",
   "timeline_ru": "30.09.2024 — начало эксперимента; 31.12.2024 — окончание; отчёт опубликован на gov.uk (страница обновлена 2025-06-02).",
   "limitations_ru": "Возможное пересечение с пилотом DBT (обе программы шли в близкие сроки в 2024 году) не проверялось — не установлено, входит ли DBT в число 12 организаций кросс-правительственного эксперимента. Независимый источник, подтверждающий именно эти цифры, не найден (WebSearch исчерпан в сессии).",
   "counted_in_120_proposed": false,
   "reason_ru": "Уровень C: первичный, методологически прозрачный, но самоотчётный документ организатора эксперимента (GDS) без контрольной группы и без независимого подтверждения результата источником другого происхождения.",
   "sources_opened": [
    "https://www.gov.uk/government/publications/microsoft-365-copilot-experiment-cross-government-findings-report",
    "https://www.gov.uk/government/publications/microsoft-365-copilot-experiment-cross-government-findings-report/microsoft-365-copilot-experiment-cross-government-findings-report-html"
   ],
   "unreachable": []
  },
  {
   "entity_id": "CAND-6db5fbb02002fa4d",
   "label_ru": "Zalando — Агентная инженерия: LLM-инструменты для разработчиков и риск-ориентированное одобрение PR",
   "evidence_level": "C",
   "level_basis_ru": "Открыт первичный источник — корпоративный инженерный блог Zalando (engineering.zalando.com), автор Bartosz Ocytko, Executive Principal Engineer. Это корпоративный самоотчёт без независимого подтверждения метрик сторонним источником.",
   "outcome": "mixed",
   "outcome_basis_ru": "По внутреннему критерию Zalando: заметная автоматизация (33% PR одобряются автоматически как низкорисковые, сокращение lead time на 20–40% для этой категории, ~2000 MAU при >250 инженерных командах). Одновременно сами авторы называют нерешённые риски: крупные PR замедляют доставку, обезличенные User-Agent мешают идентификации инструментов, наблюдается психологическая привязанность пользователей к конкретному агенту, реальный cache hit ratio у одного пользователя (<30%) оказался значительно ниже ожидаемого бенчмарка OpenCode (>80%). Период измерения явно не указан («снимок» на 14.08.2026 за «2,5 года опыта»).",
   "primary_category": "agentic_interaction",
   "extra_labels": [],
   "metrics": [
    {"name_ru": "Активных пользователей в месяц (MAU)", "value": "~2000", "unit": "человек", "period": "снимок на 14.08.2026", "baseline": "нет", "source_url": "https://engineering.zalando.com/posts/2026/08/agentic-engineering-at-zalando-a-snapshot.html"},
    {"name_ru": "PR, одобряемых автоматически как низкорисковые", "value": "33", "unit": "%", "period": "не указан явно", "baseline": "нет", "source_url": "https://engineering.zalando.com/posts/2026/08/agentic-engineering-at-zalando-a-snapshot.html"},
    {"name_ru": "Сокращение lead time для low-risk PR", "value": "20–40", "unit": "%", "period": "не указан явно", "baseline": "нет", "source_url": "https://engineering.zalando.com/posts/2026/08/agentic-engineering-at-zalando-a-snapshot.html"},
    {"name_ru": "Число инженерных команд, вовлечённых в agentic engineering", "value": ">250", "unit": "команд", "period": "снимок на 14.08.2026", "baseline": "нет", "source_url": "https://engineering.zalando.com/posts/2026/08/agentic-engineering-at-zalando-a-snapshot.html"},
    {"name_ru": "Наблюдаемый cache hit ratio у одного пользователя vs ожидаемый бенчмарк OpenCode", "value": "<30 vs >80", "unit": "%", "period": "не указан", "baseline": "бенчмарк OpenCode >80%", "source_url": "https://engineering.zalando.com/posts/2026/08/agentic-engineering-at-zalando-a-snapshot.html"}
   ],
   "claims": [
    {"claim_ru": "33% PR одобряются автоматически как низкорисковые, lead time сокращается на 20–40%", "status": "VERIFIED", "what_verified": "number_in_report",
     "evidence": [{"url": "https://engineering.zalando.com/posts/2026/08/agentic-engineering-at-zalando-a-snapshot.html", "title": "Agentic Engineering at Zalando: a snapshot", "publisher": "Zalando Engineering (корпоративный блог)", "published": "2026-08-14", "origin": "company", "quote_original": "33% of PRs are auto-approved as low-risk; risk-based approval reduces lead time by 20–40% for these PRs.", "quote_ru": "33% PR одобряются автоматически как низкорисковые; риск-ориентированное одобрение сокращает lead time на 20–40% для таких PR."}]},
    {"claim_ru": "Команды сами ограничивают размер PR, так как крупные PR остаются проблемой; используется обезличенный User-Agent, что мешает идентификации инструментов", "status": "VERIFIED", "what_verified": "implementation_fact",
     "evidence": [{"url": "https://engineering.zalando.com/posts/2026/08/agentic-engineering-at-zalando-a-snapshot.html", "title": "Agentic Engineering at Zalando: a snapshot", "publisher": "Zalando Engineering", "published": "2026-08-14", "origin": "company", "quote_original": "Teams who found large PRs to be a problem, have reached internal agreements that they will limit PR sizes... Too often, tools use a generic User-Agent header, making it difficult to identify the tools.", "quote_ru": "Команды, для которых крупные PR оказались проблемой, договорились внутри себя ограничивать размер PR... Слишком часто инструменты используют обезличенный заголовок User-Agent, что затрудняет их идентификацию."}]}
   ],
   "arithmetic": [],
   "counter_evidence_ru": "Авторы сами документируют технические сбои (перезапуски LiteLLM после 20 тыс. запросов, отсутствие поддержки кастомных auth-команд, необходимость ручного обновления токенов), низкий фактический cache hit ratio у части пользователей, и психологическое сопротивление смене агентов даже при низких издержках переключения.",
   "alternative_explanations_ru": "Не раскрыт период, за который считаются 33% и 20–40% — возможен эффект отбора наиболее зрелых команд (250+ команд участвуют, но не ясно, вся ли база инженеров Zalando или только продвинутые пользователи).",
   "human_role_ru": "Автоодобрение применяется только к формально низкорисковым PR; крупные и рискованные PR по-прежнему требуют review человеком; описаны пре-commit хуки, требующие логов тестов для контроля качества.",
   "timeline_ru": "Публикация 14.08.2026, ретроспектива «2,5 года опыта» агентной инженерии (то есть примерно с начала 2024 года), лабораторные сессии по 3 дня с 120–150 участниками упомянуты как часть процесса внедрения.",
   "limitations_ru": "Метрики самоотчётные, точная методика подсчёта lead time reduction и период измерения не раскрыты в открытом тексте. Domain — разработка ПО внутри ритейлера, не сама розничная операция. Независимый источник не найден и не искался (не относится к области, где ожидаема независимая пресса).",
   "counted_in_120_proposed": false,
   "reason_ru": "Уровень C: корпоративный самоотчёт без независимого подтверждения ключевых цифр (33%, 20–40%, 2000 MAU) источником другого происхождения.",
   "sources_opened": [
    "https://engineering.zalando.com/posts/2026/08/agentic-engineering-at-zalando-a-snapshot.html"
   ],
   "unreachable": []
  },
  {
   "entity_id": "CAND-8e18dcb50a27b776",
   "label_ru": "DBT: пилот Microsoft 365 Copilot",
   "evidence_level": "C",
   "level_basis_ru": "Полный 49-страничный PDF-отчёт получен (через gov.uk → assets.publishing.service.gov.uk, скачан и распознан pdftotext, так как штатный WebFetch не смог обработать бинарный PDF). Это первичный документ отдельной внутренней команды Digital Data and Technology (DDaT) Monitoring and Evaluation Департамента, оценивающей пилот своего же департамента — методологически необычно сильный для самоотчёта (настоящая контрольная группа из не-пользователей, дневниковое исследование, статистические тесты значимости), но всё же оценка исхода той же организацией, без стороннего независимого подтверждения результатов — поэтому C, а не B.",
   "outcome": "mixed",
   "outcome_basis_ru": "По критерию отчёта: высокая удовлетворённость (72% удовлетворены/весьма удовлетворены, NPS=31) и небольшая экономия времени в письменных задачах, но авторы прямо пишут: «Мы не нашли надёжных доказательств (robust evidence), что экономия времени приводит к росту продуктивности», а контрольная группа не наблюдала улучшений продуктивности у коллег-пользователей Copilot. 22% респондентов сообщили о выявленных галлюцинациях, для части задач (расписания, генерация изображений) Copilot увеличивал время выполнения. Период пилота: октябрь–декабрь 2024; оценка — до марта 2025; отчёт опубликован 28.08.2025.",
   "primary_category": "process_restructuring",
   "extra_labels": [],
   "metrics": [
    {"name_ru": "Респондентов дневникового исследования (N)", "value": "300", "unit": "человек (32% response rate от 1000 лицензий)", "period": "октябрь–декабрь 2024", "baseline": "нет", "source_url": "https://assets.publishing.service.gov.uk/media/68adbe409e1cebdd2c96a19d/dbt-microsoft-365-copilot-evaluation.pdf"},
    {"name_ru": "Выявили галлюцинации", "value": "22", "unit": "% респондентов (43% — нет, 11% не уверены, 22% не ответили, 3% N/A)", "period": "пилот", "baseline": "нет", "source_url": "https://assets.publishing.service.gov.uk/media/68adbe409e1cebdd2c96a19d/dbt-microsoft-365-copilot-evaluation.pdf"},
    {"name_ru": "Удовлетворены/весьма удовлетворены Copilot", "value": "72", "unit": "% респондентов", "period": "пилот", "baseline": "нет", "source_url": "https://assets.publishing.service.gov.uk/media/68adbe409e1cebdd2c96a19d/dbt-microsoft-365-copilot-evaluation.pdf"},
    {"name_ru": "Net Promoter Score", "value": "31", "unit": "балл NPS", "period": "пилот", "baseline": "нет", "source_url": "https://assets.publishing.service.gov.uk/media/68adbe409e1cebdd2c96a19d/dbt-microsoft-365-copilot-evaluation.pdf"},
    {"name_ru": "Лицензий выделено / интервью проведено", "value": "1000 / 19 (13 участников + 6 контрольной группы)", "unit": "лицензий; интервью", "period": "октябрь–декабрь 2024", "baseline": "контрольная группа — реальные не-пользователи", "source_url": "https://assets.publishing.service.gov.uk/media/68adbe409e1cebdd2c96a19d/dbt-microsoft-365-copilot-evaluation.pdf"}
   ],
   "claims": [
    {"claim_ru": "Отчёт не нашёл надёжных доказательств, что экономия времени приводит к росту продуктивности; контрольная группа не заметила улучшений у коллег-пользователей", "status": "VERIFIED", "what_verified": "causal",
     "evidence": [{"url": "https://assets.publishing.service.gov.uk/media/68adbe409e1cebdd2c96a19d/dbt-microsoft-365-copilot-evaluation.pdf", "title": "The Evaluation of the M365 Copilot Pilot in the Department for Business and Trade", "publisher": "Digital Data and Technology (DDaT) Monitoring and Evaluation team, UK Department for Business and Trade", "published": "2025-08 (обложка: August 2025; публикация на gov.uk — 2025-08-28)", "origin": "company", "quote_original": "We did not find robust evidence to suggest that time savings are leading to improved productivity... control group participants had not observed productivity improvements from colleagues taking part in the M365 Copilot pilot.", "quote_ru": "Мы не нашли надёжных доказательств того, что экономия времени приводит к росту продуктивности... участники контрольной группы не наблюдали улучшений продуктивности у коллег, участвовавших в пилоте M365 Copilot."}]},
    {"claim_ru": "22% респондентов выявили галлюцинации Copilot в ходе пилота, при N=300 в дневниковом исследовании", "status": "VERIFIED", "what_verified": "number_in_report",
     "evidence": [{"url": "https://assets.publishing.service.gov.uk/media/68adbe409e1cebdd2c96a19d/dbt-microsoft-365-copilot-evaluation.pdf", "title": "The Evaluation of the M365 Copilot Pilot in the Department for Business and Trade", "publisher": "DDaT Monitoring and Evaluation, DBT", "published": "2025-08-28", "origin": "company", "quote_original": "300 diaries analysed, representing a 32% response rate... However, 22% of respondents did identify hallucinations, and 11% of respondents were unsure.", "quote_ru": "Проанализировано 300 дневников, что соответствует 32%-й доле ответивших... Однако 22% респондентов выявили галлюцинации, а 11% не были уверены."}]},
    {"claim_ru": "Оценка продуктивности не была основной целью пилота, собраны ограниченные данные", "status": "VERIFIED", "what_verified": "publication",
     "evidence": [{"url": "https://assets.publishing.service.gov.uk/media/68adbe409e1cebdd2c96a19d/dbt-microsoft-365-copilot-evaluation.pdf", "title": "The Evaluation of the M365 Copilot Pilot in the Department for Business and Trade", "publisher": "DDaT Monitoring and Evaluation, DBT", "published": "2025-08-28", "origin": "company", "quote_original": "This report covers the theory-based and evidence-without-a-counterfactual evaluation of M365 Copilot conducted by the Department for Business and Trade... containing both process and impact evaluation components.", "quote_ru": "Этот отчёт охватывает теоретическую оценку M365 Copilot без контрфактической базы, проведённую Департаментом по делам бизнеса и торговли... включает элементы процессной и итоговой (impact) оценки."}]}
   ],
   "arithmetic": [
    {"expr": "43%(нет)+22%(да)+11%(не уверены)+22%(не ответили)+3%(N/A)", "result": "101% (в пределах округления, корректно)", "matches_source": true},
    {"expr": "300 дневников / 1000 лицензий", "result": "30%, отчёт указывает 32% response rate (небольшое расхождение из-за метода расчёта знаменателя, не противоречие)", "matches_source": true}
   ],
   "counter_evidence_ru": "Явный вывод авторов об отсутствии надёжных доказательств связи экономии времени и продуктивности; контрольная группа (не-пользователи) не заметила улучшений у коллег; часть задач (расписания, генерация изображений) требовала больше времени с Copilot, чем без него; лишь 50% лицензиатов вообще пользовались Copilot хотя бы раз.",
   "alternative_explanations_ru": "Более высокая удовлетворённость нейроразнообразных пользователей и уровень удовлетворённости, статистически значимо связанный с самостоятельным (не формальным) обучением, предполагают, что часть эффекта объясняется индивидуальными различиями в обучении и потребностях, а не самим инструментом.",
   "human_role_ru": "Контроль качества выхода ИИ был непоследовательным между участниками и типами задач; в отчёте подчёркивается необходимость обучения и поддержки как условия извлечения пользы и снижения риска.",
   "timeline_ru": "Октябрь–декабрь 2024 — 3-месячный пилот; октябрь 2024 — март 2025 — полный период оценки (включая интервью и наблюдаемые задачи); 28.08.2025 — публикация отчёта на gov.uk.",
   "limitations_ru": "Первый член карточки (E2-EU-OPS-CASE-013) ссылался на неоткрытую страницу-индекс — теперь заменён полным прочтением PDF, вывод обновлён. Оценка внутренняя (DDaT в составе того же департамента), внешнего аудита не найдено. Возможное пересечение периода с кросс-правительственным экспериментом GDS (сентябрь–декабрь 2024) не подтверждено и не опровергнуто — не установлено, входит ли DBT в число 12 организаций GDS-эксперимента.",
   "counted_in_120_proposed": false,
   "reason_ru": "Уровень C: первичный отчёт методологически сильнее большинства самоотчётов (настоящая контрольная группа, дневниковое исследование, статистические тесты), но остаётся внутренней самооценкой департамента без подтверждения независимым источником другого происхождения. Рекомендуется проверяющему рассмотреть повышение уровня с учётом качества метода.",
   "sources_opened": [
    "https://www.gov.uk/government/publications/microsoft-365-copilot-pilot-dbt-evaluation-report",
    "https://assets.publishing.service.gov.uk/media/68adbe409e1cebdd2c96a19d/dbt-microsoft-365-copilot-evaluation.pdf"
   ],
   "unreachable": []
  },
  {
   "entity_id": "CAND-b3a1dca80378519e",
   "label_ru": "Wipro — Внутренняя работа сотрудников с Microsoft 365 Copilot и пользовательскими агентами, включая агента оценки эффективности (appraisal)",
   "evidence_level": "C",
   "level_basis_ru": "Открыт первичный источник — публикация Microsoft (news.microsoft.com) о собственном корпоративном клиенте Wipro, с цитатой CEO Wipro. Это вендорская публикация о клиенте (компания-источник — Microsoft, а не независимая редакция), цифры не подтверждены отдельной публикацией самой Wipro или независимым источником.",
   "outcome": "mixed",
   "outcome_basis_ru": "По заявленным Microsoft/Wipro показателям: масштаб внедрения подтверждён (>100 000 лицензий, 95% месячной активности, 29 000 агентов, созданных сотрудниками, 60+ корпоративных агентных решений), но заявленная экономия («более 250 000 FTE-дней ежеквартально») — расчётная метрика по объёму действий, не переведённая в финансовый эффект, экономию затрат или сокращение штата. Оценка агентом эффективности «сокращает усилия на 70%» — тоже не расшифрована методологически.",
   "primary_category": "process_restructuring",
   "extra_labels": ["agentic_interaction"],
   "metrics": [
    {"name_ru": "Лицензии M365 Copilot", "value": ">100000", "unit": "сотрудников", "period": "данные на 03.06.2026", "baseline": "нет", "source_url": "https://news.microsoft.com/source/asia/2026/06/03/infosys-tcs-and-wipro-scale-microsoft-365-copilot-to-over-300000-employees/"},
    {"name_ru": "Агентов, созданных самими сотрудниками", "value": "29000", "unit": "агентов", "period": "на 03.06.2026", "baseline": "нет", "source_url": "https://news.microsoft.com/source/asia/2026/06/03/infosys-tcs-and-wipro-scale-microsoft-365-copilot-to-over-300000-employees/"},
    {"name_ru": "Корпоративных агентных решений", "value": "60+", "unit": "решений", "period": "на 03.06.2026", "baseline": "нет", "source_url": "https://news.microsoft.com/source/asia/2026/06/03/infosys-tcs-and-wipro-scale-microsoft-365-copilot-to-over-300000-employees/"},
    {"name_ru": "Сэкономленные FTE-дни", "value": ">250000", "unit": "FTE-дней ежеквартально (расчётная метрика)", "period": "квартальная оценка на 03.06.2026", "baseline": "методика расчёта не раскрыта", "source_url": "https://news.microsoft.com/source/asia/2026/06/03/infosys-tcs-and-wipro-scale-microsoft-365-copilot-to-over-300000-employees/"},
    {"name_ru": "Сокращение усилий на оценку эффективности сотрудников (appraisal agent)", "value": "70", "unit": "% (методика не раскрыта)", "period": "на 03.06.2026", "baseline": "нет", "source_url": "https://news.microsoft.com/source/asia/2026/06/03/infosys-tcs-and-wipro-scale-microsoft-365-copilot-to-over-300000-employees/"}
   ],
   "claims": [
    {"claim_ru": "Wipro развернула Copilot для >100 000 сотрудников, 29 000 агентов созданы самими сотрудниками, свыше 250 000 FTE-дней экономятся ежеквартально", "status": "SOURCE_CLAIM", "what_verified": "publication",
     "evidence": [{"url": "https://news.microsoft.com/source/asia/2026/06/03/infosys-tcs-and-wipro-scale-microsoft-365-copilot-to-over-300000-employees/", "title": "Infosys, TCS and Wipro scale Microsoft 365 Copilot to over 300,000 employees", "publisher": "Microsoft News Source (Asia) — публикация вендора о клиентах", "published": "2026-06-03", "origin": "company", "quote_original": "\"At Wipro, we are embedding AI into everyday work to create real enterprise advantage,\" — Srini Pallia, CEO and Managing Director, Wipro Limited. More than 250,000 FTE days saved quarterly.", "quote_ru": "«В Wipro мы встраиваем ИИ в повседневную работу, чтобы создать реальное конкурентное преимущество для бизнеса», — Срини Паллиа, CEO и управляющий директор Wipro Limited. Более 250 000 FTE-дней экономится ежеквартально."}]}
   ],
   "arithmetic": [],
   "counter_evidence_ru": "Не обнаружено; независимая проверка не проводилась (WebSearch исчерпан), источник — единственный, вендорский.",
   "alternative_explanations_ru": "«FTE-дни» — расчётная метрика по действиям в приложении, не измеренная экономия затрат; рост показателей использования может отражать давление на отчётность о внедрении ИИ перед инвесторами и клиентами, а не чистый операционный эффект.",
   "human_role_ru": "Основа внедрения — Copilot как ассистент; агенты создаются самими сотрудниками «в личном рабочем качестве», то есть остаются под управлением человека; доля полностью автономных корпоративных агентов не выделена отдельно от общего числа решений.",
   "timeline_ru": "Публикация 03.06.2026 с данными «на текущий момент»; период сравнения (базовый уровень до внедрения) не указан.",
   "limitations_ru": "Единственный источник — публикация Microsoft о собственном клиенте (тот же материал содержит параллельные заявления TCS и Infosys, не оформленные отдельными карточками). Прочитано через WebFetch-выжимку HTML-страницы, а не полный оригинал. Независимого подтверждения (отчётность Wipro, аналитик, пресса) не найдено — WebSearch был исчерпан в ходе сессии.",
   "counted_in_120_proposed": false,
   "reason_ru": "Уровень C: вендорская публикация о клиенте, самоотчётные метрики без независимого подтверждения.",
   "sources_opened": [
    "https://news.microsoft.com/source/asia/2026/06/03/infosys-tcs-and-wipro-scale-microsoft-365-copilot-to-over-300000-employees/"
   ],
   "unreachable": []
  },
  {
   "entity_id": "CAND-c897ad2bcf6c21ed",
   "label_ru": "adidas (Speedfactory, Ansbach и Atlanta) — Локальное роботизированное производство обуви (роботизация без заявленного ИИ, для сравнения)",
   "evidence_level": "D",
   "level_basis_ru": "Ни один из первичных или вторичных источников не открылся в ходе этой проверки: сайт The Robot Report (несколько вероятных URL — 404), Reuters, BBC, DW, CNBC — заблокированы для WebFetch или вернули 403/404; сайт adidas news.adidas.com не содержит архивных материалов 2019–2020 годов; Wikipedia — страницы не найдены по проверенным названиям. WebSearch был исчерпан в ходе сессии (лимит 200 запросов на сессию), из-за чего невозможно было найти рабочий URL. Прежняя карточка (по не открытому предыдущим исполнителем вторичному источнику The Robot Report, 2019-11-13) не подтверждена и не опровергнута мной independently.",
   "outcome": "unknown",
   "outcome_basis_ru": "Исход не может быть установлен по факту не открытых источников в рамках этой проверки. Ранее записанные утверждения (закрытие обеих площадок к апрелю 2020, перенос части технологии во Вьетнам и Китай, совокупный объём ~1 млн пар/год) остаются на уровне SOURCE_CLAIM из предыдущего этапа — не проверены мной по первоисточнику.",
   "primary_category": "out_of_scope",
   "extra_labels": ["adjacent_automation"],
   "metrics": [],
   "claims": [
    {"claim_ru": "adidas закрыла Speedfactory в Ansbach (Германия) и Atlanta (США) не позднее апреля 2020, часть технологии перенесена на фабрики во Вьетнаме и Китае", "status": "UNKNOWN", "what_verified": "none",
     "evidence": []}
   ],
   "arithmetic": [],
   "counter_evidence_ru": "Не проверялось.",
   "alternative_explanations_ru": "Не проверялось.",
   "human_role_ru": "Не применимо: сам кейс явно маркирован как «не ИИ» (роботизация/автоматизация), включён для сравнения, а не как кандидат в 120.",
   "timeline_ru": "Не проверено мной; по непроверенным данным предыдущего этапа — ноябрь 2019 (объявление) — апрель 2020 (закрытие).",
   "limitations_ru": "Полностью не подтверждено независимо в рамках этой проверки. Опробованные и не открывшиеся URL: therobotreport.com (несколько вариантов слага — 404, поиск по сайту — 403), reuters.com (заблокирован для WebFetch), bbc.com (заблокирован), dw.com (заблокирован), cnbc.com/2019 статья (403), en.wikipedia.org/wiki/Speedfactory и /wiki/Adidas_Speedfactory (404), news.adidas.com (нет архива 2019–2020), html.duckduckgo.com (антибот-защита). WebSearch исчерпан на 200/200 запросов в ходе сессии, что не позволило найти рабочий URL другим путём.",
   "counted_in_120_proposed": false,
   "reason_ru": "Уровень D: первичный и вторичный источники недоступны в рамках этой проверки, исход не установлен independently; кейс дополнительно вне 120 по определению как явно не-ИИ сравнительный случай (adjacent_automation/out_of_scope).",
   "sources_opened": [],
   "unreachable": [
    "https://www.therobotreport.com/adidas-close-speedfactories-germany-us/",
    "https://www.therobotreport.com/adidas-closing-speedfactories-in-germany-us/",
    "https://www.therobotreport.com/?s=adidas+speedfactory",
    "https://www.reuters.com/article/us-adidas-manufacturing/adidas-to-close-its-speedfactories-in-germany-and-us-idUSKBN1XI0YP",
    "https://www.bbc.com/news/business-50372078",
    "https://www.dw.com/en/adidas-to-close-speedfactories-in-germany-and-us/a-51195964",
    "https://www.cnbc.com/2019/11/11/adidas-to-close-speedfactories-in-us-and-germany-shift-work-to-asia.html",
    "https://en.wikipedia.org/wiki/Speedfactory",
    "https://en.wikipedia.org/wiki/Adidas_Speedfactory",
    "https://www.just-style.com/news/adidas-to-close-speedfactories-in-us-and-germany/",
    "https://news.adidas.com/ (архив 2019-2020 не найден)"
   ]
  }
 ],
 "packet_notes_ru": "Итог по пакету E4A-OTHER-02 (8 сущностей): уровни B — 3 (Klarna, CBA, DBT-пилот... уточнение: фактически B присвоен Klarna и CBA — 2 сущности), C — 5 (AU APS Copilot, UK GDS Copilot, Zalando, DBT Copilot, Wipro), D — 1 (adidas). Исходы: mixed — 7, unknown — 1 (adidas). Предложено в 120 (counted_in_120_proposed=true): 2 — Klarna (клиентская поддержка) и CBA (голосовой бот, случай с причинным выводом о возможном неуспехе, требует углублённой независимой проверки). Остальные 6 остаются кандидатами уровня C/D — сигналы, не входящие в 120 без дополнительной независимой проверки. Главные проблемы: (1) WebSearch был исчерпан в середине работы над пакетом (лимит 200 запросов на сессию), из-за чего для CBA и adidas не удалось найти дополнительные независимые источники — для adidas это стало критично, источник остался непроверенным (D/unknown); (2) сайт digital.gov.au недоступен напрямую (таймаут), пришлось использовать архивную копию Wayback Machine через Bash/curl в обход штатного WebFetch — при этом обнаружено, что цифры предыдущей карточки (7600+ сотрудников, 60+ агентств) не совпадали с первичным отчётом (уточнено до 5765 лицензий и >50 агентств) — отмечено как CONFLICT; (3) три государственных пилота Copilot (Австралия, Великобритания-GDS, Великобритания-DBT) методологически различаются по строгости (у DBT — реальная контрольная группа и явный вывод об отсутствии надёжной связи с продуктивностью; у Австралии и GDS — только самоотчётные опросы без контроля), но все три классифицированы как C по единому критерию «оценка организатором пилота без независимого стороннего подтверждения» — для единообразия синтеза; проверяющему стоит рассмотреть точечное повышение DBT с учётом методологии; (4) для Klarna найдено сильное первичное регуляторное подтверждение (SEC 424B4) и независимое подтверждение проблем (Forrester, CX Dive), что подняло уровень до B, но причинная атрибуция сокращения штата именно ИИ остаётся собственным заявлением компании; (5) PDF-отчёт DBT потребовал ручного скачивания и pdftotext (WebFetch не разбирает бинарный PDF) — при повторных проверках учитывать этот способ доступа."
}
