{
 "packet_id": "W8-FIELD-WORK",
 "verifier": "claude-opus subagent",
 "finished_at": "2026-09-23T09:20:00Z",
 "entities": [
  {
   "entity_id": "W8-FIELD-WORK-01",
   "checked": true,
   "verdict": "downgrade",
   "evidence_level": "B",
   "outcome": "success",
   "counted_in_120": true,
   "issues_ru": [
    "Конфликт интересов не отражён автором: двое из шести соавторов (Sonia Jaffe, Sida Peng) — сотрудники Microsoft (сноска на с. 1: «Jaffe: Microsoft… Peng: Microsoft»); Microsoft владеет GitHub, то есть поставщиком Copilot, и здесь изучается внутреннее внедрение собственного продукта. Автор называет аффилиацию «Microsoft Research» как часть «независимых исследователей» — это неверно.",
    "РКИ пост-регистрирован (AEARCTR-0014530, «post-registered»), а не предрегистрирован; эксперимент проводила сама компания для бизнес-решения («ad-hoc»), исследователи получили данные позже.",
    "Отдельного независимого подтверждения исхода другого происхождения нет. С учётом вендорского конфликта и пост-регистрации уровень снижен с A до B. Решение принимать как B допустимо: основную часть анализа ведут независимые учёные (Princeton, MIT, Wharton), статья прошла рецензирование.",
    "Публикация подтверждена: Management Science, DOI 10.1287/mnsc.2025.00535, 27.02.2026 (Crossref). Автор не указал DOI журнала.",
    "Цифры Table 3 и Table 4 совпадают: PR W-IV 27,38** (SE 12,88), коммиты 18,32 (11,25), сборки 23,19 (14,20), доля успешных сборок −1,34 (4,23), одобрение PR 9,88*** (3,28). Пересчёт 95% ДИ для PR: 27,38 ± 1,96×12,88 ≈ [+2,1%; +52,6%] — эффект значим, но интервал широк, нижняя граница близка к нулю. Коммиты и сборки незначимы.",
    "Исход success допустим только по основному показателю (PR) при отсутствии признаков ухудшения качества; формулировать осторожно («значимый рост PR с широким ДИ; остальные показатели незначимы»).",
    "Период эксперимента — сентябрь 2022 – апрель 2023, начат до ChatGPT; окно задания 2023–2026 выполнено лишь частично — отметить в карточке.",
    "Цитаты проверены по PDF: «Overall, we do not find any evidence…» и «short-tenure developers increase their output by 27% to 39%…» — дословно. Цитата из Table 3 оформлена как сводка таблицы, а не как текст; числа верны.",
    "Вопрос о трёх случаях из одной статьи: Microsoft и Accenture можно считать раздельно — это разные организации с раздельной рандомизацией, данными и исходами. Но это одно происхождение доказательств (одна исследовательская группа и одна статья), поэтому взаимным подтверждением или репликацией они не являются. В сводке 120 нужен флаг «общий источник».",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия."
   ],
   "added_evidence": [
    {
     "url": "https://api.crossref.org/works?query.bibliographic=Effects+of+Generative+AI+on+High-Skilled+Work+Three+Field+Experiments+Software+Developers&rows=5",
     "publisher": "Crossref (метаданные INFORMS)",
     "published": "2026-02-27",
     "origin": "academic",
     "quote_original": "10.1287/mnsc.2025.00535 ['Management Science'] ['The Effects of Generative AI on High-Skilled Work: Evidence from Three Field Experiments with Software Developers']",
     "quote_ru": "Статья опубликована в Management Science, DOI 10.1287/mnsc.2025.00535."
    },
    {
     "url": "https://mertdemirer.com/Papers/Demirer_AI_productivity.pdf",
     "publisher": "Cui et al., рабочая версия, июнь 2025",
     "published": "2025-06",
     "origin": "academic",
     "quote_original": "Jaffe: Microsoft. Musolff: The Wharton School of the University of Pennsylvania. Peng: Microsoft. Salz: MIT. This RCT was post-registered as AEARCTR-0014530 (Peng 2024).",
     "quote_ru": "Джаффе и Пэн — сотрудники Microsoft; РКИ зарегистрирован постфактум (AEARCTR-0014530)."
    }
   ],
   "sources_opened": [
    "https://mertdemirer.com/Papers/Demirer_AI_productivity.pdf",
    "https://mertdemirer.com",
    "https://api.crossref.org/works?query.bibliographic=Effects+of+Generative+AI+on+High-Skilled+Work+Three+Field+Experiments+Software+Developers&rows=5"
   ]
  },
  {
   "entity_id": "W8-FIELD-WORK-02",
   "checked": true,
   "verdict": "downgrade",
   "evidence_level": "B",
   "outcome": "mixed",
   "counted_in_120": true,
   "issues_ru": [
    "Источник тот же, что у -01: действует тот же конфликт интересов (два соавтора из Microsoft, продукт Microsoft/GitHub) и пост-регистрация. Уровень снижен до B для согласованности. Вендорский уклон здесь менее вероятен: результат по качеству неблагоприятен для поставщика.",
    "Числа Table 3 совпадают: сборки W-IV 92,40*** (26,78), доля успешных сборок −17,40** (7,12), PR 17,94 (18,72), коммиты −4,48 (21,88). 95% ДИ: сборки ≈ [+39,9%; +144,9%], доля успешных сборок ≈ [−31,4%; −3,4%], PR ≈ [−18,8%; +54,6%].",
    "Ошибка в claim_ru: «упала на 17,40 процентных пункта в относительном выражении». По таблице это −17,40% от контрольного среднего, а не процентные пункты.",
    "Исход mixed обоснован, но нужна оговорка: основной показатель продуктивности (PR) незначим. Значимы только рост числа сборок (авторы допускают, что это «проб и ошибки», а не выработка) и падение доли успешных сборок. Это скорее «нет доказанного роста выработки + признак ухудшения качества», чем «рост выработки при снижении качества». Метку label_ru стоит поправить.",
    "Цитаты проверены: «trial-and-error… (weakly) support…» и «abandoned due to a large layoff affecting 42%… −39.18% (SE: 36.78%)» — дословно с сокращениями; начало цитаты «developers may engage in more» разорвано сноской в PDF, текст верен.",
    "Период июль – декабрь 2023 внутри окна. Это реальное внедрение Copilot в работу разработчиков офисов Accenture в ЮВА (с обучением менеджеров и подталкиванием), а не лабораторная задача: критерий (1) выполнен.",
    "Раздельный зачёт с Microsoft допустим (другая организация, другая рандомизация), но с флагом общего источника.",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия."
   ],
   "added_evidence": [],
   "sources_opened": [
    "https://mertdemirer.com/Papers/Demirer_AI_productivity.pdf",
    "https://api.crossref.org/works?query.bibliographic=Effects+of+Generative+AI+on+High-Skilled+Work+Three+Field+Experiments+Software+Developers&rows=5"
   ]
  },
  {
   "entity_id": "W8-FIELD-WORK-03",
   "checked": true,
   "verdict": "downgrade",
   "evidence_level": "B",
   "outcome": "unknown",
   "counted_in_120": false,
   "issues_ru": [
    "Уровень A → B по той же причине, что у -01 и -02 (общий источник, соавторы из Microsoft, пост-регистрация). Исход unknown подтверждён: PR W-IV 54,03 (SE 42,63) без звёздочек; 95% ДИ ≈ [−29,5%; +137,6%]. Других метрик нет: «We do not present other outcome measures in Panel C because we do not have access to these data».",
    "Неточность цитаты: в PDF «these data», у автора «this data» — не дословно.",
    "Незачёт в 120 подтверждён.",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия."
   ],
   "added_evidence": [],
   "sources_opened": [
    "https://mertdemirer.com/Papers/Demirer_AI_productivity.pdf"
   ]
  },
  {
   "entity_id": "W8-FIELD-WORK-04",
   "checked": true,
   "verdict": "reject_counting",
   "evidence_level": "B",
   "outcome": "success",
   "counted_in_120": false,
   "issues_ru": [
    "ДУБЛИКАТ: это тот же случай, что известный кандидат CAND-a5840cf57971555b («Не названа на прочитанной странице (компания с поддержкой клиентов) — Клиентская поддержка в чате», US-CASE-03, primary_url nber.org/papers/w31161) в integration-v06/case-entities.json. По заданию W8 дубли известных кандидатов не допускаются. Материал проверки нужно перенести в карточку существующего кандидата, а не заводить новый случай.",
    "Вне окна 2023–2026: основное внедрение — ноябрь 2020 – февраль 2021; небольшой РКИ — август – сентябрь 2020 (PDF). Инструмент основан на GPT до ChatGPT.",
    "Фактическая ошибка в outcome_basis_ru: «рост удовлетворённости клиентов (NPS)». В статье: «Column 4 finds no economically significant change in customer satisfaction, as measured by net promoter scores: the coefficient is -0.13 percentage points». Рост отмечен по тональности клиентов (customer sentiment), не по NPS.",
    "Независимость: данные получены через поставщика ИИ-инструмента («We work with a company that provides AI-based customer service support software (hereafter, the “AI firm”)»). NBER раскрывает, что «at least one co-author has disclosed additional relationships». Основной дизайн — ступенчатый DiD, а не РКИ: результаты РКИ на 50 операторах отдельно не анализируются. С учётом этого — B, а не A. Публикация в QJE подтверждена: 140(2), DOI 10.1093/qje/qjae044.",
    "Цитаты «Our data firm is a Fortune 500…», «Most agents in our sample, 89%…», «increases RPH by 0.30 chats or 13.8%», «by 14% on average, including a 34% improvement…» — дословно. Пересчёт 0,30/2,12 ≈ 14,2% — согласуется.",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия."
   ],
   "added_evidence": [
    {
     "url": "https://www.nber.org/system/files/working_papers/w31161/w31161.pdf",
     "publisher": "NBER Working Paper 31161",
     "published": "2023-04 (ред. 2023-11)",
     "origin": "academic",
     "quote_original": "Finally, Column 4 finds no economically significant change in customer satisfaction, as measured by net promoter scores: the coefficient is -0.13 percentage points and the mean is 79.6%.",
     "quote_ru": "Столбец 4 не показывает экономически значимого изменения удовлетворённости клиентов по NPS: коэффициент −0,13 п.п. при среднем 79,6%."
    },
    {
     "url": "https://api.crossref.org/works?query.bibliographic=Generative+AI+at+Work+Brynjolfsson+Li+Raymond&rows=3",
     "publisher": "Crossref",
     "published": "2025-02-04",
     "origin": "academic",
     "quote_original": "10.1093/qje/qjae044 ['The Quarterly Journal of Economics'] 140 2",
     "quote_ru": "Публикация в QJE, т. 140, вып. 2."
    }
   ],
   "sources_opened": [
    "https://www.nber.org/system/files/working_papers/w31161/w31161.pdf",
    "https://api.crossref.org/works?query.bibliographic=Generative+AI+at+Work+Brynjolfsson+Li+Raymond&rows=3"
   ]
  },
  {
   "entity_id": "W8-FIELD-WORK-05",
   "checked": true,
   "verdict": "reject_counting",
   "evidence_level": "B",
   "outcome": "mixed",
   "counted_in_120": false,
   "issues_ru": [
    "Критерий (1) не выполнен: исход измерен на специально сконструированных экспериментальных задачах («we have developed realistic management consulting tasks»), а не на изменении реальной работы BCG. Это эксперимент с сотрудниками организации, а не случай изменения её работы с ИИ.",
    "Конфликт интересов: в числе соавторов сотрудники BCG (Candelon, Krayer, Rajendran «ran the experiment on the BCG side»). Финансирование — HBS Digital Data Design Institute. Независимого подтверждения другого происхождения нет. Уровень A не заслужен — B.",
    "Автор не открыл саму статью: цифры взяты из блога соавтора. Публикация и аннотация подтверждены через Crossref: Organization Science, DOI 10.1287/orsc.2025.21838, март 2026, эксперимент предрегистрирован, 758 участников. В аннотации журнала результат вне «границы» сформулирован как «19% less likely to produce correct solutions»; блоговые «84% против 60–70%» — упрощение соавтора, и в карточке должна быть цифра статьи.",
    "Цитаты блога проверены — дословны; «…produced 40% higher quality results…» есть на странице.",
    "Исход mixed по задачам эксперимента корректен, но относится к задачам, а не к работе фирмы.",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия."
   ],
   "added_evidence": [
    {
     "url": "https://api.crossref.org/works/10.1287/orsc.2025.21838",
     "publisher": "Crossref (аннотация INFORMS, Organization Science)",
     "published": "2026-03",
     "origin": "academic",
     "quote_original": "In collaboration with the global management consulting firm Boston Consulting Group, we have developed realistic management consulting tasks... The preregistered experiment involved 758 knowledge workers... for a complex managerial task selected to be outside the frontier, subjects using AI were 19% less likely to produce correct solutions compared with those without AI",
     "quote_ru": "Совместно с BCG разработаны реалистичные консалтинговые задачи… предрегистрированный эксперимент с 758 участниками… на задаче за пределами границы участники с ИИ на 19% реже давали верное решение."
    }
   ],
   "sources_opened": [
    "https://www.oneusefulthing.org/p/centaurs-and-cyborgs-on-the-jagged",
    "https://api.crossref.org/works/10.1287/orsc.2025.21838",
    "https://api.openalex.org/works/https://doi.org/10.1287/orsc.2025.21838"
   ]
  },
  {
   "entity_id": "W8-FIELD-WORK-06",
   "checked": true,
   "verdict": "reject_counting",
   "evidence_level": "B",
   "outcome": "failure",
   "counted_in_120": false,
   "issues_ru": [
    "Критерий (1) не выполнен: это не изменение работы организации. 16 мейнтейнеров открытых проектов оплачивались METR как участники исследования (в обновлении METR указано, что оплата снижена с $150/ч до $50/ч во втором исследовании), рандомизация — по задачам. Незачёт в 120 подтверждаю.",
    "ЦИТАТА НЕ ДОСЛОВНА И СОДЕРЖИТ ОШИБКУ: приписанный arXiv текст «contrary to developers' predictions of a 20% reduction and expert forecasts suggesting 38-39% improvements» на странице отсутствует. В аннотации: прогноз разработчиков до начала — 24%, оценка после — 20%, эксперты — 39% (экономисты) и 38% (ML). Цитата блога «16 experienced contributors; 246 total issues…» тоже не дословна (это пересказ).",
    "Доверительный интервал не указан автором. По METR (24.02.2026): «19% longer, with a confidence interval between +2% and +39%» — нижняя граница близка к нулю.",
    "Позднее событие, пропущенное автором: 24.02.2026 METR опубликовал обновление. На подвыборке тех же разработчиков новая оценка — ускорение (−18%, ДИ от −38% до +9%), у новых участников — −4% (ДИ от −15% до +9%). METR считает новые данные ненадёжными из-за отбора и полагает, что к началу 2026 года разработчики, вероятно, ускорились. Исход failure относится только к инструментам февраля – июня 2025 и не является устойчивым.",
    "Уровень B для самого измерения приемлем (прозрачный РКИ, независимая некоммерческая организация, без рецензирования).",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия. Обновление METR от 24.02.2026 найдено по ссылке на странице исходного блога."
   ],
   "added_evidence": [
    {
     "url": "https://metr.org/blog/2026-02-24-uplift-update/",
     "publisher": "METR",
     "published": "2026-02-24",
     "origin": "independent",
     "quote_original": "Our early 2025 study found the use of AI causes tasks to take 19% longer, with a confidence interval between +2% and +39%. For the subset of the original developers who participated in the later study, we now estimate a speedup of -18% with a confidence interval between -38% and +9%.",
     "quote_ru": "Исследование начала 2025 года показало, что с ИИ задачи занимают на 19% дольше (ДИ от +2% до +39%). Для подвыборки тех же разработчиков во втором исследовании оценка теперь — ускорение −18% (ДИ от −38% до +9%)."
    },
    {
     "url": "https://arxiv.org/abs/2507.09089",
     "publisher": "arXiv (METR)",
     "published": "2025-07-12 (v2 2025-07-25)",
     "origin": "independent",
     "quote_original": "Before starting tasks, developers forecast that allowing AI will reduce completion time by 24%. After completing the study, developers estimate that allowing AI reduced completion time by 20%. Surprisingly, we find that allowing AI actually increases completion time by 19%--AI tooling slowed developers down.",
     "quote_ru": "До начала разработчики прогнозировали сокращение времени на 24%, после исследования оценили его в 20%; фактически время выросло на 19%."
    }
   ],
   "sources_opened": [
    "https://export.arxiv.org/abs/2507.09089",
    "https://metr.org/blog/2025-07-10-early-2025-ai-experienced-os-dev-study/",
    "https://metr.org/blog/2026-02-24-uplift-update/"
   ]
  },
  {
   "entity_id": "W8-FIELD-WORK-07",
   "checked": true,
   "verdict": "confirm",
   "evidence_level": "C",
   "outcome": "mixed",
   "counted_in_120": false,
   "issues_ru": [
    "Первая цитата не дословна: в аннотации Crossref нет фразы «This preregistered randomized field experiment examined…»; там сказано «We study how access to a firm-specific LLM influences auditor performance using a preregistered randomized field experiment with 100 professional auditors at a global audit firm». Вторая цитата склеена: фрагмент «auditors using LLM tools produced more formally correct documentation but showed no improvement…» не дословен; в оригинале — «Auditors with LLM access produce more formally correct documentation… In contrast, LLM access does not improve adherence to internal audit guidelines».",
    "Критерий (1) слабый: аудиторы выполняли одну экспериментальную задачу («completed a complex inventory valuation task»), это не изменение аудиторской работы фирмы. Даже с полным текстом в 120 не пойдёт без данных о реальном внедрении.",
    "Полный текст SSRN недоступен (HTTP 403, проверено повторно). Уровень C и незачёт подтверждаю.",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия."
   ],
   "added_evidence": [
    {
     "url": "https://api.crossref.org/works/10.2139/ssrn.6095166",
     "publisher": "Crossref (SSRN)",
     "published": "2026",
     "origin": "academic",
     "quote_original": "We study how access to a firm-specific LLM influences auditor performance using a preregistered randomized field experiment with 100 professional auditors at a global audit firm. Auditors completed a complex inventory valuation task either using the traditional digital tool set or with additional LLM support.",
     "quote_ru": "Изучаем влияние фирменной LLM на работу 100 аудиторов глобальной аудиторской фирмы в предрегистрированном полевом эксперименте; аудиторы выполняли сложную задачу оценки запасов с обычными инструментами или с LLM."
    }
   ],
   "sources_opened": [
    "https://api.crossref.org/works/10.2139/ssrn.6095166",
    "https://api.openalex.org/works/https://doi.org/10.2139/ssrn.6095166"
   ]
  },
  {
   "entity_id": "W8-FIELD-WORK-08",
   "checked": true,
   "verdict": "reject_counting",
   "evidence_level": "B",
   "outcome": "mixed",
   "counted_in_120": false,
   "issues_ru": [
    "Полный текст доступен в открытом доступе (CC BY-NC-ND) через репозиторий Уппсалы: https://uu.diva-portal.org/smash/get/diva2:1991857/FULLTEXT01. Автор его не нашёл; ссылка есть в OpenAlex.",
    "Критическая ошибка периода: эксперимент шёл с Q1/2012 по Q2/2017, ИИ-система продаж внедрена в Q2/2014 в четырёх северных дочерних компаниях (Дания, Финляндия, Норвегия, Швеция). Автор предположил «вероятно 2022». Случай вне окна 2023–2026, а инструмент — не генеративный ИИ.",
    "Масштаб: 72 торговых эксперта в 12 бизнес-единицах (единица рандомизации). Авторы указывают низкую мощность (37% и 61%) и прямо пишут: «we caution against causal interpretations due to power constraints».",
    "Уровень повышен с C до B: рецензируемая статья, полный текст прочитан, финансирование от фондов, без вендора. Исход mixed подтверждён: адаптированное взаимодействие улучшает продажи, неадаптированное хуже и адаптированного, и контроля. Но из-за периода и оговорки авторов о причинности в 120 не засчитывается.",
    "Вторая часть первой цитаты («…company that implemented an AI… based on focal sales expert cognitive style») в аннотации Crossref отсутствует — вероятно, фрагмент выдачи Google Scholar; дословность не подтверждена. Фраза «tailored interaction significantly improves sales performance, whereas untailored interaction results in negative treatment effects» дословна.",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия."
   ],
   "added_evidence": [
    {
     "url": "https://uu.diva-portal.org/smash/get/diva2:1991857/FULLTEXT01",
     "publisher": "Management Science (авторская OA-копия, Uppsala DiVA)",
     "published": "2025-06-09 (Articles in Advance)",
     "origin": "academic",
     "quote_original": "The field experiment included 72 sales experts across 12 business units, which served as the unit of randomization, and ran from Q1/2012 to Q2/2017... The AI system was implemented in Q2/2014",
     "quote_ru": "Эксперимент охватил 72 торговых эксперта в 12 бизнес-единицах и шёл с Q1/2012 по Q2/2017; ИИ-система внедрена в Q2/2014."
    },
    {
     "url": "https://uu.diva-portal.org/smash/get/diva2:1991857/FULLTEXT01",
     "publisher": "Management Science (авторская OA-копия)",
     "published": "2025-06-09",
     "origin": "academic",
     "quote_original": "However, we caution against causal interpretations due to power constraints.",
     "quote_ru": "Однако из-за ограниченной статистической мощности мы предостерегаем от причинной интерпретации."
    }
   ],
   "sources_opened": [
    "https://api.crossref.org/works/10.1287/mnsc.2022.03849",
    "https://api.openalex.org/works/https://doi.org/10.1287/mnsc.2022.03849",
    "https://uu.diva-portal.org/smash/get/diva2:1991857/FULLTEXT01"
   ]
  },
  {
   "entity_id": "W8-FIELD-WORK-09",
   "checked": true,
   "verdict": "needs_rework",
   "evidence_level": "C",
   "outcome": "mixed",
   "counted_in_120": false,
   "issues_ru": [
    "Цитаты не дословны: фраз «AI-assisted agents demonstrated faster response times compared to controls; Customer sentiment showed greater improvement…» и «particularly strong for subscription cancellations…» нет в аннотации издателя (Crossref). Там: «AI-assisted agents responded faster, engaged customers more deeply, and achieved greater improvements in customer sentiment. The benefits were most pronounced for less-experienced agents… if customers who had experienced chatbot comprehension failures were then connected to AI-assisted human agents, the involvement of AI negatively affected customer sentiment». Цитаты надо заменить дословными из аннотации издателя, а источником указать Crossref или INFORMS, а не выдачу Google Scholar.",
    "Критерий (1) выполнен: реальные чаты клиентов компании доставки еды, рандомизированный доступ операторов к подсказкам ИИ. Исход mixed по аннотации обоснован.",
    "Период не установлен. DOI с кодом 2022 указывает на подачу рукописи в 2022 году, значит эксперимент, вероятно, до 2022 года и вне окна 2023–2026 (при неясном типе ИИ). Полный текст закрыт (OpenAlex: closed; SSRN 5173181 — HTTP 403). Без периода и величин эффекта — C, в 120 не засчитывается.",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия."
   ],
   "added_evidence": [
    {
     "url": "https://api.crossref.org/works/10.1287/mnsc.2022.03920",
     "publisher": "Crossref (аннотация INFORMS, Management Science)",
     "published": "2026-01",
     "origin": "academic",
     "quote_original": "We found that if customers who had experienced chatbot comprehension failures were then connected to AI-assisted human agents, the involvement of AI negatively affected customer sentiment.",
     "quote_ru": "Если клиенты, столкнувшиеся с непониманием со стороны чат-бота, затем попадали к оператору с ИИ-подсказками, участие ИИ ухудшало их настроение."
    }
   ],
   "sources_opened": [
    "https://api.crossref.org/works/10.1287/mnsc.2022.03920",
    "https://api.openalex.org/works/https://doi.org/10.1287/mnsc.2022.03920",
    "https://papers.ssrn.com/sol3/papers.cfm?abstract_id=5173181 (HTTP 403)"
   ]
  },
  {
   "entity_id": "W8-FIELD-WORK-10",
   "checked": true,
   "verdict": "reject_counting",
   "evidence_level": "C",
   "outcome": "mixed",
   "counted_in_120": false,
   "issues_ru": [
    "Критерий (1) не выполнен: основные исходы измерены на экспериментальных эталонных задачах («benchmark patent drafting tasks») и на одной итоговой задаче редлайнинга, за которые участникам платили по их почасовой ставке («paid at their contractual hourly rate for the time spent on experimental tasks»). Работу 11 фирм не меняли; данные о реальной работе — самоотчёт 68 участников, по словам авторов «exploratory». Это эксперимент на сотрудниках, а не случай изменения работы организаций.",
    "Конфликт интересов недооценён: не пять, а шесть из семи соавторов — сотрудники Google (Rodchenko, Martin, Iscenko, Strand, Pearl, Ferere). Инструмент — «InFlow, an unreleased product developed by Google Labs», прямые расходы оплатил Google, Autor получает поддержку Google Technology and Society Visiting Fellows Program. Вендор изучает свой неизданный продукт. Дополнительная оценка работ выполнялась моделью Gemini. Рецензирования нет. Без независимого подтверждения — C, а не B.",
    "Цитаты аннотации проверены — дословны (0,34 SD, p = 0,03; 0,38 SD, p = 0,01; 0,32 SD, p = 0,04; 0,45 SD, p = 0,02). Исход mixed по задачам эксперимента корректен.",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия."
   ],
   "added_evidence": [
    {
     "url": "https://www.nber.org/system/files/working_papers/w35720/w35720.pdf",
     "publisher": "NBER Working Paper 35720",
     "published": "2026-09",
     "origin": "academic",
     "quote_original": "Subjects in the treatment group were provided access via a gated online platform to InFlow, an unreleased product developed by Google Labs.",
     "quote_ru": "Экспериментальная группа получила доступ к InFlow — неизданному продукту Google Labs."
    },
    {
     "url": "https://www.nber.org/system/files/working_papers/w35720/w35720.pdf",
     "publisher": "NBER Working Paper 35720",
     "published": "2026-09",
     "origin": "academic",
     "quote_original": "participants were, with the consent of their employers, paid at their contractual hourly rate for the time spent on experimental tasks.",
     "quote_ru": "С согласия работодателей участникам платили по их почасовой ставке за время на экспериментальных задачах."
    }
   ],
   "sources_opened": [
    "https://www.nber.org/system/files/working_papers/w35720/w35720.pdf"
   ]
  },
  {
   "entity_id": "W8-FIELD-WORK-11",
   "checked": true,
   "verdict": "confirm",
   "evidence_level": "C",
   "outcome": "mixed",
   "counted_in_120": false,
   "issues_ru": [
    "Ошибка в именах авторов: в Crossref — Jung Ho Choi и Chloe L. Xie, а не «Jonathan H. Choi, C. Xie». Журнал подтверждён: Journal of Accounting Research, DOI 10.1111/1475-679x.70052, 16.04.2026.",
    "Первая цитата не дословна. В оригинале: «Using survey data from 277 professional accountants… Using proprietary field data from an AI‐enabled accounting platform serving 79 small‐ and medium‐sized enterprises, we analyze over 200,000 transaction‐level records». Вторая цитата — склейка дословных фрагментов, допустимо.",
    "Дизайн: основные результаты — корреляционные («is associated with») на данных платформы-вендора; риск ошибок показан во «framed field experiment», то есть в лабораторных условиях. Причинность по организации не установлена, 79 предприятий анонимны. C и незачёт подтверждаю.",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия."
   ],
   "added_evidence": [],
   "sources_opened": [
    "https://api.crossref.org/works/10.1111/1475-679x.70052",
    "https://api.openalex.org/works/https://doi.org/10.1111/1475-679x.70052"
   ]
  },
  {
   "entity_id": "W8-FIELD-WORK-12",
   "checked": true,
   "verdict": "reject_counting",
   "evidence_level": "C",
   "outcome": "mixed",
   "counted_in_120": false,
   "issues_ru": [
    "ДУБЛИКАТ: известный кандидат CAND-b6d0a90d8475645a («Организация не раскрыта — Коллаборация и обмен знаниями в командах поддержки и продаж», SCI-WORK-CASE-003, INSEAD working paper, 316 сотрудников, 42 команды, 3 месяца). Среди авторов SSRN 6028034 есть Phanish Puranam (INSEAD), которого автор пропустил. По заданию W8 новый случай заводить нельзя.",
    "Цитаты не дословны: в аннотации «316 employees at a European technology services firm, randomly assigning members of 42 teams…». Производительность измерена как «number of projects executed during the time window»; слова «продавцы» в аннотации нет.",
    "Исход mixed спорен: оба показателя положительные, различается только их распределение по ролям. Правильнее «success по сетевым показателям, неоднородный по ролям» или unknown до чтения полного текста.",
    "Поиск поздних событий (откат, опровержение, повторные публикации) через WebSearch не выполнен: лимит поиска исчерпан; открыты только известные URL и API Crossref/OpenAlex (23.09.2026). Отсутствие найденных опровержений не доказывает их отсутствия."
   ],
   "added_evidence": [
    {
     "url": "https://api.crossref.org/works/10.2139/ssrn.6028034",
     "publisher": "Crossref (SSRN)",
     "published": "2026",
     "origin": "academic",
     "quote_original": "They test these ideas in a randomized field experiment with 316 employees at a European technology services firm, randomly assigning members of 42 teams to either use a GenAI assistant customized with organization-specific knowledge (treatment) or work as usual without it (control).",
     "quote_ru": "Идеи проверены в рандомизированном полевом эксперименте с 316 сотрудниками европейской фирмы технологических услуг; участники 42 команд получали GenAI-ассистента с корпоративными знаниями или работали как обычно."
    }
   ],
   "sources_opened": [
    "https://api.crossref.org/works/10.2139/ssrn.6028034",
    "https://www.insead.edu/faculty-research/publications/working-papers/impact-generative-ai-adoption-organizational-networks (антибот-заглушка, не прочитано)"
   ]
  }
 ],
 "unchecked_entity_ids": [],
 "packet_notes_ru": "Системные ошибки автора. (1) Не учтены конфликты интересов: у Cui et al. двое соавторов из Microsoft при изучении продукта Microsoft/GitHub и пост-регистрация; у Autor et al. шесть из семи соавторов из Google, инструмент — неизданный продукт Google Labs; у BCG соавторы из BCG. Поэтому уровень A не присвоен ни одному случаю. (2) Критерий «изменение работы организации» смешан с экспериментами на сотрудниках, где исход измерен на сконструированных задачах (BCG, патентные фирмы, аудиторы, METR). Их нельзя засчитывать как случаи изменения работы. (3) Два дубликата известных кандидатов: 04 = CAND-a5840cf57971555b, 12 = CAND-b6d0a90d8475645a. (4) Окно 2023–2026 не проверялось: 04 — 2020–2021; 08 — 2012–2017 (не GenAI); 09 — вероятно, до 2022; 01 — 2022–2023. (5) Часть quote_original — пересказы, а не дословные цитаты (06 с фактической ошибкой 24%/20%, 07, 08, 09, 11, 12); у 04 ошибка про рост NPS. (6) Не найдены доступные первоисточники: OA-копия Krakowski et al. в DiVA и аннотации издателей в Crossref. (7) Пропущено позднее событие: обновление METR от 24.02.2026. Итог проверяющего: в 120 подтверждаются 2 случая — 01 Microsoft (B, success) и 02 Accenture (B, mixed). Оба из одной статьи: организации разные, происхождение доказательств одно; в сводке нужен флаг общего источника, и считать их взаимным подтверждением нельзя. Ограничение проверки: WebSearch исчерпан, поиск поздних событий (откаты, опровержения, иски) по всем сущностям не выполнялся; открывались только известные URL, PDF и API Crossref/OpenAlex."
}