| name | cross-source-verify |
| description | Движок круговой сверки: берёт результаты из НЕСКОЛЬКИХ источников (агрегаторы, госреестры, веб, выгрузки) и сводит в один ответ с дедупликацией, оценкой уверенности (свежесть × авторитет × согласие источников), tier-маркерами и явным показом расхождений. Не выбирает молча одну версию — показывает конфликт. Переиспользуемое ядро под counterparty-guard, competitor-scout, факт-чек, любой скилл с несколькими источниками. Адаптация enterprise-search/knowledge-synthesis под РФ-источники + опыт мульти-агрегаторной проверки. Триггеры: «проверь через несколько источников», «круговая сверка», «насколько достоверно», «сведи данные из источников», «где правда».
|
| metadata | {"author":"тандем, на основе Anthropic enterprise-search + counterparty-guard 15.06.2026","version":"0.2.1"} |
Cross-Source Verify — движок круговой сверки
Последняя миля любой проверки: сырые результаты из N источников → один связный ответ, которому можно доверять, с явной оценкой уверенности и показанными расхождениями.
Один источник звучит уверенно и часто врёт. Агрегатор отдаёт ровную карточку с точными числами — и ты веришь, потому что цифра конкретная. Но конкретная ≠ верная: у соседнего агрегатора по той же компании число другое, а ты этого не видишь, пока не откроешь оба. Этот движок открывает все сразу и сводит — не выбирая молча одну версию, а показывая, где источники согласны (это и есть факт), а где разошлись (это флаг).
Принцип (POV), доказан вживую 15.06.2026. Прогнали одну компанию через 5 агрегаторов: число судов разошлось почти втрое (примерно ~500 / ~1000 / ~1500 — разная методология), при этом выручка и ФССП совпали у всех. Вывод движка: один источник = единая точка отказа и ложная точность. Факт = совпадение у ≥3; расхождение = разброс, а не выбор одной цифры. Совпало → уверенность; разошлось → флаг. (Цифры округлены; проверяйте сами.)
Шкала авторитетности источников (РФ)
| Уровень | Источники | Вес |
|---|
| Highest — первоисточник | Госреестры: ЕГРЮЛ/ЕГРИП ФНС, ГИР БО, kad.arbitr, ФССП, ЕФРСБ/Федресурс, нормативка (НК/ГК/ТК), официальная документация | максимальный |
| High — официальная сводка | Прозрачный бизнес ФНС, реестры ЦБ/Роскомнадзора, рецензируемые статьи, первичная отчётность | высокий |
| Moderate — агрегатор (проверенный) | checko, rusprofile, saby/СБИС, audit-it — собирают из официальных, но добавляют свою методологию/скоринг | средний, кросс-сверять |
| Low-moderate — агрегатор (шумный) | list-org (подмешивает чужие сигналы), отраслевые порталы, экспертные блоги | проверять принадлежность данных |
| Low — неподтверждённое | форумы, отзывы, маркетинг, агрегаторы новостей, соцсети | только как гипотеза |
| Unverified — со слов | данные, которые дал пользователь как истину | помечать «не верифицировано» |
Оценка уверенности = свежесть × авторитет × согласие
Свежесть: у каждого факта — дата источника. Свежее (сегодня/неделя) → высокая уверенность для статусных данных; устаревшее (месяцы) → понизить, пометить «возможно неактуально». Пример из практики: audit-it отдавал 2023, когда другие 2024 — бери самый свежий год.
Авторитет: по таблице выше. Госреестр > агрегатор > форум.
Согласие (главное в круговой сверке):
- Совпало у ≥3 источников → ✅ высокая уверенность, давай прямым утверждением.
- Разошлось (разные цифры/оценки) → ⚠️ покажи разброс и не выдавай одну цифру за факт. Пример: число судов у одной компании — примерно ~500 / ~1000 / ~1500 у разных агрегаторов (разная методология подсчёта) → «по разным источникам от ~500 до ~1500 дел, методики счёта различаются».
- Сигнал только в одном источнике → проверь принадлежность (особенно тревожный: банкротство, суд, долг — у list-org бывают чужие). Не пугай, пока не подтвердил.
Дедупликация
Одна и та же информация часто в нескольких местах. Сливай:
- Сигналы дубля: тот же текст/сущность (ИНН, ОГРН, имя), близкие даты, один источник ссылается на другой.
- Приоритет при слиянии: полнота (самая полная версия) > авторитет (госреестр > агрегатор) > свежесть (последнее обновление).
- НЕ сливать: разные выводы по той же теме, разные точки зрения, эволюция данных (v1 vs v2), разные периоды.
Конфликт — показывать, не прятать
Когда источники расходятся — выводи явно, не выбирай молча:
Расхождение источников по [параметр]:
- [источник A, дата, tier]: значение X
- [источник B, дата, tier]: значение Y
Вероятная причина: [разная методология / устарело / чужие данные].
Наиболее надёжно: [вывод по авторитету+свежести] — но проверьте, если критично.
Атрибуция — каждый факт к источнику
Каждое утверждение → источник + дата + tier-маркер (✅ подтверждено Tier 1-2 / ⚠️ частично / ❌ не подтверждено). В конце — список источников. Никаких чисел без происхождения.
Как работает
[Запрос] → определи тип (факт / статус / сущность / решение)
↓
[Декомпозиция] → какие источники релевантны, что у каждого спросить (параллельно)
↓
[Сбор] → собери из ≥3 источников (агрегаторы/реестры/веб)
↓
[Дедуп] → слей дубли по приоритету полнота>авторитет>свежесть
↓
[Уверенность] → свежесть × авторитет × согласие на каждый факт
↓
[Синтез] → связный ответ, ведёт вывод (не методология), конфликты явно, атрибуция + tier
Anti-patterns
- НЕ перечисляй по источникам («у checko… у list-org…») — сведи в нарратив по фактам.
- НЕ выдавай одну цифру, когда источники расходятся — покажи разброс.
- НЕ давай одиночному сигналу тот же вес, что подтверждённому ≥3.
- НЕ прячь конфликт. НЕ опускай атрибуцию. НЕ пугай непроверенным сигналом.
Формат вывода
Единый формат killer-карточки (общий для counterparty-guard / tax-calendar-proactive / cross-source-verify): шапка {эмодзи} {что} — на {дата} → вердикт (✅ согласовано / ⚠️ расхождение) → факты по существу → футер Что проверено: (источник + дата + tier) и Что НЕ проверено:. Один узнаваемый вид во всех стеках (markdown, без host-specific вёрстки).
Пример (иллюстративный)
Запрос: «Сколько судов у этого контрагента?» Собрано из 4 агрегаторов.
Плохо (одиночный источник): «~1500 судебных дел» — берём самый высокий счётчик, звучит точно. На деле он подмешал чужие эпизоды, а методология у всех разная.
Хорошо (круговая сверка):
🔎 Сверка: контрагент {ИНН} — на 15.06.2026
⚠️ Расхождение по числу судов — единой цифре верить нельзя.
Суды: по разным источникам от ~500 до ~1500 дел — методики подсчёта различаются
(примерно ~500 / ~1000 / ~1500 у трёх агрегаторов). Надёжнее ориентироваться
на нижнюю-среднюю оценку; точное число — в kad.arbitr.
ФССП: совпало у всех источников — ✅ высокая уверенность.
Выручка: совпала у всех — ✅ Tier 1 (ГИР БО).
Что проверено: 4 агрегатора + ГИР БО (15.06.2026); ФССП/выручка — ✅ совпали ≥3.
Что НЕ проверено: точное число судов — только kad.arbitr вручную.
Разница: вместо ложно-точной цифры — честный разброс там, где источники спорят, и твёрдое утверждение там, где совпали.
Кто использует движок
- counterparty-guard — 5 агрегаторов по контрагенту (основной потребитель, отсюда родился).
- competitor-scout — сбор по конкурентам из разных площадок.
- факт-чек любого скилла — числа/цитаты с tier (по умолчанию из CLAUDE.md).
- Любой скилл, где >1 источника сводится в ответ.
Основа — Anthropic enterprise-search/knowledge-synthesis, адаптировано под РФ-источники и tier-протокол тандема.
Changelog
- 0.2.1 (16.06.2026) — единый формат killer-карточки (шапка с датой → вердикт согласовано/расхождение → факты → футер Что проверено/НЕ проверено), общий с counterparty-guard и tax-calendar-proactive; пример обёрнут в карточку.
- 0.2 (15.06.2026) — упаковка: hero про ложную точность одиночного источника, POV-пруф вынесен наверх (живой тест 5 агрегаторов), worked-пример «плохо/хорошо».
- 0.1 — движок круговой сверки: шкала авторитетности РФ, уверенность = свежесть × авторитет × согласие, дедуп, явный показ конфликтов, атрибуция с tier.