cross-source-verify
Движок круговой сверки: берёт результаты из НЕСКОЛЬКИХ источников (агрегаторы, госреестры, веб, выгрузки) и сводит в один ответ с дедупликацией, оценкой уверенности (свежесть × авторитет × согласие источников), tier-маркерами и явным показом расхождений. Не выбирает молча одну ве
Install
npx skills add https://github.com/ilyautov/small-business-ru/tree/main/small-business-ru/skills/cross-source-verify
claude plugin marketplace add https://llmmart.ai/marketplace.json && claude plugin install ilyautov-small-business-ru@llmmart
git clone https://github.com/ilyautov/small-business-ru.git
The skills CLI installs just this skill, for any of its supported agents. Claude Code installs the whole ilyautov/small-business-ru collection as a plugin from our marketplace. Git is the plain clone.
Skill manifest
Cross-Source Verify — движок круговой сверки
Последняя миля любой проверки: сырые результаты из N источников → один связный ответ, которому можно доверять, с явной оценкой уверенности и показанными расхождениями.
Один источник звучит уверенно и часто врёт. Агрегатор отдаёт ровную карточку с точными числами — и ты веришь, потому что цифра конкретная. Но конкретная ≠ верная: у соседнего агрегатора по той же компании число другое, а ты этого не видишь, пока не откроешь оба. Этот движок открывает все сразу и сводит — не выбирая молча одну версию, а показывая, где источники согласны (это и есть факт), а где разошлись (это флаг).
Принцип (POV), доказан вживую 15.06.2026. Прогнали одну компанию через 5 агрегаторов: число судов разошлось почти втрое (примерно ~500 / ~1000 / ~1500 — разная методология), при этом выручка и ФССП совпали у всех. Вывод движка: один источник = единая точка отказа и ложная точность. Факт = совпадение у ≥3; расхождение = разброс, а не выбор одной цифры. Совпало → уверенность; разошлось → флаг. (Цифры округлены; проверяйте сами.)
Шкала авторитетности источников (РФ)
| Уровень | Источники | Вес |
|---|---|---|
| Highest — первоисточник | Госреестры: ЕГРЮЛ/ЕГРИП ФНС, ГИР БО, kad.arbitr, ФССП, ЕФРСБ/Федресурс, нормативка (НК/ГК/ТК), официальная документация | максимальный |
| High — официальная сводка | Прозрачный бизнес ФНС, реестры ЦБ/Роскомнадзора, рецензируемые статьи, первичная отчётность | высокий |
| Moderate — агрегатор (проверенный) | checko, rusprofile, saby/СБИС, audit-it — собирают из официальных, но добавляют свою методологию/скоринг | средний, кросс-сверять |
| Low-moderate — агрегатор (шумный) | list-org (подмешивает чужие сигналы), отраслевые порталы, экспертные блоги | проверять принадлежность данных |
| Low — неподтверждённое | форумы, отзывы, маркетинг, агрегаторы новостей, соцсети | только как гипотеза |
| Unverified — со слов | данные, которые дал пользователь как истину | помечать «не верифицировано» |
Оценка уверенности = свежесть × авторитет × согласие
Свежесть: у каждого факта — дата источника. Свежее (сегодня/неделя) → высокая уверенность для статусных данных; устаревшее (месяцы) → понизить, пометить «возможно неактуально». Пример из практики: audit-it отдавал 2023, когда другие 2024 — бери самый свежий год.
Авторитет: по таблице выше. Госреестр > агрегатор > форум.
Согласие (главное в круговой сверке):
- Совпало у ≥3 источников → ✅ высокая уверенность, давай прямым утверждением.
- Разошлось (разные цифры/оценки) → ⚠️ покажи разброс и не выдавай одну цифру за факт. Пример: число судов у одной компании — примерно ~500 / ~1000 / ~1500 у разных агрегаторов (разная методология подсчёта) → «по разным источникам от ~500 до ~1500 дел, методики счёта различаются».
- Сигнал только в одном источнике → проверь принадлежность (особенно тревожный: банкротство, суд, долг — у list-org бывают чужие). Не пугай, пока не подтвердил.
Дедупликация
Одна и та же информация часто в нескольких местах. Сливай:
- Сигналы дубля: тот же текст/сущность (ИНН, ОГРН, имя), близкие даты, один источник ссылается на другой.
- Приоритет при слиянии: полнота (самая полная версия) > авторитет (госреестр > агрегатор) > свежесть (последнее обновление).
- НЕ сливать: разные выводы по той же теме, разные точки зрения, эволюция данных (v1 vs v2), разные периоды.
Конфликт — показывать, не прятать
Когда источники расходятся — выводи явно, не выбирай молча:
Расхождение источников по [параметр]:
- [источник A, дата, tier]: значение X
- [источник B, дата, tier]: значение Y
Вероятная причина: [разная методология / устарело / чужие данные].
Наиболее надёжно: [вывод по авторитету+свежести] — но проверьте, если критично.
Атрибуция — каждый факт к источнику
Каждое утверждение → источник + дата + tier-маркер (✅ подтверждено Tier 1-2 / ⚠️ частично / ❌ не подтверждено). В конце — список источников. Никаких чисел без происхождения.
Как работает
[Запрос] → определи тип (факт / статус / сущность / решение)
↓
[Декомпозиция] → какие источники релевантны, что у каждого спросить (параллельно)
↓
[Сбор] → собери из ≥3 источников (агрегаторы/реестры/веб)
↓
[Дедуп] → слей дубли по приоритету полнота>авторитет>свежесть
↓
[Уверенность] → свежесть × авторитет × согласие на каждый факт
↓
[Синтез] → связный ответ, ведёт вывод (не методология), конфликты явно, атрибуция + tier
Anti-patterns
- НЕ перечисляй по источникам («у checko… у list-org…») — сведи в нарратив по фактам.
- НЕ выдавай одну цифру, когда источники расходятся — покажи разброс.
- НЕ давай одиночному сигналу тот же вес, что подтверждённому ≥3.
- НЕ прячь конфликт. НЕ опускай атрибуцию. НЕ пугай непроверенным сигналом.
Формат вывода
Единый формат killer-карточки (общий для counterparty-guard / tax-calendar-proactive / cross-source-verify): шапка
{эмодзи} {что} — на {дата}→ вердикт (✅ согласовано / ⚠️ расхождение) → факты по существу → футерЧто проверено:(источник + дата + tier) иЧто НЕ проверено:. Один узнаваемый вид во всех стеках (markdown, без host-specific вёрстки).
Пример (иллюстративный)
Запрос: «Сколько судов у этого контрагента?» Собрано из 4 агрегаторов.
Плохо (одиночный источник): «~1500 судебных дел» — берём самый высокий счётчик, звучит точно. На деле он подмешал чужие эпизоды, а методология у всех разная.
Хорошо (круговая сверка):
🔎 Сверка: контрагент {ИНН} — на 15.06.2026
⚠️ Расхождение по числу судов — единой цифре верить нельзя.
Суды: по разным источникам от ~500 до ~1500 дел — методики подсчёта различаются
(примерно ~500 / ~1000 / ~1500 у трёх агрегаторов). Надёжнее ориентироваться
на нижнюю-среднюю оценку; точное число — в kad.arbitr.
ФССП: совпало у всех источников — ✅ высокая уверенность.
Выручка: совпала у всех — ✅ Tier 1 (ГИР БО).
Что проверено: 4 агрегатора + ГИР БО (15.06.2026); ФССП/выручка — ✅ совпали ≥3.
Что НЕ проверено: точное число судов — только kad.arbitr вручную.
Разница: вместо ложно-точной цифры — честный разброс там, где источники спорят, и твёрдое утверждение там, где совпали.
Кто использует движок
- counterparty-guard — 5 агрегаторов по контрагенту (основной потребитель, отсюда родился).
- competitor-scout — сбор по конкурентам из разных площадок.
- факт-чек любого скилла — числа/цитаты с tier (по умолчанию из CLAUDE.md).
- Любой скилл, где >1 источника сводится в ответ.
Основа — Anthropic enterprise-search/knowledge-synthesis, адаптировано под РФ-источники и tier-протокол тандема.
Changelog
- 0.2.1 (16.06.2026) — единый формат killer-карточки (шапка с датой → вердикт согласовано/расхождение → факты → футер Что проверено/НЕ проверено), общий с counterparty-guard и tax-calendar-proactive; пример обёрнут в карточку.
- 0.2 (15.06.2026) — упаковка: hero про ложную точность одиночного источника, POV-пруф вынесен наверх (живой тест 5 агрегаторов), worked-пример «плохо/хорошо».
- 0.1 — движок круговой сверки: шкала авторитетности РФ, уверенность = свежесть × авторитет × согласие, дедуп, явный показ конфликтов, атрибуция с tier.
Files (small-business-ru)
-
SKILL.md 13.3 KB
--- name: cross-source-verify description: > Движок круговой сверки: берёт результаты из НЕСКОЛЬКИХ источников (агрегаторы, госреестры, веб, выгрузки) и сводит в один ответ с дедупликацией, оценкой уверенности (свежесть × авторитет × согласие источников), tier-маркерами и явным показом расхождений. Не выбирает молча одну версию — показывает конфликт. Переиспользуемое ядро под counterparty-guard, competitor-scout, факт-чек, любой скилл с несколькими источниками. Адаптация enterprise-search/knowledge-synthesis под РФ-источники + опыт мульти-агрегаторной проверки. Триггеры: «проверь через несколько источников», «круговая сверка», «насколько достоверно», «сведи данные из источников», «где правда». metadata: author: тандем, на основе Anthropic enterprise-search + counterparty-guard 15.06.2026 version: "0.2.1" --- <!-- Производное от Anthropic knowledge-work-plugins / enterprise-search (Apache-2.0, (c) Anthropic). Локализовано под РФ, файл изменён. См. /NOTICE и /LICENSE. --> # Cross-Source Verify — движок круговой сверки > Последняя миля любой проверки: сырые результаты из N источников → один связный ответ, которому можно доверять, с явной оценкой уверенности и показанными расхождениями. Один источник звучит уверенно и часто врёт. Агрегатор отдаёт ровную карточку с точными числами — и ты веришь, потому что цифра конкретная. Но конкретная ≠ верная: у соседнего агрегатора по той же компании число другое, а ты этого не видишь, пока не откроешь оба. Этот движок открывает все сразу и сводит — не выбирая молча одну версию, а показывая, где источники согласны (это и есть факт), а где разошлись (это флаг). > **Принцип (POV), доказан вживую 15.06.2026.** Прогнали одну компанию через 5 агрегаторов: число судов разошлось почти втрое (примерно ~500 / ~1000 / ~1500 — разная методология), при этом выручка и ФССП совпали у всех. Вывод движка: **один источник = единая точка отказа и ложная точность. Факт = совпадение у ≥3; расхождение = разброс, а не выбор одной цифры.** Совпало → уверенность; разошлось → флаг. (Цифры округлены; проверяйте сами.) ## Шкала авторитетности источников (РФ) | Уровень | Источники | Вес | |---|---|---| | **Highest** — первоисточник | Госреестры: ЕГРЮЛ/ЕГРИП ФНС, ГИР БО, kad.arbitr, ФССП, ЕФРСБ/Федресурс, нормативка (НК/ГК/ТК), официальная документация | максимальный | | **High** — официальная сводка | Прозрачный бизнес ФНС, реестры ЦБ/Роскомнадзора, рецензируемые статьи, первичная отчётность | высокий | | **Moderate** — агрегатор (проверенный) | checko, rusprofile, saby/СБИС, audit-it — собирают из официальных, но добавляют свою методологию/скоринг | средний, кросс-сверять | | **Low-moderate** — агрегатор (шумный) | list-org (подмешивает чужие сигналы), отраслевые порталы, экспертные блоги | проверять принадлежность данных | | **Low** — неподтверждённое | форумы, отзывы, маркетинг, агрегаторы новостей, соцсети | только как гипотеза | | **Unverified** — со слов | данные, которые дал пользователь как истину | помечать «не верифицировано» | ## Оценка уверенности = свежесть × авторитет × согласие **Свежесть:** у каждого факта — дата источника. Свежее (сегодня/неделя) → высокая уверенность для статусных данных; устаревшее (месяцы) → понизить, пометить «возможно неактуально». Пример из практики: audit-it отдавал 2023, когда другие 2024 — бери самый свежий год. **Авторитет:** по таблице выше. Госреестр > агрегатор > форум. **Согласие (главное в круговой сверке):** - **Совпало у ≥3 источников** → ✅ высокая уверенность, давай прямым утверждением. - **Разошлось** (разные цифры/оценки) → ⚠️ покажи разброс и не выдавай одну цифру за факт. Пример: число судов у одной компании — примерно ~500 / ~1000 / ~1500 у разных агрегаторов (разная методология подсчёта) → «по разным источникам от ~500 до ~1500 дел, методики счёта различаются». - **Сигнал только в одном источнике** → проверь принадлежность (особенно тревожный: банкротство, суд, долг — у list-org бывают чужие). Не пугай, пока не подтвердил. ## Дедупликация Одна и та же информация часто в нескольких местах. Сливай: - **Сигналы дубля:** тот же текст/сущность (ИНН, ОГРН, имя), близкие даты, один источник ссылается на другой. - **Приоритет при слиянии:** полнота (самая полная версия) > авторитет (госреестр > агрегатор) > свежесть (последнее обновление). - **НЕ сливать:** разные выводы по той же теме, разные точки зрения, эволюция данных (v1 vs v2), разные периоды. ## Конфликт — показывать, не прятать Когда источники расходятся — выводи явно, не выбирай молча: ``` Расхождение источников по [параметр]: - [источник A, дата, tier]: значение X - [источник B, дата, tier]: значение Y Вероятная причина: [разная методология / устарело / чужие данные]. Наиболее надёжно: [вывод по авторитету+свежести] — но проверьте, если критично. ``` ## Атрибуция — каждый факт к источнику Каждое утверждение → источник + дата + tier-маркер (✅ подтверждено Tier 1-2 / ⚠️ частично / ❌ не подтверждено). В конце — список источников. Никаких чисел без происхождения. ## Как работает ``` [Запрос] → определи тип (факт / статус / сущность / решение) ↓ [Декомпозиция] → какие источники релевантны, что у каждого спросить (параллельно) ↓ [Сбор] → собери из ≥3 источников (агрегаторы/реестры/веб) ↓ [Дедуп] → слей дубли по приоритету полнота>авторитет>свежесть ↓ [Уверенность] → свежесть × авторитет × согласие на каждый факт ↓ [Синтез] → связный ответ, ведёт вывод (не методология), конфликты явно, атрибуция + tier ``` ## Anti-patterns - НЕ перечисляй по источникам («у checko… у list-org…») — сведи в нарратив по фактам. - НЕ выдавай одну цифру, когда источники расходятся — покажи разброс. - НЕ давай одиночному сигналу тот же вес, что подтверждённому ≥3. - НЕ прячь конфликт. НЕ опускай атрибуцию. НЕ пугай непроверенным сигналом. ## Формат вывода > **Единый формат killer-карточки** (общий для counterparty-guard / tax-calendar-proactive / cross-source-verify): шапка `{эмодзи} {что} — на {дата}` → вердикт (✅ согласовано / ⚠️ расхождение) → факты по существу → футер `Что проверено:` (источник + дата + tier) и `Что НЕ проверено:`. Один узнаваемый вид во всех стеках (markdown, без host-specific вёрстки). ## Пример (иллюстративный) **Запрос:** «Сколько судов у этого контрагента?» Собрано из 4 агрегаторов. **Плохо (одиночный источник):** «~1500 судебных дел» — берём самый высокий счётчик, звучит точно. На деле он подмешал чужие эпизоды, а методология у всех разная. **Хорошо (круговая сверка):** ``` 🔎 Сверка: контрагент {ИНН} — на 15.06.2026 ⚠️ Расхождение по числу судов — единой цифре верить нельзя. Суды: по разным источникам от ~500 до ~1500 дел — методики подсчёта различаются (примерно ~500 / ~1000 / ~1500 у трёх агрегаторов). Надёжнее ориентироваться на нижнюю-среднюю оценку; точное число — в kad.arbitr. ФССП: совпало у всех источников — ✅ высокая уверенность. Выручка: совпала у всех — ✅ Tier 1 (ГИР БО). Что проверено: 4 агрегатора + ГИР БО (15.06.2026); ФССП/выручка — ✅ совпали ≥3. Что НЕ проверено: точное число судов — только kad.arbitr вручную. ``` Разница: вместо ложно-точной цифры — честный разброс там, где источники спорят, и твёрдое утверждение там, где совпали. ## Кто использует движок - **counterparty-guard** — 5 агрегаторов по контрагенту (основной потребитель, отсюда родился). - **competitor-scout** — сбор по конкурентам из разных площадок. - **факт-чек любого скилла** — числа/цитаты с tier (по умолчанию из CLAUDE.md). - Любой скилл, где >1 источника сводится в ответ. Основа — Anthropic enterprise-search/knowledge-synthesis, адаптировано под РФ-источники и tier-протокол тандема. ## Changelog - **0.2.1** (16.06.2026) — единый формат killer-карточки (шапка с датой → вердикт согласовано/расхождение → факты → футер Что проверено/НЕ проверено), общий с counterparty-guard и tax-calendar-proactive; пример обёрнут в карточку. - **0.2** (15.06.2026) — упаковка: hero про ложную точность одиночного источника, POV-пруф вынесен наверх (живой тест 5 агрегаторов), worked-пример «плохо/хорошо». - **0.1** — движок круговой сверки: шкала авторитетности РФ, уверенность = свежесть × авторитет × согласие, дедуп, явный показ конфликтов, атрибуция с tier.
Comments (0)
Sign in to join the conversation.
Reviews (0)
No reviews yet.
No comments yet.