🛡 Друзья, коллеги, всем привет!!!👋
В настоящее время разрабатываю сервис автоматизации OSINT-анализа контрагентов на базе ИИ. По задумке, он будет собирать картину о контрагенте из открытых источников: реестровая карточка по ИНН (ЕГРЮЛ/ЕГРИП через DaData), загруженные документы (PDF, DOC/DOCX, XLSX, PPTX), финотчётность и иная информация из открытых источников и загруженных в сервис документов - и превращть всё это в структурированное заключение с уровнем риска и ссылками на каждый установленный факт. 🎯 Цель моего проекта: заменить значительное время ручных проверок в WEB, сбора всей информации и ее анализа, одним запуском и анализом всех материалов проверки с использованием технологий ИИ 🤖+👨=🪄 ⚙️ Реализованные решения в настоящее время, но я дальше “пилю” проект и генерю идеи 🤔 • AI bridge - единое подключение к LLM: OpenRouter (300+ моделей: Claude, GPT, Gemini, DeepSeek, Qwen, Grok…), RouterAI (РФ, оплата в рублях), DeepSeek напрямую и локальная Ollama - полностью офлайн-режим, данные не покидают ПК; • 4 режима анализа: Fast, Structured, Live OSINT (живой поиск в сети) и Hybrid; • зарубежные контрагенты: LEI через GLEIF, национальные идентификаторы, санкционные списки OFAC / EU / UN / OFSI; • Batch-проверка: массовая проверка ИНН из CSV-списка с выгрузкой результатов; • экспорт отчётов: DOCX, PDF/печать, Evidence JSON и HTML-заключение с QR-кодом и SHA-256-проверкой целостности (видно, если файл правили после выгрузки); • AI-чат по отчёту с ИИ если возникли дополнительные вопросы по проведенной проверке; • история проверок, каталог промптов с возможностью создания новых промптов под разные типы проверок. 12 цветовых тем интерфейса - от «Багрового щита» до «Графитового монохрома», пошаговый сценарий «API → ИНН → документы → запуск», интерактивный радар рисков. Сейчас всё работает прямо в браузере. 🤖 Автоматизация в связке с AI Модель не «пишет красивый текст», а работает по жёсткой методологии: промпт запрещает выдумывать факты и ссылки, требует метки [ФАКТ] / [ГИПОТЕЗА] / [ТРЕБУЕТ ПРОВЕРКИ] и возвращает машиночитаемую оценку риска по категориям. Цель на выходе - заключение, которое будет базой для принятия итогового решения, которое будет не стыдно показать руководству или приложить к документам на согласование договора. 💬 Сейчас я пришел в ту точку в которой задаю себе вопрос “А что дальше?” и у меня пару вопросов к друзьям и коллегам.
Насколько вам был бы полезен такой сервис проверки контрагентов? Что хотели бы в нём видеть и какую боль закрыть в рамках проверок - время, разрозненные данные по разным сервисам, оценка совокупности всей имеющейся информации в рамках перекрестного анализа гипотез и фактов? Нужен ли вашей компании такой инструмент автоматизации для оптимизации рабочих процессов и экономии рабочего времени? Буду признателен если напишите свое мнение - самые ценные идеи заберу в следующую версию сборки 🙌 Не реклама, коммерческие цели не преследую и ничего не продаю☝️😎 #OSINT #проверкаконтрагентов #DueDiligence #AI #нейросети #автоматизация #экономическаябезопасность
· вчера
Добрый день, Денис 👋🏻 Не хочу вас расстраивать, но почти со всем этим сейчас в принципе справляется ChatGPT последней версии (где можно переключать "умность" модели) за 20$ в месяц. Такой продукт (по задумке как у вас) мог бы быть интересным, если бы обладал каким-то реальным конкурентным преимуществом. То есть мог бы "ходить" туда, куда обычный "массовый" движок не может. Но для этого нужно, видимо, партнерство/прямая интеграция именно с такими "местами". Впрочем, это всего лишь мое субъективное мнение 😌
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён
· вчера
Иван, добрый день! Спасибо за развёрнутое мнение - такие комментарии полезнее лайков. Но позиция держится на двух допущениях, которые легко проверить: будто продукт - это «обёртка над моделью», и будто интеграций с реестрами нет. Оба неверны, причём второе - ровно наоборот. 1. Категориальная ошибка. Вы сравниваете инструмент с интерфейсом. Мой сервис не конкурент модели, а её потребитель. Внутри подключаемый мост: OpenRouter (каталог 300+ моделей), RouterAI (оплата в ₽, инфраструктура в РФ), прямой DeepSeek с нативным серверным поиском и локальный Ollama. Модель уровня ChatGPT можно буквально вставить внутрь - и она станет одним из движков, а не альтернативой продукту. «Переключатель умности» в ChatGPT меняет процессинг; у меня это выбор провайдера плюс 5 режимов со своими бюджетами и температурой (Fast 1800/0.2, Structured 5000/0.15, Live 4500/0.15, Hybrid 6000/0.2, Local 3000/0.2). 2. «Ходить туда, куда массовый движок не может» - это уже сделано, и это ровно то, чего ChatGPT не умеет принципиально. Подключены DaData findById/party - прямой ЕГРЮЛ/ЕГРИП поверх данных ФНС, работает из РФ без VPN, бесплатно 10 000 запросов в сутки; тот же токен открывает реестры Беларуси и Казахстана. Подключён GLEIF - поиск по LEI и по наименованию для иностранных контрагентов. Есть модуль дизамбигуации: по одному ИНН тянет все записи, смены фамилии и число связанных организаций. Вам казалось, что для этого нужно партнёрство. Нет - это публичные API с ключом пользователя, и они уже работают. У ChatGPT такого слота под ваш ключ просто нет: он не может сходить в ФНС от вашего имени и не может работать в вашем контуре. 3. Слой, которого в чате нет вообще. До того как тратится первый токен, локально и офлайн считается контрольная сумма ИНН по алгоритму ФНС, нормализуются гомоглифы (кириллическое «о», арабо-индийские цифры - иначе ИНН из Excel молча ломался), проверяется LEI по ISO 17442 / ISO 7064, определяются VAT, УНП, БИН и китайский USCC. 4. Главное - проверка, а не вера модели на слово. Реестровый блок подаётся в промпт как единственно верная идентификация с прямым запретом подмены компании на похожую. После ответа работает автопроверка: сверяет заголовок отчёта с реестровым наименованием, фиксирует отсутствие ИНН в ответе, считает Evidence coverage - долю фактов, снабжённых проверяемой ссылкой (Хорошо ≥ 75 %, Средне ≥ 40 %, Низко) - и снижает доверие, если больше половины фактов без URL. Плюс машинная разбивка риска по 8 категориям с радаром, детекция обрыва ответа по finish_reason (отчёт помечается неполным, а не выдаётся за целый) и SHA-256-отпечаток с QR-кодом, по которому любой получатель проверит, что файл не правили после выгрузки. ChatGPT даст текст, который вы будете проверять сами. Здесь получаем отчёт с измеренным процентом подтверждаемости. 5. Про $20 и «почти со всем этим». Возьмём типовую задачу - пакетную проверку для закупок или кредитного контура. 200 контрагентов в чате: это 200 ручных диалогов, без CSV, без статуса по строке, без экспорта. Здесь: вставили список → один прогон → пауза между запросами против лимитов → на выходе CSV со статусом по каждому ИНН. Это не «почти», это другой класс задачи. 6. Про данные - пункт, который умность не закроет. Приложения нет на сервере: один файл, ключи в вашем браузере, строгий CSP с белым списком подключений, referrer: no-referrer, политика разрешений, выключающая камеру, микрофон, геолокацию и USB. Есть полностью автономный режим на локальной модели: всё считается на localhost, без облака, без DaData и без веб-поиска. Для проверки контрагента под 152-ФЗ, NDA или банковским комплаенсом вопрос не в том, насколько умна модель, а в том, допустимо ли отдавать реквизиты и документы третьей стороне. Никакая подписка этот пункт не снимет. И последнее. Вы честно написали «субъективное мнение» - и в этом его слабое место: вывод сделан о внутренностях продукта, который Вами не открывался и не использывался. А Ваш ChatGPT так умеет?
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· вчера
Благодарю за развернутый комментарий 👍🏻 Так я и направил вам свое субъективное мнение на основе той информации, которую вы имели удовольствие нам всем тут предоставить. Я понимаю ваше желание как творца встать в "боевую стойку" и защищать свое детище. Но я же не могу вытянуть телепатически из вашей головы информацию о вашем продукте. Именно для этого и была оговорка о субъективности мнения 😌 И я вовсе не защищаю ChatGPT 😌 Более того, у меня нет задачи доказать, что ваш продукт не нужен или что его можно целиком заменить подпиской за $20. Я написал гораздо более простую вещь: из представленного в посте описания я как потенциальный пользователь не увидел для себя достаточного конкурентного преимущества перед уже доступными массовыми инструментами. При этом вы почему-то приписали мне несколько тезисов, которых в моем комментарии не было. Например, я нигде не писал, что у вас нет интеграций с реестрами. Я написал, что продукт был бы для меня интереснее, если бы мог получать данные оттуда, куда массовый инструмент самостоятельно добраться не может. Это несколько разные утверждения. И, кстати, ваш ответ в этом смысле оказался гораздо информативнее вашего исходного поста. Batch-проверка, единый воспроизводимый процесс для большого количества контрагентов, автоматическая верификация результатов, контроль Evidence coverage, работа в локальном контуре и стандартизированный выходной отчет уже гораздо лучше объясняют мне, в чем именно вы видите ценность своего продукта. Поэтому мне кажется, что вас немного занесло в защите собственного решения 😌 Вы сами спросили у коллег, насколько им был бы полезен такой сервис и какую боль они хотели бы им закрыть. Я прочитал предоставленное вами описание и честно ответил, что лично мне на основании этой информации пока проще воспользоваться ChatGPT, а также написал, чего мне как потенциальному пользователю в описанной концепции не хватает. Если после этого требуется открыть продукт, изучить его внутреннее устройство и только потом иметь право ответить на вопрос "насколько вам был бы полезен такой сервис", то это уже несколько другой формат сбора обратной связи. Ну а на вопрос "А Ваш ChatGPT так умеет?" я отвечу вам совсем просто: что-то умеет, что-то нет. И это совершенно нормально. Я ведь с вами не на дуэль моделей пришел, а всего лишь оставил комментарий под постом, в котором вы сами попросили мнение о своем продукте 😌
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· вчера
Иван, спасибо за развёрнутый ответ. Это уже разговор, а не перепалка - ценю).
1. Вы правы, возможно могло показаться, что я приписал. «У вас нет интеграций» вы не писали - вы написали, что из описания не видите для себя преимущества. Это разные утверждения, снимаю. И про «открыть продукт и изучить внутренности, чтобы иметь право на мнение» - тоже лишнее: вы отвечали на вопрос, который я сам задал, и материалом, который я сам предоставил. Претензий тут быть не может по определению. 2. И в главном Вы правы - это самая полезная обратная связь для меня на текущий момент в ветке. Я дал список функций вместо ценности. Batch-проверка, воспроизводимый процесс на большом объёме, автоверификация, Evidence coverage, локальный контур и стандартизированный выход - это и есть ответ на боль «время и разрозненные данные», и именно этого в посте не было. Диагноз точный: я объяснил, что сделано, вместо того чтобы объяснить, зачем. Отдельный привет двенадцати цветовым темам - им в описании досталось внимания больше, чем batch-проверке. Наверное, в этом и есть корень проблемы :) 3. Зацепило не «ChatGPT», а рамка. «Не хочу вас расстраивать, но почти со всем этим справляется ChatGPT» работает как «без обид, но…» - за таким вступлением всегда следует вердикт, а не вопрос. А человек, который длительное время собирает инструмент, слышит это как «твой труд - пункт в чужой подписке»). Это моя реакция, не ваша ответственность. Но именно поэтому я и развернул ответ подробнее.
4. Дуэль отменяется))). Вы не приходили соревноваться моделями, и я не должен был её навязывать. «Что-то умеет, что-то нет» - честный ответ, принято. А теперь вернусь к исходному, потому что Вы - идеальный респондент: вы прочитали описание и не купили. Так это и должно работать. Если будет пара минут, ответьте, пожалуйста, не по описанию, а по своей практике: Сколько времени реально уходит на одного контрагента (если занимаетесь этим направлением), когда всё вручную и по разным сервисам? Что выматывает сильнее: собрать данные или свести их в одно решение? «Не стыдно приложить к договору» - это про формат документа или про ответственность за вывод?
Ваши пункты и ответы заберу не в следующую сборку, а в описание продукта - туда, где им и место. Спасибо, что сформулировали 🙌 и хорошего Вам дня!!!
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· вчера
Денис, со своей стороны попрошу прощения за "Не хочу вас расстраивать...", печатал действительно без иронии 😌 Я сам таким направлением плотно не занимаюсь, но иногда делаю небольшие OSINT исследования при случае, если что-то (или кто-то) вызывает мое любопытство. Это у меня профдеформация из "прошлой жизни" (я бывший "восьмерик", если вы знаете, о чем я). Отвечая на ваш вопрос про собрать данные или свести их в одно решение: скорее собрать "актуальные" данные. Машины "общего пользования" очень часто находят какие-то старые и уже давно неактуальные данные и во многих случаях выдают их за актуальные. Судя по всему, опять же, из той информации что вы нам всем тут предоставили о своем продукте - эта проблема у вас как минимум минимизирована (простите за тавтологию), как максимум - искоренена. На второе место я бы поставил сведение данных в одно решение. Со сбором данных как таковых сейчас вроде проблем особых нет, этому уже все научены. Про "не стыдно приложить к договору" не могу дать ответ - просто не сталкиваюсь с таким. В целом я бы даже просто следил за развитием вашего продукта из банального интереса 👍🏻 Хорошего дня и не держите, пожалуйста, зла 😌
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· вчера
Спасибо Иван. Прощения не нужно - всё закрыли предыдущим комментарием, и никакого зла нет, в помине. Про «восьмерика» понял :) Тогда ваше замечание про актуальность я принимаю не как комплимент, а как техническое задание. Это пока самая точная формулировка проблемы, которую я здесь услышал. Спасибо. Вы попали в самую точку: собирать данные все научились, а отличать свежее от давно “испорченного” - нет. Машины общего пользования выдают найденное за актуальное, потому что им нечем мерить возраст факта. У меня с этим так. В режимах без web-поиска модель не просто «не ищет» - ей прямо запрещено имитировать обход сайтов и новостей: всё, чего она не видит в переданных данных, обязано уйти под метку [ТРЕБУЕТ ПРОВЕРКИ], а не в утверждения. Реестровая карточка приходит не из памяти модели, а живым запросом в ФНС и считается единственно верной идентификацией - её свежесть определяется датой запроса, а не датой обучения. Ну и каждый факт со ссылкой: возраст источника проверяем руками, не веря на слово. Но честно: coverage считает цитируемость, а не свежесть. Дату публикации источника продукт пока не меряет, и старый факт с корректной ссылкой сейчас пройдёт как подтверждённый. Так что Ваше «как минимум минимизирована» вернее, чем «искоренена». Спасибо, что ткнули именно туда - забрал в список. Ну и на добрую ноту, раз уж речь зашла про зло: Зло - это зло. Меньшее, большее, среднее - границы размыты. Устаревший факт - это устаревший факт: «ещё ничего» или «уже ничего» - границы тоже размыты. Но если мне выбирать между «нашёл и выдал за актуальное» и «нашёл, не уверен - пометил [ТРЕБУЕТ ПРОВЕРКИ]», я выберу метку. А на “восьмериков” обижаться - это не обида, а неосторожность :) Хорошего дня. И спасибо, что будете следить - для меня это лучше любой метрики.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 1 ч
Добрый день, Денис 👋🏻 Взял паузу, чтобы выделить время на подумать, какие бы фичи могли бы еще быть потенциально полезными. Проще, наверное, описать конкретную ситуацию 😌 Искал информацию по одному руководителю и получил интересный результат: из открытых источниках по одному из них машина мне говорит "Он дисквалифицирован". Захожу в источник - там такого нет. Прошу машину проверить еще раз. Именно по этому источнику точно такой же результат. Тыкаю машину "носом" (буквально скриншотом) - "Вот, смотри, нет дисквалификации". Машина задумывается и потом дает ответ: "Да, точно. Но он был дисквалифицирован точно с года Х по год Y. Сейчас он не дисквалифицирован". То есть она смогла взять какой-то старый индекс источника и найти то, что оттуда удалили после снятия дисквалификации. Я привел эту ситуацию не как "дефект", а как потенциальную фичу, потому что многие открытые источники действительно опускают "завершившиеся" состояния (навроде дисквалификации), но это может быть важно при поиске информации. Хорошей пятницы 👍🏻
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 1 ч
Иван, добрый день! Предлагаю продолжить в личке👌
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён