← UNUM Site Cabinet Фича 2 · Приоритетная фича 2. AI-ассистент на архиве новостей и котировках
Содержание

Приоритетная фича 2. AI-ассистент на архиве новостей и котировках

Зарегистрированный пользователь общается в кабинете с AI-ассистентом, который отвечает на вопросы и строит аналитические отчёты на базе всего архива новостей theunum.io и котировок CoinGecko. И новости, и котировки уже лежат в Postgres в векторном виде — фича строится на существующем корпусе данных, а не требует собирать новый. Это вторая из двух приоритетных фич личного кабинета.

1. Ценность и отстройка#

ChatGPT и Perplexity отвечают на крипто-вопросы «по интернету вообще». Ассистент кабинета отвечает по конкретному, полному, датированному архиву новостей с проверяемыми ссылками на первоисточники и с котировками, пришитыми к той же временной оси. Это даёт то, чего у общих чат-ботов нет: восстановление хронологии нарратива («как менялась повестка вокруг ETH за полгода»), связку «новость → движение цены» и отчёты, где каждое утверждение подкреплено конкретной публикацией из архива.

Вторая связка — с приоритетной фичей 1: когда у пользователя подключены кошельки, ассистент знает его реальные активы и по умолчанию отвечает про них («что писали на этой неделе про то, что у меня в портфеле»). Две фичи усиливают друг друга: портфель даёт ассистенту контекст, ассистент даёт портфелю объяснение.

2. Что умеет ассистент#

Вопрос-ответ по архиву. «Что известно о X?», «что происходило с Y в марте?», «какие главные темы недели?». Ответ собирается только из найденных в архиве материалов, с явными ссылками-цитатами на новости (заголовок + дата + ссылка). Если в архиве ответа нет — ассистент так и говорит, а не фантазирует.

Аналитические отчёты по шаблонам. Кнопки-пресеты рядом с чатом, каждая — параметризованный отчёт:

Отчёт открывается как оформленный документ (заголовки, список источников, таблица движений цены), а не простыня в чате; его можно сохранить в кабинете и вернуться к нему.

Уточняющий диалог. Ассистент держит контекст беседы: «а теперь то же самое, но за квартал», «сравни с SOL». История чатов сохраняется в кабинете.

Границы. Ассистент не даёт индивидуальных инвестиционных рекомендаций и не предсказывает цены — это зафиксировано в системном промпте, в дисклеймере под окном чата и в тоне ответов («новостной фон был таким» вместо «покупай»). Это одновременно регуляторная гигиена и защита доверия к продукту.

3. Архитектура#

Классический RAG с инструментами, поверх уже существующей базы.

Хранилище — уже есть. Postgres + pgvector: эмбеддинги новостей и котировки CoinGecko. Дособрать нужно немногое: метаданные для фильтрации (дата, источник, упомянутые активы/тикеры, язык), если их ещё нет рядом с векторами — извлечь батчем по архиву один раз.

Поиск — гибридный. Чистый векторный поиск плохо работает с датами и тикерами («новости про SOL за март» — семантика тут не главное). Поэтому: векторный поиск по смыслу + полнотекстовый по ключевым словам/тикерам + жёсткие SQL-фильтры по дате и активу, слияние результатов. Всё это умеет один Postgres — отдельная поисковая инфраструктура не нужна.

Оркестрация — LLM с tool calling. Модель (Claude; провайдер за абстракцией, чтобы можно было менять) получает инструменты:

Модель сама решает, какие инструменты и в какой последовательности дёргать, собирает ответ и обязана снабжать утверждения ссылками на найденные документы. Ответ стримится в чат токен за токеном.

Слой продукта. Бэкенд-сервис между кабинетом и LLM: авторизация, история чатов, лимиты, логирование, сборка контекста (активы пользователя из фичи 1 — если разрешено в настройках). Фронт — чат в кабинете: стриминг, цитаты-карточки с переходом на новость, пресеты отчётов, история диалогов.

4. Экономика и лимиты#

Каждый ответ стоит реальных денег (LLM-токены), поэтому с первого дня:

5. Этапность#

MVP: чат с гибридным поиском по архиву и котировкам, цитаты-ссылки на новости, стриминг, история диалогов, два пресета (отчёт по активу, дайджест периода), лимиты запросов, дисклеймер.

Волна 2: остальные пресеты, сохраняемые отчёты, контекст портфеля из фичи 1, регулярный дайджест по расписанию (в кабинет и на почту/в Telegram), русский+английский интерфейс ответов независимо от языка источника.

Сознательно не в первом контуре: голос, автономные агенты-мониторы («следи и сообщай»), генерация торговых сигналов (не делаем принципиально), публичные шаринги отчётов.

6. Качество и риски#

7. Метрики успеха#

Доля пользователей кабинета, задавших ≥1 вопрос; возвраты к ассистенту (WAU); среднее число вопросов на сессию; доля ответов с кликом по цитате (прокси доверия и качества); конверсия из лимита бесплатных вопросов в подписку; стоимость LLM на активного пользователя.