Я не прошёл в Sber500xDisrupt, но за время ожидания уже собрал рабочий эксперимент. Несколько недель использования показали, что aibrain.ru всё меньше похож на ИИ-таролога и всё больше - на накопительную систему самонаблюдения.
Мне отказали в Sber500xDisrupt. За это время ИИ-таролог стал другим продуктом
Мне отказали в Sber500xDisrupt. Эта история началась с исследования 32 идей ИИ-продуктов для частных пользователей. Я сократил список до четырёх гипотез, отдельно исследовал финалистов и в итоге выбрал для заявки ИИ-таролога.
Заявку отправил. Отбор не прошёл.
Но пока Сбер принимал решение, я уже начал делать продукт. За несколько недель собственного использования стало понятно, что первоначальное название описывает его всё хуже. В предыдущей статье я писал, что Таро для меня оказалось скорее входом в персональный ИИ с долговременной памятью. Теперь эту идею можно сформулировать точнее.
Что я отправлял в Sber500xDisrupt
В заявке рабочее название было простым: персональный ИИ-нумеролог-таролог. Но описывал я уже тогда не генератор раскладов, а персональный ИИ для регулярной рефлексии, который постепенно накапливает разрешённый пользователем контекст жизни. Человек задаёт вопрос текстом или голосом. Система знает предыдущие обращения, помнит людей, события и повторяющиеся темы.
Нумерологические расчёты выполняются отдельно от языковой модели.
Таро даёт дополнительный способ посмотреть на ситуацию.
ИИ связывает это с накопленным контекстом и помогает продолжить диалог.
Главную продуктовую гипотезу в заявке я сформулировал так: сможет ли персональный агент с накопительным контекстом стать регулярным пользовательским ритуалом, а не одноразовой ИИ-генерацией.
Анкета была подробной. Я описал целевую аудиторию, пользовательский сценарий, ограничения продукта, архитектуру, использование языковой модели, план разработки по неделям и конкурентное отличие. Отдельно привёл данные двух своих предыдущих пользовательских ИИ-продуктов: почти 2 000 регистраций суммарно и больше 51 тысячи пользовательских сообщений. И отдельно написал о том, чего мне не хватает: опыта устойчивого масштабирования массового потребительского продукта, привлечения, удержания и монетизации. Поэтому связывать отказ с недостаточной проработкой самой анкеты без дополнительных данных я не могу. Но и причины решения Сбера я не знаю. Додумывать её не хочу.
За время ожидания важнее произошло другое: гипотеза из анкеты превратилась в работающий эксперимент.
Я решил не ждать результата отбора
Уже 9 сентября появилась первая версия продукта. Изначально мне хотелось объединить несколько систем интерпретации и посмотреть, что получится, если использовать их не как отдельные сервисы, а внутри одного накопительного персонального контекста. Сейчас в системе есть расчётная нумерология, астрологические расчёты, отдельный слой Таро, фактические наблюдения о происходящих событиях, ранее сформулированные сигналы и обратная связь о том, что произошло потом.
Но главное изменение не в количестве методологий. Я начал строить систему так, чтобы разные типы информации нельзя было незаметно смешать между собой.
Почему я не хочу строить просто ИИ-таролога
Сделать ИИ, который убедительно разговаривает как таролог, относительно просто. Можно дать модели дату рождения, вопрос, выпавшие карты и попросить написать персональную интерпретацию. Текст почти наверняка будет звучать связно.
Проблема в проверке. После произошедшего легко подобрать достаточно широкую трактовку и увидеть совпадение. Поэтому в моем проекте расчёты выполняются программно, а наблюдения о реально произошедших событиях хранятся отдельно.
Таро является отдельным проективным слоем и не повышает силу расчётного сигнала только потому, что значение карты оказалось тематически похожим.
Гипотеза сохраняется вместе со временем её публикации. После события к ней можно добавить обратную связь.
Меня интересует уже не только вопрос: “Насколько описание кажется подходящим?” Гораздо важнее другое:
Что именно система сформулировала до того, как я узнал результат?
Первые совпадения оказались достаточно интересными, чтобы продолжить
За несколько недель накопились ситуации, где сформулированная заранее тема потом действительно проявлялась в моих действиях или событиях. Например, на неделю 9-15 сентября система выделяла тему структуры и формализации рабочих контуров. Наиболее выраженной точкой называлось 14 сентября.
14 сентября я упаковал разработанный мной алгоритм исследования в отдельный рабочий процесс и передал повторяемую предварительную часть инженеру, оставив за собой фильтрацию и финальные решения.
Другой пример появился позже. 21 сентября система сформулировала для 24 сентября тему изменения курса: при появлении новых фактов изменение процесса или приоритета может оказаться полезнее продолжения работы по инерции. 24 сентября я анализировал распространение коротких видео. Из четырёх площадок устойчивый результат показывала только одна. Я перестал одинаково работать со всеми площадками и изменил подход там, где уже был наблюдаемый сигнал.
Ещё один пример связан с моей группой предпринимателей. 21 сентября система сформулировала для 26 сентября отдельную гипотезу: после расширенных встреч разобрать наблюдаемые факты о группе и сделать собственную оценку более конкретной. 26 сентября прошёл большой совместный разбор. После него у меня стало значительно больше фактической информации о других участниках, их результатах и направлениях движения. По моему кейсу появилось около тридцати отдельных гипотез для дальнейшего исследования. Моё отношение к формату стало конкретнее, чем было до этих встреч.
Это интересные совпадения. Пока именно совпадения и материал для дальнейшей проверки.
Как я проверяю совпадения, а не просто замечаю их задним числом
Сейчас у меня есть 24 оценки обратной связи по ранее сохранённым сигналам.
- 17 из них я отметил как совпавшие.
- 7 - как совпавшие частично.
Но складывать эти случаи в одну цифру “точности” нельзя.
15 оценок относятся к сигналам, опубликованным до дня соответствующего события. Среди них 11 получили от меня оценку “да” и 4 - “частично”.
Ещё 9 относятся к сигналам, опубликованным уже в течение соответствующего дня. Среди них 6 отмечены как совпавшие и 3 - как частичные.
Для проверки прогнозной способности это разные классы данных. Поэтому оснований говорить о подтверждённой точности системы пока нет. Выборка маленькая.
Пользователь пока в основном один - я.
Часть недельных и дневных сигналов пересекается.
Одно событие может соответствовать нескольким близким гипотезам.
Кроме того, если человек прочитал сигнал заранее, этот сигнал потенциально способен повлиять на его собственное поведение.
Для меня эти числа означают только одно:
Данных уже достаточно, чтобы перейти от впечатления “удивительно совпадает” к накопительной проверке.
Как я защищаюсь от знания будущего
Представим, что утром система сформулировала гипотезу.
Днём что-то произошло.
Вечером я добавил событие в память.
Если после этого снова пересчитать тот же день, новая информация уже известна системе.
Так очень легко получить красивое совпадение задним числом и принять его за качество первоначального сигнала.
Поэтому система отдельно хранит момент публикации гипотезы, последующие обновления и связь между ними.
Информация, появившаяся позже, не должна незаметно улучшать первоначальный прогноз.
Для такого продукта это одна из самых важных частей архитектуры.
Без неё накопительная система быстро превращается в механизм подтверждения собственных ожиданий.
Самое интересное наблюдение пока не про точность
В заявке в Sber500xDisrupt меня особенно интересовало повторное использование. Возникнет ли причина возвращаться?
На уровне рынка ответа пока нет. У продукта нет большой аудитории, данных об удержании по когортам, подтверждённой экономики и данных о массовом использовании.
Но на одном пользователе я уже вижу важный для себя сигнал. На себе. Мне действительно хочется возвращаться к системе, причём не столько ради нового расклада. Мне интересно утром посмотреть на выделенные темы, в течение дня заниматься обычной жизнью, потом записать произошедшее и спустя время увидеть повторения. А затем вернуться назад и проверить, что система формулировала до события. Получился цикл наблюдения, которого я не закладывал в первоначальное название “ИИ-таролог”.
Чем больше истории, тем меньше продукт зависит от Таро
За время использования внутри моего профиля накопилось больше ста отдельных наблюдений. Это рабочие решения, исследования, изменения продуктовых гипотез, коммуникация и выбор между альтернативами. Некоторые темы повторяются на разных датах.
Система начинает работать уже не только с описанием человека внутри какой-либо методологии. У неё появляется фактическая история того, что с человеком происходило.
Можно смотреть, какие ситуации повторяются.
Какие решения я принимаю в похожих условиях.
Где появляется один и тот же тип ограничений.
Какие гипотезы подтверждаются чаще, а какие нет.
Как со временем меняется одна и та же тема.
Таро или нумерология могут предложить вопрос.
Накопленная история постепенно даёт системе другой класс контекста.
Работает ли Таро - для продукта это не главный вопрос
Я не использую Таро, нумерологию или астрологию как научно подтверждённые причинные модели будущего. Внутри самой системы они обозначаются как символические расчётные или проективные источники.
Например, Таро может дополнительно подсветить похожую тему. Но оно не увеличивает автоматически количество независимых расчётных подтверждений.
- Если тема появилась только в Таро, система должна уметь так и сказать.
- Если её поддерживает одна расчётная методология - это другой уровень.
- Если сходятся несколько независимых расчётных источников - третий.
- Если похожая тема ещё и неоднократно возникала в фактических наблюдениях пользователя, появляется дополнительный поведенческий контекст.
Пользователь должен видеть эту разницу.
Что имею сейчас
После первых исследований я называл продукт персональным ИИ с долговременной памятью.
После нескольких недель разработки и регулярного использования определение стало точнее:
AiBrain - накопительная персональная система самонаблюдения, которая формулирует проверяемые гипотезы о человеке и его текущем периоде, сохраняет их во времени, сопоставляет с последующими событиями и помогает замечать повторяющиеся темы в контексте собственной жизни.
Источники внутри могут быть разными. Сами источники не являются продуктом. Продуктовый контур для меня сейчас выглядит так:
- человек живёт свою обычную жизнь;
- система заранее формулирует ограниченные гипотезы;
- реальные события постепенно пополняют персональный контекст;
- обратная связь связывает гипотезы с последующим результатом;
- на длинной дистанции появляется история повторений, решений и изменений.
Если этот цикл окажется полезным другим людям, у продукта появится глубина, которой нет у обычного генератора раскладов.
Почему “ИИ-таролог” остаётся входом, но уже не описывает продукт
Таро решает важную продуктовую задачу. Оно понятно, создаёт естественный повод задать вопрос, даёт ритуал взаимодействия и снижает абстрактность идеи “накопительной системы самонаблюдения”.
Но потенциальная основная ценность находится дальше.
В накопленной истории.
В возможности возвращаться к старым ситуациям.
В проверке гипотез во времени.
В поиске повторяющихся сценариев.
В разделении факта, расчёта, наблюдения и интерпретации.
И в вопросе, который система со временем сможет задавать всё точнее:
Это действительно повторяющийся сценарий твоей жизни или очередное совпадение, которому хочется придать значение?
Ранее я отдельно исследовал ИИ-Таро, астрологию и ИИ-дневники и разбирал существующих конкурентов ИИ-таролога. Сейчас эксперимент перешёл из исследования категории в собственное использование продукта.
Что изменил отказ Sber500xDisrupt
Я хотел пройти Sber500xDisrupt не ради строчки об акселераторе. Мне был интересен опыт построения массовых продуктов для частных пользователей.
У меня уже был опыт создания пользовательских ИИ-сервисов, реальных регистраций, оплат и повторного использования. Но устойчивую систему массового привлечения и удержания пользователей я раньше не построил.
Именно эту компетенцию мне особенно хотелось получить внутри программы. Теперь её придётся проверять другим способом.
Технологическая часть эксперимента при этом уже началась.
Следующие вопросы у меня конкретные.
Будет ли человек, кроме меня, регулярно возвращаться в такой продукт?
Через какое время накопленная память начинает ощущаться полезной?
Какие источники добавляют ценность, а какие только создают шум?
Нужен ли Таро после того, как система накопила достаточно фактических наблюдений?
Можно ли на длинной дистанции честно измерять качество заранее опубликованных гипотез?
Сколько персональных данных человек готов доверить такой системе?
И за какую работу здесь вообще готовы платить?
С этих вопросов начинается следующий этап. Я пришёл в этот эксперимент через исследование ИИ-таролога для Sber500xDisrupt. В Sber500xDisrupt я не прошёл. Продуктовый эксперимент продолжаю.
Строю ИИ-продукт для частных пользователей
- 1Заявку в Sber500xDisrupt я отправил. Но продукт для меня не про Таро
- 2Я прочитал правила Sber500xDisrupt. 35 обращений оказались совсем не тем, что я думал
- 3Я исследовал ИИ-таро, астрологию и ИИ-дневники. Самого Таро для продукта оказалось мало
- 4Конкуренты ИИ-таролога: что уже есть в России и за рубежом
- 5Мне отказали в Sber500xDisrupt. За это время ИИ-таролог стал другим продуктом