Как Blue J быстро масштабируется в сложных и регулируемых сферах
Компания Blue J вышла на рынки трёх стран и завоевала доверие более 3000 фирм благодаря четкой специализации, глубокому знанию предметной области и правильной модели OpenAI.

2.7
Часа экономии на одного пользователя в неделю
1/700
Менее 1 ответа из 700 вызывают споры
Традиционные налоговые исследования начинаются с изучения сотен источников еще до того, как они будут проанализированы. Затем налоговые эксперты тратят часы на изучение законов, регламентов, постановлений, прецедентного права и экспертных комментариев, чтобы понять взаимосвязь правил и сформировать ответ.
В зависимости от сложности вопроса этот процесс может занять часы, дни или даже недели — и всё равно привести к противоречивым или устаревшим результатам, причем любая упущенная деталь влечет за собой реальные финансовые потери.
Компания Blue J была основана в 2015 году профессорами и практиками в области налогового права, которые осознали необходимость создания лучших инструментов для налоговых исследований. Опираясь на первые эксперименты по применению ИИ для прогнозирования исходов дел в налоговом праве, команда продолжила разработку различных продуктов для поддержки налоговых и бухгалтерских фирм любого размера.
Когда появился ChatGPT, в Blue J увидели возможность создать нечто принципиально новое: объединить расширенные возможности рассуждения над сложными нормативными актами со структурированным поиском, чтобы за считанные секунды выдавать ответы налогового уровня экспертной точности, дополненные встроенными цитатами и списками источников, которым профессионалы могут доверять.
Всего через два года после запуска Blue J развернула поисково-аналитическую систему на базе GPT-4.1 в США, Канаде и Великобритании. Свой первый продукт они выпустили всего через шесть месяцев после дебюта ChatGPT, а затем быстро проводили итерации, учитывая отзывы пользователей и создавая надежную структуру для оценки качества.
Сегодня более 70% пользователей заходят в систему еженедельно, а доля несогласных с ответами составляет менее 1 из 700 случаев. Специалисты Blue J поделились опытом выхода в сложную сферу и быстрого масштабирования за счет того, что доверие, точность и скорость стали для них бескомпромиссными приоритетами.
«Мы двигались быстро, потому что уже знали суть проблемы и пути ее решения. OpenAI предоставила нам именно то качество модели, которое было необходимо для масштабирования этой экспертизы».
Использование опыта в предметной области для создания уникального решения
Налоговое решение от Blue J построено на базе системы поиска с дополненной генерацией (RAG), объединяющей GPT-4.1 с проприетарной библиотекой, насчитывающей миллионы тщательно отобранных документов, включая авторитетные первичные источники и экспертные комментарии из таких изданий, как Tax Notes.
Когда пользователь задает налоговый вопрос вроде «Что такое «соляная торпеда» (SALT torpedo), созданная законом OBBBA, и как ее можно смягчить?», Blue J мгновенно находит необходимый материал, а GPT-4.1 синтезирует его в четкий ответ со всеми ссылками, который звучит скорее как рекомендация от надежного коллеги, чем как результат работы алгоритма. Эту систему могла создать только команда, свободно ориентирующаяся как в налоговом деле, так и в технологиях.
«Мы протестировали множество моделей, и GPT-4.1 — это та модель, которая неизменно делает то, что нам нужно, — говорит Янссен. — Она следует инструкциям, учитывает контекст и справляется с нестандартными кейсами лучше всего, что мы видели».
Масштабирование доверия через отзывы пользователей
В налоговой сфере даже небольшие ошибки могут спровоцировать аудиты, задержать подачу документов или стоить клиентам реальных денег. Команда Blue J на собственном опыте знала, что даже редкие исключения могут подорвать доверие, если их не выявлять и не исправлять вовремя. Поэтому с первого дня продукт проектировался так, чтобы собирать обратную связь и совершенствоваться в масштабах всей системы, опираясь на экспертные знания команды налоговых исследователей.
Чтобы система становилась лучше с каждым использованием, компания Blue J внедрила опциональный обмен данными для клиентов, которые хотели внести свой вклад в улучшение продукта. Каждый ответ Blue J содержит кнопку «не согласен», и при ее нажатии ответ систематически классифицируется по типу проблемы, налоговой теме и вероятной первопричине.
Этот цикл позволяет находить разовые ошибки и выявлять закономерности. Если запросы по налогам партнерств работают недостаточно хорошо, команда проводит расследование. Если промпт выдает противоречивые результаты, его настраивают. Модель GPT-4.1 обслуживает этот уровень триажа, анализируя тысячи отзывов, группируя связанные проблемы и помогая командам разработки и налоговых исследований Blue J сосредоточить усилия там, где они принесут наибольшую пользу.
Поскольку GPT-4.1 отвечает стабильно, даже небольшие улучшения дают накопительный эффект. В результате получается система, которая учится на каждом взаимодействии, обеспечивая более быстрые итерации, более высокое качество ответов и развитие продукта в ногу с потребностями пользователей. Этот маховик помог Blue J снизить показатель несогласий до менее чем 1 на каждые 700 ответов.
Итеративная разработка продуктов также помогает Blue J опережать изменения. Когда в 2025 году был принят масштабный пакет налоговых законов США, команда уже потратила шесть недель на картирование его влияния на кодовую базу. Всего через несколько часов после подписания законопроекта пользователи уже видели обновленные ответы в рабочей среде.
В сфере, где правила постоянно меняются, а точность имеет решающее значение, эта замкнутая система позволяет Blue J оставаться быстрой, заслуживающей доверия и опережать рынок.
Проектируйте оценки так, чтобы они задавали новую планку, а не просто проверяли результат
Качество модели — это не просто функция, это контролирующий барьер. Blue J оценивает каждый выпуск новой модели с помощью набора бенчмарков, включающего более 350 промптов по налоговому законодательству США, Канады и Великобритании. Каждая модель проверяется на соответствие инструкциям, согласованность с источниками и ясность ответов, что гарантирует подкрепление улучшений в промптах или логике поиска предсказуемым поведением в реальных условиях.
«Несмотря на то что мы протестировали их все, мы никогда не выпускали в продакшн модели не от OpenAI, — говорит Янссен. — Модели OpenAI стабильно превосходят другие решения по нашим внутренним бенчмаркам, особенно в том, что касается следования инструкциям и выдачи ответов, соответствующих нашим стандартам реального использования».
Используйте экспертизу в своей области как конкурентное преимущество
Клиенты полагаются на Blue J как на основной инструмент налоговых исследований круглый год, а не только в сезон сдачи отчетности. Более 70% пользователей заходят в систему еженедельно, экономя 2,7 часа на каждого пользователя в неделю при проведении исследований и общении с клиентами — это время они инвестируют в более прибыльное планирование и консультационную работу.
Компания Blue J завоевала такое доверие, сосредоточившись на том, что она знает лучше всего: на реальных потребностях налоговых профессионалов. Модель GPT-4.1 усиливает их экспертизу благодаря структурированным результатам, стабильному следованию инструкциям и надежным результатам. Для основателей вывод очевиден: используйте свою узкоспециализированную экспертизу в качестве главного преимущества и применяйте правильные модели для масштабирования.
OpenAI <3 стартапов
Полный текст статьи читайте на OpenAI
