Главная/Услуги

Четыре направления, одна граница ответственности

Каждое направление описано одинаково: что входит в работу, что нужно от вас, что получите на выходе и где проходит граница. Это те же четыре промера, что на карте на главной.

промер 1

Агентные системы

Агент, который делает полезную работу в ваших системах и не выходит за описанные правила. Каждый вызов инструмента описан контрактом, рискованные действия подтверждает человек.

Что входит

  • оркестрация и цикл «рассуждение — действие» на ядре Protocore
  • контракты инструментов: что агент может вызывать и с какими правами
  • память и состояние между шагами, восстановление после сбоя
  • точки подтверждения человеком для рискованных действий
  • защита от prompt injection и журнал всех действий

Что нужно от вас

  • описание процессов, которые должен выполнять агент
  • доступ к системам, с которыми он работает: база, API, документы
  • человек на вашей стороне, который отвечает за правила

Результат

  • агент с описанными контрактами инструментов
  • журнал действий и точки подтверждения
  • сценарии, на которых проверяется поведение

Граница ответственности

Мы отвечаем за поведение агента в описанных сценариях. Правила бизнеса и права доступа задаёте вы.

промер 2

RAG и семантический поиск

Поиск по вашим документам, качество которого измерено, а не «кажется хорошим». Гибридный поиск и реранкинг отбирают фрагменты, которые действительно отвечают на вопрос.

Что входит

  • чанкирование и подготовка корпуса
  • эмбеддинги и векторный индекс внутри контура
  • гибридный поиск: лексический плюс семантический
  • реранкинг и фильтрация шума
  • оценка качества retrieval на регрессионном наборе

Что нужно от вас

  • корпус документов в любом формате
  • хотя бы несколько десятков вопросов с ожидаемыми ответами
  • эксперт, который скажет, какой ответ правильный

Результат

  • поисковый контур с измеренным качеством
  • регрессионный набор, который можно прогонять при изменениях
  • описание, как обновлять корпус

Граница ответственности

Качество измеряется на согласованном наборе. Данные и индекс остаются в вашем контуре.

промер 3

Self-hosted inference

Открытые модели на вашем железе через vLLM и Kubernetes. Никаких внешних API: модели, запросы и логи не покидают периметр.

Что входит

  • vLLM в Kubernetes или на выделенных серверах
  • выбор открытых моделей под задачу и железо
  • производительность: батчинг, квантование, стоимость запроса
  • мониторинг и алерты
  • описание эксплуатации для вашей команды

Что нужно от вас

  • доступ к кластеру или серверам с GPU
  • требования по безопасности и сети
  • понимание нагрузки: сколько запросов и какой задержки ждёте

Результат

  • работающий inference-сервис с мониторингом
  • документ по эксплуатации и обновлению моделей
  • замеры производительности и стоимости

Граница ответственности

Мы настраиваем и передаём. Железо, сеть и доступы остаются вашей зоной.

промер 4

Evals и наблюдаемость

Измерение, которое показывает, стало ли лучше после каждого изменения: смены модели, промпта, индекса. Деградация видна до того, как её увидит пользователь.

Что входит

  • регрессионные наборы на ваших данных
  • LLM-как-судья с проверкой на людях
  • метрики качества и панель для команды
  • мониторинг качества в проде
  • прогоны при каждом изменении системы

Что нужно от вас

  • доступ к логам системы
  • участие эксперта предметной области в разметке
  • критерии, что считается хорошим ответом

Результат

  • панель качества
  • регрессионные прогоны при каждом изменении
  • отчёты и план улучшений

Граница ответственности

Мы строим измерение. Решение о выкатке принимает ваша команда.

Стек: Python, asyncio, FastAPI, PostgreSQL, vLLM, Kubernetes. Только то, что реально используем. Цены на сайте не публикуем: формат работы — оценка под задачу после разбора. Опишите задачу, и мы предложим время созвона.