Испытания

Испытания YappiX AI: архитектура и замеры стоимости

Как устроен иерархический оркестратор YappiX AI и сколько стоит одна и та же задача разработки в YappiX AI, в Claude и в Cursor. Авторский протокол полевых замеров на задачах реальных проектов.

Обновлено 1 октября 2026

Схема

Как задача становится работающим продуктом

Задача на русском языке не уходит целиком одной модели. Планировщик раскладывает её на граф подзадач по базе знаний: рекомендованным стекам, дизайн-системам, базам данных, рецептам и запретам. Каждую подзадачу выполняет минимально достаточная модель или программный шаг без модели, а результат принимается только после исполняемой проверки — сборки, ответа работающего приложения, входа администратора.

Поэтому пользователю не нужно знать языки программирования, стеки, базы данных и устройство серверов. Доступ к моделям, хранилище кода, база данных и размещение проекта в базовом объёме входят в одну подписку в рублях.

Задача заказчика обычными словами, на русском«Сделай сайт мастерской с каталогом и заказами, вести буду сама»
1 Планировщик
Черновик плана — без обращения к моделиграф подзадач с зависимостями по признакам задачи и базе знаний
Одно уточнение сильной моделью тарифажёсткий лимит ответа; вопросы заказчику по бизнес-логике — одним сообщением, у каждого есть допущение по умолчанию
Валидатор планабез циклов, не более 12 подзадач, стек и дизайн-система — из базы знаний, команды — из белого списка; при нарушении — черновик, причина в журнал
База знаний владельца платформы
  • 7 стеков: Next.js + Payload CMS, Expo, телеграм-бот, API на Python
  • 6 дизайн-систем: shadcn/ui, Flowbite, Mantine, Ant Design и др.
  • базы данных, 10 готовых библиотек
  • запреты: что агенту нельзя предлагать
  • 15 умений-рецептов с точными командами и критериями готовности
граф подзадач: 12 видов, от создания проекта до публикации 2 Цикл каждой подзадачи провал проверки → повтор с выводом ошибки или уровнем выше
Маршрутизаторуровень по виду подзадачи (быстрая · рабочая · сильная) — по таблице и в пределах тарифа; не более 3 попыток и 2 эскалаций
Исполнительполучает только постановку, 1–2 умения и сжатые сводки предшественников — не всю историю переписки
Исполняемая проверкакомпиляция и сборка, файлы, ответ работающего приложения, вход администратора, правила базы знаний
служебный шаг
Без моделипроект и база, ключи, каркас, установка, сборка, предпросмотр
вызов модели пройдено
Сводка → следующая подзадачакраткий итог идёт в контекст зависимых подзадач
Учёт стоимости ходафактические токены × цена уровня; у лимита тарифа — без сильных моделей
Модельный шлюзDeepSeek, GLM, Kimi (открытые веса) · локальная модель на компьютере пользователя · Claude и GPT — необязательная опция. Виртуальные ключи клиентов, бюджеты тарифов, резервные поставщики на каждом уровне, кэш поставщика.
3 Результатработающий проект: база данных, первый администратор, готовая дизайн-система, сборка, публикация с доменом и сертификатом; вопросы по бизнес-логике — одним сообщением
4 Журнал траекторийплан, решения маршрутизатора, исходы проверок, токены и стоимость каждой подзадачи → обучающие выборки для исполнителя, планировщика, маршрутизатора и верификатора. Обученные модели заменяют эвристики выбора уровня и проверки (этап 2 исследования).
Иерархический оркестратор YappiX AI. Сплошные стрелки — поток задачи, штриховая оранжевая — повтор при провале проверки, штриховые зелёные — данные базы знаний и обратная связь от журнала.

Параметры

Параметры реализации

ЧтоКак устроено
Виды подзадач12: платформа (проект, репозиторий, база данных), каркас, модель данных, начальные данные, дизайн-система, код, проверка, исправление, предпросмотр, память проекта, вопросы заказчику, публикация
ПланировщикЧерновик без модели → одно уточнение сильной моделью тарифа → валидатор. Не более 12 подзадач и 10 вопросов; обязательные подзадачи восстанавливаются
Уровни моделейТри: быстрая, рабочая, сильная. Уровень назначает таблица по виду подзадачи, а не модель, и только в пределах тарифа
ЭскалацияТолько по факту провала проверки: не более 3 попыток и 2 эскалаций на подзадачу, 3 эскалаций за ход. Вывод ошибки — до 3 000 знаков — передаётся следующей попытке
Исполняемые проверкиКоманда из белого списка (компиляция, сборка) с таймаутом; наличие и содержимое файлов; ответ работающего приложения; вход администратора; правила базы знаний — подключена дизайн-система, нет секретов в коде, нет запрещённых решений
База знаний7 стеков, 6 дизайн-систем, базы данных, 10 готовых библиотек, инфраструктурные решения, запреты; 15 умений-рецептов, каждое задаёт и белый список команд
Шаги без модели5 из 11 шагов в сценарии «сайт с панелью администратора»
БезопасностьКлючи и пароли не передаются модели и не попадают в журналы; у каждого проекта клиента своя база данных и роль
Качество кода232 автоматических теста: 149 — ядро, 68 — расширение среды, 15 — конвейер данных
Данные для обученияЖурнал 305 траекторий реальных задач с оценками пользователей: 197 приняты, 7 исправлены, 40 отклонены

Журнал шлюза

Что измерено по журналу модельного шлюза

ПоказательЗначение
Соотношение входных и выходных токенов в агентном цикле≈ 12 : 1
Стоимость задачи: малой / средней≈ $0,02 / ≈ $0,11
Стоимость тяжёлой задачи: рабочая / сильная модель≈ $0,57 / ≈ $1,36
Высокая доля входа — следствие того, что агент с единым циклом на каждом шаге заново отправляет всю переписку. Оркестратор уменьшает именно этот множитель: узкий контекст подзадачи и шаги без модели.

Протокол

Протокол полевых испытаний

Цель — сравнить стоимость одинаковых задач разработки в распространённых конфигурациях ИИ-сред и в YappiX AI. Объект — задачи реальных проектов: платформа «Мой Союз» и портал региональной профсоюзной организации работников здравоохранения, система «Протокол» для университета. Те же задачи выполнялись в каждой конфигурации; учитывались фактические расходы по счетам поставщиков и по лимиту тарифа. Пересчёт по курсу ЦБ РФ 84,26 ₽ за доллар на 13 сентября 2026 года.

КонфигурацияМодель и режимЗатратыВ рубляхПримечание
ClaudeClaude Opus 5.5, режим MAX≈ $100 за прогон≈ 8 400 ₽—
Cursor, модели Claude через API CursorClaude≈ $400≈ 33 700 ₽Лимит исчерпан за 5 часов
Cursor, нативный режимGrok 4.7, режим MAX22 % месячного лимита тарифа Ultra ($200)≈ 3 700 ₽С 4 сентября 2026 года недоступен пользователям из России
YappiX AI, иерархический оркестраторClaude, Kimi и DeepSeek по подзадачам, база знаний и проверки3 900 ₽ за проект3 900 ₽Проект выполнил пользователь с базовыми навыками работы на компьютере
Результат: в YappiX AI стоимость в 2,2 раза ниже, чем при работе напрямую с Claude Opus 5.5 в режиме MAX, и в 8,6 раза ниже, чем с моделями Claude через Cursor. С Grok 4.7 в Cursor затраты сопоставимы, но YappiX AI доступен в России, оплачивается в рублях, доводит проект до публикации с базой данных и не требует навыков программирования.
  • Это разовые полевые замеры, а не серия: среды различаются устройством цикла и ценообразованием, а стоимость в YappiX AI ограничена месячным тарифом.
  • Контролируемая серия — следующий шаг: 20 задач × 3 прогона × 4 условия (агент на одной модели, агент на сильной модели, оркестратор без уточнения плана моделью, полный оркестратор), парные сравнения и бутстрэп-интервалы. Гипотеза — снижение стоимости решённой задачи не менее чем в 2 раза при доле решённых задач не ниже базовой.
  • Результаты серии опубликуем на этой странице.

Проверить

Где посмотреть работающие системы

«Протокол»

Запись совещания → стенограмма с выступающими → протокол по бланку → маршрут подписи. Создан с помощью YappiX AI для университета.

«Мой Союз»

Платформа для членов профсоюза: заявки со статусами, сообщения, документы и электронная подпись, ИИ-помощник.

YappiX Work OS

Корпоративная платформа: задачи, сделки, ИИ-наставник, развитие и обучение сотрудника. В разработке.

Свидетельство Роспатента

Программа для ЭВМ «YAPPIX AI», № 2026686682 от 1 сентября 2026 года. Правообладатель — ООО «ЯППИКС».

Попробовать самому

YappiX AI для macOS, Windows и Linux. Бесплатный тариф без карты.