Bitrix AI Challenge

Бенчмарк AI-агентов на реальной задаче 1С-Битрикс. Сравниваем связки «приложение + модель + скиллы»: один заказ веб-студии, живой стенд, две оценки — модели-ревьювера и автора.

Задача: «Лак&Точка» Лендинг студии маникюра с онлайн-записью Задача Методология →
Все связки
Связка Срезы Оценка Итер. Мин Токены in/out Расход
Тир B · 70–84
Лендинг связки Cursor · Grok 4.6 High

Работает с первого прогона: узнаваемый первый экран и настоящая D7-архитектура с гонкой на уровне БД, но лендинг после первого экрана и английские заголовки референса тянут визуал вниз.

Виз
66
Бэк
79
71.7
√(В·Б)
1 45 628.2K / 146.1K
кеш ввода 17.5M
кеш вывода 0
2% мес.
тариф Pro ($20)
Прогон →
Балл критерия = среднее оценок модели-ревьювера и автора · срез = сумма 0–100 Оценка = √(Визуал · Бэкенд) · тиры по полосам балла, внутри тира различия не интерпретируются Итерации: 1 = с первого прогона, лимит 10 · под токенами — кеш ввода и вывода; расход — как есть ($ API или % лимита тарифа), между приложениями не сравнивается
Мы используем файлы cookie для улучшения работы сайта. Продолжая использовать сайт, вы соглашаетесь с нашей политикой конфиденциальности.
AI Домовой

AI Домовой История

на связи

пишет…
Нет истории чатов
AI Домовой

Нужна авторизация

Войдите, чтобы задавать вопросы AI Домовому.

Войти