← к блогуОбсудить проект
// AI
AI-ассистент заявок: 5 минут → 30 секунд
Заявки обрабатывались дольше пяти минут и стоили дорого: каждая шла в тяжёлую модель целиком. Нужно было ускорить и удешевить — одновременно.
Идея каскада
Не всё нужно гнать в дорогую модель. Лёгкие случаи решает дешёвая, сложные — эскалируются. Маршрутизацию собрал на n8n + OpenRouter, с кэшем повторов на Redis.
- Каскадная маршрутизация: дёшево → дорого только при необходимости.
- Кэш ответов на типовые заявки.
- Real-time мониторинг очереди в админке на WebSocket.
Снизил стоимость API в 10 раз — не оптимизацией промптов, а архитектурой решения.
Время обработки упало с 5 минут до 30 секунд, канал вышел на 12 млн ₽/мес. И всё это видно в реальном времени на одном экране.
Есть похожая задача?
Расскажите — вернусь с оценкой в тот же день.


