| name | cost-aware-orchestrator |
| description | Интеллектуальный выбор модели/инструмента с учётом цены и сложности задачи. Каждый tool call = деньги. Минимизируй стоимость без потери качества. |
| tags | ["cost","optimization","provider-selection","tokens"] |
Cost-Aware Orchestrator — Оркестратор с учётом стоимости
Активировать: перед каждой задачей, где есть выбор между моделями/инструментами.
Цель: Потратить минимум денег на задачу, сохранив качество результата.
Текущая ценовая карта
| Канал | Модель | Input/1M | Output/1M | Для чего |
|---|
| Polza (DeepSeek V4 Flash) | Основной чат | 26.88₽ | 53.76₽ | Разговор с пользователем, простые задачи |
| AITunnel (GPT-5 Nano) | delegation | 0.96₽ | ? | Тяжёлые delegate_task, сложная логика |
| AITunnel (Gemini 2.0 Flash Lite) | Рутина | 14.4₽ | 57.6₽ | Средние задачи, ресёрч |
| AITunnel (gpt-image-2) | Картинки | — | ~0.86-7.64₽/img | Генерация изображений |
Decision Tree выбора модели
Какой тип задачи?
│
├─ 🔵 Разговор с пользователем
│ → DeepSeek V4 Flash (Polza) — всегда. Это основной канал.
│
├─ 🟢 delegate_task (лёгкая)
│ Признаки: 1-3 шага, простой запрос, чтение данных
│ → DeepSeek V4 Flash (Polza) — нет смысла переключать
│
├─ 🟡 delegate_task (средняя)
│ Признаки: 4-10 шагов, циклы, немного логики
│ → Gemini 2.0 Flash Lite (AITunnel) — 14.4₽ vs 26.88₽
│
├─ 🔴 delegate_task (сложная)
│ Признаки: код с бизнес-логикой, парсинг, анализ данных, многопаговый reasoning
│ → GPT-5 Nano (AITunnel) — 0.96₽, дешевле DeepSeek в 28 раз!
│
├─ 🟣 Генерация изображений
│ → gpt-image-2 (AITunnel) с коротким промптом
│ Совет: промпт ≤50 токенов = ~0.86₽. >100 токенов = ~7.64₽
│
└─ ⚪ Ресёрч / сбор информации
→ Gemini 2.0 Flash Lite (14.4₽) — достаточное качество
Когда НЕ экономить
- Пользователь явно просит качество — не экономь
- Код в production — лучше потратить 10₽ на ревью, чем 1000₽ на баг
- Финансовые данные — точность важнее цены
- Первая итерация нового подхода — сделай на лучшей модели, потом шаблонизируй
Cost Budgeting по задаче
Перед задачей прикинь бюджет:
| Тип задачи | Разумный бюджет | Стоп-лосс |
|---|
| Ответ на вопрос | 1-3₽ | 10₽ |
| Написать код | 5-15₽ | 30₽ |
| Ресёрч | 10-20₽ | 50₽ |
| Генерация картинки | 0.86-3₽ | 10₽ |
| Целая фича | 20-50₽ | 100₽ |
Если бюджет превышен на 50% — остановись и спроси пользователя.
Cost-Saving Patterns
- Bulk через execute_code — 1 tool call вместо N. Экономия: 50-70% на overhead tool calls
- Delegate на дешёвую модель — для тяжёлой работы. Экономия: до 95%
- Короткие промпты для картинок — 50 токенов vs 200 = 0.86₽ vs 7.64₽
- Отложенная верификация — не проверяй каждый шаг, проверь в конце
- Остановись на 80% — если задача решена на 80%, а добивка стоит 50% бюджета — спроси пользователя
- Batch однотипных задач — 10 задач в одном delegate_task вместо 10 отдельных
Anti-Patterns
- ❌ Экономия на спичках — переключение модели ради задачи на 0.5₽ (overhead переключения > экономии)
- ❌ Жадность — послать сложную задачу на дешёвую модель, получить мусор, переделывать (cost ×3)
- ❌ Забыть про выходные токены — DeepSeek output (53.76₽) дороже input (26.88₽) в 2 раза
- ❌ Долгий промпт для картинок — каждое лишнее слово = деньги