Один ИИ-процесс обработал 6 418 529 757 токенов при работе примерно с 460 статьями. Расчётный эквивалент использования через API составил около $25 000. Большая часть потерь возникла после того, как полезная работа над текстами уже была выполнена.
Агенты повторно открывали принятые статьи. Рецензенты получали устаревшие файлы. Несовпадение хеша запускало новое смысловое чтение. Точные факты о публикации поручались дорогой модели. Управляющий агент видел состояние отдельных веток, но не остановил общее дерево из 222 веток и 564 ходов.
Мед ИТ (MYOD.IT) помогает перестроить такие процессы до массового запуска. Мы определяем один текущий источник, один измеримый результат, строгую последовательность состояний, программные проверки, общий предел расходов и автоматическое условие остановки. Сначала весь путь проверяется на одном рабочем случае.
Подробная хронология и причины разобраны в статье «Как GPT-5.6-Sol Xhigh сжёг 6,4 млрд токенов на переписывании 460 статей». Здесь собран контур, который не даёт повторить этот провал.
Первое ограничение определяет, что считается завершением
Задачи для ИИ часто формулируются как деятельность: переписать страницы, проверить документы, найти компании, разобрать заявки или следить за событиями. Такая формулировка не сообщает системе, когда нужно остановиться.
Завершение должно описывать наблюдаемый результат в целевой системе. Для очереди статей требовались следующие признаки:
- выбран утверждённый текущий файл;
- в WordPress создана запись типа
post; - дата совпадает с реестром публикаций;
- статья видна в правильном разделе административной панели;
- страница нормально открывается по ожидаемому адресу;
- заголовок, призывы к действию и форма отображаются без дефектов.
После успешной проверки одного материала и использования того же программного маршрута для очереди полное повторное чтение всех статей не добавляет полезного результата.
Семь ограничений против бесконечной проверки
1. Один текущий источник для каждого задания
Каждая единица работы указывает на один файл, запись, снимок данных или версию источника. Автор и рецензент получают этот источник и его номер версии. Старые копии и отчёты не передаются как равноправные основания.
После изменения текущей версии прежнее заключение либо применяется через зафиксированное исправление, либо помечается устаревшим. Сам по себе старый отчёт не может снова открыть принятую работу.
2. Строгая последовательность состояний
Для статьи можно использовать состояния «готово к написанию», «написано», «проверено», «исправлено», «готово к размещению», «запланировано» и «проверено на сайте». Переход требует короткого и понятного подтверждения.
Если отсутствует дата, статья возвращается только к планированию. Если WordPress создал неправильный тип записи, исправляется публикация. Полная смысловая проверка повторяется только при новом дефекте в текущем тексте.
3. Программные проверки до обращения к модели
Наличие файла, структура данных, дата, идентификатор, дубли, тип записи, код ответа страницы и обязательные метки проверяются кодом. Программа возвращает точную строку и нарушенное правило. Модель получает только исключения, где действительно нужно толкование.
Одна неправильная строка не должна делать подозрительными остальные 459 материалов.
4. Общий бюджет всего дерева задачи
Бюджет основной задачи включает дочерних агентов, рецензентов, повторные попытки и унаследованный контекст. Локальный счётчик одного агента не показывает общую стоимость. Все расходы связываются с единым номером задачи.
Пороговые действия задаются заранее:
- при 50 процентах сравнить расход с количеством принятых результатов;
- при 75 процентах запретить новые дочерние задачи и завершить текущие;
- при 90 процентах разрешить только точную проверку и обязательное исправление;
- при 100 процентах автоматически остановить процесс и вернуть сохранённое состояние.
5. Одно написание и одна независимая проверка
Рецензент сравнивает текущий файл с фиксированными требованиями. Замечание содержит номер, место, наблюдаемую проблему и требуемое исправление. Общие вкусовые пожелания не открывают уже принятые разделы.
После точечного исправления программа проверяет, что нужное место изменилось, а файл остался корректным. Ещё одна полная рецензия требует нового доказательства существенного дефекта.
6. Один пробный запуск до массовой обработки
Пробный материал проходит по тому же коду, тем же состояниям, разрешениям и целевой системе, которые будут использоваться для всей очереди. Для публикации недостаточно зелёного отчёта и локального файла. Статья должна появиться в реальном WordPress и нормально отобразиться на странице.
После приёмки способ фиксируется. Процесс не проектируется заново внутри каждой статьи.
7. Условия остановки, которые выполняются автоматически
Фраза «следить за расходами» не является ограничением. Система должна уметь остановиться при исчерпании токенов, достижении расчётной стоимости, превышении времени, повторном дефекте, изменении источника, отсутствии полномочий или провале пробного запуска.
При остановке сохраняются готовые результаты и возвращается точная причина. По умолчанию остановка не запускает более широкий аудит.
Что руководителю нужно выяснить до запуска
Начните с массовых задач, процессов с дочерними агентами, повторных смысловых проверок, большим контекстом, дорогими моделями или результатом в другой системе: CRM, WordPress, системе заявок или хранилище данных.
Проведите один ограниченный запуск, оцените минимальные вызовы модели и контекст для принятого результата, добавьте заранее указанное исключение и остановите новые дочерние задачи до достижения жёсткого предела.
Качество защищают фиксированная приёмка и одна независимая проверка. Повторные рецензии без нового доказательства дефекта не гарантируют улучшения и могут создавать новые расхождения.
Да. Мед ИТ может связать расходы с основной задачей, определить текущие источники и рабочие результаты, отделить решения модели от программных проверок и проверить изменение на одном действующем процессе.
Да, если она управляет оркестрацией, моделями, учётом расходов, состояниями задач, интеграцией с целевой системой и приёмкой в рабочей среде. Мед ИТ помогает, когда ответственность разделена между контентом, разработкой, эксплуатацией и финансами или текущая система не показывает полную стоимость результата.
Рабочий пакет откроется сразу ниже после ввода рабочей почты
Введите рабочую почту, и на этой странице сразу откроются реестр задачи, состояния, ограничение расходов, правила рецензирования, программный валидатор и приёмка пробного запуска. Переходить в почтовый ящик и ждать письмо не нужно.
Рабочий пакет ограничения стоимости ИИ-агента
Введите рабочий email — план сразу откроется ниже на этой странице. Переходить в почту не нужно.
Термины
- API: программный интерфейс вызова модели и учёта потребления.
- Токен: единица обработки текста моделью.
- Хеш SHA-256: цифровой отпечаток содержимого файла.
- Task ID: постоянный технический идентификатор основной задачи.
- Item ID: постоянный технический идентификатор отдельной единицы работы.
- WordPress post: технический тип записи WordPress, используемый для статьи.
- H1: главный заголовок страницы первого уровня. На странице статьи он должен быть один.
- Stop: технический ответ оркестратора, запрещающий продолжение конкретного действия.
