VJOURNAL

SMART • Глобальная редакция • 25 сентября 2026 г.

Калькулятор бюджета агента ИИ: многоразовая формула для токенов, инструментов и повторных попыток

Бюджет ИИ-агента требует единицы работы. Определите прогон, ожидаемое количество шагов модели в этом прогоне, среднее количество входных и выходных токенов на шаг и ожидаемое количество прогонов в месяц.

Иллюстрация с помощью ИИ: аналитик дома сверяет счета с таблицей расходов

Короткий ответ

Бюджет ИИ-агента требует единицы работы. Определите прогон, ожидаемое количество шагов модели в этом прогоне, среднее количество входных и выходных токенов на шаг и ожидаемое количество прогонов в месяц.

Дата проверки фактов: 2 источника
Бюджет ИИ-агента требует единицы работы.
OpenAI и Anthropic публикуют цены на модели на своих официальных сайтах.
Агент может вызвать платную службу поиска, запустить инструмент несколько раз, сохранить файлы, создать встраивания или потребовать проверки человеком.

Напишите формулу перед вводом цен

Бюджет ИИ-агента требует единицы работы. Определите прогон, ожидаемое количество шагов модели в этом прогоне, среднее количество входных и выходных токенов на шаг и ожидаемое количество прогонов в месяц. Для одной модели простая ежемесячная оценка стоимости модели равна количеству прогонов, умноженному на сумму входных токенов, умноженную на входную цену, и выходных токенов, умноженную на выходную цену, при этом обе цены выражаются за миллион токенов. Разделите количество токенов на один миллион, а затем примените множитель повторов, если указанные средние значения исключают повторные попытки. Это оценка, а не счет. Сохранять переменные видимыми полезнее, чем вводить привлекательную сумму, предположения которой никто не может восстановить.

Используйте текущий тариф поставщика

OpenAI и Anthropic публикуют цены на модели на своих официальных сайтах. Цены могут различаться в зависимости от модели, направления токена и особенностей, а также могут меняться. Таким образом, многоразовый калькулятор просит читателя ввести тарифы и записать проверенную дату, а не вставлять фиксированное число 2026 года, как если бы оно было универсальным. Не делайте вывод, что две модели имеют одинаковое качество только потому, что их прейскуранты можно поместить в соседние ячейки. Команда должна сначала оценить задачу, а затем сравнить стоимость моделей, соответствующих ее требованиям. Формула поддерживает это решение, не претендуя на замену технического испытания.

Добавьте шаги, которые пропускает компактное выражение

Агент может вызвать платную службу поиска, запустить инструмент несколько раз, сохранить файлы, создать встраивания или потребовать проверки человеком. Those costs belong in separate lines rather than being hidden inside a model-token estimate. Также учтите, что последующие шаги могут иметь более длительную историю разговоров, чем первый. If every step uses more input tokens, a single average should be measured from a representative trace. Частота повторных попыток имеет значение для таймаутов и неверных выходных данных, но множитель повторных попыток является предположением сценария до тех пор, пока реальные прогоны не предоставят данные. Отделите фиксированную ежемесячную инфраструктуру от переменной стоимости за запуск, чтобы можно было четко моделировать изменения объема.

Показывать диапазон вместо ложной точности

Set low, base and high scenarios for volume, steps, token use and retries. Дело не в том, чтобы точно предсказать, какой именно месяц наступит; это значит увидеть, какая переменная приводит к риску. If doubling the number of steps makes the high case unaffordable, design a step ceiling and a fallback. Если длина вывода преобладает над стоимостью, проверьте, удовлетворяет ли более короткий ответ потребностям пользователя. Если преобладает плата за инструмент, выясните, когда инструмент действительно необходим. Каждая предлагаемая экономия должна быть проверена на предмет качества и безопасности на том же наборе оценок. Более дешевый вариант, который приводит к большему количеству неправильных решений, не является автоматически лучшим продуктом.

Сопоставьте оценку с реальным использованием

Once a service has actual traffic, compare invoices and usage logs with the assumptions in the worksheet. Записывайте разницу в объеме, среднем количестве токенов, повторных попытках, стоимости инструментов и любых изменениях цен поставщика. Используйте несоответствие для улучшения следующего прогноза и, при необходимости, самого рабочего процесса. В этой статье SMART представлены формула и метод, а не действующее ценовое предложение от любого поставщика. Он также отличается от калькулятора запуска магазина одежды в другом месте ВЖУРНАЛА; смешение этих двух моделей затрат ввело бы читателей в заблуждение. На нашей обложке показано планирование, а не скриншот официального калькулятора поставщика.

Рабочий пример: смоделируйте стоимость перед выбором поставщика

Рассмотрим чисто иллюстративный рабочий процесс с 10 000 запусков в месяц, тремя шагами модели на каждый запуск, 2 000 входных токенов и 500 выходными токенами на шаг. Если заявленная ставка за входные токены равна I долларов, а ставка за выходные токены — O долларов за миллион токенов, оценка только для модели равна 10 000 × 3 × ((2 000 × I + 500 × O) / 1 000 000). Оставьте I и O в качестве текущих входных данных со страницы цен поставщика, а не публикуйте цену, которая может измениться. В примере описываются арифметические действия, а не текущее предложение поставщика или ожидаемый счет за реальное приложение.

Теперь добавьте затраты, которые компактная формула не отражает. Запуск может включать в себя поиск или другой оплачиваемый инструмент, более длительный контекст после неудачного шага, повторную попытку по истечении времени ожидания внешней службы, а также отдельные затраты на хранение или мониторинг. Если повторные попытки увеличивают среднее количество шагов, используйте наблюдаемый множитель, а не спокойно предполагайте, что каждый запуск успешен с первого раза. Команда с большим объемом работы должна проверять распределение продолжительности сеансов, а не только среднее значение: небольшое количество необычно длинных сеансов может изменить как задержку, так и затраты. Держите каждое предположение на видном месте в таблице расчетов.

Тестирование чувствительности более полезно, чем один точный итог. Рассчитайте нижний, базовый и верхний вариант для ежемесячных запусков, средних шагов и длины вывода. Если высокий случай недоступен, вопрос проектирования может заключаться в том, нужна ли для каждого шага одна и та же модель, может ли подсказка быть короче без потери доказательств или должна ли проверка человеком заменить дорогостоящий цикл. Не делайте заявлений о качестве более дешевой модели до ее тестирования. Бюджет — это ограждение для выбора дизайна, а не доказательство того, что агент будет работать хорошо.

Наконец, согласуйте оценку с реальным счетом, как только сервис получит образец рабочего трафика. Сравните зарегистрированное использование токенов, вызовы инструментов и повторные попытки с предположениями, использованными для получения одобрения. Исследуйте различия, а не просто обновляйте итоговые данные в электронной таблице. Сохраняйте модельные тарифы связанными с официальной страницей поставщика и записывайте дату их проверки. В этой статье SMART предлагается метод многократного использования, отдельный от калькулятора бюджета магазина одежды в другом месте журнала. Его иллюстративная обложка и формула не подразумевают существование универсальной фиксированной цены на ИИ-агент.

Как сделать смету многоразовой в следующем месяце

Сохраняйте предположения как именованные входные данные, а не прячьте их в одной ячейке электронной таблицы. Читатель должен иметь возможность независимо изменять количество прогонов за месяц, количество шагов за прогон, жетоны ввода и вывода, две расценки за единицу, стоимость инструмента и коэффициент повтора. Запишите дату проверки каждой цены и ссылку на официальную страницу поставщика. Если поставщик добавляет новую категорию выставления счетов, в формуле потребуется новая строка; его не следует молча включать в курс модельных токенов. Это делает калькулятор полезным после даты публикации статьи и позволяет коллеге понять, откуда взялась измененная сумма.

Ограничение бюджета должно быть связано с поведением в приложении. Решите, что произойдет, если пробег приблизится к своему шагу или пределу расходования: остановится, попросит пользователя подтвердить более дорогой путь или передаст его другому человеку. Измерьте долю задач, достигающих этих пределов, и определите, влияют ли на результат более короткие подсказки или другой порядок инструментов. Агент, который стоит дешевле, но чаще выходит из строя, может оказаться худшим выбором после включения повторных попыток и ремонта человеком. Арифметика в этой статье поможет при планировании. Прежде чем он станет производственным бюджетом, ему необходим реальный образец использования и оценка качества.

Передача, которую может использовать коллега

Окончательный рабочий лист должен отображать формулу, условные обозначения единиц измерения, входные данные сценария и ссылки на текущие прейскуранты на одном экране. Коллега должен иметь возможность изменить ежемесячный объем, не редактируя скрытые ячейки и не угадывая, указана ли цена за токен или за миллион токенов. Добавьте примечание, поясняющее, какие расходы исключены, и никогда не называйте сценарий ценой поставщика. Когда произойдет фактическое использование, сохраните исходную оценку вместе с новым наблюдением, чтобы ошибка прогнозирования была видна. Такое сравнение может выявить проблему проектирования рабочего процесса, а не просто изменение цен. Четкие предположения — самая полезная функция бюджетного калькулятора.