Как работает этот калькулятор
Стоимость каждой из четырех архитектур определяется одинаковой общей стоимостью. жетоны за цикл цифра, поэтому единственное, что меняет стоимость между ними, — это ФОРМА рабочего процесса, а не цена за шаг. Реакт базовый уровень для одного агента: reactLoops × tokensPerLoop — один агент, один цикл, делается, когда уже готово. Древо мысли умножает ту же самую стоимость за цикл на оба фактор разветвления и глубина — branching × depth × tokensPerLoop — потому что исследование трех ветвей на трех уровнях глубины означает выполнение примерно девяти циклов рассуждений вместо одного. Мультиагентные дебаты запускает каждого дискуссионного агента на свои раунды — agents × rounds × tokensPerLoop — затем добавляет жетоны, которые должен прочитать судья: окончательный ответ каждого агента плюс собственные рассуждения судьи, agents × answerTokens + judgeTokens.
Планировщик/оркестратор является наиболее вовлеченным: оркестратор тратит свои собственные жетоны планирования вперед, затем порождает несколько субагенты, каждый из которых изолированно выполняет свой СОБСТВЕННЫЙ полный внутренний цикл — subagents × subagentLoops × tokensPerLoop — и каждый из которых сообщает только сжатый краткое содержание что оркестратор читает, subagents × summaryTokens. Собственный контекст оркестратора остается небольшим, поскольку он всегда видит только сводные данные, а не полные трассировки субагентов, но общие затраты токенов ВСЕЙ СИСТЕМЫ, которые фактически выставляются в счет при каждом вызове модели в конвейере, по-прежнему включают каждый токен, сгенерированный каждым субагентом внутри. Экономичный оркестратор не означает дешевую систему: это означает, что дорогостоящая часть перемещается из контекстного окна оркестратора в набор параллельных циклов субагентов, счета за которые оплачиваются одинаково. Стоимость каждой архитектуры totalTokens / 1,000,000 × pricePerMillion, а множитель каждого шаблона, не относящегося к ReAct, представляет собой просто общее количество токенов, деленное на общее количество токенов базового уровня ReAct.
Часто задаваемые вопросы
Почему в этом калькуляторе «умный» шаблон планировщика/оркестратора обходится дороже, чем один агент ReAct?
Потому что экономичный оркестратор и дешевая система — это две разные вещи. В шаблоне планировщик/работник центральный оркестратор считывает только сжатую сводку от каждого субагента (несколько сотен токенов), что делает СОБСТВЕННЫЙ контекст оркестратора небольшим и удерживает его намного ниже любого потолка контекстного окна. Но каждый из этих субагентов по-прежнему выполняет свой собственный полный внутренний цикл шагов «думай-действуй-наблюдай», чтобы фактически выполнить свою часть задачи, и каждый из этих токенов цикла где-то генерируется и выставляется счет, хотя оркестратор никогда не видит их напрямую. При каждом 3 субагентах, каждый из которых выполняет 4 цикла по 3000 токенов за цикл, это означает, что 36 000 токенов работы субагента выполняются в стороне, плюс собственные жетоны планирования оркестратора и возвращаемые сводки — общесистемные расходы, которые никогда не придется платить одному агенту ReAct, выполняющему 5 циклов одной и той же задачи, потому что работает только один цикл, а не один цикл оркестратора плюс три параллельных цикла субагента.
Стоят ли когда-нибудь «дерево мысли» или дебаты с участием нескольких агентов дополнительных затрат?
Да, но аргументы в пользу выплаты множителя должны основываться на чем-то другом, а не на чистой стоимости токена, потому что только на токенах оба шаблона каждый раз проигрывают одному циклу ReAct. Дерево мысли зарабатывает 1,8x (или хуже, при более высоком разветвлении или глубине), когда задача имеет действительно большое пространство решений, где преждевременное принятие одного пути рассуждения, вероятно, приведет к неправильному ответу, который затем придется переделывать с нуля — дополнительные ветви являются страховкой от гораздо более дорогостоящей повторной попытки, а не бесплатного обновления. Дебаты с участием нескольких агентов оправдывают свою цену, когда собственная самосогласованность одной модели представляет собой реальный риск, например, классификация с высокими ставками или состязательный анализ, когда независимые агенты находят ответы по отдельности, а затем их судят, и они выявляют ошибки, которые пропустил бы одиночный проход. Если задача находится в пределах надежного диапазона одного агента, ни один из шаблонов не стоит своего множителя — вы платите за страховку, которая вам не нужна.
Влияет ли кэширование подсказок на то, какая архитектура является самой дешевой?
Это сокращает все четыре стоимости примерно в одинаковой пропорции без изменения их порядка, поскольку кэширование учитывает повторяющиеся префиксы входных токенов (системные подсказки, схемы инструментов, общий контекст), и каждый из этих четырех шаблонов по-прежнему требует, чтобы эти префиксы пересылались повторно на каждом цикле, ветке, повороте агента или шаге субагента. Каждый из 5 циклов ReAct частично выигрывает от кэширования повторяющегося префикса, а также ветви древа мысли, раунды дебатов для каждого агента и внутренние циклы каждого субагента планировщика — скидка применяется примерно равномерно по всем направлениям, а не в пользу формы одного шаблона над другой. Кэширование не меняет основную арифметику подсчета циклов: планировщик, порождающий 3 субагента, каждый из которых запускает 4 цикла, по-прежнему генерирует гораздо больше общих сгенерированных (выходных) токенов, чем один агент ReAct с 5 циклами, а выходные токены обычно вообще не имеют права на скидку на кэшированные входные данные, поэтому рейтинг шаблона архитектуры в этом калькуляторе сохраняется независимо от вашей настройки кэширования.
Чем это отличается от калькулятора бюджета цикла агента и калькулятора стоимости инфраструктуры агента ИИ, которые уже есть на этом сайте?
Все три токена ценового агента тратятся, но на разных уровнях одного и того же стека. Калькулятор бюджета цикла агента оценивает собственный бюджет итерации цикла ОДНОГО агента — учитывая стоимость токена на цикл и потолок расходов, сколько ходов «думай-действуй-наблюдай» может позволить себе один агент, прежде чем вам придется его отрезать — он никогда не сравнивается между архитектурами, а только по количеству ходов, которые получает один агент. Калькулятор стоимости платформы агента искусственного интеллекта сравнивает затраты на инструменты и инфраструктуру при выполнении заданной рабочей нагрузки агента на разных платформах, таких как CrewAI, LangGraph и пользовательский цикл — один и тот же шаблон архитектуры, но по цене с разной стоимостью. Этот калькулятор находится на один уровень выше обоих: он сохраняет структуру и стоимость каждого цикла постоянными и вместо этого сравнивает четыре разных АРХИТЕКТУРНЫХ ШАБЛОНА для решения одной и той же задачи — ReAct с одним агентом, ветвление дерева мыслей, многоагентные дебаты и планировщик/оркестратор с изолированными субагентами — чтобы показать, что выбранный вами шаблон умножает ваши затраты токенов еще до того, как выбор структуры или циклическое бюджетирование когда-либо войдут в игру.