Перейти к содержимому
Aback Tools Logo

Калькулятор стоимости AWS Bedrock

Оцените стоимость инференса API Amazon Bedrock для моделей Anthropic Claude, Amazon Nova, Meta Llama, Mistral и Cohere. Рассчитайте расход на запрос, примените скидки пакетного инференса (50 %) и кеширования промптов, сравните цены моделей и спрогнозируйте расходы на день, месяц или год — бесплатно и полностью в браузере.

AWS Bedrock Cost Calculator

Estimate on-demand inference costs across Anthropic Claude, Amazon Nova, Meta Llama, Mistral, and Cohere models. Configure prompt caching, Batch API discounts, and forecast daily, monthly, or yearly API spend - entirely in your browser.

Provider: AnthropicInput/1M: $3.000Output/1M: $15.000Cache/1M: $0.300Context: 1,000,000 tokens

Prompt Token Counts

tokens
tokens

Cost Optimizations

Workload Volume

reqs

Projected Monthly Workload Cost

$900.00for 30,000 total requests

Cost per Single Call

$0.0300

Input Token Cost

$0.0150

Output Token Cost

$0.0150

Model Comparison (Monthly Forecast)

ModelCost/CallMonthly TotalFeatures
Amazon Nova MicroBest Value
Amazon · In: $0.035/M · Out: $0.140/M
$0.000315$9.45Std
Amazon Nova LiteBest Value
Amazon · In: $0.060/M · Out: $0.240/M
$0.000540$16.20Caching ✓
Mistral Small 3Best Value
Mistral AI · In: $0.100/M · Out: $0.300/M
$0.000800$24.00Std
Claude 3 HaikuBest Value
Anthropic · In: $0.250/M · Out: $1.250/M
$0.002500$75.00Caching ✓
Cohere Command RBest Value
Cohere · In: $0.500/M · Out: $1.500/M
$0.004000$120.00Std
Meta Llama 3.3 70B InstructBest Value
Meta · In: $0.720/M · Out: $0.720/M
$0.004320$129.60Std
Meta Llama 3.1 70B Instruct
Meta · In: $0.720/M · Out: $0.720/M
$0.004320$129.60Std
Amazon Nova ProCapable
Amazon · In: $0.800/M · Out: $3.200/M
$0.007200$216.00Caching ✓
Claude 3.5 HaikuBest Value
Anthropic · In: $0.800/M · Out: $4.000/M
$0.008000$240.00Caching ✓
Mistral Large 2 (2411)Capable
Mistral AI · In: $2.000/M · Out: $6.000/M
$0.0160$480.00Std
Meta Llama 3.1 405B InstructCapable
Meta · In: $2.650/M · Out: $3.500/M
$0.0168$502.50Std
Cohere Command R+
Cohere · In: $2.500/M · Out: $10.000/M
$0.0225$675.00Std
Claude Sonnet 4 (Latest)Capable Selected
Anthropic · In: $3.000/M · Out: $15.000/M
$0.0300$900.00Caching ✓
Claude 3.7 SonnetCapable
Anthropic · In: $3.000/M · Out: $15.000/M
$0.0300$900.00Caching ✓
Claude 3.5 Sonnet v2
Anthropic · In: $3.000/M · Out: $15.000/M
$0.0300$900.00Caching ✓
Claude 3 OpusCapable
Anthropic · In: $15.000/M · Out: $75.000/M
$0.1500$4,500.00Caching ✓
Disclaimer: Rates reflect US-East-1 (N. Virginia) on-demand pricing. Actual bills may vary by AWS region, EDP commitments, AWS Free Tier credits, or model version updates. Prompt caching discount depth varies by model (typically 75-90% off standard input rates). Always verify against the official AWS Bedrock pricing page before committing budget. All calculations run locally in your browser - no data is sent to any server.

Что определяет стоимость вызова в Bedrock

В Bedrock расход зависит не от фиксированного тарифа, а от числа входных и выходных токенов на запрос. Два приложения с одинаковым числом вызовов могут иметь совершенно разные счета.

Укажите входные и выходные токены на запрос, объём запросов и выбранную модель, чтобы увидеть реальную стоимость вызова и прогноз расходов.

  • Выходные токены стоят в 3–10 раз дороже входных: длина ответов — самый прямой рычаг.
  • Пакетный инференс даёт фиксированную скидку 50 %, когда задержка в реальном времени не нужна.
  • Кеширование промптов снижает стоимость повторяющегося префикса в длинных статичных контекстах на 75–90 %.

Выбор модели и способа оплаты

Самая мощная модель редко оказывается самой выгодной для всех задач. Разделение нагрузок по сложности экономит больше, чем любая техническая оптимизация.

  • Nova Micro и Nova Lite хорошо закрывают общие текстовые задачи при очень низкой цене.
  • Provisioned Throughput выгоден при высоком стабильном трафике: дешевле до 40–60 %.
  • Обязательства PTU заключаются на 1 или 6 месяцев — проверьте стабильность объёма.

Как разумно использовать прогноз

Прогноз — это инструмент планирования, а не счёт. Сравните его с реальным счётом первого месяца и скорректируйте допущения по токенам и объёму.

  1. Измерьте фактические входные и выходные токены на типичном запросе.
  2. Введите ожидаемый объём за день, месяц или год.
  3. Выберите модель и базовый регион, чтобы получить прогноз стоимости.
  4. Примените скидки пакетного инференса или кеша и сравните оптимизированный сценарий с базовым.

Часто задаваемые вопросы

Это онлайн-инструмент, который оценивает ваши расходы на API Amazon Bedrock по числу входных и выходных токенов, выбору модели и объёму запросов. Он показывает стоимость одного вызова и масштабирует её в прогнозы на день, месяц или год. Наш калькулятор работает полностью в браузере: данные не загружаются и не сохраняются.

Калькулятор использует тарифы за токены по запросу региона us-east-1 (Северная Виргиния) с официальной страницы цен AWS Bedrock. Реальные счета могут немного отличаться из-за региональных различий цен, скидок по обязательствам EDP, промокредитов, обновлений версий моделей или платы за передачу данных при межрегиональном инференсе.

Оплата по запросу взимается за потреблённые токены без обязательств — идеально для переменных и непредсказуемых нагрузок. Provisioned Throughput Units (PTU) резервируют выделенную мощность модели по фиксированной почасовой ставке, обычно на 40–60 % дешевле при постоянном высоком трафике. Обязательства PTU требуют срока 1 или 6 месяцев.

Он обрабатывает запросы асинхронно в фоне и возвращает результаты в течение 24 часов. AWS даёт фиксированную скидку 50 % на все входные и выходные токены по сравнению с ценами по запросу. Идеально для массовой обработки документов, ночных оценок, перевода наборов данных и любой нагрузки без требования реального времени.

Кеширование промптов хранит часто переиспользуемый контент (длинные системные промпты, справочные документы для RAG, большие блоки инструкций) в инфраструктуре AWS. При последующих вызовах с тем же кешированным префиксом эта часть тарифицируется на 75–90 % дешевле стандартных входных токенов. Особенно эффективно для чат-ботов и агентов с большим статичным системным контекстом.

Выходные токены генерируются последовательно и авторегрессивно: каждый требует полного прямого прохода по модели, что вычислительно дороже обработки входных токенов. Большинство моделей Bedrock тарифицируют выход в 3–10 раз дороже входа. Краткие ответы — самый прямой способ снизить стоимость вызова.

Для чисто текстовых задач общего назначения самые экономичные на AWS Bedrock — Amazon Nova Micro и Amazon Nova Lite, причём Nova Micro от 0,035 $ за миллион входных токенов. Для более сложных задач Claude 3.5 Haiku или Claude 3 Haiku дают отличное соотношение качества и цены. Используйте таблицу сравнения в калькуляторе.

Да. Калькулятор работает полностью на стороне клиента, в браузере. Число токенов, объёмы запросов, выбор моделей и все прогнозы рассчитываются локально на вашем устройстве и никогда не передаются на сервер, не сохраняются и не логируются. Данные вашего бюджета остаются полностью приватными.