Калькулятор стоимости AWS Bedrock
Оцените стоимость инференса API Amazon Bedrock для моделей Anthropic Claude, Amazon Nova, Meta Llama, Mistral и Cohere. Рассчитайте расход на запрос, примените скидки пакетного инференса (50 %) и кеширования промптов, сравните цены моделей и спрогнозируйте расходы на день, месяц или год — бесплатно и полностью в браузере.
Estimate on-demand inference costs across Anthropic Claude, Amazon Nova, Meta Llama, Mistral, and Cohere models. Configure prompt caching, Batch API discounts, and forecast daily, monthly, or yearly API spend - entirely in your browser.
Prompt Token Counts
Cost Optimizations
Workload Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0300
Input Token Cost
$0.0150
Output Token Cost
$0.0150
Model Comparison (Monthly Forecast)
| Model | Cost/Call | Monthly Total | Features |
|---|---|---|---|
Amazon Nova MicroBest Value Amazon · In: $0.035/M · Out: $0.140/M | $0.000315 | $9.45 | Std |
Amazon Nova LiteBest Value Amazon · In: $0.060/M · Out: $0.240/M | $0.000540 | $16.20 | Caching ✓ |
Mistral Small 3Best Value Mistral AI · In: $0.100/M · Out: $0.300/M | $0.000800 | $24.00 | Std |
Claude 3 HaikuBest Value Anthropic · In: $0.250/M · Out: $1.250/M | $0.002500 | $75.00 | Caching ✓ |
Cohere Command RBest Value Cohere · In: $0.500/M · Out: $1.500/M | $0.004000 | $120.00 | Std |
Meta Llama 3.3 70B InstructBest Value Meta · In: $0.720/M · Out: $0.720/M | $0.004320 | $129.60 | Std |
Meta Llama 3.1 70B Instruct Meta · In: $0.720/M · Out: $0.720/M | $0.004320 | $129.60 | Std |
Amazon Nova ProCapable Amazon · In: $0.800/M · Out: $3.200/M | $0.007200 | $216.00 | Caching ✓ |
Claude 3.5 HaikuBest Value Anthropic · In: $0.800/M · Out: $4.000/M | $0.008000 | $240.00 | Caching ✓ |
Mistral Large 2 (2411)Capable Mistral AI · In: $2.000/M · Out: $6.000/M | $0.0160 | $480.00 | Std |
Meta Llama 3.1 405B InstructCapable Meta · In: $2.650/M · Out: $3.500/M | $0.0168 | $502.50 | Std |
Cohere Command R+ Cohere · In: $2.500/M · Out: $10.000/M | $0.0225 | $675.00 | Std |
Claude Sonnet 4 (Latest)Capable Selected Anthropic · In: $3.000/M · Out: $15.000/M | $0.0300 | $900.00 | Caching ✓ |
Claude 3.7 SonnetCapable Anthropic · In: $3.000/M · Out: $15.000/M | $0.0300 | $900.00 | Caching ✓ |
Claude 3.5 Sonnet v2 Anthropic · In: $3.000/M · Out: $15.000/M | $0.0300 | $900.00 | Caching ✓ |
Claude 3 OpusCapable Anthropic · In: $15.000/M · Out: $75.000/M | $0.1500 | $4,500.00 | Caching ✓ |
Что определяет стоимость вызова в Bedrock
В Bedrock расход зависит не от фиксированного тарифа, а от числа входных и выходных токенов на запрос. Два приложения с одинаковым числом вызовов могут иметь совершенно разные счета.
Укажите входные и выходные токены на запрос, объём запросов и выбранную модель, чтобы увидеть реальную стоимость вызова и прогноз расходов.
- Выходные токены стоят в 3–10 раз дороже входных: длина ответов — самый прямой рычаг.
- Пакетный инференс даёт фиксированную скидку 50 %, когда задержка в реальном времени не нужна.
- Кеширование промптов снижает стоимость повторяющегося префикса в длинных статичных контекстах на 75–90 %.
Выбор модели и способа оплаты
Самая мощная модель редко оказывается самой выгодной для всех задач. Разделение нагрузок по сложности экономит больше, чем любая техническая оптимизация.
- Nova Micro и Nova Lite хорошо закрывают общие текстовые задачи при очень низкой цене.
- Provisioned Throughput выгоден при высоком стабильном трафике: дешевле до 40–60 %.
- Обязательства PTU заключаются на 1 или 6 месяцев — проверьте стабильность объёма.
Как разумно использовать прогноз
Прогноз — это инструмент планирования, а не счёт. Сравните его с реальным счётом первого месяца и скорректируйте допущения по токенам и объёму.
- Измерьте фактические входные и выходные токены на типичном запросе.
- Введите ожидаемый объём за день, месяц или год.
- Выберите модель и базовый регион, чтобы получить прогноз стоимости.
- Примените скидки пакетного инференса или кеша и сравните оптимизированный сценарий с базовым.
Часто задаваемые вопросы
Это онлайн-инструмент, который оценивает ваши расходы на API Amazon Bedrock по числу входных и выходных токенов, выбору модели и объёму запросов. Он показывает стоимость одного вызова и масштабирует её в прогнозы на день, месяц или год. Наш калькулятор работает полностью в браузере: данные не загружаются и не сохраняются.
Калькулятор использует тарифы за токены по запросу региона us-east-1 (Северная Виргиния) с официальной страницы цен AWS Bedrock. Реальные счета могут немного отличаться из-за региональных различий цен, скидок по обязательствам EDP, промокредитов, обновлений версий моделей или платы за передачу данных при межрегиональном инференсе.
Оплата по запросу взимается за потреблённые токены без обязательств — идеально для переменных и непредсказуемых нагрузок. Provisioned Throughput Units (PTU) резервируют выделенную мощность модели по фиксированной почасовой ставке, обычно на 40–60 % дешевле при постоянном высоком трафике. Обязательства PTU требуют срока 1 или 6 месяцев.
Он обрабатывает запросы асинхронно в фоне и возвращает результаты в течение 24 часов. AWS даёт фиксированную скидку 50 % на все входные и выходные токены по сравнению с ценами по запросу. Идеально для массовой обработки документов, ночных оценок, перевода наборов данных и любой нагрузки без требования реального времени.
Кеширование промптов хранит часто переиспользуемый контент (длинные системные промпты, справочные документы для RAG, большие блоки инструкций) в инфраструктуре AWS. При последующих вызовах с тем же кешированным префиксом эта часть тарифицируется на 75–90 % дешевле стандартных входных токенов. Особенно эффективно для чат-ботов и агентов с большим статичным системным контекстом.
Выходные токены генерируются последовательно и авторегрессивно: каждый требует полного прямого прохода по модели, что вычислительно дороже обработки входных токенов. Большинство моделей Bedrock тарифицируют выход в 3–10 раз дороже входа. Краткие ответы — самый прямой способ снизить стоимость вызова.
Для чисто текстовых задач общего назначения самые экономичные на AWS Bedrock — Amazon Nova Micro и Amazon Nova Lite, причём Nova Micro от 0,035 $ за миллион входных токенов. Для более сложных задач Claude 3.5 Haiku или Claude 3 Haiku дают отличное соотношение качества и цены. Используйте таблицу сравнения в калькуляторе.
Да. Калькулятор работает полностью на стороне клиента, в браузере. Число токенов, объёмы запросов, выбор моделей и все прогнозы рассчитываются локально на вашем устройстве и никогда не передаются на сервер, не сохраняются и не логируются. Данные вашего бюджета остаются полностью приватными.