Перейти до вмісту

Калькулятор вартості API великих мовних моделей

Оберіть сценарій або задайте свої числа — побачите місячний рахунок у кожній моделі каталогу, від найдешевшої.

Без реєстрації та email

Сценарій

10 000 звернень на місяць, довгий системний промпт із базою знань, короткі відповіді.

Сталий системний промпт, який повторюється в кожному запиті, більшість провайдерів рахує дешевше. Якщо провайдер не публікує ціну кешу, ми рахуємо цю частку за повною ціною — краще завищити рахунок, ніж занизити.

Скільки це коштуватиме

Найдешевша модель для сценарію «Чат-бот підтримки» — Mistral Small 3.2.2506: $1,26 на місяць.

МодельЗа запитНа місяцьЕкономія на кеші
Mistral Small 3.2.2506$0,00013$1,26
Gemini 2.0 Flash Lite$0,00014$1,40$0,41
Gemini 2.0 Flash Lite 001$0,00014$1,40$0,41
GPT-5 Nano$0,00015$1,48$0,32
Ministral 3 3b 2512$0,00015$1,50
DeepSeek V4 Flash$0,00015$1,53$0,99
Gemini 2.5 Flash Lite$0,00018$1,75$0,65
Gemini Flash Lite$0,00018$1,75$0,65
Gemini 2.5 Flash Lite Preview 09.2025$0,00018$1,75$0,65
Gemini 2.0 Flash 001$0,00019$1,86$0,54
Gemini 2.5 Flash Lite Preview 06.17$0,00019$1,86$0,54
Gemini 2.0 Flash$0,00019$1,86$0,54
GPT-4.1 Nano$0,00019$1,86$0,54
Devstral Small 2507$0,00021$2,10
Devstral Small 2505$0,00021$2,10

179 × модель

Як це рахується

Моделі без опублікованої ціни (прев'ю та немовні) у порівнянні не беруть участі: нуль у джерелі означає «ціни немає», а не «безкоштовно». Вартість = (токени запиту ÷ 1 000 000) × ціна входу + (токени відповіді ÷ 1 000 000) × ціна виходу, помножена на кількість запитів. Кешована частка входу рахується за ціною читання з кешу, якщо провайдер її публікує. Ми не додаємо податки, знижки за обсяг і вартість повторних спроб — реальний рахунок буде трохи вищим.

Ціни беруться з нашого каталогу моделей, який щодня синхронізується з відкритим прайс-довідником LiteLLM.

Дані звірено 15 серпня 2026 р.

А тепер головне питання

Порахувати вартість токенів — легко. Значно важче зрозуміти, які саме процеси у вашій компанії варто віддати AI-агентам і в якому порядку. Для цього ми зробили оргсхему компанії з AI-ролями.

FAQ

Скільки токенів у моєму тексті?
Груба оцінка для української: одне слово ≈ 2–3 токени, сторінка тексту ≈ 700–1000 токенів. Для англійської приблизно втричі економніше: слово ≈ 1,3 токена. Точну кількість дає токенізатор конкретної моделі.
Чому та сама модель у різних провайдерів коштує по-різному?
Ми показуємо ціну постачальника самої моделі. Хмарні перепродавці (Azure, Bedrock, Vertex) мають власні прайси, які можуть відрізнятися на десятки відсотків в обидва боки.
Чи враховані знижки за пакетну обробку?
Ні. Багато провайдерів дають близько половини ціни за асинхронну пакетну обробку. Якщо ваш сценарій це дозволяє, ділíть підсумок приблизно навпіл.

uk