Калькулятор вартості API великих мовних моделей
Оберіть сценарій або задайте свої числа — побачите місячний рахунок у кожній моделі каталогу, від найдешевшої.
Без реєстрації та email
Сценарій
10 000 звернень на місяць, довгий системний промпт із базою знань, короткі відповіді.
Сталий системний промпт, який повторюється в кожному запиті, більшість провайдерів рахує дешевше. Якщо провайдер не публікує ціну кешу, ми рахуємо цю частку за повною ціною — краще завищити рахунок, ніж занизити.
Скільки це коштуватиме
Найдешевша модель для сценарію «Чат-бот підтримки» — Mistral Small 3.2.2506: $1,26 на місяць.
| Модель | За запит | На місяць | Економія на кеші |
|---|---|---|---|
| Mistral Small 3.2.2506 | $0,00013 | $1,26 | — |
| Gemini 2.0 Flash Lite | $0,00014 | $1,40 | $0,41 |
| Gemini 2.0 Flash Lite 001 | $0,00014 | $1,40 | $0,41 |
| GPT-5 Nano | $0,00015 | $1,48 | $0,32 |
| Ministral 3 3b 2512 | $0,00015 | $1,50 | — |
| DeepSeek V4 Flash | $0,00015 | $1,53 | $0,99 |
| Gemini 2.5 Flash Lite | $0,00018 | $1,75 | $0,65 |
| Gemini Flash Lite | $0,00018 | $1,75 | $0,65 |
| Gemini 2.5 Flash Lite Preview 09.2025 | $0,00018 | $1,75 | $0,65 |
| Gemini 2.0 Flash 001 | $0,00019 | $1,86 | $0,54 |
| Gemini 2.5 Flash Lite Preview 06.17 | $0,00019 | $1,86 | $0,54 |
| Gemini 2.0 Flash | $0,00019 | $1,86 | $0,54 |
| GPT-4.1 Nano | $0,00019 | $1,86 | $0,54 |
| Devstral Small 2507 | $0,00021 | $2,10 | — |
| Devstral Small 2505 | $0,00021 | $2,10 | — |
179 × модель
Як це рахується
Моделі без опублікованої ціни (прев'ю та немовні) у порівнянні не беруть участі: нуль у джерелі означає «ціни немає», а не «безкоштовно». Вартість = (токени запиту ÷ 1 000 000) × ціна входу + (токени відповіді ÷ 1 000 000) × ціна виходу, помножена на кількість запитів. Кешована частка входу рахується за ціною читання з кешу, якщо провайдер її публікує. Ми не додаємо податки, знижки за обсяг і вартість повторних спроб — реальний рахунок буде трохи вищим.
Ціни беруться з нашого каталогу моделей, який щодня синхронізується з відкритим прайс-довідником LiteLLM.
Дані звірено 15 серпня 2026 р.
А тепер головне питання
Порахувати вартість токенів — легко. Значно важче зрозуміти, які саме процеси у вашій компанії варто віддати AI-агентам і в якому порядку. Для цього ми зробили оргсхему компанії з AI-ролями.
FAQ
- Скільки токенів у моєму тексті?
- Груба оцінка для української: одне слово ≈ 2–3 токени, сторінка тексту ≈ 700–1000 токенів. Для англійської приблизно втричі економніше: слово ≈ 1,3 токена. Точну кількість дає токенізатор конкретної моделі.
- Чому та сама модель у різних провайдерів коштує по-різному?
- Ми показуємо ціну постачальника самої моделі. Хмарні перепродавці (Azure, Bedrock, Vertex) мають власні прайси, які можуть відрізнятися на десятки відсотків в обидва боки.
- Чи враховані знижки за пакетну обробку?
- Ні. Багато провайдерів дають близько половини ціни за асинхронну пакетну обробку. Якщо ваш сценарій це дозволяє, ділíть підсумок приблизно навпіл.
uk