Gemini 3.5 Flash Lite

Google (Gemini)

Коротко

Ціна за 1М токенів (вхід)
$0.30
Ціна за 1М токенів (вихід)
$2.50
Контекст
1 048 576 токенів
Безкоштовний доступ
так (деталі нижче)

Оновлюється щодня; дані станом на 9 серпня 2026 р.. Опубліковано 9 серпня 2026 р..

Ця модель від Google призначена для розробників і команд, які потребують швидкого та економного виконання завдань, що не вимагають надмірної обчислювальної потужності. Вона доречна для сценаріїв, де критична низька затримка відповіді, наприклад, для чат-ботів, класифікації тексту або вилучення даних. Підхід вендора полягає в оптимізації продуктивності на одиницю ресурсів, що робить її придатною для масштабних інтеграцій. Модель підтримує аналіз зображень, виклик інструментів для взаємодії із зовнішніми сервісами та покрокове міркування для складніших логічних задач, що розширює сферу її застосування.

Специфікація та ціни

Вхід (за 1М токенів)$0.30
Вихід (за 1М токенів)$2.50
Кеш-читання (за 1М токенів)$0.03
Контекстне вікно1 048 576 токенів
Максимальний вихід65 536 токенів
Можливостізображення, виклик інструментів, reasoning

Ціни за даними LiteLLM community dataset (MIT), звірено 9 серпня 2026 р.. Офіційний прайс Google (Gemini).

Як спробувати безкоштовно

  • У Google (Gemini) є безкоштовний чат — Gemini (безкоштовний план). Безкоштовний чат вендора може працювати на іншій моделі цієї ж лінійки — точну модель вендор не гарантує.

Часті запитання

Для яких практичних завдань найкраще підходить ця модель?+

Вона оптимальна для завдань, де швидкість відповіді важливіша за максимальну глибину аналізу. Це можуть бути обробка вхідних звернень, категоризація документів, створення коротких текстів, а також сценарії з використанням виклику інструментів, наприклад, для заповнення форм або отримання даних з API.

Як почати працювати з моделлю?+

Для початку потрібно отримати доступ через хмарну платформу Google. Далі використовуйте офіційний SDK для вашої мови програмування, щоб надсилати запити. У документації наведено приклади коду для базових викликів, роботи із зображеннями та налаштування виклику інструментів.

Чим ця модель відрізняється від інших моделей лінійки Gemini?+

Головна відмінність — це баланс між швидкістю, вартістю та якістю. Вона легша за флагманські моделі, тому працює швидше і потребує менше ресурсів, але може поступатися їм у складних творчих або аналітичних задачах. Водночас вона потужніша за найпростіші варіанти, пропонуючи розширені можливості, як-от робота із зображеннями та покрокове міркування.

Які обмеження варто враховувати при використанні?+

Модель може бути менш точною у вузькоспеціалізованих або творчих завданнях, де потрібен глибокий контекстний аналіз. Також слід пам'ятати про обмеження контекстного вікна, що впливає на обсяг тексту, який можна передати за один раз. Для задач, що потребують дуже довгих міркувань, можливо, доведеться розбивати їх на етапи.

Порівняйте з іншими

Хочете навчитися працювати з AI-моделями на практиці?

Наші курси — про реальну роботу з AI-агентами: від основ до впровадження в компанії.