Перейти до вмісту

Gemini Robotics Er 2 Streaming Preview

Google (Gemini)

Коротко

Ціна за 1М токенів (вхід)
$1.00
Ціна за 1М токенів (вихід)
$5.00
Контекст
131 072 токенів
Безкоштовний доступ
так (деталі нижче)

Оновлюється щодня; дані станом на 1 жовтня 2026 р.. Опубліковано 1 жовтня 2026 р..

Модель Gemini Robotics Er 2 Streaming Preview призначена для розробників та інженерів, які працюють над системами, що взаємодіють зі світом через зображення та потребують інтеграції з зовнішніми інструментами. Вона особливо корисна у завданнях, де потрібне послідовне розуміння сцени, прийняття рішень на основі візуальних даних та виконання дій через API або роботізовані механізми. Підхід Google тут полягає у поєднанні мультимодального розуміння з можливістю виклику інструментів у режимі потокової обробки, що дозволяє моделі не лише аналізувати зображення, а й динамічно взаємодіяти з зовнішніми сервісами під час розсудів. Це відрізняє її від чисто текстуальних або статичних мультимодальних моделей, що не підтримують інтеграцію з інструментами у реальному часі.

Специфікація та ціни

Вхід (за 1М токенів)$1.00
Вихід (за 1М токенів)$5.00
Контекстне вікно131 072 токенів
Максимальний вихід65 536 токенів
Можливостізображення, виклик інструментів, reasoning

LiteLLM community dataset (MIT), звірено 1 жовтня 2026 р.. Офіційний прайс Google (Gemini).

Скільки коштуватиме Gemini Robotics Er 2 Streaming Preview саме вам — порахуйте в калькуляторі вартості →

Де спробувати Gemini Robotics Er 2 Streaming Preview безкоштовно

Часті запитання

Для яких завдань ця модель найкраще підходить?+

Вона ефективна у сценаріях, де потрібно аналізувати відеопоток або серію зображень, приймати рішення на основі того, що бачить система, і одночасно викликати зовнішні функції — наприклад, керування рухом руки-робота, звернення до бази даних або запуск обробки даних у хмарі.

Як почати працювати з моделлю?+

Потрібно мати доступ до Google Cloud та підключену службу Vertex AI. Далі через API надається доступ до потокового режиму, де можна передавати послідовні кадри з камери, формулювати промпти з запитом на виклик інструментів та отримувати структуровані відповіді з пропозиціями дій.

Чим вона відрізняється від інших моделей у лінійці Gemini?+

Від стандартних Gemini-моделей вона спеціалізована на робототехнічних сценариях: оптимізована для швидкої обробки візуальних потоків, має покращені можливості пространственного розуміння та краще інтегрована з системами керуванняExecutor-ami через виклик інструментів.

Які обмеження слід враховувати при використанні?+

Модель потребує стабільного з’єднання для потокової роботи, її ефективність залежить від якості вхідного відеосигналу, а виклик інструментів вимагає попередньої реєстрації функцій у схемі, яку модель може розуміти та викликати.

Порівняйте з іншими

Оргсхема: як перевести компанію на штучний інтелект

Оргсхема: як перевести компанію на штучний інтелект

Практична карта: які ролі й процеси компанії закриваються AI-агентами, з чого почати і в якому порядку впроваджувати.