Версия API • Июль 2026
Мы продолжаем масштабировать инфраструктуру API шлюзов VseLLM, предоставляя разработчикам передовые инструменты для решения сложных инженерных, аналитических и продуктовых задач. В июльском обновлении нашего каталога ИИ-моделей стали доступны четыре новых эндпоинта, сфокусированных на кодинге, мультиагентных сценариях и высокой вычислительной эффективности.
Новые ИИ-модели, доступные через API VseLLM
google/gemini-3.6-flash
Высокоэффективная генеративная модель от Google, профилированная под разработку мобильных и веб-приложений (web & app development). Главное техническое отличие версии Gemini 3.6 Flash — способность выдавать готовый, «отполированный» код с минимальным количеством избыточных оговорок и «воды» (hedging). Это радикально снижает необходимость в дополнительных ручных правках, оптимизирует расход токенов и уменьшает общее число вызовов к API.
google/gemini-3.5-flash-lite
Легковесная и быстрая ИИ-модель от Google с глубоким апгрейдом агентных возможностей. Gemini 3.5 Flash Lite — это оптимальный выбор для сложных микросервисных архитектур, где используются многоуровневые мультиагентные процессы. Модель идеально справляется с ролью быстрого субагента для выполнения узких, сфокусированных задач с минимальной задержкой (latency).
openai/gpt-chat-latest
Стабильный системный алиас (chat-latest), который напрямую маршрутизирует ваши API-запросы в самую актуальную Instant-модель, используемую под капотом ChatGPT. По мере выпуска новых минорных апдейтов от OpenAI, переключение будет происходить на нашей стороне автоматически — вам больше не нужно тратить время на мониторинг и обновление версий (слагов) в вашей кодовой базе.
Все новые нейросети и актуальная сетка рублевых тарифов за токены уже загружены на сайт. Переходите в личный кабинет, генерируйте ключи и тестируйте возможности новых моделей в ваших интеграциях!