VSELLM

VSELLM

Единый API-доступ к лучшим AI-моделям

Передовые модели

Claude Sonnet 4.6
Передовая модель Anthropic

Claude Sonnet 4.6

Высокоэффективная версия Claude 4.6, оптимизированная для скорости и низкой стоимости при хорошей производительности в кодировании и агентских задачах.

GPT-5 Нейросеть нового поколения

GPT-5

Флагманская языковая модель с продвинутыми возможностями рассуждения, программирования и анализа сложных контекстов.

Gemini 2.5 Pro Линейка Google DeepMind

Gemini 2.5 Pro

Мощная мультимодальная модель от Google, оптимизированная для сложных задач рассуждения, работы с кодом и анализа данных.

Чтобы сгенерировать ключ, авторизуйтесь и пополните баланс

Цены указаны за 1 млн токенов, за генерацию 1 изображения или за 1 минуту входного аудио.

Модель ID Цена Input Цена Output Контекст Latency (сек) Throughput (т/сек) Function
Calling
Подключение
qwen3-vl-235b-a22b-thinking qwen/qwen3-vl-235b-a22b-thinking 44 ₽ 439 ₽ 128000 4.07 30.85
qwen3.5-plus qwen/qwen3.5-plus 18 ₽ 105 ₽ 1000000 47.12 6.67
qwen3-vl-235b-a22b-instruct qwen/qwen3-vl-235b-a22b-instruct 44 ₽ 175 ₽ 128000 11.44 19.84
claude-opus-4.8 anthropic/claude-opus-4.8 552 ₽ 2762 ₽ 1000000 3.92 16.39
gpt-5.5 openai/gpt-5.5 552 ₽ 3315 ₽ 1050000 4.76 23.32
gemini-2.5-flash google/gemini-2.5-flash 33 ₽ 276 ₽ 1048576 0.94 22.29
gpt-5.3-codex openai/gpt-5.3-codex 194 ₽ 1547 ₽ 400000 3.42 4.53
qwen3-235b-a22b qwen/qwen3-235b-a22b 44 ₽ 175 ₽ 128000 25.71 4.43
claude-opus-4.6 anthropic/claude-opus-4.6 552 ₽ 2762 ₽ 1000000 8.56 42.79
glm-4.6v z-ai/glm-4.6v 46 ₽ 138 ₽ 128000 2.58 32.19
llama-3.3-70b-instruct meta-llama/llama-3.3-70b-instruct 16 ₽ 49 ₽ 131072 6.2 17.76
claude-sonnet-5 anthropic/claude-sonnet-5 221 ₽ 1105 ₽ 1000000 11.07 58.39
gpt-oss-20b openai/gpt-oss-20b 5 ₽ 21 ₽ 131072 6.31 84.47
glm-4.6v-flash z-ai/glm-4.6v-flash 1 ₽ 8 ₽ 128000 0.73 21.89
glm-5.1 z-ai/glm-5.1 127 ₽ 505 ₽ 202752 6.85 28.99
mimo-v2.5-pro xiaomi/mimo-v2.5-pro 67 ₽ 133 ₽ 1048576 1.89 32.15
deepseek-v4-pro deepseek/deepseek-v4-pro 252 ₽ 505 ₽ 1000000 13.84 29.67
glm-4.6v-flashx z-ai/glm-4.6v-flashx 6 ₽ 61 ₽ 128000 1.09 53.97
gemini-3-flash-preview google/gemini-3-flash-preview 55 ₽ 332 ₽ 1048576 1.98 75.32
gpt-5.1-chat openai/gpt-5.1-chat 138 ₽ 1105 ₽ 128000 1.39 15.13
qwen3.6-plus qwen/qwen3.6-plus 42 ₽ 252 ₽ 1000000 33.43 6.67
gpt-5 openai/gpt-5 138 ₽ 1105 ₽ 400000 7.39 59.02
gpt-4o-mini openai/gpt-4o-mini 17 ₽ 66 ₽ 128000 1.6 14.43
kimi-k2.6 moonshotai/kimi-k2.6 137 ₽ 568 ₽ 256000 0.93 54.06
claude-opus-4.7 anthropic/claude-opus-4.7 552 ₽ 2762 ₽ 1000000 2.98 18.1
kimi-k2.5 moonshotai/kimi-k2.5 66 ₽ 332 ₽ 262144 1.0 78.17
qwen3-vl-30b-a3b-thinking qwen/qwen3-vl-30b-a3b-thinking 16 ₽ 165 ₽ 128000 37.8 6.6
qwen3.5-flash qwen/qwen3.5-flash 4 ₽ 44 ₽ 1000000 43.79 92.63
glm-5 z-ai/glm-5 110 ₽ 354 ₽ 202752 6.21 19.21
qwen3-vl-flash qwen/qwen3-vl-flash 3 ₽ 33 ₽ 256000 10.68 16.06
qwen3.6-flash qwen/qwen3.6-flash 26 ₽ 151 ₽ 1000000 17.44 107.74
gpt-4.1-nano openai/gpt-4.1-nano 11 ₽ 44 ₽ 1047576 1.03 18.82
chatgpt-4o-latest openai/chatgpt-4o-latest 552 ₽ 1658 ₽ 128000 1.98 21.67
kimi-k2-0905 moonshotai/kimi-k2-0905 61 ₽ 306 ₽ 262144 2.58 9.96
gpt-5.2-codex openai/gpt-5.2-codex 194 ₽ 1547 ₽ 400000 1.84 15.93
deepseek-v4-flash deepseek/deepseek-v4-flash 21 ₽ 42 ₽ 1000000 16.35 42.99
glm-4.7 z-ai/glm-4.7 66 ₽ 243 ₽ 202752 10.24 20.06
gpt-5-chat openai/gpt-5-chat 138 ₽ 1105 ₽ 128000 1.18 14.59
glm-4.7-flash z-ai/glm-4.7-flash 8 ₽ 44 ₽ 202752 4.6 29.78
qwen3-max-thinking qwen/qwen3-max-thinking 55 ₽ 219 ₽ 256000 1.58 10.84
gemini-3.1-flash-lite google/gemini-3.1-flash-lite 28 ₽ 166 ₽ 1048576 2.32 160.69
claude-haiku-4.5 anthropic/claude-haiku-4.5 110 ₽ 552 ₽ 200000 11.65 89.02
gpt5.1-pro yandex/gpt5.1-pro 1040 ₽ 1040 ₽ 32000 0.85 102.68
gemini-3.1-pro-preview-customtools google/gemini-3.1-pro-preview-customtools 221 ₽ 1326 ₽ 1048576 2.35 36.36
claude-sonnet-4 anthropic/claude-sonnet-4 332 ₽ 1658 ₽ 1000000 2.84 27.16
deepseek-v3.2 deepseek/deepseek-v3.2 44 ₽ 66 ₽ 128000 6.14 82.16
gpt-5.1 openai/gpt-5.1 138 ₽ 1105 ₽ 400000 1.35 26.81
gpt-5-mini openai/gpt-5-mini 28 ₽ 221 ₽ 400000 5.89 74.04
gpt-5.4-nano openai/gpt-5.4-nano 22 ₽ 139 ₽ 400000 2.3 64.67
gpt-5-nano openai/gpt-5-nano 6 ₽ 44 ₽ 400000 7.54 95.91
gemini-3.1-pro-preview google/gemini-3.1-pro-preview 221 ₽ 1326 ₽ 1048576 13.12 26.99
glm-4.5-air z-ai/glm-4.5-air 20 ₽ 130 ₽ 131072 3.88 24.11
claude-sonnet-4.5 anthropic/claude-sonnet-4.5 332 ₽ 1658 ₽ 1000000 11.65 42.75
qwen3.6-max-preview qwen/qwen3.6-max-preview 190 ₽ 1136 ₽ 256000 5.42 40.07
gpt-oss-120b openai/gpt-oss-120b 17 ₽ 66 ₽ 131072 1.85 317.4
gpt-5.2-chat openai/gpt-5.2-chat 193 ₽ 1547 ₽ 128000 2.69 36.75
gemini-2.5-pro google/gemini-2.5-pro 138 ₽ 1105 ₽ 1048576 13.96 96.19
qwen3-vl-8b-thinking qwen/qwen3-vl-8b-thinking 11 ₽ 110 ₽ 128000 3.21 56.58
qwen3-vl-30b-a3b-instruct qwen/qwen3-vl-30b-a3b-instruct 16 ₽ 65 ₽ 128000 2.07 12.6
mimo-v2.5 xiaomi/mimo-v2.5 21 ₽ 42 ₽ 1048576 2.06 21.27
gpt-5.4-pro openai/gpt-5.4-pro 3315 ₽ 19890 ₽ 1050000 200.95 33.04
claude-opus-4.1 anthropic/claude-opus-4.1 1658 ₽ 8288 ₽ 200000 28.02 24.76
qwen3.6-35b-a3b qwen/qwen3.6-35b-a3b 38 ₽ 227 ₽ 256000 215.07 7.37
gpt-5.2 openai/gpt-5.2 193 ₽ 1547 ₽ 400000 3.97 18.93
qwen3-vl-8b-instruct qwen/qwen3-vl-8b-instruct 11 ₽ 44 ₽ 128000 4.32 17.08
qwen3-coder-next qwen/qwen3-coder-next 22 ₽ 88 ₽ 256000 8.53 2.81
claude-opus-4.5 anthropic/claude-opus-4.5 552 ₽ 2762 ₽ 200000 3.41 1.46
gpt-5.3-chat openai/gpt-5.3-chat 194 ₽ 1547 ₽ 128000 2.07 26.65
qwen3.7-max qwen/qwen3.7-max 252 ₽ 757 ₽ 1000000 9.28 16.54
deepseek-chat-v3-0324 deepseek/deepseek-chat-v3-0324 38 ₽ 153 ₽ 163840 2.28 7.74
glm-4.6 z-ai/glm-4.6 59 ₽ 291 ₽ 202752 7.34 24.14
gemini-3.5-flash google/gemini-3.5-flash 166 ₽ 994 ₽ 1048576 1.87 71.86
deepseek-r1-distill-llama-70b deepseek/deepseek-r1-distill-llama-70b 107 ₽ 122 ₽ 131072 12.57 17.02
qwen3.5-397b-a17b qwen/qwen3.5-397b-a17b 26 ₽ 158 ₽ 256000 53.7 2.72
gpt5-pro yandex/gpt5-pro 1560 ₽ 1560 ₽ 32000 0.75 45.85
gpt5-lite yandex/gpt5-lite 260 ₽ 260 ₽ 32000 4.13 75.29
gpt-5.4 openai/gpt-5.4 276 ₽ 1658 ₽ 1050000 2.01 6.12
glm-5.2 z-ai/glm-5.2 155 ₽ 486 ₽ 1000000 40.55 11.62
gpt-4.1 openai/gpt-4.1 221 ₽ 884 ₽ 1047576 2.39 37.06
gpt-5.4-mini openai/gpt-5.4-mini 83 ₽ 497 ₽ 400000 1.97 22.83
claude-sonnet-4.6 anthropic/claude-sonnet-4.6 332 ₽ 1658 ₽ 1000000 11.72 39.04
gpt-4.1-mini openai/gpt-4.1-mini 44 ₽ 177 ₽ 1047576 1.3 15.9
qwen3.7-plus qwen/qwen3.7-plus 35 ₽ 141 ₽ 1000000 17.01 13.0
kimi-k2.7-code moonshotai/kimi-k2.7-code 105 ₽ 442 ₽ 262144 2.82 19.83
deepseek-v3.2-speciale deepseek/deepseek-v3.2-speciale 61 ₽ 184 ₽ 163840 4.58 65.95
qwen3-vl-plus qwen/qwen3-vl-plus 22 ₽ 219 ₽ 256000 16.95 1.12

Скорость vs Цена Output

Оптимальное соотношение скорость/цена

Контекст vs Цена Output

Модели с лучшим контекстом за цену

Ключевые определения

Контекстное окно: максимальное общее количество входных и выходных токенов.
Throughput (скорость вывода): количество токенов в секунду, получаемых во время генерации токенов моделью.
Latency (задержка, время до первого токена): время до получения первого токена в секундах после отправки запроса к API.
Цена Output (вывода): цена за токен, сгенерированный моделью, выраженная в соответствующей валюте за миллион токенов.
Цена Input (ввода): цена за токен, включенный в запрос/сообщение, отправленное к API.