VSELLM

VSELLM

Единый API-доступ к лучшим AI-моделям

Передовые модели

Claude Sonnet 4.6
Передовая модель Anthropic

Claude Sonnet 4.6

Высокоэффективная версия Claude 4.6, оптимизированная для скорости и низкой стоимости при хорошей производительности в кодировании и агентских задачах.

GPT-5 Нейросеть нового поколения

GPT-5

Флагманская языковая модель с продвинутыми возможностями рассуждения, программирования и анализа сложных контекстов.

Gemini 2.5 Pro Линейка Google DeepMind

Gemini 2.5 Pro

Мощная мультимодальная модель от Google, оптимизированная для сложных задач рассуждения, работы с кодом и анализа данных.

Чтобы сгенерировать ключ, авторизуйтесь и пополните баланс

Цены указаны за 1 млн токенов, за генерацию 1 изображения или за 1 минуту входного аудио.

Модель ID Цена Input Цена Output Контекст Latency (сек) Throughput (т/сек) Function
Calling
Подключение
gemini-3.1-pro-preview google/gemini-3.1-pro-preview 221 ₽ 1326 ₽ 1048576 15.32 36.76
qwen3.5-flash qwen/qwen3.5-flash 4 ₽ 44 ₽ 1000000 20.51 96.16
gemini-3.7-flash google/gemini-3.7-flash 83 ₽ 414 ₽ 1048576 1.54 134.2
qwen3.6-flash qwen/qwen3.6-flash 26 ₽ 151 ₽ 1000000 17.36 131.89
qwen3.5-plus qwen/qwen3.5-plus 18 ₽ 105 ₽ 1000000 15.99 35.71
gpt-5.5 openai/gpt-5.5 552 ₽ 3315 ₽ 1050000 7.68 17.84
claude-opus-4.8 anthropic/claude-opus-4.8 552 ₽ 2762 ₽ 1000000 9.26 28.53
claude-opus-5 anthropic/claude-opus-5 552 ₽ 2762 ₽ 1000000 20.6 66.2
deepseek-v4-flash-0731 deepseek/deepseek-v4-flash-0731 15 ₽ 30 ₽ 1000000 21.54 115.65
gemini-3.5-flash-lite google/gemini-3.5-flash-lite 33 ₽ 276 ₽ 1048576 0.95 77.2
claude-fable-5 anthropic/claude-fable-5 1105 ₽ 5525 ₽ 1000000 3.14 5.41
claude-opus-4.7 anthropic/claude-opus-4.7 552 ₽ 2762 ₽ 1000000 3.15 1.91
gpt-5.6-luna openai/gpt-5.6-luna 22 ₽ 133 ₽ 1050000 3.42 55.62
glm-4.6v z-ai/glm-4.6v 33 ₽ 99 ₽ 128000 1.76 41.74
gpt-chat-latest openai/gpt-chat-latest 552 ₽ 3315 ₽ 1047576 1.86 28.99
gemini-2.5-flash google/gemini-2.5-flash 33 ₽ 276 ₽ 1048576 1.01 30.65
kimi-k3 moonshotai/kimi-k3 332 ₽ 1658 ₽ 1048576 37.17 31.64
gpt-5.4-nano openai/gpt-5.4-nano 22 ₽ 138 ₽ 400000 1.95 22.82
qwen3.7-flash qwen/qwen3.7-flash 3 ₽ 14 ₽ 1000000 14.42 113.73
gpt-oss-20b openai/gpt-oss-20b 11 ₽ 55 ₽ 131072 0.95 86.97
glm-4.7-flash z-ai/glm-4.7-flash 8 ₽ 44 ₽ 202752 56.01 74.8
gpt-5.6-sol openai/gpt-5.6-sol 552 ₽ 3315 ₽ 1050000 5.3 20.47
llama-3.3-70b-instruct meta-llama/llama-3.3-70b-instruct 24 ₽ 55 ₽ 131072 0.47 74.7
gpt-5 openai/gpt-5 138 ₽ 1105 ₽ 400000 5.1 72.94
gpt-5.3-codex openai/gpt-5.3-codex 194 ₽ 1547 ₽ 400000 110.37 53.56
claude-sonnet-5 anthropic/claude-sonnet-5 221 ₽ 1105 ₽ 1000000 4.09 12.75
gpt-5.6-terra openai/gpt-5.6-terra 221 ₽ 1326 ₽ 1050000 104.0 54.57
qwen3.6-plus qwen/qwen3.6-plus 42 ₽ 252 ₽ 1000000 4.32 49.05
qwen3.8-max qwen/qwen3.8-max 155 ₽ 465 ₽ 1000000 4.17 33.39
mimo-v2.5-pro xiaomi/mimo-v2.5-pro 48 ₽ 96 ₽ 1048576 2.97 69.03
glm-4.6v-flash z-ai/glm-4.6v-flash 1 ₽ 8 ₽ 128000 9.03 25.22
qwen3-235b-a22b qwen/qwen3-235b-a22b 44 ₽ 175 ₽ 128000 2.57 53.2
gemini-3-flash-preview google/gemini-3-flash-preview 55 ₽ 332 ₽ 1048576 3.45 62.76
qwen3-vl-235b-a22b-instruct qwen/qwen3-vl-235b-a22b-instruct 44 ₽ 175 ₽ 128000 6.2 36.0
kimi-k2.6 moonshotai/kimi-k2.6 105 ₽ 442 ₽ 256000 1.75 42.64
qwen3-vl-flash qwen/qwen3-vl-flash 3 ₽ 33 ₽ 256000 1.04 30.71
gpt-4o-mini openai/gpt-4o-mini 17 ₽ 66 ₽ 128000 2.3 17.11
chatgpt-4o-latest openai/chatgpt-4o-latest 552 ₽ 1658 ₽ 128000 1.98 21.67
glm-5v-turbo z-ai/glm-5v-turbo 133 ₽ 442 ₽ 202752 5.4 14.07
gpt-5.2-codex openai/gpt-5.2-codex 194 ₽ 1547 ₽ 400000 1.84 15.93
deepseek-v4-flash deepseek/deepseek-v4-flash 21 ₽ 42 ₽ 1000000 15.38 88.95
glm-5.1 z-ai/glm-5.1 155 ₽ 486 ₽ 202752 11.5 67.12
glm-4.7 z-ai/glm-4.7 66 ₽ 243 ₽ 202752 14.47 93.2
gpt-4.1-nano openai/gpt-4.1-nano 11 ₽ 44 ₽ 1047576 1.58 94.07
text-embedding-3-large openai/text-embedding-3-large 14 ₽ - ₽ 8192 8.71 0.0
glm-5 z-ai/glm-5 110 ₽ 354 ₽ 202752 5.12 29.71
gemini-3.1-flash-lite google/gemini-3.1-flash-lite 28 ₽ 166 ₽ 1048576 1.84 72.28
claude-haiku-4.5 anthropic/claude-haiku-4.5 110 ₽ 552 ₽ 200000 4.68 25.71
gpt5.1-pro yandex/gpt5.1-pro 1040 ₽ 1040 ₽ 32000 0.85 102.68
qwen3-vl-235b-a22b-thinking qwen/qwen3-vl-235b-a22b-thinking 44 ₽ 439 ₽ 128000 2.74 48.95
claude-opus-4.6 anthropic/claude-opus-4.6 552 ₽ 2762 ₽ 1000000 6.83 8.94
gpt-5.1 openai/gpt-5.1 138 ₽ 1105 ₽ 400000 1.71 40.09
deepseek-v3.2 deepseek/deepseek-v3.2 44 ₽ 66 ₽ 128000 1.55 59.81
gpt-5-mini openai/gpt-5-mini 28 ₽ 221 ₽ 400000 25.87 99.91
claude-sonnet-4.5 anthropic/claude-sonnet-4.5 332 ₽ 1658 ₽ 1000000 123.67 49.03
qwen3-max-thinking qwen/qwen3-max-thinking 55 ₽ 219 ₽ 256000 1.51 11.13
gpt-5-nano openai/gpt-5-nano 6 ₽ 44 ₽ 400000 0.98 24.91
gemini-3.6-flash google/gemini-3.6-flash 83 ₽ 414 ₽ 1048576 2.29 21.0
kimi-k2.5 moonshotai/kimi-k2.5 66 ₽ 332 ₽ 262144 1.6 21.08
glm-4.5-air z-ai/glm-4.5-air 22 ₽ 122 ₽ 131072 5.36 29.0
glm-4.6v-flashx z-ai/glm-4.6v-flashx 4 ₽ 44 ₽ 128000 1.85 35.1
qwen3-vl-30b-a3b-thinking qwen/qwen3-vl-30b-a3b-thinking 16 ₽ 165 ₽ 128000 10.77 91.68
deepseek-v4-pro deepseek/deepseek-v4-pro 192 ₽ 385 ₽ 1000000 1.64 120.76
qwen3.6-max-preview qwen/qwen3.6-max-preview 190 ₽ 1136 ₽ 256000 7.49 18.16
gpt-oss-120b openai/gpt-oss-120b 17 ₽ 66 ₽ 131072 2.93 160.53
gemini-3.1-pro-preview-customtools google/gemini-3.1-pro-preview-customtools 221 ₽ 1326 ₽ 1048576 8.65 84.94
qwen3-vl-30b-a3b-instruct qwen/qwen3-vl-30b-a3b-instruct 16 ₽ 65 ₽ 128000 1.39 76.04
gemini-2.5-pro google/gemini-2.5-pro 138 ₽ 1105 ₽ 1048576 76.1 121.16
mimo-v2.5 xiaomi/mimo-v2.5 15 ₽ 31 ₽ 1048576 3.52 115.73
qwen3-vl-8b-thinking qwen/qwen3-vl-8b-thinking 11 ₽ 110 ₽ 128000 3.78 53.19
gpt-5.4-pro openai/gpt-5.4-pro 3315 ₽ 19890 ₽ 1050000 200.95 33.04
qwen3.6-35b-a3b qwen/qwen3.6-35b-a3b 38 ₽ 227 ₽ 256000 1.56 111.75
gpt-5.2 openai/gpt-5.2 193 ₽ 1547 ₽ 400000 10.2 47.49
qwen3-vl-8b-instruct qwen/qwen3-vl-8b-instruct 11 ₽ 44 ₽ 128000 12.03 23.22
qwen3-coder-next qwen/qwen3-coder-next 22 ₽ 88 ₽ 256000 0.96 23.6
claude-opus-4.5 anthropic/claude-opus-4.5 552 ₽ 2762 ₽ 200000 5.02 19.32
qwen3.7-max qwen/qwen3.7-max 252 ₽ 757 ₽ 1000000 3.58 39.6
glm-4.6 z-ai/glm-4.6 66 ₽ 243 ₽ 202752 4.42 32.1
qwen3.5-397b-a17b qwen/qwen3.5-397b-a17b 26 ₽ 158 ₽ 256000 5.05 54.44
gemini-3.5-flash google/gemini-3.5-flash 166 ₽ 994 ₽ 1048576 4.23 85.26
deepseek-chat-v3-0324 deepseek/deepseek-chat-v3-0324 55 ₽ 166 ₽ 163840 0.53 24.27
deepseek-r1-distill-llama-70b deepseek/deepseek-r1-distill-llama-70b 88 ₽ 88 ₽ 131072 17.54 13.69
gpt5-pro yandex/gpt5-pro 1560 ₽ 1560 ₽ 32000 0.75 45.85
gpt5-lite yandex/gpt5-lite 260 ₽ 260 ₽ 32000 4.13 75.29
gpt-5.4 openai/gpt-5.4 276 ₽ 1658 ₽ 1050000 4.69 35.86
glm-5.2 z-ai/glm-5.2 155 ₽ 486 ₽ 1000000 24.82 48.38
gpt-4.1 openai/gpt-4.1 221 ₽ 884 ₽ 1047576 3.94 69.17
gpt-5.4-mini openai/gpt-5.4-mini 83 ₽ 497 ₽ 400000 1.32 58.82
claude-sonnet-4.6 anthropic/claude-sonnet-4.6 332 ₽ 1658 ₽ 1000000 21.47 51.63
gpt-4.1-mini openai/gpt-4.1-mini 44 ₽ 177 ₽ 1047576 2.02 13.69
qwen3.7-plus qwen/qwen3.7-plus 30 ₽ 122 ₽ 1000000 5.05 48.79
kimi-k2.7-code moonshotai/kimi-k2.7-code 99 ₽ 410 ₽ 262144 2.21 14.04
qwen3-vl-plus qwen/qwen3-vl-plus 22 ₽ 219 ₽ 256000 1.04 17.56

Скорость vs Цена Output

Оптимальное соотношение скорость/цена

Контекст vs Цена Output

Модели с лучшим контекстом за цену

Ключевые определения

Контекстное окно: максимальное общее количество входных и выходных токенов.
Throughput (скорость вывода): количество токенов в секунду, получаемых во время генерации токенов моделью.
Latency (задержка, время до первого токена): время до получения первого токена в секундах после отправки запроса к API.
Цена Output (вывода): цена за токен, сгенерированный моделью, выраженная в соответствующей валюте за миллион токенов.
Цена Input (ввода): цена за токен, включенный в запрос/сообщение, отправленное к API.