VSELLM

VSELLM

Единый API-доступ к лучшим AI-моделям

Передовые модели

Claude Sonnet 4.6
Передовая модель Anthropic

Claude Sonnet 4.6

Высокоэффективная версия Claude 4.6, оптимизированная для скорости и низкой стоимости при хорошей производительности в кодировании и агентских задачах.

GPT-5 Нейросеть нового поколения

GPT-5

Флагманская языковая модель с продвинутыми возможностями рассуждения, программирования и анализа сложных контекстов.

Gemini 2.5 Pro Линейка Google DeepMind

Gemini 2.5 Pro

Мощная мультимодальная модель от Google, оптимизированная для сложных задач рассуждения, работы с кодом и анализа данных.

Чтобы сгенерировать ключ, авторизуйтесь и пополните баланс

Цены указаны за 1 млн токенов, за генерацию 1 изображения или за 1 минуту входного аудио.

Модель ID Цена Input Цена Output Контекст Latency (сек) Throughput (т/сек) Function
Calling
Подключение
claude-fable-5 anthropic/claude-fable-5 1105 ₽ 5525 ₽ 1000000 18.11 46.06
qwen3.5-plus qwen/qwen3.5-plus 18 ₽ 105 ₽ 1000000 8.71 77.06
qwen3.6-flash qwen/qwen3.6-flash 25 ₽ 151 ₽ 1000000 25.39 110.89
gpt-oss-20b openai/gpt-oss-20b 5 ₽ 21 ₽ 131072 0.79 74.31
qwen3.5-flash qwen/qwen3.5-flash 4 ₽ 44 ₽ 1000000 19.77 119.89
claude-opus-5 anthropic/claude-opus-5 552 ₽ 2762 ₽ 1000000 20.6 66.2
gpt-5.6-luna openai/gpt-5.6-luna 110 ₽ 663 ₽ 1050000 2.19 52.16
kimi-k3 moonshotai/kimi-k3 76 ₽ 1658 ₽ 1048576 8.73 18.32
gpt-chat-latest openai/gpt-chat-latest 552 ₽ 3315 ₽ 1047576 2.25 12.89
gpt-5.5 openai/gpt-5.5 552 ₽ 3315 ₽ 1050000 2.7 25.62
claude-opus-4.8 anthropic/claude-opus-4.8 552 ₽ 2762 ₽ 1000000 33.27 52.45
gemini-3.1-pro-preview google/gemini-3.1-pro-preview 221 ₽ 1326 ₽ 1048576 20.5 102.35
gemini-3.5-flash-lite google/gemini-3.5-flash-lite 33 ₽ 276 ₽ 1048576 1.14 80.99
gpt-5.4-nano openai/gpt-5.4-nano 22 ₽ 138 ₽ 400000 2.77 57.59
gemini-2.5-flash google/gemini-2.5-flash 33 ₽ 276 ₽ 1048576 1.11 29.26
gpt-5.6-sol openai/gpt-5.6-sol 552 ₽ 3315 ₽ 1050000 2.24 14.67
claude-opus-4.7 anthropic/claude-opus-4.7 552 ₽ 2762 ₽ 1000000 10.36 3.04
gpt-5.6-terra openai/gpt-5.6-terra 276 ₽ 1658 ₽ 1050000 89.08 52.98
qwen3-vl-235b-a22b-instruct qwen/qwen3-vl-235b-a22b-instruct 44 ₽ 175 ₽ 128000 7.51 30.3
gpt-5 openai/gpt-5 138 ₽ 1105 ₽ 400000 73.97 20.62
claude-sonnet-5 anthropic/claude-sonnet-5 221 ₽ 1105 ₽ 1000000 35.46 63.74
llama-3.3-70b-instruct meta-llama/llama-3.3-70b-instruct 17 ₽ 49 ₽ 131072 2.68 10.44
qwen3-235b-a22b qwen/qwen3-235b-a22b 44 ₽ 175 ₽ 128000 2.4 63.65
mimo-v2.5-pro xiaomi/mimo-v2.5-pro 67 ₽ 133 ₽ 1048576 11.21 51.55
glm-4.6v-flash z-ai/glm-4.6v-flash 1 ₽ 8 ₽ 128000 3.11 7.72
gemini-3-flash-preview google/gemini-3-flash-preview 55 ₽ 332 ₽ 1048576 4.29 46.84
kimi-k2.6 moonshotai/kimi-k2.6 137 ₽ 568 ₽ 256000 2.6 22.57
qwen3.6-plus qwen/qwen3.6-plus 42 ₽ 253 ₽ 1000000 5.65 42.96
qwen3-vl-flash qwen/qwen3-vl-flash 3 ₽ 33 ₽ 256000 2.72 76.61
gpt-4o-mini openai/gpt-4o-mini 17 ₽ 66 ₽ 128000 1.74 2.58
chatgpt-4o-latest openai/chatgpt-4o-latest 552 ₽ 1658 ₽ 128000 1.98 21.67
gpt-5.2-codex openai/gpt-5.2-codex 193 ₽ 1547 ₽ 400000 1.84 15.93
glm-5v-turbo z-ai/glm-5v-turbo 133 ₽ 442 ₽ 202752 6.87 12.39
glm-4.7 z-ai/glm-4.7 66 ₽ 243 ₽ 202752 29.46 26.62
glm-5.1 z-ai/glm-5.1 126 ₽ 505 ₽ 202752 8.73 34.34
gpt-4.1-nano openai/gpt-4.1-nano 11 ₽ 44 ₽ 1047576 0.94 16.1
deepseek-v4-flash deepseek/deepseek-v4-flash 21 ₽ 42 ₽ 1000000 3.33 68.98
text-embedding-3-large openai/text-embedding-3-large 16 ₽ - ₽ 8192 8.71 0.0
glm-5 z-ai/glm-5 110 ₽ 354 ₽ 202752 3.18 24.82
gemini-3.1-flash-lite google/gemini-3.1-flash-lite 28 ₽ 166 ₽ 1048576 1.1 11.85
claude-haiku-4.5 anthropic/claude-haiku-4.5 110 ₽ 552 ₽ 200000 19.9 88.46
gpt5.1-pro yandex/gpt5.1-pro 1040 ₽ 1040 ₽ 32000 0.85 102.68
claude-opus-4.6 anthropic/claude-opus-4.6 552 ₽ 2762 ₽ 1000000 13.78 37.17
qwen3-vl-235b-a22b-thinking qwen/qwen3-vl-235b-a22b-thinking 44 ₽ 439 ₽ 128000 5.36 46.97
gpt-5.1 openai/gpt-5.1 138 ₽ 1105 ₽ 400000 7.12 43.49
deepseek-v3.2 deepseek/deepseek-v3.2 44 ₽ 66 ₽ 128000 1.27 65.11
gpt-5.3-codex openai/gpt-5.3-codex 193 ₽ 1547 ₽ 400000 2.64 0.38
gpt-5-mini openai/gpt-5-mini 28 ₽ 221 ₽ 400000 24.06 101.52
gpt-5-nano openai/gpt-5-nano 6 ₽ 44 ₽ 400000 1.5 15.0
claude-sonnet-4.5 anthropic/claude-sonnet-4.5 332 ₽ 1658 ₽ 1000000 9.99 12.81
gemini-3.6-flash google/gemini-3.6-flash 166 ₽ 829 ₽ 1048576 6.78 33.78
glm-4.5-air z-ai/glm-4.5-air 20 ₽ 130 ₽ 131072 2.31 46.26
qwen3-max-thinking qwen/qwen3-max-thinking 55 ₽ 219 ₽ 256000 1.66 3.02
kimi-k2.5 moonshotai/kimi-k2.5 66 ₽ 332 ₽ 262144 38.42 28.7
deepseek-v4-pro deepseek/deepseek-v4-pro 252 ₽ 505 ₽ 1000000 26.74 52.09
glm-4.6v-flashx z-ai/glm-4.6v-flashx 6 ₽ 61 ₽ 128000 1.9 54.08
glm-4.6v z-ai/glm-4.6v 46 ₽ 138 ₽ 128000 4.88 11.89
glm-4.7-flash z-ai/glm-4.7-flash 8 ₽ 44 ₽ 202752 151.26 42.56
qwen3-vl-30b-a3b-thinking qwen/qwen3-vl-30b-a3b-thinking 17 ₽ 164 ₽ 128000 2.13 88.99
qwen3.6-max-preview qwen/qwen3.6-max-preview 189 ₽ 1136 ₽ 256000 11.26 24.55
gemini-3.1-pro-preview-customtools google/gemini-3.1-pro-preview-customtools 221 ₽ 1326 ₽ 1048576 2.59 34.95
gpt-oss-120b openai/gpt-oss-120b 17 ₽ 66 ₽ 131072 1.91 211.48
gemini-2.5-pro google/gemini-2.5-pro 138 ₽ 1105 ₽ 1048576 12.21 113.33
mimo-v2.5 xiaomi/mimo-v2.5 21 ₽ 43 ₽ 1048576 3.22 26.29
qwen3-vl-8b-thinking qwen/qwen3-vl-8b-thinking 11 ₽ 110 ₽ 128000 2.71 121.62
qwen3-vl-30b-a3b-instruct qwen/qwen3-vl-30b-a3b-instruct 17 ₽ 66 ₽ 128000 1.3 72.8
qwen3.6-35b-a3b qwen/qwen3.6-35b-a3b 38 ₽ 227 ₽ 256000 1.32 38.5
gpt-5.4-pro openai/gpt-5.4-pro 3315 ₽ 19890 ₽ 1050000 200.95 33.04
claude-opus-4.1 anthropic/claude-opus-4.1 1658 ₽ 8288 ₽ 200000 1.88 30.66
gpt-5.2 openai/gpt-5.2 193 ₽ 1547 ₽ 400000 3.65 30.65
qwen3-coder-next qwen/qwen3-coder-next 22 ₽ 89 ₽ 256000 0.76 23.13
qwen3-vl-8b-instruct qwen/qwen3-vl-8b-instruct 11 ₽ 44 ₽ 128000 1.93 70.58
claude-opus-4.5 anthropic/claude-opus-4.5 552 ₽ 2762 ₽ 200000 2.45 11.32
qwen3.7-max qwen/qwen3.7-max 252 ₽ 758 ₽ 1000000 4.14 40.51
glm-4.6 z-ai/glm-4.6 60 ₽ 291 ₽ 202752 12.81 20.61
deepseek-chat-v3-0324 deepseek/deepseek-chat-v3-0324 38 ₽ 153 ₽ 163840 3.37 8.17
gemini-3.5-flash google/gemini-3.5-flash 166 ₽ 995 ₽ 1048576 1.57 57.75
qwen3.5-397b-a17b qwen/qwen3.5-397b-a17b 26 ₽ 158 ₽ 256000 5.85 58.79
deepseek-r1-distill-llama-70b deepseek/deepseek-r1-distill-llama-70b 107 ₽ 122 ₽ 131072 8.41 18.67
gpt5-pro yandex/gpt5-pro 1560 ₽ 1560 ₽ 32000 0.75 45.85
gpt5-lite yandex/gpt5-lite 260 ₽ 260 ₽ 32000 4.13 75.29
gpt-5.4 openai/gpt-5.4 276 ₽ 1658 ₽ 1050000 2.98 24.18
glm-5.2 z-ai/glm-5.2 155 ₽ 486 ₽ 1000000 3.35 31.95
gpt-4.1 openai/gpt-4.1 221 ₽ 884 ₽ 1047576 2.93 18.4
gpt-5.4-mini openai/gpt-5.4-mini 83 ₽ 497 ₽ 400000 1.51 70.38
claude-sonnet-4.6 anthropic/claude-sonnet-4.6 332 ₽ 1658 ₽ 1000000 7.89 14.96
gpt-4.1-mini openai/gpt-4.1-mini 44 ₽ 177 ₽ 1047576 2.31 61.48
qwen3.7-plus qwen/qwen3.7-plus 35 ₽ 141 ₽ 1000000 29.14 50.35
kimi-k2.7-code moonshotai/kimi-k2.7-code 105 ₽ 442 ₽ 262144 0.86 56.23
deepseek-v3.2-speciale deepseek/deepseek-v3.2-speciale 61 ₽ 184 ₽ 163840 1.88 73.34
qwen3-vl-plus qwen/qwen3-vl-plus 22 ₽ 219 ₽ 256000 0.86 11.61

Скорость vs Цена Output

Оптимальное соотношение скорость/цена

Контекст vs Цена Output

Модели с лучшим контекстом за цену

Ключевые определения

Контекстное окно: максимальное общее количество входных и выходных токенов.
Throughput (скорость вывода): количество токенов в секунду, получаемых во время генерации токенов моделью.
Latency (задержка, время до первого токена): время до получения первого токена в секундах после отправки запроса к API.
Цена Output (вывода): цена за токен, сгенерированный моделью, выраженная в соответствующей валюте за миллион токенов.
Цена Input (ввода): цена за токен, включенный в запрос/сообщение, отправленное к API.