Мировые новинки у нас
- Все новинки
- 16 июля, Kimi K3 от MoonshotAI, в течение нескольких часов после выкладки API.
- 10 июля, топовые GPT-5.6 Luna, Terra, Sol от OpenAI.
- 30 июня, топовая Sonnet 5 от Anhtropic, в течение нескольких часов после публикации
- 26 июня, GLM-5.2 от Z-AI
- 28 мая, топовая Opus 4.8 от Anhtropic
- 23 мая, учли постоянную 75% скидку на Deepseek V4 Pro от Deepseek.
- 20 мая, Gemini 3.5 Flash и 3.1 Flash Lite от Google.
- 17 мая, Grok 4.3 от xAI.
- 3 мая, GPT-5.5 и GPT-5.5 Pro от OpenAI.
- 24 апреля, Deepseek V4 Flash и Pro от Deepseek. Топовые дешевые модели.
- 22 апреля, GPT Image 2 от OpenAI. Топовая модель генерации изображений.
- 20 апреля, Kimi K2.6 от MoonshotAI. По метрикам соперничает с топами.
- 17 апреля, топовая Opus 4.7 от Anhtropic
- 10 апреля, Gemma 4 от Google.
- 7 апреля, GLM-5.1 от Z-AI, в течение нескольких часов после публикации. Топовая модель программирования.
- 25 марта, Xiaomi: MiMo-V2-Pro и Omni
- 17 марта, GPT-5.4 mini и nano от OpenAI, в течение 2 часов после публикации.
- 10 марта, Kling O3 и LTX 2.3 – топовые модели генерации видео.
- 6 марта, GPT-5.4 и GPT-5.4 Pro от OpenAI.
- 3 марта, Gemini 3.1 Flash Lite Preview от Google – легкая модель, в течение 3 часов после публикации.
- 27 февраля, Nano Banana 2 – создание и редактирование изображений от Google.
- 25 февраля, GPT-5.3 Codex от OpenAI.
- 17 февраля, Sonnet 4.6 – обновленная модель от Anthropic, по метрикам приближается к Opus 4.5–4.6. Добавили в течение 3 часов после публикации.
- 6 февраля, Opus 4.6 – обновленная модель от Anthropic.
- 20 января, GPT-5.2 Codex от OpenAI.
- 15 января, Flux 2 [klein] 4B и 9B – работа с изображением (создание по тексту, редактирование), сопоставима с обычной Nano Banana.
- 12 января, поддержка Claude Code. Сделали альтернативный доступ к нейросетям через Anthropic-совместимое API, и теперь можно использовать Claude Code для программирования.
- 17 декабря, Gemini 3.0 Flash Preview от Google – легкая модель, чуть хуже топовой Gemini 3.0 Pro Preview.
- 12 декабря, GPT-5.2, GPT-5.2 Pro от OpenAI.
- 8 декабря, Seedream 4.5 – работа с изображением (создание по тексту, редактирование), конкурент Nano Banana Pro.
- 2 декабря, DeepSeek 3.2 – обновленная модель от DeepSeek.
- 25 ноября, Opus 4.5 – обновленная модель от Anthropic.
- 20 ноября, Nano Banana Pro – создание и редактирование изображений от Google, в течение 3 часов после публикации.
- 18 ноября, Gemini 3.0 Pro Preview от Google, в течение 3 часов после публикации.
- 14 ноября, GPT-5.1 от OpenAI.
- 6 ноября, Kimi K2 Thinking – в течение 2 часов после публикации. Опенсорс модель уровня GPT-5, согласно метрикам.
- 4 ноября, Kling 2.5. Топовая модель генерации видео.
- 4 ноября, Sora 2 от OpenAI. Топовая модель генерации видео.
- 31 октября, Veo 3.1 Fast от Google. Топовая модель генерации видео.
- 31 октября, Minimax M2 от Minimax. Топовая опенсорс модель.
- 22 октября, Grok 4 Fast от xAI. Модель уровня GPT-5, но значительно быстрее и дешевле.
- 22 октября, GPT 5 Pro от OpenAI. Самая дорогая и топовая модель.
- 16 октября, Haiku 4.5 – обновленная модель от Anthropic. По метрикам сопоставима с более старой Sonnet 4, но дешевле её практически в 5 раз!
- 29 сентября, Sonnet 4.5 – обновленная модель от Anthropic
- 29 сентября, DeepSeek Chat 3.2 Exp – обновленная модель от DeepSeek со значительным понижением стоимости генерации
- Более старые новости по подключенным моделям
Текстовые модели (западные, Европа, США)
OpenAI: ChatGPT, GPT-5, GPT-4o-mini...
Нейросети от мирового лидера, OpenAI. Если вы только погружаетесь в тему текстовых нейросетей – оптимально выбрать ChatGPT (gpt-3.5-turbo) в качестве основного варианта. Если вам нужна бОльшая точность в рассуждениях – выберите GPT-4. GPT-4-Turbo обладает контекстом в 128 000 символов и подходит в том числе для обработки больших файлов – но она в меру дорогая.
Внимание: для новых пользователей включена автоматическая оптимизация запросов при выборе сетeй OpenAI – выбирается самая эффективная и дешевая в своем классе. Если вы хотите точного соответствия модели вашему запросу, отключите оптимизацию в
Настройках
Внимание: для новых пользователей включена автоматическая оптимизация запросов при выборе сетeй OpenAI – выбирается самая эффективная и дешевая в своем классе. Если вы хотите точного соответствия модели вашему запросу, отключите оптимизацию в
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| OpenAI: GPT-5.6 Sol Pro ? openai/gpt-5.6-sol-pro Профессиональный (не Тестовый) повышенная цена при контексте > 250К топ, но ОЧЕНЬ дорогая tools structured-outputs vision | 1.5 | 9.0 | 1000000 | 10 июл | да |
| OpenAI: GPT-5.6 Sol (Thinking High) ? openai/gpt-5.6-sol-thinking-high Профессиональный (не Тестовый) повышенная цена при контексте > 250К топ, но дорогая tools structured-outputs vision | 1.5 | 9.0 | 1000000 | 10 июл | да |
| OpenAI: GPT-5.6 Sol ? openai/gpt-5.6-sol Профессиональный (не Тестовый) повышенная цена при контексте > 250К ТОП! tools structured-outputs vision | 1.5 | 9.0 | 1000000 | 10 июл | да |
| OpenAI: GPT-5.6 Terra Pro ? openai/gpt-5.6-terra-pro Профессиональный (не Тестовый) повышенная цена при контексте > 250К tools structured-outputs vision | 0.75 | 4.5 | 1000000 | 10 июл | да |
| OpenAI: GPT-5.6 Terra (Thinking High) ? openai/gpt-5.6-terra-thinking-high Профессиональный (не Тестовый) повышенная цена при контексте > 250К tools structured-outputs vision | 0.75 | 4.5 | 1000000 | 10 июл | да |
| OpenAI: GPT-5.6 Terra ? openai/gpt-5.6-terra Профессиональный (не Тестовый) повышенная цена при контексте > 250К tools structured-outputs vision | 0.75 | 4.5 | 1000000 | 10 июл | да |
| OpenAI: GPT-5.6 Luna Pro ? openai/gpt-5.6-luna-pro Базовый и выше (не Тестовый) повышенная цена при контексте > 250К tools structured-outputs vision | 0.3 | 1.8 | 1000000 | 10 июл | да |
| OpenAI: GPT-5.6 Luna (Thinking High) ? openai/gpt-5.6-luna-thinking-high Базовый и выше (не Тестовый) повышенная цена при контексте > 250К tools structured-outputs vision | 0.3 | 1.8 | 1000000 | 10 июл | да |
| OpenAI: GPT-5.6 Luna ? openai/gpt-5.6-luna Базовый и выше (не Тестовый) повышенная цена при контексте > 250К tools structured-outputs vision | 0.3 | 1.8 | 1000000 | 10 июл | да |
| OpenAI: GPT-5.5-Pro ? openai/gpt-5.5-pro Профессиональный (не Тестовый) топ, но ОЧЕНЬ дорогая tools structured-outputs vision | 9.0 | 54.0 | 300000 | 3 мая | да |
| OpenAI: GPT-5.5 ? openai/gpt-5.5 Профессиональный (не Тестовый) повышенная цена при контексте > 250К топ tools structured-outputs vision | 1.5 | 9.0 | 1000000 | 3 мая | да |
| OpenAI: GPT-5.4 Mini (Thinking) ? openai/gpt-5.4-mini-thinking-xhigh Базовый и выше (не Тестовый) tools structured-outputs vision | 0.20 | 1.20 | 400000 | 17 мар | да |
| OpenAI: GPT-5.4 Nano (Thinking XHigh) ? openai/gpt-5.4-nano-thinking-xhigh Базовый и выше (не Тестовый) tools structured-outputs vision | 0.06 | 0.35 | 400000 | 17 мар | да |
| OpenAI: GPT-5.4 Nano (Thinking High) ? openai/gpt-5.4-nano-thinking tools structured-outputs vision | 0.06 | 0.35 | 400000 | 17 мар | да |
| OpenAI: GPT-5.4 Nano ? openai/gpt-5.4-nano tools structured-outputs vision | 0.06 | 0.35 | 400000 | 17 мар | да |
| OpenAI: GPT-5.4 Mini (Thinking) ? openai/gpt-5.4-mini-thinking Базовый и выше (не Тестовый) tools structured-outputs vision | 0.20 | 1.20 | 400000 | 17 мар | да |
| OpenAI: GPT-5.4 Mini ? openai/gpt-5.4-mini Базовый и выше (не Тестовый) tools structured-outputs vision | 0.20 | 1.20 | 400000 | 17 мар | да |
| OpenAI: GPT-5.4 (1M контекста) ? openai/gpt-5.4-1m Профессиональный (не Тестовый) топ tools structured-outputs vision | 1.40 | 6.30 | 1000000 | 6 мар | да |
| OpenAI: GPT-5.4 Pro (Thinking High) ? openai/gpt-5.4-pro-high Профессиональный (не Тестовый) топ, но ОЧЕНЬ дорогая tools structured-outputs | 9.0 | 54.0 | 256000 | 6 мар | да |
| OpenAI: GPT-5.4 Pro (Thinking) ? openai/gpt-5.4-pro Профессиональный (не Тестовый) топ, но ОЧЕНЬ дорогая tools structured-outputs | 9.0 | 54.0 | 256000 | 6 мар | да |
| OpenAI: GPT-5.4 (X-High Thinking) ? openai/gpt-5.4-xhigh Профессиональный (не Тестовый) топ tools structured-outputs | 0.70 | 4.20 | 256000 | 6 мар | да |
| OpenAI: GPT-5.4 ? openai/gpt-5.4 Профессиональный (не Тестовый) топ tools structured-outputs | 0.70 | 4.20 | 256000 | 6 мар | да |
| OpenAI: GPT-5.3 Chat ? openai/gpt-5.3-chat Профессиональный топ tools structured-outputs | 0.48 | 3.80 | 128000 | 4 мар | да |
| OpenAI: GPT-5.3 Codex (Thinking, X-high) ? openai/gpt-5.3-codex-xhigh Профессиональный (не Тестовый) топ программирование и общие задачи tools structured-outputs vision | 0.52 | 3.90 | 400000 | 25 фев | да |
| OpenAI: GPT-5.3 Codex (Thinking) ? openai/gpt-5.3-codex Профессиональный (не Тестовый) топ программирование и общие задачи tools structured-outputs vision | 0.52 | 3.90 | 400000 | 25 фев | да |
| OpenAI: GPT-5.2 Codex (Thinking) ? openai/gpt-5.2-codex Профессиональный (не Тестовый) топ программирование и общие задачи tools structured-outputs | 0.52 | 3.90 | 400000 | 20 янв | да |
| OpenAI: GPT-5.2 Pro (Thinking High) ? openai/gpt-5.2-pro-high Профессиональный (не Тестовый) топ, но ОЧЕНЬ дорогая tools structured-outputs | 6.0 | 45.0 | 400000 | 12 дек 25 | да |
| OpenAI: GPT-5.2 Pro (Thinking) ? openai/gpt-5.2-pro Профессиональный (не Тестовый) топ, но ОЧЕНЬ дорогая tools structured-outputs | 6.0 | 45.0 | 400000 | 12 дек 25 | да |
| OpenAI: GPT-5.2 (Thinking X-High) ? openai/gpt-5.2-xhigh Профессиональный (не Тестовый) топ tools structured-outputs | 0.48 | 3.80 | 400000 | 12 дек 25 | да |
| OpenAI: GPT-5.2 (Thinking High) ? openai/gpt-5.2-high Профессиональный топ tools structured-outputs | 0.48 | 3.80 | 400000 | 12 дек 25 | да |
| OpenAI: GPT-5.2 (Thinking) ? openai/gpt-5.2 Профессиональный топ tools structured-outputs | 0.48 | 3.80 | 400000 | 12 дек 25 | да |
| OpenAI: GPT-5.2 Chat ? openai/gpt-5.2-chat Профессиональный топ tools structured-outputs | 0.48 | 3.80 | 128000 | 11 дек 25 | да |
| OpenAI: GPT-5.1 Codex Max (Thinking) ? openai/gpt-5.1-codex-max Профессиональный (не Тестовый) топ программирование и общие задачи tools structured-outputs | 0.37 | 2.80 | 400000 | 8 дек 25 | да |
| OpenAI: GPT-5.1 Codex Mini (Thinking) ? openai/gpt-5.1-codex-mini программирование и общие задачи tools structured-outputs | 0.08 | 0.56 | 400000 | 14 ноя 25 | да |
| OpenAI: GPT-5.1 Codex (Thinking) ? openai/gpt-5.1-codex Профессиональный (не Тестовый) топ программирование и общие задачи tools structured-outputs | 0.37 | 2.80 | 400000 | 14 ноя 25 | да |
| OpenAI: GPT-5.1 (Thinking) ? openai/gpt-5.1 Профессиональный (не Тестовый) топ tools structured-outputs | 0.37 | 2.80 | 400000 | 14 ноя 25 | да |
| OpenAI: GPT-5.1 Chat ? openai/gpt-5.1-chat Профессиональный топ tools structured-outputs | 0.37 | 2.80 | 400000 | 14 ноя 25 | да |
| OpenAI: GPT-5 Pro (Thinking) ? openai/gpt-5-pro Профессиональный (не Тестовый) топ, но ОЧЕНЬ дорогая tools structured-outputs | 4.5 | 28.0 | 400000 | 22 окт 25 | да |
| OpenAI: GPT-5 Codex (Thinking High) ? openai/gpt-5-codex-high Профессиональный (не Тестовый) топ программирование и общие задачи tools structured-outputs | 0.37 | 3.00 | 400000 | 25 сен 25 | да |
| OpenAI: GPT-5 Codex (Thinking) ? openai/gpt-5-codex Профессиональный (не Тестовый) топ программирование и общие задачи tools structured-outputs | 0.37 | 3.00 | 400000 | 25 сен 25 | да |
| OpenAI: GPT-5 (Thinking) ? openai/gpt-5 Профессиональный (не Тестовый) топ tools structured-outputs | 0.15 | 1.30 | 400000 | 26 авг 25 | да |
| OpenAI: GPT-5 Chat ? openai/gpt-5-chat Профессиональный топ structured-outputs | 0.15 | 1.30 | 400000 | 7 авг 25 | да |
| OpenAI: GPT-5 Thinking Mini ? openai/gpt-5-mini tools structured-outputs | 0.037 | 0.30 | 400000 | 7 авг 25 | да |
| OpenAI: GPT-5 Nano ? openai/gpt-5-nano Базовый и выше (не Тестовый) дешевая и с большим контекстом tools structured-outputs | 0.015 | 0.12 | 400000 | 7 авг 25 | да |
| OpenAI: gpt-oss-120b ? openai/gpt-oss-120b | 0.015 | 0.065 | 128000 | 7 авг 25 | нет |
| OpenAI: gpt-oss-120b (fast) ? openai/gpt-oss-120b-fast tools | 0.021 | 0.085 | 128000 | 7 авг 25 | нет |
| OpenAI: gpt-oss-20b (fast) ? openai/gpt-oss-20b tools | 0.014 | 0.06 | 128000 | 7 авг 25 | нет |
| OpenAI: o3 ? openai/o3 Профессиональный (не Тестовый) биллинг с учетом размышлений (см. ?) размышления, математика tools structured-outputs | 0.6 | 2.4 | 200000 | 7 июн 25 | да |
| OpenAI: GPT-4o (2024-11-20) Online HQ ? openai/gpt-4o-2024-11-20-online-hq Профессиональный За вызов: 2.0 р. tools structured-outputs | 0.3 | 1.2 | 128000 | 14 мая 25 | да |
| OpenAI: GPT-4o Online HQ ? openai/gpt-4o-online-hq Профессиональный За вызов: 2.0 р. топ от 13 мая tools | 0.6 | 1.8 | 128000 | 14 мая 25 | да |
| OpenAI: o4-mini-high (пресет для глубоких размышлений от o4-mini) ? openai/o4-mini-high Профессиональный (не Тестовый) биллинг с учетом размышлений (см. ?) размышления, математика tools structured-outputs | 0.28 | 1.12 | 200000 | 16 апр 25 | да |
| OpenAI: o4-mini (для размышлений, не рек. для обычных задач) ? openai/o4-mini Профессиональный (не Тестовый) биллинг с учетом размышлений (см. ?) размышления, математика tools structured-outputs | 0.28 | 1.12 | 200000 | 16 апр 25 | да |
| OpenAI: GPT-4.1 ? openai/gpt-4.1 Профессиональный топ от 14 апреля tools structured-outputs | 0.28 | 1.12 | 1000000 | 14 апр 25 | да |
| OpenAI: GPT-4.1 Mini ? openai/gpt-4.1-mini tools structured-outputs | 0.06 | 0.24 | 1000000 | 14 апр 25 | да |
| OpenAI: GPT-4.1 Nano ? openai/gpt-4.1-nano дешевая и с большим контекстом tools structured-outputs | 0.015 | 0.06 | 1000000 | 14 апр 25 | да |
| OpenAI: o3-mini-high (пресет для глубоких размышлений от o3-mini) ? openai/o3-mini-high Профессиональный (не Тестовый) биллинг с учетом размышлений (см. ?) размышления, математика structured-outputs | 0.28 | 1.12 | 200000 | 14 фев 25 | да |
| OpenAI: o3-mini (для размышлений, не рек. для обычных задач) ? openai/o3-mini Профессиональный (не Тестовый) биллинг с учетом размышлений (см. ?) размышления, математика structured-outputs | 0.28 | 1.12 | 200000 | 1 фев 25 | да |
| OpenAI: o1 (для размышлений, не рек. для обычных задач) ? openai/o1 Профессиональный (не Тестовый) биллинг с учетом размышлений (см. ?) размышления, математика tools structured-outputs | 3.5 | 14.0 | 128000 | 18 дек 24 | да |
| OpenAI: GPT-4o (2024-11-20) ? openai/gpt-4o-2024-11-20 Профессиональный tools structured-outputs | 0.3 | 1.2 | 128000 | 26 ноя 24 | да |
| OpenAI: o1-mini (не рек. для обычных задач) ? openai/o1-mini Профессиональный (не Тестовый) биллинг с учетом размышлений (см. ?) размышления, математика | 0.6 | 2.7 | 128000 | 13 сен 24 | нет |
| OpenAI: GPT-4o (2024-08-06) ? openai/gpt-4o-2024-08-06 Профессиональный топ от 6 августа tools structured-outputs | 0.3 | 1.2 | 128000 | 6 авг 24 | да |
| OpenAI: GPT-4o (2024-05-13) openai/gpt-4o-2024-05-13 Профессиональный tools | 0.6 | 1.8 | 128000 | 13 мая 24 | да |
| OpenAI: GPT-4o mini ? openai/gpt-4o-mini tools structured-outputs | 0.02 | 0.08 | 128000 | 18 июл 24 | да |
| OpenAI: GPT-4o ? openai/gpt-4o Профессиональный топ от 13 мая tools | 0.6 | 1.8 | 128000 | 25 мая 24 | да |
| OpenAI: GPT-4 Turbo (gpt-4-turbo-2024-04-09) ? openai/gpt-4-turbo Профессиональный топ! | 1.5 | 4.5 | 128000 | 10 апр 24 | да |
| OpenAI: GPT-4 ? openai/gpt-4 Профессиональный | 4.5 | 9 | 8191 | 14 дек 23 | да |
| OpenAI: GPT-3.5 Turbo 16k openai/gpt-3.5-turbo-16k | 0.45 | 0.6 | 16383 | 30 сен 23 | да |
| OpenAI: GPT-3.5 Turbo ? openai/gpt-3.5-turbo | 0.15 | 0.3 | 4095 | 7 ноя 23 | да |
Anthropic: Claude Sonnet, Opus, Haiku
Нейросети от Anthropic – основного конкурента OpenAI. Мы рекомендуем их пробовать, если нужна обработка больших текстов (файлов и пр.). Рекомендуем их нейросети Claude 3 – Haiku для дешевой и быстрой обработки большого контекста, Opus – для максимально качественной работы.
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Anthropic: Claude Sonnet 5 (Thinking High) ? anthropic/claude-sonnet-5-thinking-high Профессиональный (не Тестовый) топ от 30 июля tools structured-outputs vision | 0.6 | 3.0 | 1000000 | 30 июн | да |
| Anthropic: Claude Sonnet 5 ? anthropic/claude-sonnet-5 Профессиональный (не Тестовый) топ от 30 июля tools structured-outputs vision | 0.6 | 3.0 | 1000000 | 30 июн | да |
| Anthropic: Claude Opus 4.8 (Thinking) ? anthropic/claude-opus-4.8-thinking Профессиональный (не Тестовый) ТОП! tools structured-outputs vision | 1.2 | 6.7 | 1000000 | 28 мая | да |
| Anthropic: Claude Opus 4.8 ? anthropic/claude-opus-4.8 Профессиональный (не Тестовый) ТОП! tools structured-outputs vision | 1.2 | 6.7 | 1000000 | 28 мая | да |
| Anthropic: Claude Opus 4.7 Thinking ? anthropic/claude-opus-4.7-thinking Профессиональный (не Тестовый) ТОП! tools structured-outputs vision | 1.2 | 6.7 | 1000000 | 17 апр | да |
| Anthropic: Claude Opus 4.7 ? anthropic/claude-opus-4.7 Профессиональный (не Тестовый) ТОП! tools structured-outputs vision | 1.2 | 6.7 | 1000000 | 17 апр | да |
| Anthropic: Claude Sonnet 4.6 Deep Research 1.0 ? anthropic/claude-sonnet-4.6-deep-research-1.0 Профессиональный (не Тестовый) За вызов: 30.0 р. online, research примерная стоимость запроса 100-150 р. | 0.4 | 2.0 | 1000000 | 27 мар | да |
| Anthropic: Claude Sonnet 4.6 Online HQ ? anthropic/claude-sonnet-4.6-online-hq Профессиональный (не Тестовый) За вызов: 2.0 р. онлайн | 0.4 | 2.0 | 1000000 | 27 мар | да |
| Anthropic: Claude Sonnet 4.6 (Thinking High, 1М контекста) ? anthropic/claude-sonnet-4.6-thinking-high Профессиональный топ от 17 февраля tools structured-outputs | 0.4 | 2.0 | 1000000 | 17 фев | да |
| Anthropic: Claude Sonnet 4.6 (Thinking, 1M контекста) ? anthropic/claude-sonnet-4.6-thinking Профессиональный топ от 17 февраля tools structured-outputs | 0.4 | 2.0 | 1000000 | 17 фев | да |
| Anthropic: Claude Sonnet 4.6 (1M контекста) ? anthropic/claude-sonnet-4.6 Профессиональный топ от 17 февраля tools structured-outputs | 0.4 | 2.0 | 1000000 | 17 фев | да |
| Anthropic: Claude Opus 4.6 (Thinking) ? anthropic/claude-opus-4.6-thinking Профессиональный (не Тестовый) ТОП! tools structured-outputs | 0.75 | 3.4 | 1000000 | 6 фев | да |
| Anthropic: Claude Opus 4.6 ? anthropic/claude-opus-4.6 Профессиональный (не Тестовый) ТОП! tools structured-outputs | 0.75 | 3.4 | 1000000 | 6 фев | да |
| Anthropic: Claude Opus 4.5 (Thinking) ? anthropic/claude-opus-4.5-thinking Профессиональный ТОП! tools structured-outputs | 0.75 | 3.4 | 200000 | 25 ноя 25 | да |
| Anthropic: Claude Opus 4.5 ? anthropic/claude-opus-4.5 Профессиональный ТОП! tools structured-outputs | 0.75 | 3.4 | 200000 | 25 ноя 25 | да |
| Anthropic: Claude Haiku 4.5 (Thinking) ? anthropic/claude-haiku-4.5-thinking Профессиональный tools | 0.14 | 0.70 | 200000 | 16 окт 25 | да |
| Anthropic: Claude Haiku 4.5 ? anthropic/claude-haiku-4.5 Профессиональный tools | 0.14 | 0.70 | 200000 | 16 окт 25 | да |
| Anthropic: Claude Sonnet 4.5 1M context (Thinking) ? anthropic/claude-sonnet-4.5-1m-thinking Профессиональный топ от 29 сентября tools structured-outputs | 0.7 | 2.6 | 1000000 | 29 сен 25 | да |
| Anthropic: Claude Sonnet 4.5 1M context ? anthropic/claude-sonnet-4.5-1m Профессиональный топ от 29 сентября tools structured-outputs | 0.7 | 2.6 | 1000000 | 29 сен 25 | да |
| Anthropic: Claude Sonnet 4.5 (Thinking High) ? anthropic/claude-sonnet-4.5-thinking-high Профессиональный топ от 29 сентября tools structured-outputs | 0.4 | 2.0 | 1000000 | 29 сен 25 | да |
| Anthropic: Claude Sonnet 4.5 (Thinking) ? anthropic/claude-sonnet-4.5-thinking Профессиональный топ от 29 сентября tools structured-outputs | 0.4 | 2.0 | 1000000 | 29 сен 25 | да |
| Anthropic: Claude Sonnet 4.5 ? anthropic/claude-sonnet-4.5 Профессиональный топ от 29 сентября tools structured-outputs | 0.4 | 2.0 | 200000 | 29 сен 25 | да |
| Anthropic: Claude Sonnet 4 (1M контекста) Thinking ? anthropic/claude-sonnet-4-1m-thinking Профессиональный (не Тестовый) топ от 22 мая tools | 0.65 | 2.6 | 1000000 | 13 авг 25 | да |
| Anthropic: Claude Sonnet 4 (1M контекста) ? anthropic/claude-sonnet-4-1m Профессиональный (не Тестовый) топ от 22 мая tools | 0.65 | 2.6 | 1000000 | 13 авг 25 | да |
| Anthropic: Claude Opus 4.1 Thinking ? anthropic/claude-opus-4.1-thinking Профессиональный ТОП! tools | 2.0 | 10.0 | 200000 | 7 авг 25 | да |
| Anthropic: Claude Opus 4.1 ? anthropic/claude-opus-4.1 Профессиональный ТОП! tools | 2.0 | 10.0 | 200000 | 7 авг 25 | да |
| Anthropic: Claude Opus 4 Deep Research 1.0 ? anthropic/claude-opus-4-deep-research-1.0 Профессиональный (не Тестовый) За вызов: 60.0 р. топ от 28 мая online, research примерная стоимость запроса 500-600 р. | 2.0 | 10.0 | 200000 | 28 мая 25 | да |
| Anthropic: Claude Opus 4 Online HQ ? anthropic/claude-opus-4-online-hq Профессиональный (не Тестовый) За вызов: 4.0 р. топ от 28 мая онлайн | 2.0 | 10.0 | 200000 | 28 мая 25 | да |
| Anthropic: Claude Sonnet 4 Deep Research 1.0 ? anthropic/claude-sonnet-4-deep-research-1.0 Профессиональный (не Тестовый) За вызов: 30.0 р. топ от 28 мая online, research примерная стоимость запроса 100-150 р. | 0.4 | 2.0 | 200000 | 28 мая 25 | да |
| Anthropic: Claude Sonnet 4 Deep Online ? anthropic/claude-sonnet-4-deep-online Профессиональный (не Тестовый) За вызов: 12.0 р. топ от 28 мая онлайн примерная стоимость запроса 30-50 р. | 0.4 | 2.0 | 200000 | 28 мая 25 | да |
| Anthropic: Claude Sonnet 4 Research ? anthropic/claude-sonnet-4-online-research Профессиональный (не Тестовый) За вызов: 20.0 р. топ от 28 мая online, research примерная стоимость запроса 80-120 р. | 0.4 | 2.0 | 200000 | 28 мая 25 | да |
| Anthropic: Claude Sonnet 4 Online HQ ? anthropic/claude-sonnet-4-online-hq Профессиональный (не Тестовый) За вызов: 2.0 р. топ от 28 мая онлайн | 0.4 | 2.0 | 200000 | 28 мая 25 | да |
| Anthropic: Claude Opus 4 (Thinking High) ? anthropic/claude-opus-4-thinking-high Профессиональный (не Тестовый) размышления tools | 2.0 | 10.0 | 200000 | 22 мая 25 | да |
| Anthropic: Claude Sonnet 4 (Thinking High) ? anthropic/claude-sonnet-4-thinking-high Профессиональный (не Тестовый) топ от 22 мая размышления tools | 0.4 | 2.0 | 200000 | 22 мая 25 | да |
| Anthropic: Claude Opus 4 (Thinking) ? anthropic/claude-opus-4-thinking Профессиональный (не Тестовый) ТОП! размышления tools | 2.0 | 10.0 | 200000 | 22 мая 25 | да |
| Anthropic: Claude Sonnet 4 (Thinking) ? anthropic/claude-sonnet-4-thinking Профессиональный (не Тестовый) топ от 22 мая размышления tools | 0.4 | 2.0 | 200000 | 22 мая 25 | да |
| Anthropic: Claude Opus 4 ? anthropic/claude-opus-4 Профессиональный ТОП! tools | 2.0 | 10.0 | 200000 | 22 мая 25 | да |
| Anthropic: Claude Sonnet 4 ? anthropic/claude-sonnet-4 Профессиональный топ от 22 мая tools | 0.4 | 2.0 | 200000 | 22 мая 25 | да |
| Anthropic: Claude 3 Haiku ? anthropic/claude-3-haiku дешевая и с большим контекстом tools | 0.0375 | 0.1875 | 200000 | 14 мар 24 | да |
Perplexity: онлайн, с доступом к Интернету и фактической информации
Нейросети от Perplexity, сфокусированные на более точным следованиям фактам. Онлайн-модели (online в конце) перед запросом предположительно запрашивают свежие данные в Интернете, после чего формируют ответ – и, например, могут отвечать о погоде сегодня, о курсе доллара и пр. Также модели можно передавать ссылку на конкретную страницу в Интернете и с высокой вероятностью получить релевантный ответ.
Наша новость на Хабре о моделях Perplexity
Внимание: онлайн-модель дополнительно тарифицируется по каждому запросу (т.к. идет вызов онлайн-поиска). Модель НЕ поддерживает чат – каждый запрос учитывает только последнее сообщение пользователя.
Рекомендация: поскольку Perplexity постоянно выпускает новые модели и удаляет обработку старых, рекомендуется установить в ваших приложениях ID псевдонима для малой или большой модели – тогда сервис сам перенаправит ваш запрос в самую последнюю версию (по ней и будет происходить тарификация)
Внимание: онлайн-модель дополнительно тарифицируется по каждому запросу (т.к. идет вызов онлайн-поиска). Модель НЕ поддерживает чат – каждый запрос учитывает только последнее сообщение пользователя.
Рекомендация: поскольку Perplexity постоянно выпускает новые модели и удаляет обработку старых, рекомендуется установить в ваших приложениях ID псевдонима для малой или большой модели – тогда сервис сам перенаправит ваш запрос в самую последнюю версию (по ней и будет происходить тарификация)
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Perplexity: Sonar Reasoning Pro ? perplexity/sonar-reasoning-pro-online Профессиональный (не Тестовый) За вызов: 8.0 р. онлайн | 0.30 | 1.20 | 128000 | 28 мая 25 | нет |
| Perplexity: Sonar Pro ? perplexity/sonar-pro-online Профессиональный (не Тестовый) За вызов: 8.0 р. онлайн | 0.45 | 2.20 | 128000 | 28 мая 25 | нет |
| Perplexity: Sonar ? perplexity/sonar-online За вызов: 0.85 р. рекомендуется онлайн | 0.15 | 0.15 | 128000 | 31 янв 25 | нет |
| Perplexity: Sonar Reasoning (на базе DeepSeek R1) ? perplexity/sonar-r1-online Профессиональный За вызов: 0.85 р. онлайн размышления | 0.13 | 0.70 | 127000 | 29 янв 25 | нет |
| Perplexity: Llama 3.1 Sonar 70B Online ? perplexity/llama-3.1-sonar-large-128k-online За вызов: 0.85 р. рекомендуется онлайн | 0.15 | 0.15 | 128000 | 8 авг 24 | нет |
| Perplexity: Llama 3.1 Sonar 8B Online ? perplexity/llama-3.1-sonar-small-128k-online За вызов: 0.85 р. онлайн | 0.04 | 0.04 | 128000 | 8 авг 24 | нет |
| Perplexity, последняя большая онлайн модель (перенаправляет в нужный ID) perplexity/latest-large-online рекомендуется онлайн | 0 | 0 | 32000 | 8 авг 24 | нет |
| Perplexity, последняя малая онлайн модель (перенаправляет в нужный ID) perplexity/latest-small-online онлайн | 0 | 0 | 32000 | 8 авг 24 | нет |
Google: Gemini Pro, Flash
Нейросети от Google. Достаточно дешевые.
Рекомендуются последние версии Gemini, однако пользователи жалуются, что даже при не очень большом контексте (5К+ символов) Google относительно часто возвращает ошибки и очень маленькие ответы (июнь 2024).
В случае, если нужна точность, рекомендуем модели Claude 3 с большим контекстом.
Рекомендуются последние версии Gemini, однако пользователи жалуются, что даже при не очень большом контексте (5К+ символов) Google относительно часто возвращает ошибки и очень маленькие ответы (июнь 2024).
В случае, если нужна точность, рекомендуем модели Claude 3 с большим контекстом.
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Gemini 3.6 Flash (Thinking High) ? google/gemini-3.6-flash-high Профессиональный (не Тестовый) tools structured-outputs vision audioinput | 0.45 | 2.25 | 1000000 | 22 июл | нет |
| Gemini 3.6 Flash (Thinking Minimal) ? google/gemini-3.6-flash-minimal Профессиональный (не Тестовый) tools structured-outputs vision audioinput | 0.45 | 2.25 | 1000000 | 22 июл | нет |
| Gemini 3.5 Flash Lite (Thinking High) ? google/gemini-3.5-flash-lite-high Базовый и выше (не Тестовый) tools structured-outputs vision audioinput | 0.09 | 0.75 | 1000000 | 22 июл | нет |
| Gemini 3.5 Flash Lite (Thinking Minimal) ? google/gemini-3.5-flash-lite-minimal Базовый и выше (не Тестовый) tools structured-outputs vision audioinput | 0.09 | 0.75 | 1000000 | 22 июл | нет |
| Gemini 3.5 Flash (Thinking High) ? google/gemini-3.5-flash-high Профессиональный (не Тестовый) tools structured-outputs vision audioinput | 0.45 | 2.70 | 1000000 | 20 мая | нет |
| Gemini 3.5 Flash (Thinking Minimal) ? google/gemini-3.5-flash-minimal Профессиональный (не Тестовый) tools structured-outputs vision audioinput | 0.45 | 2.70 | 1000000 | 20 мая | нет |
| Gemini 3.5 Flash (Thinking Medium) ? google/gemini-3.5-flash Профессиональный (не Тестовый) tools structured-outputs vision audioinput | 0.45 | 2.70 | 1000000 | 20 мая | нет |
| Gemini 3.1 Flash Lite (Thinking High) ? google/gemini-3.1-flash-lite-thinking-high Базовый и выше (не Тестовый) tools structured-outputs vision audioinput | 0.075 | 0.45 | 1000000 | 20 мая | нет |
| Gemini 3.1 Flash Lite (Thinking) ? google/gemini-3.1-flash-lite-thinking Базовый и выше (не Тестовый) tools structured-outputs vision audioinput | 0.075 | 0.45 | 1000000 | 20 мая | нет |
| Gemini 3.1 Flash Lite ? google/gemini-3.1-flash-lite Базовый и выше (не Тестовый) tools structured-outputs vision audioinput | 0.075 | 0.45 | 1000000 | 20 мая | нет |
| Google: Gemma 4 26B A4B (Thinking) ? google/gemma-4-26b-a4b-it-thinking tools structured-outputs vision | 0.04 | 0.13 | 260000 | 10 апр | нет |
| Google: Gemma 4 26B A4B ? google/gemma-4-26b-a4b-it tools structured-outputs vision | 0.04 | 0.13 | 260000 | 10 апр | нет |
| Google: Gemma 4 31B (Thinking) ? google/gemma-4-31b-it-thinking tools structured-outputs vision | 0.045 | 0.13 | 260000 | 10 апр | нет |
| Google: Gemma 4 31B ? google/gemma-4-31b-it tools structured-outputs vision | 0.045 | 0.13 | 260000 | 10 апр | нет |
| Gemini 3.1 Flash Lite Preview (Thinking High) ? google/gemini-3.1-flash-lite-pre-thinking Базовый и выше (не Тестовый) tools structured-outputs vision audioinput | 0.075 | 0.45 | 1000000 | 3 мар | нет |
| Gemini 3.1 Flash Lite Preview ? google/gemini-3.1-flash-lite-pre Базовый и выше (не Тестовый) tools structured-outputs vision audioinput | 0.075 | 0.45 | 1000000 | 3 мар | нет |
| Google: Gemini 3.1 Pro Preview (версия на 1М контекста) ? google/gemini-3.1-pro-preview-1m Профессиональный (не Тестовый) топ tools structured-outputs vision | 1.10 | 4.95 | 1000000 | 20 фев | нет |
| Google: Gemini 3.1 Pro Preview (версия на 200К контекста) ? google/gemini-3.1-pro-preview Профессиональный (не Тестовый) топ tools structured-outputs | 0.55 | 3.30 | 200000 | 20 фев | нет |
| Google: Gemini 3 Flash Preview (Thinking) ? google/gemini-3-flash-pre-thinking Базовый и выше (не Тестовый) tools structured-outputs | 0.15 | 0.90 | 1000000 | 17 дек 25 | нет |
| Google: Gemini 3 Flash Preview ? google/gemini-3-flash-pre Базовый и выше (не Тестовый) tools structured-outputs | 0.15 | 0.90 | 1000000 | 17 дек 25 | нет |
| Google: Gemini 2.5 Flash Lite Preview 09-2025 (Thinking) ? google/gemini-2.5-flash-lite-pre-0925-thinking дешевая и с большим контекстом tools structured-outputs | 0.03 | 0.12 | 1000000 | 26 сен 25 | нет |
| Google: Gemini 2.5 Flash Lite Preview 09-2025 ? google/gemini-2.5-flash-lite-pre-0925 дешевая и с большим контекстом tools structured-outputs | 0.03 | 0.12 | 1000000 | 26 сен 25 | нет |
| Google: Gemini 2.5 Flash Lite ? google/gemini-2.5-flash-lite дешевая и с большим контекстом tools structured-outputs | 0.015 | 0.06 | 1000000 | 23 июл 25 | нет |
| Google: Gemini 2.5 Flash (Thinking) ? google/gemini-2.5-flash-thinking tools structured-outputs | 0.09 | 0.75 | 1000000 | 17 июн 25 | нет |
| Google: Gemini 2.5 Flash ? google/gemini-2.5-flash tools structured-outputs | 0.09 | 0.75 | 1000000 | 17 июн 25 | нет |
| Google: Gemini 2.5 Pro ? google/gemini-2.5-pro Профессиональный tools structured-outputs | 0.37 | 3.0 | 1000000 | 17 июн 25 | нет |
| Google: Gemini 2.5 Pro Preview (обновлена 5 июня) ? google/gemini-2.5-pro-preview Профессиональный tools structured-outputs | 0.37 | 3.0 | 1000000 | 5 июн 25 | нет |
| Google: Gemini 2.5 Flash Preview 05 20 (c 16 июля отключена, перенаправляется в 2.5 Flash) ? google/gemini-2.5-flash-pre-05-20 дешевая и с большим контекстом tools structured-outputs | 0.018 | 0.07 | 1000000 | 20 мая 25 | нет |
| Google: Gemini 2.5 Flash Preview (c 16 июля отключена, перенаправляется в 2.5 Flash) ? google/gemini-2.5-flash-pre дешевая и с большим контекстом structured-outputs | 0.018 | 0.07 | 1000000 | 18 апр 25 | нет |
| Google: Gemini 2.5 Pro Preview (03-25) ? google/gemini-2.5-pro-preview-03-25 Профессиональный tools structured-outputs | 0.18 | 1.90 | 1000000 | 6 мая 25 | нет |
| Gemma 3 27B (опенсорс) ? google/gemma-3-27b-it | 0.05 | 0.08 | 128000 | 13 мар 25 | нет |
| Gemini 1.5 Flash-8B (выключена, перенаправляется в Flash 2.5 Lite) ? google/gemini-flash-1.5-8b дешевая и с большим контекстом tools | 0.015 | 0.04 | 1000000 | 7 окт 24 | нет |
| Gemma 2 27B (опенсорс) ? google/gemma-2-27b-it | 0.10 | 0.10 | 8192 | 17 июл 24 | нет |
| Google: Gemini Flash 1.5 (отключена, перенаправляется в Gemini 2.5 Flash Lite) ? google/gemini-flash-1.5 дешевая и с большим контекстом | 0.017 | 0.05 | 1000000 | 25 сен 24 | нет |
xAI: Grok 2, 3, 4
Модели Grok от компании Элона Maска xAI.
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Grok 4.5 от xAI ? x-ai/grok-4.5 Профессиональный (не Тестовый) повышенная цена при контексте > 200К tools structured-outputs vision | 0.6 | 1.8 | 500000 | 16 июл | нет |
| Grok 4.3 от xAI (Thinking) ? x-ai/grok-4.3-thinking Профессиональный (не Тестовый) повышенная цена при контексте > 200К tools structured-outputs vision | 0.37 | 0.74 | 2000000 | 17 мая | нет |
| Grok 4.3 от xAI ? x-ai/grok-4.3 Профессиональный (не Тестовый) повышенная цена при контексте > 200К tools structured-outputs vision | 0.37 | 0.74 | 2000000 | 17 мая | нет |
| Grok 4.20 Beta от xAI (Thinking) ? x-ai/grok-4.20-beta-thinking Профессиональный (не Тестовый) повышенная цена при контексте > 200К tools structured-outputs vision | 0.60 | 1.80 | 2000000 | 25 мар | нет |
| Grok 4.20 Beta от xAI ? x-ai/grok-4.20-beta Профессиональный (не Тестовый) повышенная цена при контексте > 200К tools structured-outputs vision | 0.60 | 1.80 | 2000000 | 25 мар | нет |
MistralAI: опенсорс + закрытые Tiny, Small, Medium
Закрытые, предоставляемые по API нейросети от компании Mistral, известной своими опенсорс моделями. Mistral Medium по оценкам производителя в работе сравнима с Claude 2 и GPT 4. Также здесь присутствуют ссылки на её оригинальные опенсорс модели.
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Mistral: Mistral Medium 3.1 ? mistralai/mistral-medium-3.1 tools structured-outputs | 0.06 | 0.30 | 260000 | 14 авг 25 | нет |
| Mistral: Devstral Medium ? mistralai/devstral-medium программирование tools structured-outputs | 0.06 | 0.30 | 128000 | 11 июл 25 | нет |
| Mistral: Mistral Small 3.2 24B ? mistralai/mistral-small-3.2-24b-instruct tools structured-outputs | 0.015 | 0.045 | 128000 | 25 июн 25 | нет |
| Mistral: Devstral Small (25-07) ? mistralai/devstral-small программирование tools structured-outputs | 0.015 | 0.045 | 128000 | 11 июл 25 | нет |
| Mistral Medium 3 ? mistralai/mistral-medium-3 tools structured-outputs | 0.06 | 0.30 | 131000 | 8 мая 25 | нет |
| Mistral: Mistral Large 2 (версия 2411) ? mistralai/mistral-large-2411 Профессиональный tools | 0.45 | 1.35 | 128000 | 19 ноя 24 | нет |
| Mistral: Mistral NeMo 12B ? mistralai/mistral-nemo поддерживает русский общие вопросы tools | 0.05 | 0.05 | 128000 | 19 июл 24 | нет |
| Mistral: Mixtral 8x22B Instruct ? mistralai/mixtral-8x22b-instruct | 0.15 | 0.15 | 65536 | 18 апр 24 | нет |
| Mistral: Mistral Large 2 ? mistralai/mistral-large Профессиональный | 0.45 | 1.35 | 128000 | 24 июл 24 | нет |
| Mistral: Mixtral 8x7B Instruct ? mistralai/mixtral-8x7b-instruct дешевая 8x7B с большим контекстом | 0.045 | 0.045 | 32768 | 18 мар 24 | нет |
Cohere: с фокусом на RAG, function calling, tools
Модели от Cohere с фокусом на RAG, function calling, tools.
Доступны в виде OpenSource версий, но у нас предоставляются через API с модерацией.
Используя данные модели, вы соглашаетесь с
ToS Cohere
Доступны в виде OpenSource версий, но у нас предоставляются через API с модерацией.
Используя данные модели, вы соглашаетесь с
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Cohere: Command R+ (август 2024) ? cohere/command-r-plus-08-2024 Профессиональный общие вопросы и ролеплей | 0.38 | 1.5 | 128000 | 31 авг 24 | нет |
| Cohere: Command R (август 2024) ? cohere/command-r-08-2024 общие вопросы и ролеплей | 0.025 | 0.09 | 128000 | 31 авг 24 | нет |
| Cohere: Command R7B (12-2024) ? cohere/command-r7b-12-2024 За вызов: 0.005 р. | 0.01 | 0.025 | 128000 | 16 дек 24 | нет |
Amazon: Nova и пр.
Серия языковых моделей от Amazon (начиная с декабря 2024).
Модели отличаются большим контекстом (до 300 000 токенов)
Модели отличаются большим контекстом (до 300 000 токенов)
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Amazon: Nova Pro 1.0 ? amazon/nova-pro-v1 Профессиональный | 0.15 | 0.50 | 300000 | 6 дек 24 | да |
| Amazon: Nova Lite 1.0 ? amazon/nova-lite-v1 tools | 0.02 | 0.04 | 300000 | 6 дек 24 | да |
| Amazon: Nova Micro 1.0 ? amazon/nova-micro-v1 tools | 0.012 | 0.03 | 128000 | 6 дек 24 | да |
Текстовые модели (восточные, Китай)
DeepSeek: V3, R1, 3.2 и пр.
Нашумевшие нейросети от DeepSeek. Достаточно дешевые.
Они крайне дешевые в своем классе – но только при использовании самого провайдера DeepSeek, который логирует запросы (и в конце января DeepSeek не смог переварить интерес к своим моделям и лег)
Поэтому мы также поддерживаем альтернативных провайдеров для DeepSeek (постфикс alt) – они дороже, но не декларируют логирование данных и в целом часто устойчивее.
Они крайне дешевые в своем классе – но только при использовании самого провайдера DeepSeek, который логирует запросы (и в конце января DeepSeek не смог переварить интерес к своим моделям и лег)
Поэтому мы также поддерживаем альтернативных провайдеров для DeepSeek (постфикс alt) – они дороже, но не декларируют логирование данных и в целом часто устойчивее.
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| DeepSeek V4 Pro 1.6T (Альтернативные провайдеры, размышляющая) ? deepseek/deepseek-v4-pro-alt-thinking Профессиональный (не Тестовый) общие вопросы и программирование tools structured-outputs | 0.50 | 1.00 | 1000000 | 12 июн | нет |
| DeepSeek V4 Pro 1.6T (Альтернативные провайдеры) ? deepseek/deepseek-v4-pro-alt Профессиональный (не Тестовый) общие вопросы и программирование tools structured-outputs | 0.50 | 1.00 | 1000000 | 12 июн | нет |
| DeepSeek V4 Flash 284B (Альтернативные провайдеры, Thinking) ? deepseek/deepseek-v4-flash-alt-thinking общие вопросы и программирование tools structured-outputs | 0.04 | 0.08 | 1000000 | 27 апр | нет |
| DeepSeek V4 Flash 284B (Альтернативные провайдеры) ? deepseek/deepseek-v4-flash-alt общие вопросы и программирование tools structured-outputs | 0.04 | 0.08 | 1000000 | 27 апр | нет |
| DeepSeek V4 Pro 1.6T (Thinking) ? deepseek/deepseek-v4-pro-thinking Профессиональный (не Тестовый) провайдер логирует данные очень дешевая общие вопросы и программирование tools | 0.15 | 0.30 | 1000000 | 24 апр | нет |
| DeepSeek V4 Pro 1.6T ? deepseek/deepseek-v4-pro Профессиональный (не Тестовый) провайдер логирует данные очень дешевая общие вопросы и программирование tools | 0.15 | 0.30 | 1000000 | 24 апр | нет |
| DeepSeek V4 Flash 284B (Thinking) ? deepseek/deepseek-v4-flash-thinking провайдер логирует данные общие вопросы и программирование tools | 0.036 | 0.072 | 1000000 | 24 апр | нет |
| DeepSeek V4 Flash 284B ? deepseek/deepseek-v4-flash провайдер логирует данные общие вопросы и программирование tools | 0.036 | 0.072 | 1000000 | 24 апр | нет |
| DeepSeek V3.1 671B (альт провайдер, быстрая версия) ? deepseek/deepseek-chat-3.1-alt-fast быстрая общие вопросы и программирование tools structured-outputs | 0.08 | 0.25 | 162000 | 27 янв | нет |
| DeepSeek V3.2 671B (альт провайдер, быстрее) ? deepseek/deepseek-v3.2-alt-faster общие вопросы и программирование tools structured-outputs | 0.09 | 0.25 | 162000 | 16 дек 25 | нет |
| DeepSeek V3.2 Speciale 671B (альт провайдер, Thinking) ? deepseek/deepseek-v3.2-speciale-alt рассуждения, анализ | 0.045 | 0.07 | 162000 | 2 дек 25 | нет |
| DeepSeek V3.2 671B (альт провайдер, Thinking) ? deepseek/deepseek-v3.2-alt-thinking общие вопросы и программирование tools | 0.045 | 0.07 | 162000 | 2 дек 25 | нет |
| DeepSeek V3.2 671B (альт провайдер) ? deepseek/deepseek-v3.2-alt общие вопросы и программирование tools | 0.045 | 0.07 | 162000 | 2 дек 25 | нет |
| DeepSeek V3.2 Exp 671B Thinking (альт провайдер) ? deepseek/deepseek-v3.2-exp-alt-thinking общие вопросы и программирование tools | 0.045 | 0.07 | 162000 | 2 окт 25 | нет |
| DeepSeek V3.2 Exp 671B (альт провайдер) ? deepseek/deepseek-v3.2-exp-alt общие вопросы и программирование tools | 0.045 | 0.07 | 162000 | 2 окт 25 | нет |
| DeepSeek V3.1 Terminus 671B (альт провайдер, Thinking) ? deepseek/deepseek-chat-3.1-terminus-alt-thinking общие вопросы и программирование tools structured-outputs | 0.07 | 0.22 | 162000 | 25 сен 25 | нет |
| DeepSeek V3.1 Terminus 671B (альт провайдер) ? deepseek/deepseek-chat-3.1-terminus-alt общие вопросы и программирование tools structured-outputs | 0.07 | 0.22 | 162000 | 25 сен 25 | нет |
| DeepSeek V3.1 671B Thinking (альт провайдер) ? deepseek/deepseek-chat-3.1-alt-thinking общие вопросы и программирование tools structured-outputs | 0.07 | 0.22 | 162000 | 22 авг 25 | нет |
| DeepSeek V3.1 671B (альт провайдер) ? deepseek/deepseek-chat-3.1-alt общие вопросы и программирование tools structured-outputs | 0.07 | 0.22 | 162000 | 22 авг 25 | нет |
| DeepSeek R1 (05-28, конкурент o1, для размышлений, альтернативный провайдер) ? deepseek/deepseek-r1-alt-0528 Профессиональный общие вопросы | 0.075 | 0.30 | 128000 | 29 мая 25 | нет |
| DeepSeek V3 0324 600B (альт провайдер, быстрая) ? deepseek/deepseek-chat-0324-alt-fast общие вопросы и программирование | 0.16 | 0.22 | 128000 | 31 мар 25 | нет |
| DeepSeek V3 0324 600B (альтернативные провайдеры) ? deepseek/deepseek-chat-0324-alt общие вопросы и программирование | 0.16 | 0.16 | 128000 | 25 мар 25 | нет |
| DeepSeek R1 (конкурент o1, альтернативный провайдер, быстрее, но дороже) ? deepseek/deepseek-r1-alt-fast Профессиональный размышления | 0.36 | 0.99 | 163840 | 3 фев 25 | нет |
| DeepSeek R1 дистиллят на базе LLama 3.3 70B (для размышлений) ? deepseek/deepseek-r1-distill-llama-70b Профессиональный общие вопросы | 0.12 | 0.12 | 128000 | 28 янв 25 | нет |
| DeepSeek R1 (конкурент o1, для размышлений, не рекомендуется для обычного пользования) ? deepseek/deepseek-r1 Профессиональный провайдер логирует данные общие вопросы | 0.20 | 0.80 | 65536 | 20 янв 25 | нет |
| DeepSeek V3 600B (альтернативные провайдеры) ? deepseek/deepseek-chat-alt устарела, переходите на deepseek/deepseek-chat-0324-alt общие вопросы и программирование | 0.16 | 0.16 | 128000 | 14 янв 25 | нет |
| DeepSeek V4 Flash (обновлена 24 апреля 2026) ? deepseek/deepseek-chat провайдер логирует данные общие вопросы tools | 0.03 | 0.06 | 1000000 | 24 апр | нет |
| DeepSeek-Coder-V2 236B MoE (v2.5) (теперь универсальная модель, перенаправляется в DeepSeek Chat) ? deepseek/deepseek-coder топ программирование провайдер логирует данные | 0.04 | 0.05 | 128000 | 11 сен 24 | нет |
Qwen – опенсорс модели от Tongyi Qianwen (Alibaba)
Серия языковых моделей от Tongyi Qianwen (Alibaba group, Китай).
Старшие модели показывают неплохое знание русского языка – но рекомендуется ставить температуру пониже (около 0.2) и явно прописывать «отвечать на русском языке».
Блог-запись о запуске моделей
Используя эти модели, вы соглашаетесь с
Tongyi Qianwen LICENSE AGREEMENT
Для модели 110B также доступна translate-версия.
Старшие модели показывают неплохое знание русского языка – но рекомендуется ставить температуру пониже (около 0.2) и явно прописывать «отвечать на русском языке».
Используя эти модели, вы соглашаетесь с
Для модели 110B также доступна translate-версия.
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Qwen: Qwen3.7 Max ? qwen/qwen3.7-max Профессиональный (не Тестовый) tools | 0.75 | 2.25 | 1000000 | 10 июн | нет |
| Qwen: Qwen3.7 Plus ? qwen/qwen3.7-plus Базовый и выше (не Тестовый) повышенная цена при контексте > 250К tools vision | 0.12 | 0.48 | 1000000 | 10 июн | нет |
| Qwen: Qwen3 VL 235B A22B Instruct ? qwen/qwen3-vl-235b-a22b-instruct Профессиональный (не Тестовый) tools structured-outputs vision | 0.075 | 0.57 | 256000 | 24 сен 25 | нет |
| Qwen: Qwen3.6 35B A3B (Thinking) ? qwen/qwen3.6-35b-a3b-thinking Базовый и выше (не Тестовый) tools structured-outputs vision | 0.045 | 0.30 | 256000 | 20 мая | нет |
| Qwen: Qwen3.6 35B A3B (Non-thinking) ? qwen/qwen3.6-35b-a3b tools structured-outputs vision | 0.045 | 0.30 | 256000 | 20 мая | нет |
| Qwen: Qwen3.5 397B A17B (Non-thinking) ? qwen/qwen3.5-397b-a17b программирование tools | 0.09 | 0.54 | 256000 | 20 фев | нет |
| Qwen: Qwen3.5 Plus (от 2026-02-15, версия на 1M контекста) ? qwen/qwen3.5-plus-2026-02-15-1m Базовый и выше (не Тестовый) программирование tools | 0.18 | 1.00 | 1000000 | 20 фев | нет |
| Qwen: Qwen3.5 Plus (от 2026-02-15) ? qwen/qwen3.5-plus-2026-02-15 программирование tools | 0.06 | 0.36 | 256000 | 20 фев | нет |
| Qwen: Qwen3.5 397B A17B ? qwen/qwen3.5-397b-a17b-thinking программирование tools | 0.09 | 0.54 | 256000 | 20 фев | нет |
| Qwen: Qwen3 Coder Next ? qwen/qwen3-coder-next программирование tools structured-outputs | 0.022 | 0.12 | 256000 | 20 фев | нет |
| Qwen: Qwen3 Max ? qwen/qwen3-max tools | 0.18 | 0.95 | 128000 | 25 сен 25 | нет |
| Qwen: Qwen3 Coder Flash ? qwen/qwen3-coder-flash программирование tools | 0.045 | 0.22 | 32000 | 25 сен 25 | нет |
| Qwen: Qwen3 Next 80B A3B (Thinking) ? qwen/qwen3-next-80b-a3b-thinking tools | 0.022 | 0.22 | 262000 | 18 сен 25 | нет |
| Qwen: Qwen3 Next 80B A3B ? qwen/qwen3-next-80b-a3b tools structured-outputs | 0.022 | 0.22 | 262000 | 18 сен 25 | нет |
| Qwen: Qwen3 30B A3B Instruct 2507 ? qwen/qwen3-30b-a3b-instruct-2507 | 0.03 | 0.12 | 128000 | 31 июл 25 | нет |
| Qwen: Qwen3 235B A22B Thinking 2507 ? qwen/qwen3-235b-a22b-07-25-thinking Профессиональный tools | 0.045 | 0.45 | 128000 | 25 июл 25 | нет |
| Qwen3 Coder 480B A35B (с поддержкой tools) ? qwen/qwen3-coder-tools программирование и общие задачи tools | 0.30 | 0.47 | 256000 | 23 июл 25 | нет |
| Qwen3 Coder 480B A35B ? qwen/qwen3-coder программирование и общие задачи | 0.30 | 0.30 | 256000 | 23 июл 25 | нет |
| Qwen: Qwen3 235B A22B 2507 ? qwen/qwen3-235b-a22b-07-25 Профессиональный | 0.035 | 0.12 | 256000 | 22 июл 25 | нет |
| Qwen: Qwen3 30B A3B ? qwen/qwen3-30b опциональные размышления | 0.015 | 0.055 | 41000 | 29 апр 25 | нет |
| Qwen: Qwen3 14B ? qwen/qwen3-14b За вызов: 0.003 р. опциональные размышления | 0.012 | 0.033 | 41000 | 29 апр 25 | нет |
| Qwen: Qwen3 32B ? qwen/qwen3-32b опциональные размышления | 0.015 | 0.055 | 41000 | 29 апр 25 | нет |
| Qwen: Qwen3 235B A22B ? qwen/qwen3-235b Профессиональный опциональные размышления | 0.035 | 0.12 | 41000 | 29 апр 25 | нет |
| Qwen: QwQ 32B ? qwen/qwq-32b размышления tools | 0.06 | 0.08 | 128000 | 6 мар 25 | нет |
| Qwen2.5 72B Instruct (с поддержкой structured outputs) ? qwen/qwen-2.5-72b-structured Профессиональный structured-outputs | 0.22 | 0.22 | 32000 | 19 дек 24 | нет |
| Qwen2.5 Coder 32B Instruct ? qwen/qwen-2.5-coder-32b-instruct недорогая для программирования программирование и общие вопросы | 0.05 | 0.05 | 128000 | 12 ноя 24 | нет |
| Qwen2.5 72B Instruct ? qwen/qwen-2.5-72b-instruct ролеплей и общие вопросы | 0.60 | 0.60 | 128000 | 21 сен 24 | нет |
| Qwen: Qwen-Plus ? qwen/qwen-plus tools | 0.06 | 0.18 | 128000 | 1 фев 25 | нет |
| Qwen: Qwen-Turbo ? qwen/qwen-turbo-2024-11-01 tools | 0.016 | 0.035 | 1000000 | 1 фев 25 | нет |
Z-AI – GLM 5, опенсорс модели от Z.AI
Серия языковых моделей от Z.AI (Китай).
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Z.AI: GLM 5.2 (Thinking High) ? z-ai/glm-5.2-thinking-high Базовый и выше (не Тестовый) программирование tools structured-outputs | 0.40 | 1.30 | 1000000 | 26 июн | нет |
| Z.AI: GLM 5.2 (Non-thinking) ? z-ai/glm-5.2 Базовый и выше (не Тестовый) программирование tools structured-outputs | 0.40 | 1.30 | 1000000 | 26 июн | нет |
| Z.AI: GLM 4.7 (MoE 355B всего, 23B активных) (X-Fast, до 300-500 ток/сек) ? z-ai/glm-4.7-xfast Базовый и выше (не Тестовый) быстрая tools structured-outputs | 0.25 | 0.38 | 200000 | 26 июн | нет |
| Z.AI: GLM 5.1 (Thinking) ? z-ai/glm-5.1-thinking Базовый и выше (не Тестовый) программирование tools structured-outputs | 0.40 | 1.30 | 200000 | 7 апр | нет |
| Z.AI: GLM 5.1 (Non-thinking) ? z-ai/glm-5.1 Базовый и выше (не Тестовый) программирование tools structured-outputs | 0.40 | 1.30 | 200000 | 7 апр | нет |
| Z.AI: GLM 5 (Non-thinking) ? z-ai/glm-5 программирование tools | 0.15 | 0.39 | 200000 | 20 фев | нет |
| Z.AI: GLM 5 (Thinking) ? z-ai/glm-5-thinking программирование tools | 0.15 | 0.39 | 200000 | 20 фев | нет |
| Z.AI: GLM 4.7 (MoE 355B всего, 23B активных, обновлена до fast) ? z-ai/glm-4.7 быстрая tools structured-outputs | 0.09 | 0.32 | 200000 | 27 янв | нет |
| Z.AI: GLM 4.6 (MoE 355B всего, 23B активных) ? z-ai/glm-4.6 Профессиональный возможный топ по цена/качество tools | 0.09 | 0.32 | 200000 | 2 окт 25 | нет |
| Z.AI: GLM 4.5 (MoE 355B всего, 23B активных) ? z-ai/glm-4.5 Профессиональный возможный топ по цена/качество tools | 0.09 | 0.32 | 128000 | 29 июл 25 | нет |
| Z.AI: GLM 4.5 Air (MoE 106B всего, 12B активных) ? z-ai/glm-4.5-air tools | 0.03 | 0.16 | 128000 | 29 июл 25 | нет |
Minimax – модели от Minimax
Серия языковых моделей от Minimax (Китай).
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| MiniMax: MiniMax M3 ? minimax/minimax-m3 Базовый и выше (не Тестовый) tools vision | 0.09 | 0.36 | 1000000 | 10 июн | нет |
| MiniMax: MiniMax M2.7 ? minimax/minimax-m2.7 tools | 0.045 | 0.18 | 200000 | 25 мар | нет |
| MiniMax: MiniMax M2.5 ? minimax/minimax-m2.5 tools | 0.045 | 0.18 | 196000 | 13 фев | нет |
| MiniMax: MiniMax M2.1 ? minimax/minimax-m2.1 tools | 0.045 | 0.18 | 196000 | 23 дек 25 | нет |
| MiniMax: MiniMax M2 ? minimax/minimax-m2 tools | 0.045 | 0.18 | 196000 | 31 окт 25 | нет |
| MiniMax: MiniMax M1 (Thinking) ? minimax/minimax-m1 Профессиональный размышления | 0.08 | 0.33 | 1000000 | 18 июн 25 | нет |
| MiniMax: MiniMax-01 ? minimax/minimax-01 Профессиональный большой контекст | 0.03 | 0.20 | 1000000 | 17 янв 25 | нет |
Moonshot AI: Kimi K2, K2.5 и пр.
Серия языковых моделей от Moonshot AI (Китай).
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| MoonshotAI: Kimi K3 ? moonshotai/kimi-k3 Профессиональный (не Тестовый) tools structured-outputs vision | 0.9 | 4.5 | 1000000 | 16 июл | нет |
| MoonshotAI: Kimi K2.7 Code ? moonshotai/kimi-k2.7-code программирование и общие задачи tools structured-outputs vision | 0.27 | 1.20 | 262000 | 12 июн | нет |
| MoonshotAI: Kimi K2.6 (Thinking) ? moonshotai/kimi-k2.6-thinking программирование и общие задачи tools structured-outputs vision | 0.27 | 1.20 | 262000 | 20 апр | нет |
| MoonshotAI: Kimi K2.6 ? moonshotai/kimi-k2.6 программирование и общие задачи tools structured-outputs vision | 0.27 | 1.20 | 262000 | 20 апр | нет |
| MoonshotAI: Kimi K2.5 ? moonshotai/kimi-k2.5 программирование и общие задачи tools structured-outputs vision | 0.18 | 0.90 | 262000 | 29 янв | нет |
| MoonshotAI: Kimi K2 от 5 сентября (1T параметров), быстрая, до 400 ток/сек ? moonshotai/kimi-k2-0905-fast программирование и общие задачи tools structured-outputs | 0.14 | 0.45 | 256000 | 9 сен 25 | нет |
| MoonshotAI: Kimi K2 от 5 сентября (1T параметров) ? moonshotai/kimi-k2-0905 программирование и общие задачи tools structured-outputs | 0.08 | 0.37 | 256000 | 9 сен 25 | нет |
| MoonshotAI: Kimi K2 (1T параметров) ? moonshotai/kimi-k2 программирование и общие задачи tools structured-outputs | 0.075 | 0.35 | 128000 | 12 июл 25 | нет |
Российские: Сайга и Вихрь – альтернатива YaGPT и GigaChat
Сайга – третья модель, сфокусированная на российском языке после моделей от Яндекса (YaGPT) и Сбера (GigaChat) – и сравнима с ними. Подробнее об истории возникновения – в нашей статье на Хабре:
https://habr.com/ru/articles/767588/
Также здесь представлены модели от команды VikhrModels, которая также с 2024 года начала дотренировывать опенсорсные модели на русских данных. Они также рекомендуются к знакомству – по метрикам они не хуже gpt-3.5 и могут приближаться к gpt-4o-mini.
Серия моделей OMF включает в себя «холодный старт» – т.е. загрузку по мере запроса. Если на первый запрос вы не получили ответ по таймауту, просто подождите 1–2 минуты и попробуйте снова – весьма вероятно, что модель загрузится.
Также здесь представлены модели от команды VikhrModels, которая также с 2024 года начала дотренировывать опенсорсные модели на русских данных. Они также рекомендуются к знакомству – по метрикам они не хуже gpt-3.5 и могут приближаться к gpt-4o-mini.
Серия моделей OMF включает в себя «холодный старт» – т.е. загрузку по мере запроса. Если на первый запрос вы не получили ответ по таймауту, просто подождите 1–2 минуты и попробуйте снова – весьма вероятно, что модель загрузится.
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Saiga Gemma 3 12B (российский разработчик) ? OMF-R-IlyaGusev/saiga_gemma3_12b Open Models Fan За вызов: 0.15 р. ролеплей Hugging Face | 0.10 | 0.10 | 16000 | 30 апр 25 | нет |
| SAINEMO-reMIX (микс русскоязычных моделей) ? OMF-R-Moraliane/SAINEMO-reMIX Open Models Fan За вызов: 0.15 р. ролеплей Hugging Face | 0.10 | 0.10 | 16000 | 16 дек 24 | нет |
| Сайга MistralNemo 12B v1 (российский разработчик) ? OMF-R-IlyaGusev/saiga_nemo_12b Open Models Fan За вызов: 0.15 р. ролеплей Hugging Face | 0.10 | 0.10 | 8192 | 3 ноя 24 | нет |
| Vikhr-Nemo-12B-Instruct-R-21-09-24 (российский разработчик) ? OMF-R-Vikhr-Nemo-12B-Instruct-R-21-09-24 Open Models Fan За вызов: 0.15 р. Hugging Face | 0.10 | 0.10 | 16000 | 22 сен 24 | нет |
| Vikhr-Llama3.1-8B-Instruct-R-21-09-24 (российский разработчик) ? OMF-R-Vikhr-Llama3.1-8B-Instruct-R-21-09-24 Open Models Fan За вызов: 0.10 р. Hugging Face | 0.10 | 0.10 | 16000 | 22 сен 24 | нет |
| Saiga/Llama3 8B (российский разработчик) ? OMF-R-IlyaGusev/saiga_llama3_8b Open Models Fan За вызов: 0.10 р. Hugging Face | 0.10 | 0.10 | 8192 | 19 июл 24 | нет |
Опенсорс
Обычные опенсорс модели
Различные опенсорс модели. Эти модели в первую очередь тренировались на английском языке (учтите это), но и на русском могут показывать неплохое качество. В отличие от коммерческих моделей они, как правило, не используют автомодерацию запросов по этическому признаку. Читайте описания к модели по знаку ?". Как правило, модели с большим числом параметров (70B против 7B) более точны и лучше рассуждают, но и более дороги в обработке.
В тегах указано, на чем специализируется модель. Если тег не указан – модель многоцелевая, т.е. чаще всего обычное следование инструкциям, но лучше прочитать описание.
Если на русский запрос они выдают не очень хороший результат, попробуйте обращаться к ним на английском, или попробуйте наши translate-версии (ниже). Особенно рекомендуется translate-версии для ролеплейных моделей (если вы не пишете на английском)
В тегах указано, на чем специализируется модель. Если тег не указан – модель многоцелевая, т.е. чаще всего обычное следование инструкциям, но лучше прочитать описание.
Если на русский запрос они выдают не очень хороший результат, попробуйте обращаться к ним на английском, или попробуйте наши translate-версии (ниже). Особенно рекомендуется translate-версии для ролеплейных моделей (если вы не пишете на английском)
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Xiaomi: MiMo-V2.5 Pro (Thinking) ? xiaomi/mimo-v2.5-pro-thinking Профессиональный (не Тестовый) tools structured-outputs vision audioinput | 0.13 | 0.26 | 1000000 | 16 июн | нет |
| Xiaomi: MiMo-V2.5 Pro ? xiaomi/mimo-v2.5-pro Профессиональный (не Тестовый) tools structured-outputs vision audioinput | 0.13 | 0.26 | 1000000 | 16 июн | нет |
| Xiaomi: MiMo-V2.5 (Thinking) ? xiaomi/mimo-v2.5-thinking Базовый и выше (не Тестовый) tools structured-outputs vision audioinput | 0.05 | 0.09 | 1000000 | 16 июн | нет |
| Xiaomi: MiMo-V2.5 ? xiaomi/mimo-v2.5 Базовый и выше (не Тестовый) tools structured-outputs vision audioinput | 0.05 | 0.09 | 1000000 | 16 июн | нет |
| AionLabs: Aion-2.0 (ролеплей модель на базе Deepseek 3.2, размышляющая) ? aion/aion-2.0 ролеплей | 0.12 | 0.24 | 128000 | 25 фев | нет |
| Nous: Hermes 4 405B ? nousresearch/hermes-4-405b | 0.15 | 0.45 | 128000 | 2 сен 25 | нет |
| Nous: Hermes 4 70B ? nousresearch/hermes-4-70b | 0.02 | 0.07 | 128000 | 2 сен 25 | нет |
| Llama 3.3 70B Instruct (SuperFast, порядка 1000-2000 токенов в секунду) ? meta-llama/llama-3.3-70b-instruct-superfast Базовый и выше (не Тестовый) superfast tools structured-outputs | 0.14 | 0.18 | 32000 | 8 мая 25 | нет |
| Llama 4 Scout (SuperFast, порядка 1000-2000 токенов в секунду!) ? meta-llama/llama-4-scout-superfast superfast structured-outputs | 0.10 | 0.14 | 32000 | 8 мая 25 | нет |
| Llama 4 Maverick (быстрая, до 400 токенов в секунду) ? meta-llama/llama-4-maverick-fast Профессиональный | 0.09 | 0.22 | 1000000 | 6 апр 25 | нет |
| Llama 4 Maverick Online HQ ? meta-llama/llama-4-maverick-online-hq Профессиональный За вызов: 2.0 р. онлайн tools structured-outputs | 0.03 | 0.12 | 1000000 | 7 апр 25 | нет |
| Llama 4 Maverick ? meta-llama/llama-4-maverick Профессиональный tools structured-outputs | 0.03 | 0.12 | 1000000 | 6 апр 25 | нет |
| Llama 4 Scout (быстрая) ? meta-llama/llama-4-scout fast tools | 0.022 | 0.08 | 328000 | 6 апр 25 | нет |
| Llama 3.3 70B Instruct (быстрая, более 200 токенов в секунду) ? meta-llama/llama-3.3-70b-instruct-fast | 0.10 | 0.15 | 128000 | 14 фев 25 | нет |
| Sao10K: Llama 3.3 Euryale 70B ? sao10k/l3.3-euryale-70b ролеплей | 0.25 | 0.25 | 8000 | 19 дек 24 | нет |
| Llama 3.3 70B Instruct (с поддержкой structured outputs) ? meta-llama/llama-3.3-70b-structured Профессиональный structured-outputs | 0.22 | 0.22 | 128000 | 19 дек 24 | нет |
| Llama 3.3 70B Instruct ? meta-llama/llama-3.3-70b-instruct | 0.08 | 0.08 | 128000 | 8 дек 24 | нет |
| Rocinante 12B ? thedrummer/rocinante-12b ролеплей | 0.04 | 0.075 | 32768 | 16 окт 24 | нет |
| Llama 3.2 3B Instruct ? meta-llama/llama-3.2-3b-instruct | 0.015 | 0.015 | 128000 | 26 сен 24 | нет |
| Llama 3.1 Euryale 70B v2.2 ? sao10k/l3.1-euryale-70b квантизация fp8 ролеплей Hugging Face | 0.25 | 0.25 | 8192 | 28 авг 24 | нет |
| Hermes 3 405B Instruct ? nousresearch/hermes-3-llama-3.1-405b ролеплей и общие вопросы | 0.70 | 0.70 | 128000 | 17 авг 24 | нет |
| Llama 3.1 70B Instruct meta-llama/llama-3.1-70b-instruct tools | 0.12 | 0.12 | 128000 | 24 июл 24 | нет |
| Llama 3.1 8B Instruct meta-llama/llama-3.1-8b-instruct | 0.027 | 0.06 | 128000 | 24 июл 24 | нет |
| NVIDIA Nemotron 4 340B Instruct ? nvidia/nemotron-4-340b-instruct выключена провайдером топ опенсорс переводчик от 25 июня общие вопросы | 0.63 | 0.63 | 4096 | 25 июн 24 | нет |
| Euryale-v2.1-70B ? sao10k/euryale-70b ролеплей | 0.22 | 0.22 | 16000 | 30 июн 24 | нет |
| LLaMA v3 70B Instruct ? meta-llama/llama-3-70b-instruct | 0.135 | 0.135 | 8192 | 19 апр 24 | нет |
| LLaMA v3 8B Instruct ? meta-llama/llama-3-8b-instruct | 0.035 | 0.035 | 8192 | 19 апр 24 | нет |
| WizardLM-2 8x22B ? microsoft/wizardlm-2-8x22b топ ролеплей от 17 апреля ролеплей и общие вопросы | 0.15 | 0.15 | 65536 | 18 апр 24 | нет |
| Gryphe: MythoMax L2 13B ? gryphe/mythomax-L2-13b дешевая 13B | 0.04 | 0.04 | 4096 | 8 мар 24 | нет |
Самые свежие опенсорс модели Open Models Fan (OMF) (бета-тест)
Самые свежие опенсорс модели серии Open Models Fan (могут быть недоступны на Тестовом тарифе).
Особенности:
– Модели доступны для экспериментирования, а не для реальной автоматизации (но они также доступны через API). Поэтому, пожалуйста, используйте их вручную или на малом объеме автоматических запросов (до 500). Если вам нужно интенсивно работать с ними, рекомендуем развернуть их на собственном сервере. Если мы увидим большое число автоматических запросов от вас к этим моделям, мы оставляем за собой право временно заблокировать ваш аккаунт
– Следствие – мы берем плату за вызов и небольшую плату за входные и выходные символы. Таким образом, эти модели более выгодно использовать для долгого ролеплея с большим контекстом (если они это поддерживают)
– Скорость вывода – 10–40 токенов в секунду, в зависимости от размера модели.
– Модели 70B и выше поставляются в квантизации FP8 – создавая баланс между загрузкой серверов и качеством. В целом, падение качества по сравнению с FP16 и FP32 (оригинал) довольно небольшое.
– Размер контекста не гарантирован (в процессе выяснения у провайдера)
– Обычно опенсорсные файнтюны моделей в первую очередь предназначены для ролеплея и написания историй (часто – на английском, если не указано обратное). Для общих кейсов мы рекомендуем обычные модели.
– Серия моделей OMF включает в себя «холодный старт» – т.е. загрузку по мере запроса. Если на первый запрос вы не получили ответ по таймауту, просто подождите 1–2 минуты и попробуйте снова – весьма вероятно, что модель загрузится.
Пожалуйста, поддержите опенсорсную альтернативу проприетарным моделям!
Особенности:
– Модели доступны для экспериментирования, а не для реальной автоматизации (но они также доступны через API). Поэтому, пожалуйста, используйте их вручную или на малом объеме автоматических запросов (до 500). Если вам нужно интенсивно работать с ними, рекомендуем развернуть их на собственном сервере. Если мы увидим большое число автоматических запросов от вас к этим моделям, мы оставляем за собой право временно заблокировать ваш аккаунт
– Следствие – мы берем плату за вызов и небольшую плату за входные и выходные символы. Таким образом, эти модели более выгодно использовать для долгого ролеплея с большим контекстом (если они это поддерживают)
– Скорость вывода – 10–40 токенов в секунду, в зависимости от размера модели.
– Модели 70B и выше поставляются в квантизации FP8 – создавая баланс между загрузкой серверов и качеством. В целом, падение качества по сравнению с FP16 и FP32 (оригинал) довольно небольшое.
– Размер контекста не гарантирован (в процессе выяснения у провайдера)
– Обычно опенсорсные файнтюны моделей в первую очередь предназначены для ролеплея и написания историй (часто – на английском, если не указано обратное). Для общих кейсов мы рекомендуем обычные модели.
– Серия моделей OMF включает в себя «холодный старт» – т.е. загрузку по мере запроса. Если на первый запрос вы не получили ответ по таймауту, просто подождите 1–2 минуты и попробуйте снова – весьма вероятно, что модель загрузится.
Пожалуйста, поддержите опенсорсную альтернативу проприетарным моделям!
| Модель и ID | Руб за 1000 символов входных данных | Руб за 1000 символов генерации модели | Размер конте кста | Дата обнов ления | Авто моде ра ция |
| Gemma 3 27B (abliterated alt) ? OMF-gemma3-27b-abliterated-dpo Open Models Fan За вызов: 0.20 р. ролеплей Hugging Face | 0.15 | 0.15 | 32000 | 19 ноя 25 | нет |
| Saiga Gemma 3 12B (российский разработчик) ? OMF-R-IlyaGusev/saiga_gemma3_12b Open Models Fan За вызов: 0.15 р. ролеплей Hugging Face | 0.10 | 0.10 | 16000 | 30 апр 25 | нет |
| Gemma 3 27B (abliterated) ? OMF-Gemma3-27B-abliterated Open Models Fan За вызов: 0.20 р. ролеплей Hugging Face | 0.15 | 0.15 | 16384 | 12 апр 25 | нет |
| Pantheon RP 1.8 24b ? OMF-Pantheon-RP-1.8-24b-Small-3.1 Open Models Fan За вызов: 0.20 р. ролеплей Hugging Face | 0.15 | 0.15 | 16384 | 31 мар 25 | нет |
| Forgotten Abomination 24B V2.2 ? OMF-Forgotten-Abomination-24B-V2.2 Open Models Fan За вызов: 0.20 р. ролеплей Hugging Face | 0.15 | 0.15 | 16384 | 19 мар 25 | нет |
| Hamanasu QwQ 32B V2 RP ? OMF-Hamanasu-QwQ-32B-V2-RP Open Models Fan За вызов: 0.25 р. ролеплей Hugging Face | 0.18 | 0.18 | 16384 | 19 мар 25 | нет |
| QwQ 32B (abliterated) ? OMF-QwQ-32B-abliterated Open Models Fan За вызов: 0.25 р. ролеплей | 0.18 | 0.18 | 16384 | 19 мар 25 | нет |
| SAINEMO-reMIX (микс русскоязычных моделей) ? OMF-R-Moraliane/SAINEMO-reMIX Open Models Fan За вызов: 0.15 р. ролеплей Hugging Face | 0.10 | 0.10 | 16000 | 16 дек 24 | нет |
| EVA Qwen2.5-72B v0.1 ? OMF-EVA-Qwen2.5-72B-v0.1 Open Models Fan За вызов: 0.50 р. ролеплей | 0.25 | 0.25 | 8192 | 8 ноя 24 | нет |
| Сайга MistralNemo 12B v1 (российский разработчик) ? OMF-R-IlyaGusev/saiga_nemo_12b Open Models Fan За вызов: 0.15 р. ролеплей Hugging Face | 0.10 | 0.10 | 8192 | 3 ноя 24 | нет |
| EVA Qwen2.5-72B v0.0 ? OMF-EVA-Qwen2.5-72B-v0.0 Open Models Fan За вызов: 0.50 р. ролеплей | 0.25 | 0.25 | 8192 | 3 ноя 24 | нет |
| Qwen2.5-72B-Instruct-abliterated ? OMF-Qwen2.5-72B-Instruct-abliterated Open Models Fan За вызов: 0.50 р. ролеплей и общие вопросы Hugging Face | 0.25 | 0.25 | 16000 | 16 окт 24 | нет |
| Vikhr-Nemo-12B-Instruct-R-21-09-24 (российский разработчик) ? OMF-R-Vikhr-Nemo-12B-Instruct-R-21-09-24 Open Models Fan За вызов: 0.15 р. Hugging Face | 0.10 | 0.10 | 16000 | 22 сен 24 | нет |
| Vikhr-Llama3.1-8B-Instruct-R-21-09-24 (российский разработчик) ? OMF-R-Vikhr-Llama3.1-8B-Instruct-R-21-09-24 Open Models Fan За вызов: 0.10 р. Hugging Face | 0.10 | 0.10 | 16000 | 22 сен 24 | нет |
| Smaug Qwen2 72B Instruct ? OMF-abacusai/Smaug-Qwen2-72B-Instruct Open Models Fan За вызов: 0.50 р. ролеплей и общие вопросы Hugging Face | 0.25 | 0.25 | 16000 | 22 июл 24 | нет |
| Tess v2.5.2 Qwen2 72B ? OMF-Tess-v2.5.2-Qwen2-72B Open Models Fan За вызов: 0.50 р. Hugging Face | 0.25 | 0.25 | 16000 | 19 июл 24 | нет |
| MG-FinalMix-72B (Magnum-72B based) ? OMF-Undi95/MG-FinalMix-72B Open Models Fan За вызов: 0.50 р. ролеплей Hugging Face | 0.25 | 0.25 | 16000 | 19 июл 24 | нет |
| Saiga/Llama3 8B (российский разработчик) ? OMF-R-IlyaGusev/saiga_llama3_8b Open Models Fan За вызов: 0.10 р. Hugging Face | 0.10 | 0.10 | 8192 | 19 июл 24 | нет |
Примечания
Автомодерация – означает, что, в соответствии с требованиями поставщика модели автоматически проверяется вход на несоответствие этическим нормам (Terms Of Service конкретной модели). В случае, если запрос не проходит модерацию, возвращается ошибка и деньги не списываются.