
Бывает так: открываешь чат, кидаешь вопрос — и получаешь ровно то, что ожидал. А бывает иначе: переписываешь запрос трижды, редактируешь ответ четыре — и всё равно ощущение, что разговариваешь с очень уверенным в себе, но не слишком внимательным собеседником. Разница не в том, какая модель «умнее». Разница в том, под какую задачу она заточена.
Это не гонка. У каждой модели — свой профиль: одни быстрые и дешёвые, другие медленнее, но точнее, третьи специализированы под конкретный формат. Если подобрать связку правильно, те же деньги работают в разы эффективнее.

Все цены — в токенах за одно сообщение. Чем меньше токенов, тем дешевле обходится один запрос. Время ответа указано приблизительно: зависит от очереди и длины контекста, но порядок сохраняется.
| Модель | Назначение | Токенов/сообщение | Скорость |
|---|---|---|---|
| DeepSeek V3 | Черновики, перевод, быстрые ответы | 100 | Секунды |
| Claude Haiku | Короткие тексты, переписка | 120 | Секунды |
| Gemini Flash 2.0 | Универсальная «рабочая лошадка» | 160 | Секунды |
| GPT-5 mini | Заголовки, варианты, короткие задачи | 200 | Секунды |
| Claude Sonnet | Код, тексты, документы | 250 | 5–15 сек |
| GPT-5 | Сложные многошаговые рассуждения | 320 | 10–30 сек |
| Claude Opus | Глубокий анализ, рефакторинг | 500 | 15–45 сек |
Бесплатные: Nemotron 120B, Gemma 4 и Claude — по 50 токенов. Для знакомства с сервисом, тестовых запросов и задач, где точность не критична.
DeepSeek V3 — самая экономная модель в каталоге. Если задачу можно сформулировать коротко и ответ тоже будет коротким, нет смысла платить больше. Перевести абзац, составить таблицу, сгенерировать черновик письма — всё это DeepSeek закрывает за копейки. Из минусов: длинные связные тексты даются ей заметно хуже, чем специализированным конкурентам.
Claude Haiku — младшая в линейке Claude, но характер наследует. Русский язык обрабатывает аккуратнее большинства конкурентов в этом ценовом сегменте, ошибок с падежами и согласованием меньше. Подходит для переписки, несложных рабочих текстов и вопросов, где не нужна глубина.
Gemini Flash 2.0 и GPT-5 mini — универсальные модели облегчённого класса. Выигрывают там, где нужно много коротких однотипных ответов: подбор заголовков, переформулировки, проверка грамматики, варианты фраз. Быстро, дёшево, предсказуемо.
Claude Sonnet — самая популярная модель на сервисе, и это не случайность. Золотое соотношение цена/качество для большинства рабочих задач: деловые письма, статьи, переработка текстов, код. Русский язык — на уровне, инструкции соблюдает точно. Если не знаете, какую модель выбрать, и задача не относится к специфическому сегменту — берите Sonnet.
GPT-5 — выносливый рассуждатель. Если задача требует нескольких шагов, проверки логики, поиска ошибок в цепочке выводов — GPT-5 справляется лучше остальных. Он может думать дольше перед ответом, и это нормально: заложенное время учитывается в цене. Для простых вопросов брать смысла нет — переплата.
Claude Opus — премиум-сегмент. Берут не за скорость, а за глубину и точность. Юридические разборы, сложный рефакторинг, архитектурные решения, задачи, где ошибка обходится дороже самого ответа. Цена высокая, но переделывать не приходится — чаще всего ответ сразу попадает в цель.
Быстрые модели отвечают за несколько секунд. Премиальные — от десяти до сорока пяти, в зависимости от очереди и объёма контекста. На практике разница ощущается, только если отправлять по сотне сообщений в день. При пакетной работе с документами — существенно.
Стоимость считается просто: фиксированное число токенов за сообщение, указано в каталоге до отправки. Никаких сюрпризов «по факту». Единственный нюанс: если модель генерирует ответ длиннее трёх тысяч токенов, списывается двойная порция. Это тоже показано заранее.
При текущих ценах одна сотня сообщений в DeepSeek обходится дешевле чашки кофе. Та же сотня в Opus — заметная сумма. Вопрос не в том, дорого или дёшево, а в том, какой результат нужен и какая модель его даст с первой попытки.
Claude Sonnet и Opus лидируют: код получается чистым, следует стилевым конвенциям, поясняет неочевидные решения. Sonnet хорош для ежедневной работы, Opus — для рефакторинга и аудита.
GPT-5 выдаёт более «агрессивный» код: иногда работает быстрее, иногда содержит неочевидные допущения. Для простых скриптов и прототипов — норм, для продакшена стоит проверять.
Gemini и DeepSeek закрывают базовые задачи: boilerplate, исправление ошибок, перевод с одного языка на другой. Для сложной логики с нестандартными требованиями — слабее.
Модели заметно отличаются по тому, как обращаются с русским. Haiku и Sonnet из семейства Claude — лучшие в этом ценовом сегменте: склонения, согласования, устойчивые выражения — всё на месте чаще, чем у конкурентов.
GPT-5 бывает небрежен с русским в длинных текстах: может «съесть» падеж или подставить не то число. Мелкие ошибки проскакивают и в быстрых моделях.
DeepSeek и Gemini могут выдавать канцеляризмы и кальки с английского в формальных текстах. Для деловой переписки лучше перепроверять или править вручную.
Все модели работают в одном чате. Можно спросить что-то у Sonnet, получить ответ, переключиться на DeepSeek и продолжить тот же разговор — контекст сохраняется. Это позволяет экономить: черновик сделать на дешёвой модели, финальную доработку — на более дорогой.
На практике удобная связка: DeepSeek для объёма, Sonnet для качества, Opus для сложных единичных задач.
Не нужно искать одну «самую лучшую» модель. Связка из двух-трёх работает лучше, чем попытка закрыть всё одним инструментом.
Попробовать можно с минимальным пополнением — от 45 рублей. Баланс общий, история сохраняется, переключение — один клик.
Оплата кодом или USDT, вход от 45 ₽ — без иностранной карты.