Выбор
Какая модель под какую работу
Скопируй страницу и вставь в Claude или GPT — разберёт под твою задачу.
Моделей стало столько, что вопрос «какая лучшая» потерял смысл — на него нет одного ответа. Правильный вопрос: какая модель под ЭТУ работу. Ниже разложу по типам задач — код, текст, ресёрч, агенты, бюджет — с актуальными цифрами на середину 2026, чтобы ты выбирал по делу, а не по хайпу.
Короткий ответ
Единого «лучшего» не существует. Есть маршрутизация: под задачу подбираешь модель, у которой она — сильная сторона. Сжатая выжимка:
- Сложный код и автономные агенты → Claude Opus 4.8.
- Терминал, пайплайны, универсал → GPT-5.5.
- Длинный контекст, мультимодал, лучшая цена фронтира → Gemini 3.1 Pro.
- Объём и бюджет → DeepSeek V4 и другие дешёвые модели.
ВНИМАНИЕ. Все цифры ниже — на середину 2026. Рынок моделей двигается быстро: перед серьёзным выбором сверься с актуальными данными, а не с этой статьёй полугодовой давности.
Кто есть кто в 2026
- Anthropic — Claude. Opus 4.8 — флагман и лидер общего рейтинга Artificial Analysis Intelligence Index (~61.4 на середину 2026), вышел 28.05.2026. По умолчанию работает на «high effort», для трудного есть режимы xhigh/max. Лучший под сложный код, письмо и автономных агентов. Sonnet 5 — рабочая лошадка на каждый день, баланс цены и качества. Haiku 4.5 — быстрая и дешёвая для лёгких задач.
- OpenAI — GPT-5.5. Сильнейший универсал с широчайшей экосистемой (голос, картинки, агент-фреймворки). Лидер терминальных сценариев: Terminal-Bench 2.1 ~78% против ~75% у Opus. Контекст: в API ~1M токенов, внутри Codex — 400K.
- Google — Gemini. 3.1 Pro — самый длинный контекст (до 2M токенов), сильный мультимодал, лучшая цена среди фронтира (~$2/$12 за 1M токенов). 3.5 Flash (май 2026) — новейший быстрый тир: по разуму близок к Pro при цене Flash, тянет код и рой-агентов, стал моделью по умолчанию в приложении Gemini. Pro-линейка двигается к 3.5 — перед выбором сверься с актуальной версией.
- Бюджетные и открытые веса. DeepSeek V4 Pro — открытые веса, ~$0.44/$0.87 за 1M токенов, лучший опенсорс: тянет код и агентов дешевле всех (а DeepSeek V4 Flash ещё дешевле — $0.14/$0.28). Qwen3.7 Max. Kimi K2.6 — заточен под рой-агентов. Grok 4.3 — дёшево, сильные агент/tool-скоры, доступ к данным X в реальном времени.
Какая модель под какую работу
| Работа | Основной выбор | Дешевле / альтернатива | Почему |
|---|---|---|---|
| Сложный код, рефакторинг, автономные агенты | Claude Opus 4.8 | DeepSeek V4 Pro | Лидер SWE-bench Pro (~69%), меньше всего скрытых багов, надёжен в долгих автономных прогонах |
| Ежедневный код в редакторе | Claude Sonnet 5 или GPT-5.5 | Kimi K2.6 | Премиум-качество на потоке без флагман-цены |
| Терминал, скрипты, пайплайны, строгая спека | GPT-5.5 | — | Лидер Terminal-Bench, дисциплина структурного вывода, экосистема |
| Тексты, письмо, редактура | Claude Opus 4.8 (или Sonnet 5) | GPT-5.5 | Голос и ритм прозы, редакторское суждение; GPT — если нужны инструменты по ходу |
| Ресёрч, длинный контекст, синтез по многим документам | Gemini 3.1 Pro | Claude Opus 4.8 | Контекст до 2M токенов дёшево; Opus — когда важнее глубина |
| Мультимодал (картинки/видео/аудио на объёме) | Gemini 3.1 Pro | — | Лучший мультимодал, самая низкая цена фронтира |
| Объём и бюджет (много дешёвых вызовов через API) | DeepSeek V4 / Gemini 3.5 Flash / Grok Fast | — | Порядок дешевле флагманов при рабочем качестве |
«Лучше всего» здесь — это акцент модели, а не приговор остальным. Многие задачи тянут сразу несколько моделей; таблица показывает, куда бить в первую очередь.
Главный навык 2026: подбирай не только модель, но и усилие
Есть навык, который большинство пропускает: не гнать флагман на максимальном «мышлении» на всё подряд. Это жжёт деньги и время без выигрыша в качестве. Дорогую модель и высокий effort береги для реально сложного. На простое ставь модель попроще или меньше усилий — качество то же, а цена и задержка ниже.
У Claude это уровни усилия: high по умолчанию, xhigh/max — для трудного. У других вендоров свои настройки глубины рассуждения. Правило простое: сперва подбери модель под тип задачи, потом усилие — под её сложность. Два слоя, а не один.
Как это на практике
В Claude Code под капотом ходит Claude: Sonnet 5 на каждый день, Opus 4.8 — на сложное (когда что брать, разбираю отдельно в сравнении Sonnet или Opus). В Codex под капотом GPT-5.5. Сильная схема — гибрид: Claude Code планирует и ревьюит, Codex реализует и прогоняет тесты. Две разные модели ловят разные классы ошибок — получаешь двойное ревью почти бесплатно (об этом подробнее в разборе Codex или Claude Code).
Дешёвые и китайские модели подключаешь через API, когда нужен объём или экономия: пачка вызовов на классификацию, суммаризацию, черновую обработку — там флагман не нужен, а разница в цене на порядок.
Частые ошибки
| Симптом | Причина | Что сделать |
|---|---|---|
| Платишь флагман-ставку за всё | Одна дорогая модель на любую мелочь | Маршрутизируй: дешёвую модель — на простое, флагман — на сложное |
| Выбрал по хайпу, а модель не тянет твою задачу | Доверял обзорам, не тестировал сам | Прогони свою реальную задачу на 2-3 моделях и сравни |
| Одной моделью и код, и тексты, и ресёрч | Ставка на «универсал на всё» | Под каждый тип работы — своя модель с нужной сильной стороной |
| Гонишь максимальное «мышление» везде | Высокий effort по умолчанию на всё | Усилие — под сложность задачи, а не по привычке |
FAQ
Какая модель лучшая в 2026?
Единой нет. Opus 4.8 лидирует в общем рейтинге и в топе под код, агентов и письмо — но это не значит, что бери его на всё. Выбирай под конкретную задачу: для длинного контекста или объёма другие модели выгоднее.
Стоит ли брать китайские и дешёвые модели?
Да — для объёма и бюджета. DeepSeek V4 сильный и в разы дешевле флагманов, тянет код и агентов. На самое сложное и ответственное всё же ставь флагман: там цена ошибки выше экономии.
Хватит ли подписки за $20 или нужен API?
Для работы в чате или агенте подписки хватает — ChatGPT Plus, Claude Pro. API нужен, когда ты СТРОИШЬ продукт или гонишь объём вызовов: там платишь за токены и считаешь экономику.
Нужно ли платить за несколько моделей?
Многие профи держат две — Claude под код и письмо плюс GPT под универсал и инструменты. Но начни с одной и освой её глубоко; вторую добавляй, когда упрёшься в её слабое место.
Итог
Правильный вопрос — не «какая модель лучшая», а «какая под эту работу». Маршрут простой: сложный код и агенты → Opus 4.8, терминал и универсал → GPT-5.5, длинный контекст и цена → Gemini 3.1 Pro, объём → дешёвые и открытые модели. Поверх этого — второй слой: усилие под сложность, чтобы не переплачивать за «мышление» там, где оно не нужно.
Определи свой тип работы, а потом выбери модель под него — а не наоборот. Так ты платишь за качество там, где оно решает, и экономишь там, где хватит и простого.