Почему вопрос сложнее, чем кажется

«Русская модель» и «модель, которая хорошо пишет по-русски» — это разные вещи, и они не всегда совпадают.

Крупные зарубежные модели учились на огромном корпусе, включающем много русского текста, и часть из них пишет по-русски лучше, чем можно ожидать. При этом у них остаётся характерная проблема: они думают английской конструкцией и переводят на лету, а носитель это чувствует.

Модели, разработанные под русский, реже дают кальку, но могут уступать в сложных рассуждениях.

Общий вывод один: проверять надо на своих задачах, а не по заявлениям.

Пять тестов, которые всё показывают

ТестКак проверитьЧто вскрывает
Числительные«22 файла, 1 файл, 5 файлов, 101 файл»Согласование — падает первым
Длинная фразаПредложение на 30+ слов со сложным подчинениемПадежи и связность
Идиома«Объясни "не в своей тарелке" и придумай похожее»Понимание языка, а не перевод
Регистр«Перепиши это для друга, потом для налоговой»Владение стилями
Ваш терминПрофессиональное слово из вашей отраслиОтраслевая лексика

Первый тест самый быстрый и самый показательный: согласование числительных — то место, где слабые модели спотыкаются регулярно, а сильные не спотыкаются никогда.

Признаки кальки

Их пять, и они узнаются сразу, когда знаешь, что искать.

Избыточные притяжательные: «возьмите ваш телефон» вместо «возьмите телефон». Пассив вместо активного залога: «задача может быть решена» вместо «задачу можно решить». Дословные идиомы: «в конце дня» в значении «в итоге». Однообразная длина предложений — живой русский текст дышит. Канцелярит из ниоткуда: «осуществить рассмотрение» там, где сказали бы «разобраться».

Развёрнутый разбор с приёмами исправления — в гайде про русский язык у моделей.

Что показывает практика

На стилистически тонких и длинных текстах уверенно идут крупные модели: Claude Opus 5, Claude Fable 5 для художественного текста, Gemini 3.1 Pro, GPT-5.5.

Открытые модели — DeepSeek, GLM, Kimi — пишут по-русски ровно и грамотно, но суше. Для разбора документов и кода это не мешает, для текста, который должен звучать, разница заметна.

Экономичные версии справляются с бытовыми задачами, и на коротких текстах разницы почти нет. Полный список с ценами — на странице моделей.

Как сравнивать правильно

Один и тот же запрос, одна и та же задача, переключение модели в одном диалоге — это занимает пару минут в чате.

Смотрите не на первое впечатление от красоты, а на количество правок до готового результата. Модель, которая выдала гладкий текст, требующий переписывания половины, проигрывает той, что выдала суховатый, но точный.

Попробовать можно на ГПТ Россия: новичку начисляется приветственный бонус 50 ₽, сервис работает без VPN, оплата в рублях российской картой.

Про бенчмарки

Публичные рейтинги измеряют средние результаты на стандартных наборах задач. Ваша работа в этот набор не входит.

Разрыв между позицией в рейтинге и полезностью на конкретной задаче бывает существенным — особенно в русском, где многие тесты переводные. Пятнадцать минут собственной проверки дают больше, чем неделя чтения сравнений.

Частые вопросы

Правда ли, что на английском модели умнее?

На сложных рассуждениях у сильных моделей разница минимальна и на практике незаметна. У экономичных она есть, но выигрыш съедается потерями на перевод туда и обратно.

Что делать с профессиональными терминами?

Задавать глоссарий в начале диалога: перечислите 5-10 терминов и их правильные соответствия и попросите держаться только их. Это работает лучше любых уточнений по ходу.

Какая модель лучше для деловых текстов?

Для писем и стандартных документов важнее тон, чем эрудиция, — подойдёт экономичная модель при условии, что вы задали адресата и интонацию. Разбор — в гайде про деловую переписку.