В GigaChat обновился режим Рассуждения. Разобрался, зачем он нужен и что теперь умеет нейросеть Сбера

Илья Сидоров avatar | сегодня в 11:00
В GigaChat обновился режим Рассуждения. Разобрался, зачем он нужен и что теперь умеет нейросеть Сбера

Мы привыкли оценивать нейросети по скорости: написал вопрос и через секунду получил большую простыню текста.

Проблема в том, что быстрый ответ ≠ правильный ответ. Любая современная модель может отвечать на простые вопросы. Всё становится интереснее, когда запрос усложняется: появляется много цифр, условий и требований. Обычные модели могут выдать убедительный текст, но наврать в расчётах.

Поэтому рынок начал переходить к reasoning-моделям. Их фишка в том, что они не спешат. Прежде чем выдать финальный ответ, они «думают»: раскладывают задачу на этапы, строят план, проверяют сами себя и только потом формулируют вывод.

Сбер запустил свою первую reasoning-модель GigaChat 3.5 Reasoning с режимом рассуждений, которая специально создавалась для решения сложных задач.

КРАТКО

  • Когда надо переключаться на модель с рассуждением
  • Как включить GigaChat 3.5 Reasoning
  • Как устроена GigaChat 3.5 Reasoning
  • В чём GigaChat 3.5 Reasoning лучше других
  • Основные выводы
  • Когда надо переключаться на модель с рассуждением


    Перед тем как выдать ответ, GigaChat 3.5 Reasoning показывает ход своих рассуждений над вопросом.

    Я вывел простое правило: если вы задаёте односложный и простой вопрос, то рассуждение вам не нужно.

    Например, на вопросы «Сколько будет 15% от 20 000 рублей?», «Как приготовить яблочный пирог?» или «Переведи текст на русский» легко и правильно ответит самая простая модель.

    Но если ваш вопрос включает много условий, данных или дополнительных вопросов, как в примерах ниже, то сразу стоит включать рассуждение. Да, модель будет чуть дольше размышлять, зато она точно не ошибётся в цифрах и выполнит все условия.

    Также рассуждение стоит включать, когда вы не уверены, что обычная модель сможет правильно понять вопрос: всё-таки иногда модели надо давать больше времени на раздумье.

    Нет никакого смысла заставлять огромную модель пять минут рассуждать над просьбой «сделай это письмо чуть вежливее». Но точно так же странно ждать мгновенного и правильного ответа на задачу, где одновременно надо проверить десять условий, провести поиск, расчёты и проверить ошибки.

    Во всех случаях GigaChat 3.5 Reasoning показывает ход рассуждения, за которым было интересно наблюдать. Заодно это позволяет убедиться, что модель действительно «думает» и анализирует свои шаги, прежде чем ответить на вопрос. При необходимости GigaChat 3.5 Reasoning подключает поиск, чтобы найти в интернете данные для ответа на вопрос.

    ◦ Назад к содержанию ◬

    Как включить GigaChat 3.5 Reasoning

    GigaChat автоматически переключается на GigaChat 3.5 Reasoning, когда пользователь нажимает кнопку Рассуждение.

    В этот режим стоит переходить, когда вы хотите задать сложный вопрос и быть уверенным в правильности ответа без необходимости проверять его.

    Я решил проверить модель в нескольких сценариях.

    1. Покупка машины: сравнение цен и комплектаций

    🟢 Промпт

    Я выбираю новую машину. Есть два похожих варианта. Я приложил тебе брошюры с ценами и комплектациями. Выбери самую напичканную модель в бюджете до 3,3 млн рублей. Также сравни похожие по цене комплектации, выдели для каждой машины плюсы и минусы. Ответ дай в виде таблицы.

    wp-image-1387643wp-image-1387644wp-image-1387645

    Ответ GigaChat

    Модель без проблем распознала характеристики и цены машин из PDF и выдала последовательный ответ: сначала выбрала автомобиль с самой богатой комплектацией, затем сделала таблицу и в конце указала плюсы и минусы каждой модели.

    Я часто использую ИИ для сравнения характеристик похожих товаров, особенно когда различий много, а информация находится на разных сайтах. Ответ Сбера закрыл все мои вопросы.

    Ради интереса я загрузил тот же промпт и PDF в DeepSeek с включённым режимом рассуждения. По скорости и выводам обе модели были одинаковы, но DeepSeek создал нечитаемую таблицу, в отличие от GigaChat.

    2. Поиск бага в коде: ловим неочевидные ошибки

    🟢 Промпт

    Найди ошибку в функции. Объясни, почему она может долго оставаться незаметной, приведи пример неправильного результата и исправь код.

    function isExpired(expiresAt) {
    const expires = new Date(expiresAt);
    const now = new Date();

    return expires.getDate() < now.getDate(); } console.log(isExpired("2026-10-01T00:00:00Z"));

    wp-image-1387647wp-image-1387648

    Ответ GigaChat

    Я не разработчик (иногда в свободное время занимаюсь вайбкодингом), поэтому попросил GPT-5.6 Sol придумать сложную ошибку, чтобы проверить GigaChat 3.5 Reasoning. Получается, один ИИ проверяет другой.

    Этот код сравнивает только день месяца, игнорируя месяц, год и фактическое время. Например, 1 октября может ошибочно считаться «просроченным» 9 сентября, потому что 1 < 9.

    GigaChat 3.5 Reasoning распознал ошибку, подробно её объяснил и написал правильный код.

    3. Запуск бизнеса в России: пошаговый план

    🟢 Промпт

    Я хочу открыть свою пекарню. Уже нашел помещение и сотрудников. Помещение будет разделено на две части: готовка и реализация продукции. Буду продавать выпечку, напитки, кофе, чай. Объясни мне порядок действий по открытию бизнеса, помимо создания ООО. Какие документы и разрешения мне потребуются для открытия пекарни. Ответ дай со ссылками на официальные источники (сайты ведомств, законы, указания).

    wp-image-1387649wp-image-1387650

    Ответ GigaChat

    GigaChat 3.5 Reasoning выдала пошаговый список, в котором перечислила все необходимые шаги для открытия бизнеса и объяснила, зачем они нужны.

    Также не лишним был блок в конце, где модель объяснила, куда надо обращаться для получения разрешения или прохождения регистрации.

    На первый взгляд это простой вопрос, но он хорошо показывает, как модель ориентируется в российских законах. Единственный минус заключается в том, что ИИ не дал ссылки на конкретные законы и сайты.

    4. Поездка через полстраны: считаем километры и бюджет на бензин

    🟢 Промпт

    Мне надо съездить на машине из Ростова-на-Дону в Красноярск. Сколько у меня займет дорога, с учетом того, что я могу проехать в день не более 1000 км. Также подсчитай, сколько я потрачу на бензин, с учетом того, что я заправляюсь 95м по 70-80 рублей, средний расход машины при скорости 130 км/ч составляет 7-8 л/100 км, а полный бак на заправке обычно вмещает 42-45 литра.

    wp-image-1387651wp-image-1387652

    Ответ GigaChat

    На размышление ИИ потребовалось несколько секунд, после чего ответ был готов.

    GigaChat 3.5 Reasoning правильно определил расстояние между городами и время, за которое я могу его преодолеть.

    Также модель подсчитала расходы на бензин при разном расходе топлива и выдала необходимые цифры.

    ◦ Назад к содержанию ◬

    Как устроена GigaChat 3.5 Reasoning

    GigaChat 3.5 Reasoning использует собственную архитектуру с технологией линейного внимания, которая экономит токены и в то же время позволяет загружать большие документы для анализа.

    Сбер заявляет, что GigaChat 3.5 Reasoning тратит на рассуждения на 37% меньше токенов, чем DeepSeek V4 Flash Preview, которая известна своей экономичностью. При этом модель Сбера выдаёт сопоставимые по качеству ответы на математические и логические задачи.

    Результаты в бенчмарках это подтверждают:

    • IFBench (оценивает способность следовать сложным инструкциям и ограничениям): 77 баллов
    • Natural Plan (проверяет способность планирования реальных задач на основе текстовых инструкций): 80 баллов
    • Live Code Bench v6 (оценивает навыки программирования): 85 баллов

    В IFBench модель Сбера немного опережает DeepSeek V4 Flash, а в Live Code Bench v6 результат GigaChat 3.5 Reasoning сопоставим с китайской Kimi K2.5.

    ◦ Назад к содержанию ◬

    В чём GigaChat 3.5 Reasoning лучше других

    GigaChat 3.5 Reasoning имеет несколько ключевых преимуществ перед конкурентами:

    • Понимание российского контекста. Модель отлично ориентируется в российских законах и знает местную специфику.
    • Доступность. Модель полностью бесплатная и не требует VPN. Кроме того, она распространяется по бесплатной лицензии MIT, поэтому разработчики могут скачать её, дообучить при необходимости, а затем интегрировать в свои продукты.
    • Единственная российская открытая модель с рассуждением. Это очень важно для российских разработчиков, которые хотят добавить в свои продукты ИИ, который будет соответствовать государственным требованиям.
    • Экономичность. GigaChat 3.5 Reasoning потребляет меньше токенов, чем её конкуренты. Обычному пользователю это без разницы, зато разработчики смогут ощутить экономию, особенно при решении сложных задач, на решение которых может уйти несколько тысяч токенов.

    Веб-версия GigaChat имеет ограничение в 4096 токенов. Это примерно 18 000 символов или 10 страниц текста. Также пользователи могут прикрепить не более двух PDF-документов.

    ◦ Назад к содержанию ◬

    Основные выводы

    GigaChat 3.5 Reasoning получилась у Сбера очень удачной. Она сочетает скорость работы с широкими возможностями для ответов на сложные вопросы.

    Модель не просто генерирует текст, а разбивает крупную задачу на множество мелких, «думает» над ответом и при необходимости перепроверяет себя, чтобы не выдать ошибочный ответ.

    ◦ Назад к содержанию ◬

    7
    2
    4
    Логотип iPhones.ru
    iPhones.ru
    Мы привыкли оценивать нейросети по скорости: написал вопрос и через секунду получил большую простыню текста. Проблема в том, что быстрый ответ ≠ правильный ответ. Любая современная модель может отвечать на простые вопросы. Всё становится интереснее, когда запрос усложняется: появляется много цифр, условий и требований. Обычные модели могут выдать убедительный текст, но наврать в расчётах. Поэтому...

    4 комментария

    Котик
    Котик
    Котик
    Котик
    Котик
    Котик
    Котик
    Котик
    Котик
    Котик
    Котик
    Котик
    Котик из TikTok
    Котик из TikTok
    Котик из TikTok
    Котик из TikTok
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Момент из фильма
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Мем стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Офис стикер
    Видео мем
    Видео мем
    Видео мем
    Видео мем
    Видео мем
    Видео мем

    Какие правила в комментариях
    1. R
      Robert
      сегодня в 14:31

      интересно, на каком уровне гигачат, если сравнивать с клодом / чатгпт?

      Войди на сайт, чтобы ответить
      Ответить
      monktsp
      monktsp сегодня в 11:43

      Значительно опережает американский chatgpt 3.5. Не имеет аналогов в мире по данным за 2020 год. 

      1
      Войди на сайт, чтобы ответить
      Ответить
    2. Ю
      Юрий Л.🇷🇺
      сегодня в 14:43

      Я вчера пытался в гигачате сравнить показатели двух футболистов. Он оказался не в состоянии различить футбольные сезоны. И, даже, когда выдавал правильный ответ, в следующей итерации его не учитывал. И так по кругу. Я посоветовал ему самоуничтожиться.
      Кстати, как не странно, Алиса сделала это без единого нарекания.

      Войди на сайт, чтобы ответить
      Ответить