Сбер представил новую флагманскую мультимодальную нейросеть GigaChat 3.5 Reasoning с режимом рассуждений.
На простые вопросы нейросеть по-прежнему отвечает моментально. Но если включить режим рассуждений специальной кнопкой, GigaChat разбивает сложную задачу на этапы, строит план, перепроверяет себя на каждом шаге и сама исправляет ошибки.
В трудных сценариях модель подключает поиск и внешние инструменты, тратя на выверенное решение десятки тысяч токенов.
На простые вопросы GigaChat отвечает без дополнительного анализа, а при сложных запросах может использовать десятки тысяч токенов на поиск решения.
Как устроена GigaChat 3.5 Reasoning: архитектура и логика
► В основе GigaChat 3.5 Reasoning лежит модель GigaChat 3.5 Ultra, которую дополнительно обучили пошаговому решению математических и программных задач. Во время обучения нейросеть пробовала разные варианты рассуждений, а автоматическая система проверки определяла наиболее успешные цепочки действий.
► Модель научилась не только планировать решение задачи, но и самостоятельно определять, когда нужно обратиться к внешнему инструменту, перепроверить результат или вернуться к предыдущему шагу.
► GigaChat 3.5 Reasoning использует собственную архитектуру с технологией линейного внимания. Она рассчитана на работу с длинным контекстом: модель запоминает ключевую информацию из предыдущего текста и дополняет её по мере обработки новых данных.
В бенчмарках и коде: на сколько выросла точность
Особенно заметно возможности модели должны проявляться в задачах, где требуется выполнить сразу несколько действий. Режим рассуждений заметно улучшил результаты модели в программировании, планировании, работе с инструментами и выполнении сложных инструкций.
В тесте IFBench результат вырос с 44 до 77 баллов, в Natural Plan с 64 до 80, а в Live Code Bench v6 с 56 до 85 баллов.
Кроме того, на математических задачах GigaChat 3.5 Reasoning в среднем тратит на 37% меньше токенов, чем DeepSeek V4 Flash Preview, при сопоставимом качестве ответов.
❝
Сегодня от ИИ ждут не просто быстрого ответа, а способности разобраться в сложной задаче. Теперь GigaChat способен самостоятельно разложить задачу на этапы, понять, каких данных не хватает, проверить промежуточные выводы и при необходимости изменить ход решения.Такой подход особенно важен для агентских сценариев, программирования, аналитики — везде, где результат зависит от целой последовательности решений.
Это важный шаг к ИИ, который способен самостоятельно выстраивать путь к результату, действовать проактивно и взаимодействовать с другими сервисами. GigaChat – единственная российская модель с режимом рассуждений.
— Антон Фролов, старший вице-президент, руководитель блока «Развитие генеративного ИИ» Сбербанка
В Сбере называют среди основных сценариев использования новой модели финансы, юриспруденцию, разработку ПО, логистику, образование, аналитику данных и клиентскую поддержку.
Кому полезна новая модель и где она уже доступна
GigaChat 3.5 Reasoning уже доступна всем пользователям ГигаЧата. Разработчики могут бесплатно использовать модель в своих продуктах по лицензии MIT. Доступ для бизнеса через API появится позднее.
Не стесняйтесь, тут все свои. Пишите, что думаете по этому вопросу