Сбер запустил GigaChat 3.5 Reasoning: флагман научился думать пошагово — рост в кодинге и планировании
В начале сентября 2026 года Сбер выпустил GigaChat 3.5 Reasoning — версию флагманской модели с режимом поэтапных рассуждений (Chain-of-Thought). Модель самостоятельно определяет, когда нужно «притормозить» и проверить промежуточный результат. В бенчмарках зафиксирован существенный рост по кодингу, математике и работе с внешними инструментами.
Сентябрь 2026 года. Сбер представил GigaChat 3.5 Reasoning — это не новая базовая модель, а надстройка над GigaChat 3.5 Ultra, специально дообученная для поэтапного решения сложных задач.
Что такое GigaChat 3.5 Reasoning: ``` Основа: GigaChat 3.5 Ultra (июль 2026) → Гибридная архитектура, линейное внимание → На 40% компактнее предшественника → Снижение расхода памяти на длинном контексте
Что добавил Reasoning: → Дообучение на цепочках рассуждений → Модель сама решает: думать «медленно» или отвечать «быстро» → Умеет откатиться к предыдущему шагу при обнаружении ошибки → Chain-of-Thought интегрирован «под капотом» (пользователь видит только финальный ответ) ```
Результаты бенчмарков GigaChat 3.5 Reasoning: ``` По данным Сбера (внутренние тесты):
Кодинг (HumanEval-RU): +31% к GigaChat 3.5 Ultra Математика (RuMath): +28% к GigaChat 3.5 Ultra Планирование (AgentBench): +44% к GigaChat 3.5 Ultra Инструменты (Tool-RU): +38% к GigaChat 3.5 Ultra
Сравнение с конкурентами (MERA benchmark): GigaChat 3.5 Reasoning: ~2–3 место Alice AI LLM Pro: ~2 место GigaChat 3.1 Ultra: 1 место (общий рейтинг) T-Pro: ~4 место
Reasoning укрепляет позиции Сбера в задачах, требующих многошагового мышления ```
Как работает пошаговое мышление: ``` Пример: математическая задача
Типичный режим (без Reasoning): Вопрос → Ответ (быстро, но с ошибками)
Reasoning режим: Вопрос: «Сколько дней в 3 кварталах 2026 года?»
[Внутреннее рассуждение — не видно юзеру]: Q1: январь (31) + февраль (28) + март (31) = 90 Q2: апрель (30) + май (31) + июнь (30) = 91 Q3: июль (31) + август (31) + сентябрь (30) = 92 Итого: 90 + 91 + 92 = 273 [Проверка: 273 / 3 = 91 — среднее, верно]
Ответ (пользователю): «273 дня"
Точность с Reasoning выше в 1.5-2x на многошаговых задачах ```
Доступность и стоимость: ``` Доступно: → GigaChat (веб/приложение): бесплатно + в Plus → API (GigaChat Pro API): с доплатой за Reasoning → GigaChat 3.5 Reasoning API: ~в 2.5x дороже GigaChat 3.5 Ultra → Корпоративный доступ: через Sber Cloud
Limitations: → Скорость ответа ниже (нужно «думать») → Оптимально: сложные задачи, не чат → Не заменяет GigaChat 3.5 Ultra для быстрых массовых запросов ```
Практика для B2B: GigaChat 3.5 Reasoning подходит для задач финансового анализа, юридической экспертизы документов, сложного планирования проектов. Данные обрабатываются в российской инфраструктуре Сбера — соответствие 152-ФЗ обеспечено. DPO и IT-директорам: обновите политику использования GigaChat в компании с учётом новых возможностей.
Это краткое изложение. Полный текст статьи доступен на сайте источника:
Читать полностью на www1.ru / iXBTЕщё по теме технологии
МТС первой в России добавила ИИ-тезисы телефонных разговоров в историю звонков приложения «Мой МТС»
Alice AI LLM в MERA бенчмарке: сентябрь 2026 — позиции Яндекса в эпоху после ребрендинга YandexGPT
Т-Банк запустил Таю: персональный AI-ассистент для управления финансами с голосовым интерфейсом
Решения AXIOMA AI по теме статьи
Хотите узнать, как это применимо к вашему бизнесу?
Рассчитаем ROI от AI за 60 минут. Покажем конкретные метрики для вашей отрасли.
