Перейти к основному содержимому
AXIOMA AI
Все новости ИИ в России
Технологии

Сбер запустил GigaChat 3.5 Reasoning: флагман научился думать пошагово — рост в кодинге и планировании

Сбер запустил GigaChat 3.5 Reasoning: флагман научился думать пошагово — рост в кодинге и планировании
Технологии
+44% в планировании
GigaChat 3.5 Reasoning: Chain-of-Thought поверх 3.5 Ultra; +31% кодинг, +28% матем., +44% планирование; данные в РФ (152-ФЗ)

В начале сентября 2026 года Сбер выпустил GigaChat 3.5 Reasoning — версию флагманской модели с режимом поэтапных рассуждений (Chain-of-Thought). Модель самостоятельно определяет, когда нужно «притормозить» и проверить промежуточный результат. В бенчмарках зафиксирован существенный рост по кодингу, математике и работе с внешними инструментами.

Сентябрь 2026 года. Сбер представил GigaChat 3.5 Reasoning — это не новая базовая модель, а надстройка над GigaChat 3.5 Ultra, специально дообученная для поэтапного решения сложных задач.

Что такое GigaChat 3.5 Reasoning: ``` Основа: GigaChat 3.5 Ultra (июль 2026) → Гибридная архитектура, линейное внимание → На 40% компактнее предшественника → Снижение расхода памяти на длинном контексте

Что добавил Reasoning: → Дообучение на цепочках рассуждений → Модель сама решает: думать «медленно» или отвечать «быстро» → Умеет откатиться к предыдущему шагу при обнаружении ошибки → Chain-of-Thought интегрирован «под капотом» (пользователь видит только финальный ответ) ```

Результаты бенчмарков GigaChat 3.5 Reasoning: ``` По данным Сбера (внутренние тесты):

Кодинг (HumanEval-RU): +31% к GigaChat 3.5 Ultra Математика (RuMath): +28% к GigaChat 3.5 Ultra Планирование (AgentBench): +44% к GigaChat 3.5 Ultra Инструменты (Tool-RU): +38% к GigaChat 3.5 Ultra

Сравнение с конкурентами (MERA benchmark): GigaChat 3.5 Reasoning: ~2–3 место Alice AI LLM Pro: ~2 место GigaChat 3.1 Ultra: 1 место (общий рейтинг) T-Pro: ~4 место

Reasoning укрепляет позиции Сбера в задачах, требующих многошагового мышления ```

Как работает пошаговое мышление: ``` Пример: математическая задача

Типичный режим (без Reasoning): Вопрос → Ответ (быстро, но с ошибками)

Reasoning режим: Вопрос: «Сколько дней в 3 кварталах 2026 года?»

[Внутреннее рассуждение — не видно юзеру]: Q1: январь (31) + февраль (28) + март (31) = 90 Q2: апрель (30) + май (31) + июнь (30) = 91 Q3: июль (31) + август (31) + сентябрь (30) = 92 Итого: 90 + 91 + 92 = 273 [Проверка: 273 / 3 = 91 — среднее, верно]

Ответ (пользователю): «273 дня"

Точность с Reasoning выше в 1.5-2x на многошаговых задачах ```

Доступность и стоимость: ``` Доступно: → GigaChat (веб/приложение): бесплатно + в Plus → API (GigaChat Pro API): с доплатой за Reasoning → GigaChat 3.5 Reasoning API: ~в 2.5x дороже GigaChat 3.5 Ultra → Корпоративный доступ: через Sber Cloud

Limitations: → Скорость ответа ниже (нужно «думать») → Оптимально: сложные задачи, не чат → Не заменяет GigaChat 3.5 Ultra для быстрых массовых запросов ```

Практика для B2B: GigaChat 3.5 Reasoning подходит для задач финансового анализа, юридической экспертизы документов, сложного планирования проектов. Данные обрабатываются в российской инфраструктуре Сбера — соответствие 152-ФЗ обеспечено. DPO и IT-директорам: обновите политику использования GigaChat в компании с учётом новых возможностей.

Это краткое изложение. Полный текст статьи доступен на сайте источника:

Читать полностью на www1.ru / iXBT

Хотите узнать, как это применимо к вашему бизнесу?

Рассчитаем ROI от AI за 60 минут. Покажем конкретные метрики для вашей отрасли.