Перейти к основному содержимому
Все новости
Рынок AI

NVIDIA выпустила Nemotron 3 Nano Omni — открытая мультимодальная модель с 9х throughput для AI-агентов

NVIDIA выпустила Nemotron 3 Nano Omni — открытая мультимодальная модель с 9х throughput для AI-агентов
9x
throughput vs open-моделей

NVIDIA представила 28 апреля 2026 года Nemotron 3 Nano Omni — открытую мультимодальную модель 30B-A3B MoE, объединяющую текст, изображения, звук, видео и документы в одной системе. Заявлен 9х throughput по сравнению с другими open-моделями. Доступна на Hugging Face, AWS SageMaker и build.nvidia.com.

NVIDIA официально анонсировала Nemotron 3 Nano Omni — flagman новой линейки открытых мультимодальных моделей для enterprise AI-агентов.

Архитектура:

  • 30B-A3B hybrid MoE (Mixture of Experts) — активирует 3B параметров на запрос
  • Conv3D + EVS (Efficient Video Sampling) для real-time видео
  • 256K контекст — для длинных документов и аудио-стримов
  • Унифицированная обработка: текст, изображения, аудио, видео, графики, GUI, документы

Производительность:

  • 9x higher throughput по сравнению с другими open omni-моделями
  • Топ-1 на 6 leaderboards: complex document intelligence, video understanding, audio understanding, charts, OCR, GUI navigation
  • Inference cost — $0.20 за 1M входных токенов (на ~50% дешевле GPT-5.5 mini)

Доступность (с 28 апреля):

  • Hugging Face — открытые веса, лицензия NVIDIA Open Model License (commercial-friendly)
  • OpenRouter — pay-per-token API
  • build.nvidia.com — managed inference
  • AWS SageMaker JumpStart — one-click deploy
  • 25+ partner platforms

Enterprise-адопторы (анонс):

  • Уже внедряют: Aible, Applied Scientific Intelligence (ASI), Eka Care, Foxconn, H Company, Palantir, Pyler
  • Тестируют: Dell Technologies, Docusign, Infosys, Oracle, Zefr, Lila

Что это значит для рынка:

  • Open-source mit closed-source гонка: Nemotron 3 Nano Omni — первая открытая модель, обходящая GPT-5o и Gemini 3.1 Pro по multimodal benchmarks
  • Self-hosted AI становится реалистичным для enterprise — модель работает на 4× H100 (доступно on-prem)
  • Российский контекст: для 152-ФЗ-чувствительных операторов это критически важно — Nemotron можно развернуть в российском дата-центре без передачи ПДн в зарубежные API. Поддержка русского языка из коробки (хотя качество ниже YandexGPT/GigaChat).

Рекомендация для CTO: Провести pilot Nemotron 3 Nano Omni для сценариев document intelligence (распознавание сканов, multimodal RAG) и сравнить с YandexGPT Vision на русскоязычной выборке. Для compliance-чувствительных задач — Nemotron на on-prem GPU = единственный legal-путь к state-of-the-art multimodal AI.

Это краткое изложение. Полный текст статьи доступен на сайте источника:

Читать полностью на NVIDIA Developer Blog

Хотите узнать, как это применимо к вашему бизнесу?

Рассчитаем ROI от AI за 60 минут. Покажем конкретные метрики для вашей отрасли.