NVIDIA выпустила Nemotron 3 Nano Omni — открытая мультимодальная модель с 9х throughput для AI-агентов
NVIDIA представила 28 апреля 2026 года Nemotron 3 Nano Omni — открытую мультимодальную модель 30B-A3B MoE, объединяющую текст, изображения, звук, видео и документы в одной системе. Заявлен 9х throughput по сравнению с другими open-моделями. Доступна на Hugging Face, AWS SageMaker и build.nvidia.com.
NVIDIA официально анонсировала Nemotron 3 Nano Omni — flagman новой линейки открытых мультимодальных моделей для enterprise AI-агентов.
Архитектура:
- 30B-A3B hybrid MoE (Mixture of Experts) — активирует 3B параметров на запрос
- Conv3D + EVS (Efficient Video Sampling) для real-time видео
- 256K контекст — для длинных документов и аудио-стримов
- Унифицированная обработка: текст, изображения, аудио, видео, графики, GUI, документы
Производительность:
- 9x higher throughput по сравнению с другими open omni-моделями
- Топ-1 на 6 leaderboards: complex document intelligence, video understanding, audio understanding, charts, OCR, GUI navigation
- Inference cost — $0.20 за 1M входных токенов (на ~50% дешевле GPT-5.5 mini)
Доступность (с 28 апреля):
- Hugging Face — открытые веса, лицензия NVIDIA Open Model License (commercial-friendly)
- OpenRouter — pay-per-token API
- build.nvidia.com — managed inference
- AWS SageMaker JumpStart — one-click deploy
- 25+ partner platforms
Enterprise-адопторы (анонс):
- Уже внедряют: Aible, Applied Scientific Intelligence (ASI), Eka Care, Foxconn, H Company, Palantir, Pyler
- Тестируют: Dell Technologies, Docusign, Infosys, Oracle, Zefr, Lila
Что это значит для рынка:
- Open-source mit closed-source гонка: Nemotron 3 Nano Omni — первая открытая модель, обходящая GPT-5o и Gemini 3.1 Pro по multimodal benchmarks
- Self-hosted AI становится реалистичным для enterprise — модель работает на 4× H100 (доступно on-prem)
- Российский контекст: для 152-ФЗ-чувствительных операторов это критически важно — Nemotron можно развернуть в российском дата-центре без передачи ПДн в зарубежные API. Поддержка русского языка из коробки (хотя качество ниже YandexGPT/GigaChat).
Рекомендация для CTO: Провести pilot Nemotron 3 Nano Omni для сценариев document intelligence (распознавание сканов, multimodal RAG) и сравнить с YandexGPT Vision на русскоязычной выборке. Для compliance-чувствительных задач — Nemotron на on-prem GPU = единственный legal-путь к state-of-the-art multimodal AI.
Это краткое изложение. Полный текст статьи доступен на сайте источника:
Читать полностью на NVIDIA Developer BlogЕщё по теме рынок ai
SpaceXAI выпустил Grok 4.7: 2,1 трлн параметров, обучен на данных SpaceX, цель — к концу 2026 выйти Grok 5
Gemini 3.8 Flash за $0,75 и Muse Spark 1.3 за $1,25: Google и Meta делают frontier-качество массовым
SpaceX поглотила xAI за $250 млрд: что слияние означает для enterprise-рынка AI и регулирования
Хотите узнать, как это применимо к вашему бизнесу?
Рассчитаем ROI от AI за 60 минут. Покажем конкретные метрики для вашей отрасли.
