Написать в блог
Блоги
This_is_the_way

Текст опубликован в личном блоге и его автор не имеет отношения к администрации сайта

Разработка ориентирована на задачи исполнения, где агенты вызывают инструменты, проверяют результаты и выполняют команды, тогда как планирование и сложные решения остаются за большими моделями.
реклама

Нейросеть изначально адаптирована для работы в экосистеме популярных агентных платформ, включая OpenClaw и Hermes Agent. Это позволило добиться более точного взаимодействия со сторонними сервисами и снизить временные задержки при обработке рутинных запросов. Исходные коды, весовые коэффициенты и данные для дообучения распространяются по лицензии OpenMDW-1.1, а для настройки и обучения с подкреплением предусмотрена поддержка фирменного инструментария NVIDIA NeMo.

Изображение: interestingengineering.com

По данным разработчика, Nemotron 3.5 Lightning демонстрирует четырёхкратный прирост производительности по числу генерируемых токенов в секунду, в сравнении с моделями аналогичного размера. В ходе тестирования на бенчмарке PinchBench точность решения составила 86%, а скорость обработки 10 тысяч задач оказалась на 30% выше, чем у сопоставимой по качеству модели Qwen 3.6 35B. В состав решения включена поддержка спекулятивной декодизации, ускоряющей инференс благодаря предварительной генерации и последующей проверке нескольких токенов, а также две вспомогательные модели — DSpark и DFlash, адаптированные под различные сценарии нагрузки.

реклама

Модель работает на оборудовании NVIDIA (DGX Spark, Jetson, GeForce RTX 5090) и может быть развёрнута как локально, так и в центрах обработки данных. Интеграция с экосистемой включает совместимость с платформами Ollama, LM Studio, Amazon SageMaker JumpStart, Google Cloud, Microsoft Foundry и Oracle Cloud Infrastructure. Загрузка модели доступна через репозитории Hugging Face и ModelScope.

Параллельно с выпуском модели NVIDIA представила библиотеку маршрутизации NeMo Switchyard, которая динамически распределяет запросы в зависимости от их сложности: ресурсоёмкие аналитические задачи направляются на мощные модели, а рутинные операции — на Nemotron 3.5 Lightning. Это позволяет снизить вычислительные затраты и повысить эффективность работы систем, выполняющих большое количество однотипных операций в течение длительного времени.

Источник: interestingengineering.com
Теперь в новом формате

Наш Telegram-канал @overclockers_news
Подписывайся, чтобы быть в курсе всех новостей!

Популярные новости