Домой Новости NVIDIA представила компактные ИИ-системы DGX Spark на 64 ГБ

NVIDIA представила компактные ИИ-системы DGX Spark на 64 ГБ

NVIDIA расширяет линейку локальных ИИ-систем: новая конфигурация DGX Spark с 64 ГБ памяти обеспечит разработчикам мощные возможности для работы с моделями без облаков.

1
0

Развитие локальных ИИ-вычислений: NVIDIA DGX Spark

По мере того как ИИ-агенты переходят из стадии экспериментов в повседневную разработку, всё более производительные открытые модели адаптируются для работы на локальных устройствах. В октябре 2026 года NVIDIA представит новую конфигурацию DGX Spark с 64 ГБ объединенной памяти, которая будет доступна через партнерскую сеть производителей, включающую Acer, ASUS, Dell, Gigabyte, HP и MSI. Разработчики, исследователи и энтузиасты получат готовое решение с предустановленной ОС DGX и программным стеком NVIDIA AI, позволяющее запускать функциональных локальных агентов конфиденциально, без зависимости от облачных сервисов.

Система NVIDIA DGX Spark
NVIDIA представила компактные ИИ-системы DGX Spark на 64 ГБ — иллюстрация к материалу.
YouTube

Новый стандарт персональных ИИ-суперкомпьютеров

Система DGX Spark объединяет в себе вычислительные возможности NVIDIA Grace Blackwell, унифицированную память, сетевые адаптеры NVIDIA ConnectX-7 и программный стек с поддержкой CUDA. Это полноценная локальная платформа для работы с агентами, инференса, дообучения моделей, анализа данных и разработки на периферийных устройствах. Компактный ИИ-суперкомпьютер позволяет проводить эксперименты с моделями и собственными данными пользователя без необходимости обращения к облачным инстансам для каждой задачи.

Конфигурация с 64 ГБ памяти сохраняет ключевые преимущества модели со 128 ГБ: наличие суперчипа GB10 Grace Blackwell, использование DGX OS и полный набор ПО NVIDIA. Система обеспечивает поддержку моделей объемом до 100 миллиардов параметров и соответствующих агентных приложений локально. При кластеризации двух устройств объемом 64 ГБ преимущества выходят за рамки простого удвоения памяти. Согласно внутренним тестам NVIDIA с использованием модели Qwen 3.8 27B, два соединенных узла демонстрируют до 1,7-кратного прироста производительности по сравнению с одиночной системой.

DGX Spark поставляется с поддержкой NVIDIA Agent Toolkit, библиотек CUDA-X AI, открытых моделей Nemotron, а также популярных сред исполнения, таких как Ollama, vLLM и PyTorch с CUDA. Разработчики могут приступить к запуску моделей через несколько минут после включения. Программа Blender также войдет в число первых крупных инструментов для авторов контента с поддержкой этой платформы, для которой в скором времени будет выпущен готовый установщик.

Масштабирование с помощью NVIDIA Sync Cluster Assistant

Разработчики могут начать работу с необходимого объема памяти, а по мере роста сложности проектов — объединять устройства в многоузловые кластеры. В каждый DGX Spark встроен контроллер NVIDIA ConnectX-7. Два устройства можно соединить напрямую кабелем QSFP, расширив общий объем памяти до 128 ГБ, что позволяет запускать модели объемом до 200 миллиардов параметров, удваивая пропускную способность памяти и повышая производительность до 1,7 раз.

Приложение NVIDIA Sync обеспечивает настройку кластера: функция Cluster Assistant автоматически обнаруживает устройства, проверяет конфигурацию и настраивает сеть ConnectX-7. Поскольку на каждом узле используется идентичный стек ПО NVIDIA, при масштабировании не требуется дополнительная перенастройка. В конце месяца выйдет NVIDIA Sync Model Launcher, который максимально упростит запуск локального ИИ: пользователи смогут загружать и запускать модель Qwen3.8 27B на одном устройстве или кластере всего несколькими кликами, обеспечивая доступ к ней прямо с ноутбука. Инструмент также автоматически настроит OpenCode для написания кода в браузере.

Варианты использования и доступность

Новая конфигурация DGX Spark 64 ГБ поддерживает широкий спектр практических задач. Разработчики могут использовать одну систему для моделей, соответствующих объему памяти, или связывать несколько узлов через NVIDIA Sync Cluster Assistant. Продажи устройств от Acer, ASUS, Dell, Gigabyte, HP и MSI стартуют 23 октября по цене от 4 999 долларов.

Пользователи могут изучить рабочие сценарии на портале build.nvidia.com/spark. В ближайшее время для устройств с 64 ГБ памяти станут доступны новые решения, включая модель Alibaba Qwen-Image-2.1. Эта модель с открытыми весами поддерживает генерацию и редактирование изображений и оптимизирована для локальной работы на графических процессорах NVIDIA RTX, DGX Spark и DGX Station.

Новая точка отсчета для персональных ИИ-суперкомпьютеров

Система DGX Spark объединяет в себе вычислительные мощности NVIDIA Grace Blackwell, унифицированную память, сетевые адаптеры NVIDIA ConnectX-7 и программный стек NVIDIA с ускорением CUDA в едином решении. Это полноценная локальная ИИ-платформа, предназначенная для работы с агентами, инференсом, тонкой настройкой моделей, анализом данных и разработкой для периферийных вычислений. Компактный персональный суперкомпьютер позволяет экспериментировать с моделями и собственными данными разработчиков без необходимости использовать облачные инстанции для каждой задачи.

Новая конфигурация с 64 ГБ памяти, доступная эксклюзивно у партнеров-производителей, делает платформу более доступной по цене, сохраняя при этом суперчип GB10 Grace Blackwell, ОС DGX и полный стек ПО NVIDIA, аналогичный 128-гигабайтной версии. Система поддерживает работу с моделями до 100 миллиардов параметров и построенными на их основе агентными приложениями полностью на устройстве. При объединении двух 64-гигабайтных модулей в кластер через NVIDIA Sync Cluster Assistant происходит не только удвоение объема памяти. Согласно тестам NVIDIA с использованием модели Qwen 3.8 27B, связка из двух систем показала рост производительности до 1,7 раза по сравнению с одним устройством, при этом сохраняется потенциал для дальнейшего масштабирования.

Готовность к разработке и поддержке приложений

DGX Spark готова к созданию агентов с первого дня: заявлена полная поддержка NVIDIA Agent Toolkit, библиотек CUDA-X AI, открытых моделей Nemotron и популярных сред выполнения, таких как Ollama, vLLM и PyTorch с поддержкой CUDA. Разработчики могут начать запуск моделей спустя всего несколько минут после включения питания. Среди первых крупных разработчиков ПО, обеспечивших поддержку платформы, значится компания Blender — в ближайшее время будет выпущен предустановленный загрузчик для этого приложения.

Масштабирование с помощью NVIDIA Sync Cluster Assistant

Разработчики могут начинать работу с тем объемом памяти, который необходим для текущих проектов, расширяя платформу по мере роста их конвейеров. Каждая система DGX Spark оснащена встроенным сетевым адаптером NVIDIA ConnectX-7. Два устройства могут быть соединены напрямую кабелем QSFP, что объединяет их память до 128 ГБ и расширяет поддержку моделей до 200 миллиардов параметров, обеспечивая при этом двукратное увеличение пропускной способности памяти и прирост производительности до 1,7 раза.

Приложение NVIDIA Sync позволяет бесшовно настроить многоузловой кластер. Функция кластерного помощника автоматически обнаруживает подключенные устройства, проверяет конфигурацию и настраивает сеть ConnectX-7, освобождая разработчиков от ручного управления инфраструктурой. Поскольку на каждом узле используется идентичный программный стек NVIDIA, при масштабировании с одного устройства до двух переконфигурация не требуется. В конце месяца выйдет NVIDIA Sync Model Launcher, который упростит запуск локального ИИ до нажатия нескольких кнопок. Инструмент позволит загрузить и запустить Qwen3.8 27B на одной системе или кластере, обеспечивая доступ к ней с ноутбуков пользователей, а также настроит OpenCode для использования модели прямо в браузере.

Варианты использования DGX Spark для разработчиков

Конфигурация DGX Spark 64 ГБ поддерживает практическую работу сразу после приобретения. Доступно три типичных сценария использования:

  • Круглосуточная работа ИИ-агента: запуск исследовательского или программного агента для анализа кода, документов или выполнения многоэтапных задач. Кластер предоставляет дополнительные мощности для более крупных моделей, длинных контекстных окон или работы нескольких агентов одновременно.
  • Поддержка ИИ-приложений для повседневного ПК: выполнение инференса языковых или генеративных моделей на DGX Spark, пока основной ноутбук или рабочий стол свободен для других задач.
  • Масштабирование при росте нагрузки: когда задача требует больших мощностей, две системы DGX Spark 64 ГБ объединяются через 200 GbE fabric посредством NVIDIA Sync Cluster Assistant, предоставляя 128 ГБ общей памяти без смены среды разработки.

Система DGX Spark 64 ГБ поступит в продажу в пятницу, 23 октября, у компаний Acer, ASUS, Dell, Gigabyte, HP и MSI по цене от 4 999 долларов. Для начала работы необходимо загрузить поддерживаемую среду инференса (llama.cpp, Ollama, vLLM или LM Studio), скачать рекомендуемую локальную модель и при необходимости масштабирования соединить порты NVIDIA ConnectX-7, запустив NVIDIA Sync Cluster Assistant для автоматической маршрутизации нагрузки.

Новые сценарии использования и возможности генерации изображений

В ближайшее время для устройств с 64 ГБ оперативной памяти станут доступны следующие руководства (playbooks):

  • Развертывание больших языковых моделей (LLM) с помощью vLLM.
  • Запуск OpenClaw с использованием локальной LLM.
  • Подключение нескольких систем DGX Spark для выполнения распределенных рабочих нагрузок.

Модель Qwen-Image-2.1 от компании Alibaba объединяет функции генерации и редактирования изображений в едином легковесном решении с открытыми весами.

Данная модель способна работать локально на графических процессорах NVIDIA RTX, а также на системах DGX Spark и DGX Station. Это предоставляет создателям контента дополнительные возможности для генерации и детальной обработки изображений непосредственно на собственном аппаратном обеспечении.

Практические рекомендации по началу работы

Для того чтобы максимально быстро приступить к эксплуатации DGX Spark, пользователям предлагается воспользоваться следующей инструкцией:

  • Загрузка инфраструктуры: Выберите и установите одну из поддерживаемых сред инференса — llama.cpp, Ollama, vLLM или LM Studio.
  • Подбор моделей: Скачайте рекомендуемую локальную модель, соответствующую вашему текущему рабочему процессу.
  • Настройка кластера: В случае необходимости масштабирования до двух узлов, соедините их через порты NVIDIA ConnectX-7. После запуска приложения NVIDIA Sync Cluster Assistant система автоматически выполнит конфигурацию сети и настроит маршрутизацию рабочих нагрузок.

Дополнительные сценарии (Playbooks)

На портале build.nvidia.com/spark NVIDIA публикует специализированные руководства (playbooks), которые помогают разработчикам эффективнее использовать возможности DGX Spark. В ближайшее время для устройств в конфигурации 64 ГБ станут доступны следующие материалы:

  • Serve LLMs With vLLM: Руководство по эффективному обслуживанию больших языковых моделей.
  • Run OpenClaw With a Local LLM: Инструкция по запуску OpenClaw с использованием локальной LLM.
  • Connect Multiple DGX Sparks for Distributed Workloads: Технические рекомендации по объединению нескольких систем для выполнения распределенных вычислений.
Источник: https://www.techpowerup.com