Домой Новости ИИ Стартап из Тайваня заявил о запуске ИИ-ускорителя на «устаревших» чипах, способного локально...

Стартап из Тайваня заявил о запуске ИИ-ускорителя на «устаревших» чипах, способного локально запускать модели на 700 млрд параметров

Новинка от Skymizer использует стандартную память LPDDR и оптимизированные алгоритмы, чтобы обойтись без дорогой инфраструктуры дата-центров.

Тайваньская компания Skymizer анонсировала уникальный ИИ-ускоритель HTX301, который, по словам разработчиков, позволяет локально запускать большие языковые модели объемом до 700 млрд параметров на базе одной PCIe-карты. Примечательно, что решение не полагается на современные дорогостоящие техпроцессы или высокоскоростную память HBM, предпочитая использовать проверенные 28-нм чипы и стандартную память типов LPDDR4/LPDDR5.

Архитектурный подход Skymizer

Основной акцент в разработке HTX301 сделан не на «сырую» вычислительную мощность, а на энергоэффективность и внушительный объем памяти. Одна карта оснащена 384 ГБ памяти, распределенной между шестью специализированными чипами HyperThought HTX301. Несмотря на внушительные возможности, общее энергопотребление устройства составляет всего 240 Вт, что существенно ниже показателей флагманских ускорителей от Nvidia или AMD.

Производитель заявляет о следующих результатах производительности:

  • до 30 токенов в секунду при работе с гигантскими моделями;
  • до 240 токенов в секунду при использовании более компактных решений уровня Llama2 7B.

Эффективность достигается за счет фирменных алгоритмов сжатия весов и KV-кэша. Согласно внутренним тестам Skymizer, такой подход позволяет ускорителю обходить популярный open-source движок llama.cpp на 9–17,8%.

ИИ-ускоритель Skymizer HTX301 в серверном исполнении
Инженерный образец HTX301 Источник: ixbt.com

Преимущества для корпоративного сегмента

По мнению авторов проекта, HTX301 решает фундаментальную проблему бизнеса: избыточную зависимость от дорогостоящих GPU-кластеров. В отличие от современных ускорителей, таких как Nvidia RTX PRO 6000 Blackwell (потребляющих до 600 Вт) или AMD Instinct MI350P (использующих HBM3E), тайваньская разработка рассчитана на установку в стандартные серверные стойки с воздушным охлаждением.

Разработчики подчеркивают значимость локального инференса: компании могут запускать модели внутри собственных закрытых контуров, что гарантирует защиту от утечек данных и исключает непредсказуемые затраты на оплату облачных ИИ-сервисов.

Перспективы и ожидание тестов

Тайваньский стартап стремится доказать, что для задач вывода (инференса) ИИ-моделей архитектура памяти и методы оптимизации данных имеют большее значение, чем наращивание терафлопсов. Однако на текущий момент все озвученные характеристики опираются исключительно на данные компании.

Независимая проверка работоспособности HTX301 запланирована на международной выставке Computex 2026 в начале июня. Только реальные бенчмарки покажут, станет ли устройство доступной альтернативой рыночным гигантам или останется лишь смелой теоретической концепцией.

Источник: https://www.ixbt.com