USD/RUB
EUR/RUB
EUR/USD
Золото ₽/oz
Серебро ₽/oz

Технологии

Пользователю удалось запустить 27B языковых моделей, превратив видеокарту NVIDIA Tesla V100 в игровой компьютер

Кратко

  • Подробности в наших новостях.
  • Для запуска высококачественных языковых моделей требуется, чтобы видеокарта имела большой объем видеопамяти (VRAM).
  • Владелец RTX 4080 понял, что его система, на которой легко можно играть в современные игры, недостаточна для больших языковых моделей (LLM), и сделал интересную модификацию.
  • Пользователю удалось добиться как игровой производительности, так и производительности искусственного интеллекта, интегрировав видеокарту NVIDIA Tesla V100 в свой игровой компьютер.

Пользователю удалось запустить 27B языковых моделей, превратив видеокарту NVIDIA Tesla V100 в игровой компьютер. Подробности в наших новостях. Для запуска высококачественных языковых моделей требуется, чтобы видеокарта имела большой объем видеопамяти (VRAM).

Владелец RTX 4080 понял, что его система, на которой легко можно играть в современные игры, недостаточна для больших языковых моделей (LLM), и сделал интересную модификацию. Пользователю удалось добиться как игровой производительности, так и производительности искусственного интеллекта, интегрировав видеокарту NVIDIA Tesla V100 в свой игровой компьютер. Технические трудности, возникшие в этом процессе, были преодолены с помощью специальных адаптеров и решений для охлаждения.

Для подключения платы Tesla V100 к стандартной материнской плате для настольных ПК потребовалось использование адаптера-преобразователя SXM2-PCIe. Эта установка, общая стоимость которой составила около 266 долларов США, позволила включить в систему карту с памятью HBM2 объемом 16 ГБ. Tesla V100 выделяется своими 5120 ядрами CUDA и 4096-битной шиной, обеспечивающей пропускную способность 900 ГБ/с. Отсутствие видеовыхода или стандартного подключения питания PCIe на карте потребовало от моддера дополнительных усилий на этапе установки.

Высокий уровень шума системы охлаждения в 82 дБ контролировался с помощью батареи 9 В и перемычки ШИМ. Скорость вентилятора была снижена до 10 процентов от исходного максимального значения, что обеспечило более тихую работу системы. Общий объем видеопамяти объемом 32 ГБ, добавленный в систему, обеспечил необходимое пространство для запуска таких моделей, как Qwen3.6 27B. Модель, занимающая 19 ГБ на уровне квантования Q5_K_M, может работать со скоростью 32 токена в секунду с размером контекста 128 тыс. токенов.

Скорость обработки транзакций варьируется от 133 до 160 токенов в секунду. Эта установка предлагает локальную рабочую среду искусственного интеллекта, не требующую подключения к Интернету, по цене менее 300 долларов США.

Источник: ShiftDelete

Самое читаемое в категории