USD/CNY
EUR/USD
USD/JPY
黄金 ¥/oz
白银 ¥/oz

科技

某用户将NVIDIA Tesla V100显卡改装成游戏电脑,成功运行27B语言模型

一位用户通过将NVIDIA Tesla V100显卡改装成游戏电脑,成功运行27B语言模型。详情请见我们的新闻。运行高质量的语言模型需要显卡具有大视频内存 (VRAM)。 一位 RTX 4080 用户意识到他的系统可以轻松玩现代游戏,但不足以支持大型语言模型 (LLM),并进行了有趣的修改。用户通过将 NVIDIA Tesla V100 显卡集成到游戏计算机中,成功实现了游戏和人工智能性能。通过特殊的适配器和冷却解决方案克服了这一过程中遇到的技术困难。 将 Tesla V100 板连接到标准台式机主板需要使用 SXM2-PC Ie 转换器适配器。此次安装总共花费约 266 美元,使具有 16GB HBM2 内存的卡能够包含在系统中。 Tesla V100 以其 5,120 个 CUDA 核心和 4,096 位总线提供 900GB/s 带宽而脱颖而出。 该卡上缺少视频输出或标准 PC Ie 电源连接,需要改装者在安装阶段付出额外的努力。冷却系统产生的 82dB 高噪音水平是通过使用 9V 电池和 PWM 跳线来控制的。风扇速度降低至原始最大值的 10%,确保系统更安静地运行。 添加到系统中的 32GB 总 VRAM 为运行 Qwen3.6 27B 等型号提供了必要的空间。该模型在 Q5_K_M 量化级别占用 19GB,可以以每秒 32 个令牌的速度运行,上下文大小为 128K 个令牌。交易处理速率在每秒 133 到 160 个代币之间变化。此设置提供了不需要互联网连接的本地 AI 工作环境,价格低于 300 美元。.

来源: ShiftDelete

本分类热读