基于海光8张Z100L算力服务器,vLLM 部署全量微调过的 qwen2.5-32B大模型。
1. 需求: 在客户提供的 8 * Z100L 算力服务器上,部署全量微调过的 qwen2.5-32B 大模型。 2. 解决...
1. 需求: 在客户提供的 8 * Z100L 算力服务器上,部署全量微调过的 qwen2.5-32B 大模型。 2. 解决...

文章浏览阅读1.5k次,点赞12次,收藏21次。曙光&宁畅&中科可控&海光服务器如何通过ipmitool工具带内带外调整风扇转速&...
文章浏览阅读1k次。本文主要介绍因服务器CPU模式不一致导致虚拟化场景下无法热迁移虚拟机问题的原因及解决方法_rdseed and rdrand control