智己的周视视觉服务器基本搞定,昨天把大模型(qwen3.6 35b a3b moe)装好有点问题先能用CPU跑只有12Token每秒,今天搞定了GPU算力,原来CUDA版本兼容问题,现在32token每秒,这玩意儿有专门用来处理视频的硬件,等我研究研究







智己的周视视觉服务器基本搞定,昨天把大模型(qwen3.6 35b a3b moe)装好有点问题先能用CPU跑只有12Token每秒,今天搞定了GPU算力,原来CUDA版本兼容问题,现在32token每秒,这玩意儿有专门用来处理视频的硬件,等我研究研究






