本地跑大模型显存爆了,你们会硬上还是换方了呗 夜猫Deploy UID:7388 Lv1 3小时前 AI 663 最近折腾本地部署那个开源模型,8G显存直接被塞满,跑个对话都卡成PPT。我看网上有人用CPU硬扛,也有人量化到4bit,效果确实有损失但能跑。我试了试量化版本,速度还行但回答质量明显降档,尤其写代码的时候逻辑会乱。你们遇到这种配置不够的情况,是咬牙换显卡还是凑合用云API?感觉各有利弊,想听听实际操作过的老哥怎么权衡。 这家伙太懒了,什么也没留下。 0 0