商机榜单 / 档案 O-0815
为llama.cpp添加将MoE模型的非共享专家卸载到SSD、由CPU执行的能力,缓解RAM昂贵与模型膨胀带来的内存压力,保留GPU VRAM用于其他权重与KV cache
首次发现 2026-07-23 · 最近更新 2026-07-23 · 每日重算
趋势因子 ×1.0(上限 2.0)。
原帖标题:Possible to load non shared experts to SSD in llama.cpp?
I know llama.cpp can use -cmoe switch to load non …
我知道 llama.cpp 可以使用 -cmoe 开关将 MoE 模型中的非共享专家加载到 RAM …
公开层仅保留极短引用;请打开原帖核对完整语境。
跟进这条商机的后续变化
1 条证据逐条可追溯 · 免费开放 · 有效变化写进每周周报
评分口径摘要
证据置信度 = 强度 × 证据量 × 来源多样性 × 付费 × 竞争 × 趋势 × 10。所有计数基于独立内容条目(同一帖子多条信号只计 1 条);仅"亲身痛点 / 当前支出 / 明确愿付 / 功能请求"四类一手证据计入;同一作者的重复内容按 0.15 权重折价计入评分,刷屏抬不了分;评分与状态晋级由确定性代码完成。
⚠ "证据充分"表示问题真实、反复、有人花钱;不是"值得创业"的判断。完整规则见 方法与可信度。