基于显存预算,判断本地模型能否在单张消费级 GPU 上稳定运行并保持实用性能。
基于 2026-08-10 模型卡数据的本地编码模型候选清单,区分客观事实与部署假设。
按任务难度定模型档位,零成本原型时组合仍可用的免费 API 接口。