跳到主要内容

4 篇文档带有标签「local-models」

查看所有标签

单卡本地模型

判断本地模型能否装入并在单张 8–24 GB 加速卡上保持可用的显存优先方法。

本地推理运行时

按产物兼容性、硬件路径、延迟、吞吐、可观测性与安全选择本地运行时。

本地模型评测

测量某个精确本地模型配置是否越过真实工作流阈值的可复现协议。