应用介绍
DeepSeek、Qwen、GLM 这类开放权重的大模型动辄几百 GB,本地跑要么显存不够,要么慢得没法用。FreeToken 把数据中心级的模型推理带到桌面电脑上,专门优化混合专家模型在消费级硬件上的运行。
它按需加载专家权重,结合 KV 缓存和专家缓存管理显存与内存,提供带用量统计的桌面控制台和兼容接口,一个月下来还能看到省了多少 API 费用。
超大模型:DeepSeek、Qwen、GLM 等。
MoE 优化:专家按需加载。
缓存管理:KV 与专家缓存可调。
桌面控制台:运行状态与用量。
本地 API:供其他应用调用。
它按需加载专家权重,结合 KV 缓存和专家缓存管理显存与内存,提供带用量统计的桌面控制台和兼容接口,一个月下来还能看到省了多少 API 费用。
软件功能
超大模型:DeepSeek、Qwen、GLM 等。
MoE 优化:专家按需加载。
缓存管理:KV 与专家缓存可调。
桌面控制台:运行状态与用量。
本地 API:供其他应用调用。

