FreeToken

FreeToken

在普通电脑上本地运行超大MoE模型

AI官网

应用介绍

DeepSeek、Qwen、GLM 这类开放权重的大模型动辄几百 GB,本地跑要么显存不够,要么慢得没法用。FreeToken 把数据中心级的模型推理带到桌面电脑上,专门优化混合专家模型在消费级硬件上的运行。

它按需加载专家权重,结合 KV 缓存和专家缓存管理显存与内存,提供带用量统计的桌面控制台和兼容接口,一个月下来还能看到省了多少 API 费用。

软件功能



超大模型:DeepSeek、Qwen、GLM 等。

MoE 优化:专家按需加载。

缓存管理:KV 与专家缓存可调。

桌面控制台:运行状态与用量。

本地 API:供其他应用调用。

应用截图