同一个模型有 4bit/8bit/免审版,怎么选?一句话:稠密选小、MoE 选大。附下载地址与实测速度;2026-09 补测 oMLX 引擎,修正「换引擎不会变快」的旧结论。
本地运行的AI上下文压缩工具,支持6种算法、可逆压缩、跨Agent共享记忆,零代码接入
Claude Code 插件,自动保存会话上下文并在新会话中恢复记忆