站内搜索「上下文」共 103 条结果

推荐模型
Google Gemma 4 12B - 无编码器多模态大模型Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
3个月前

推荐模型
Unlimited-OCR - 百度开源一次性长文档OCR解析模型百度出品,基于DeepSeek-OCR改进,支持一次性解析超长文档、多页PDF,单图640切片+多页1024两种模式,SGLang部署兼容OpenAI API
3个月前

推荐模型
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 MaxQwen3.6-27B正统后继:原生多模态+混合线性注意力架构,262K上下文,终端编程基准超Opus 4.6 Max,Apache 2.0可商用,量化后16GB内存可跑
1个月前

推荐程序员
DwarfStar 4 — DeepSeek V4 Flash 本地推理引擎antirez新作:DeepSeek V4 Flash的Metal/CUDA原生推理引擎,2-bit量化128GB Mac跑百万token上下文
4个月前

推荐教程
Codex 桌面版一键切换 OpenAI / DeepSeek / Qwen:3 个图标与自动压缩配置Windows 版 Codex 通过桌面图标切换 OpenAI、DeepSeek、本地 Qwen,并为不同上下文窗口设置独立自动压缩阈值。
1个月前

推荐软件
Memmy:让所有 AI 共享同一份记忆的本地记忆中枢Claude Code、Codex、Cursor、Hermes 等 Agent 共享本地记忆,换工具不丢上下文,MIT 开源,附桌面宠物 UI
19天前

推荐程序员
NInfer - 只认RTX 5090的Qwen3.8-27B极限推理引擎(从零手搓CUDA,单卡并发破千tok/s)从零手搓的C++/CUDA推理引擎,只认RTX 5090一张卡:Qwen3.8-27B八路并发767 tok/s、AIME双96.7%不掉点,240K上下文还能看图看视频,5090党的天花板玩法。
8天前

推荐模型
Basic Memory - MCP原生的AI知识图谱记忆系统Markdown文件做记忆载体,AI和人类双向读写,知识图谱+语义搜索,Claude/Codex/Cursor/Hermes全平台支持
3个月前

推荐模型
Honcho - AI Agent 推理优先的记忆基础设施Agent记忆不是存文本块做匹配,而是从对话中提取结论,持续理解用户和Agent。支持MCP集成Claude Code/OpenCode/Hermes等,托管或自托管。
3个月前










