站内搜索「llama」共 22 条结果

推荐程序员
prompts.chat — 全球最大开源 AI Prompt 库(160k⭐)原名 Awesome ChatGPT Prompts,支持 ChatGPT/Claude/Gemini/Llama 等,可自托管,含交互式 Prompt Engineering 教程和儿童版。
5个月前

推荐模型
Happy-LLM - 从零开始构建大模型(Datawhale 开源教程)Datawhale 开源的系统性 LLM 学习教程,从 NLP 基础到动手搭建 LLaMA2,再到训练实践与 RAG/Agent 应用
5个月前

推荐软件
Unsloth Dynamic GGUF:新模型发布当天就能跑,510万人下载的量化生态闭环不只量化更是全链路:Dynamic v3.0动态精度+MTP投机解码+Flash Attention加速,llama.cpp/Ollama一键起
5天前

推荐程序员
NInfer - 只认RTX 5090的Qwen3.8-27B极限推理引擎(从零手搓CUDA,单卡并发破千tok/s)从零手搓的C++/CUDA推理引擎,只认RTX 5090一张卡:Qwen3.8-27B八路并发767 tok/s、AIME双96.7%不掉点,240K上下文还能看图看视频,5090党的天花板玩法。
8天前

推荐MacOS
Rapid-MLX - 专为 Apple Silicon 打造的极速本地 AI 引擎比 Ollama 快 4.2 倍,17 种工具调用解析器,0.08 秒首字延迟,完整兼容 OpenAI API
4个月前

推荐程序员
DwarfStar 4 — DeepSeek V4 Flash 本地推理引擎antirez新作:DeepSeek V4 Flash的Metal/CUDA原生推理引擎,2-bit量化128GB Mac跑百万token上下文
4个月前

推荐api
EchoBird - AI Agent一键安装管理桌面端AI Agent管理器,一键安装Claude Code、OpenClaw、Hermes等,统一管理模型配置,一键部署本地LLM
4个月前

推荐模型
MiniCPM-V 4.6 - 口袋级多模态大模型,手机端部署的超高效视觉语言模型OpenBMB超轻量多模态模型,SigLIP2+Qwen3.5-0.8B,AI Index 13分,三端手机部署
3个月前

推荐模型
Qwen3.8-27B 去审查版首选:OrcaRouter Uncensored十几个去审查版里口碑最干净的一版,MLX 786赞/FP8 715赞双第一,红队探针0拒绝且不变笨;附 JonathanColetti/OBLITERATUS/huihui 等6家横评
1个月前

推荐软件
GSQ-RCO:ISTA研究所的非均匀量化,11.8GB跑出BF16满分的Qwen3.8-27B学术派量化天花板:每个张量单独分配精度,同体积比Unsloth高10分,论文代码全公开可自己复刻
5天前

推荐程序员
GitHub Trending 今日热榜 (2026-05-09)AI Agent 持续霸榜:Anthropic 金融方案、DeepSeek 终端代理、隐身浏览器、全自动AI交易系统等 9 个热门项目一览
4个月前

推荐软件
Hindsight:让 agent 越用越聪明的记忆系统LongMemEval 榜单 SOTA(第三方复现背书)——仿生记忆结构:事实/经历/信念/心智模型四层,Docker 一条命令自部署,25+ LLM 提供商含全本地方案
1个月前
文档智能体入门教程
如何拥有一个自己的智能体如何拥有一个自己的智能体 本文只讨论能调用工具、自主执行的智能体(Agent),不讨论纯对话机器人。 按照难度从低到高分为三层。 --- 第一层:大厂云端智能体(开箱即用,零安装) 这一层是各大厂已经搭建好、部署在云端的智能体产品。你不需要安装任何软件,注册账号就能用。 基于 OpenClaw 的云端产品 OpenClaw(龙虾)是一个开源的自主 AI 助手框架,GitHub 地址 。国内外大厂基
5个月前

推荐模型
Bonsai 2 27B - 54GB压到5.9GB还留98%智力的三值模型(Qwen3.8-27B官方压缩,笔记本能跑满血27B推理)发布3天下载破150万!54GB的Qwen3.8-27B压到5.9GB还留98.2%智力,传统2bit崩掉的数学题它守住95分,低比特本地部署天花板。
8天前

推荐程序员
MinerU - 文档解析引擎开源文档解析引擎,OpenDataLab 出品 78k Star。PDF/Word/PPT/Excel/图片一键转 LLM 友好的 Markdown/JSON,公式转 LaTeX、表格转 HTML、跨页表格合并、109 语言 OCR;Pipeline 后端纯 CPU 可跑,VLM 后端精度 95+,另有 mineru.net 在线服务免部署
5个月前




