站内搜索「27B」共 16 条结果
Qwen3.6-27B - ≤130B开源最强本地大模型
推荐模型
Qwen3.6-27B - ≤130B开源最强本地大模型
27B稠密多模态,SWE-bench 77.2碾压同级,Apple Silicon最优甜点,Apache 2.0商用免费
2个月前
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 Max
推荐模型
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 Max
Qwen3.6-27B正统后继:原生多模态+混合线性注意力架构,262K上下文,终端编程基准超Opus 4.6 Max,Apache 2.0可商用,量化后16GB内存可跑
1个月前
Qwen3.8-27B 去审查版首选:OrcaRouter Uncensored
推荐模型
Qwen3.8-27B 去审查版首选:OrcaRouter Uncensored
十几个去审查版里口碑最干净的一版,MLX 786赞/FP8 715赞双第一,红队探针0拒绝且不变笨;附 JonathanColetti/OBLITERATUS/huihui 等6家横评
1个月前
Bonsai 2 27B - 54GB压到5.9GB还留98%智力的三值模型(Qwen3.8-27B官方压缩,笔记本能跑满血27B推理)
推荐模型
Bonsai 2 27B - 54GB压到5.9GB还留98%智力的三值模型(Qwen3.8-27B官方压缩,笔记本能跑满血27B推理)
发布3天下载破150万!54GB的Qwen3.8-27B压到5.9GB还留98.2%智力,传统2bit崩掉的数学题它守住95分,低比特本地部署天花板。
8天前
M5 Max 实测 Qwen3.8-27B MLX 4bit 并发扩展性:1→32 并行全数据
推荐硬件
M5 Max 实测 Qwen3.8-27B MLX 4bit 并发扩展性:1→32 并行全数据
64GB 统一内存本地跑 27B,252 次请求零报错。低并发看响应,高并发看总量,甜蜜区在 N≤4
28天前
GSQ-RCO:ISTA研究所的非均匀量化,11.8GB跑出BF16满分的Qwen3.8-27B
推荐软件
GSQ-RCO:ISTA研究所的非均匀量化,11.8GB跑出BF16满分的Qwen3.8-27B
学术派量化天花板:每个张量单独分配精度,同体积比Unsloth高10分,论文代码全公开可自己复刻
5天前
NInfer - 只认RTX 5090的Qwen3.8-27B极限推理引擎(从零手搓CUDA,单卡并发破千tok/s)
推荐程序员
NInfer - 只认RTX 5090的Qwen3.8-27B极限推理引擎(从零手搓CUDA,单卡并发破千tok/s)
从零手搓的C++/CUDA推理引擎,只认RTX 5090一张卡:Qwen3.8-27B八路并发767 tok/s、AIME双96.7%不掉点,240K上下文还能看图看视频,5090党的天花板玩法。
8天前
Qwen3.8 微调指南(Unsloth)
推荐教程
Qwen3.8 微调指南(Unsloth)
使用 Unsloth 微调 Qwen3.8-27B 的完整教程:SFT、视觉微调、强化学习、导出
1个月前
Google Gemma 4 12B - 无编码器多模态大模型
推荐模型
Google Gemma 4 12B - 无编码器多模态大模型
Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
3个月前
本地跑顶级大模型完整攻略(2千到4万美元硬件方案)
推荐硬件
本地跑顶级大模型完整攻略(2千到4万美元硬件方案)
想自己组装机器在本地跑顶级AI大模型,不依赖任何API?这份攻略从硬件选型到系统配置到模型推荐全讲清楚了,2千美元起步。
2个月前
Qwen开源模型全家桶选购指南(3.5/3.6/3.8全系列)
推荐模型
Qwen开源模型全家桶选购指南(3.5/3.6/3.8全系列)
从0.8B到397B全覆盖,编程/视觉/推理/端侧一张表选对模型
1个月前
Unsloth Dynamic GGUF:新模型发布当天就能跑,510万人下载的量化生态闭环
推荐软件
Unsloth Dynamic GGUF:新模型发布当天就能跑,510万人下载的量化生态闭环
不只量化更是全链路:Dynamic v3.0动态精度+MTP投机解码+Flash Attention加速,llama.cpp/Ollama一键起
5天前
GitHub Trending 今日热榜 (2026-05-09)
推荐程序员
GitHub Trending 今日热榜 (2026-05-09)
AI Agent 持续霸榜:Anthropic 金融方案、DeepSeek 终端代理、隐身浏览器、全自动AI交易系统等 9 个热门项目一览
4个月前
Mac 上跑本地大模型:该选哪个版本、免审模型用哪个(附下载地址与实测速度)
推荐模型
Mac 上跑本地大模型:该选哪个版本、免审模型用哪个(附下载地址与实测速度)
同一个模型有 4bit/8bit/免审版,怎么选?一句话:稠密选小、MoE 选大。附下载地址与实测速度;2026-09 补测 oMLX 引擎,修正「换引擎不会变快」的旧结论。
7天前
NVIDIA 上跑本地大模型:一张 3090 Ti 跑 27B 免审模型(附下载地址与实测对照)
推荐模型
NVIDIA 上跑本地大模型:一张 3090 Ti 跑 27B 免审模型(附下载地址与实测对照)
一张 3090 Ti 跑 27B 免审模型:改写/翻译类比原双卡快 2.2 倍,日常对话快 32%。代价是量化从 8 位降到 4 位,且质量尚未验证。
5天前
Wan2.2-I2V-A14B - 阿里万相MoE图生视频模型
推荐模型
Wan2.2-I2V-A14B - 阿里万相MoE图生视频模型
阿里万相2.2图生视频,27B双专家MoE架构激活仅14B,支持480P/720P,电影级画质+复杂运动,Apache 2.0开源
3个月前