模型一张 3090 Ti 跑 27B 免审模型:改写/翻译类比原双卡快 2.2 倍,日常对话快 32%。代价是量化从 8 位降到 4 位,且质量尚未验证。
程序员开源界最能自己干活的AI程序员,8.8万star,issue丢给它就自己改代码跑测试,免费自托管!
MacOSLM Studio跑MLX模型的官方引擎:多轮对话缓存命中秒回、同图追问只算一次视觉编码。99%的人不用装(LM Studio自带),自建MLX服务的值得抄它的缓存设计。
模型同一个模型有 4bit/8bit/免审版,怎么选?一句话:稠密选小、MoE 选大。附下载地址与实测速度;2026-09 补测 oMLX 引擎,修正「换引擎不会变快」的旧结论。
程序员从零手搓的C++/CUDA推理引擎,只认RTX 5090一张卡:Qwen3.8-27B八路并发767 tok/s、AIME双96.7%不掉点,240K上下文还能看图看视频,5090党的天花板玩法。
模型发布3天下载破150万!54GB的Qwen3.8-27B压到5.9GB还留98.2%智力,传统2bit崩掉的数学题它守住95分,低比特本地部署天花板。
模型国产 3D 大模型的天花板:一张图几十秒出生产级 3D 模型,SIGGRAPH 最佳论文团队出品,先试再说
区块链850星的OpenClaw技能,让AI助手自动交易Polymarket的BTC五分钟合约:到期前2分钟进场、只跟动量不预测、硬止损+dry-run空跑,风控比策略还认真。
模型Google Research 时序预测模型:丢历史曲线直接出未来预测+置信区间,1.3GB 零样本免训练,注意非商用许可
Skills丢一本小说进去,出来直接能拍短剧的整套制作包?2700星的神仙skill库,Claude Code和codex都能跑
模型甩一段视频进去,画面内容、背景音乐、音效、对白全给你分析出来——阿里原生全模态模型,30B只激活3B,还能直接用语音回答你,Apache 2.0
硬件8.8寸 2.5K 144Hz,Ryzen AI 9 HX 370,770g 极致便携,模块化 RS-232/KVM/LTE,车载出差一台搞定
模型83 万下载的开源视频模型天花板——文生视频/图生视频/音视频同步/4K 20 秒,8GB 显存量化可跑
Skills字级配音同步、七层反PPT镜头系统、三重验收自动返工,把Claude Code/Codex变成口播视频动效工作室
硬件64GB 统一内存本地跑 27B,252 次请求零报错。低并发看响应,高并发看总量,甜蜜区在 N≤4
模型FLUX 1/2 团队新作:图像/视频/音频联合训练的世界模型,视频+原生音频最长 20 秒,Early Access 已开放
模型Qwen3-ASR 效率碾压、VibeVoice 长音频分人无敌、Whisper 生态覆盖最广——三大 ASR 各守一象限,谁该装谁



