软件不只量化更是全链路:Dynamic v3.0动态精度+MTP投机解码+Flash Attention加速,llama.cpp/Ollama一键起
模型一张 3090 Ti 跑 27B 免审模型:改写/翻译类比原双卡快 2.2 倍,日常对话快 32%。代价是量化从 8 位降到 4 位,且质量尚未验证。
酷站不知道 System One 决策模型能干嘛?这个策展站把 194 个真实 Jev 项目、演示和作者一站收齐,找灵感的最佳入口
源码做企业AI视频踩坑沉淀的开源包:543条实测prompt按官方公式收录,Action每周巡检防过期,跨模型prompt翻译器+15模型选型顾问,做AI视频的Star一份。
模型同一个模型有 4bit/8bit/免审版,怎么选?一句话:稠密选小、MoE 选大。附下载地址与实测速度;2026-09 补测 oMLX 引擎,修正「换引擎不会变快」的旧结论。
随笔RLHF共同发明人新公司首作:不做聊天只做结构化决策,概率校准可信到能写进代码阈值,便宜两个数量级
软件Krea.ai从零自研的12.9B图像模型,ComfyUI官方仓935万下载:风格参考混搭+反AI味审美,Turbo版8步2秒出2K图,3090可跑
酷站6年不断更的老牌科技博客,AI新模型发布次日就有实测+免费上手教程,会员限免、本地部署、虚拟信用卡攻略全实操向
模型国产 3D 大模型的天花板:一张图几十秒出生产级 3D 模型,SIGGRAPH 最佳论文团队出品,先试再说
软件SIP 电话线接任意 AI 模型,实时接听可调用工具,录音转写全归自己。pre-alpha 阶段,值得提前关注。
软件IEEE TCSVT 收录的 Vid-LLM 综述配套清单:论文+代码+数据集+基准全整理,选型与研究必备
随笔首个开源全能参考视频模型:消费级显卡可跑,效果≈Seedance 2.0 Fast 八成、成本仅十分之一。附Seedance/可灵/万相/LTX/Veo/Grok/FLUX3逐家盘点
模型FLUX 1/2 团队新作:图像/视频/音频联合训练的世界模型,视频+原生音频最长 20 秒,Early Access 已开放
教程Windows 版 Codex 通过桌面图标切换 OpenAI、DeepSeek、本地 Qwen,并为不同上下文窗口设置独立自动压缩阈值。
模型微信视觉团队出品,Apache-2.0 可商用——2B 打赢别家 8B,MMEB-v2 新 SOTA;Matryoshka 可变维度,256 维保住 98.7% 性能,视频号/朋友圈搜索同款技术
模型83 万下载的开源视频模型天花板——文生视频/图生视频/音视频同步/4K 20 秒,8GB 显存量化可跑
软件DeepSeek 官方开源 Agent Harness,两天 9 万星,0.2元/任务,兼容近40家模型,对标 Claude Code



