站内搜索「Studio」共 46 条结果
M5 Max 实测 Qwen3.8-27B MLX 4bit 并发扩展性:1→32 并行全数据
推荐硬件
M5 Max 实测 Qwen3.8-27B MLX 4bit 并发扩展性:1→32 并行全数据
64GB 统一内存本地跑 27B,252 次请求零报错。低并发看响应,高并发看总量,甜蜜区在 N≤4
28天前
GSQ-RCO:ISTA研究所的非均匀量化,11.8GB跑出BF16满分的Qwen3.8-27B
推荐软件
GSQ-RCO:ISTA研究所的非均匀量化,11.8GB跑出BF16满分的Qwen3.8-27B
学术派量化天花板:每个张量单独分配精度,同体积比Unsloth高10分,论文代码全公开可自己复刻
5天前
Unsloth Dynamic GGUF:新模型发布当天就能跑,510万人下载的量化生态闭环
推荐软件
Unsloth Dynamic GGUF:新模型发布当天就能跑,510万人下载的量化生态闭环
不只量化更是全链路:Dynamic v3.0动态精度+MTP投机解码+Flash Attention加速,llama.cpp/Ollama一键起
5天前
A2A Protocol:Agent 之间的通用语,一个 pip 包就能部署
推荐程序员
A2A Protocol:Agent 之间的通用语,一个 pip 包就能部署
Google 捐给 Linux 基金会的 agent 互联协议,v1.0 已稳定。最小部署只要一个 SDK、一张 Agent Card、一个 ASGI 服务,5 分钟跑通闭环。
5天前
Kimi 开源 K2.6:1万亿参数 MoE,长程编码与 Agent Swarm 能力行业领先
推荐模型
Kimi 开源 K2.6:1万亿参数 MoE,长程编码与 Agent Swarm 能力行业领先
Moonshot AI 开源 Kimi K2.6,1万亿参数 MoE(激活32B),原生多模态。在 SWE-Bench Pro、长程编码、Agent Swarm 等关键指标上超越 Claude Opus 4.6 和 GPT-5.4。开源模型做到这个水平,闭源阵营的压力来了。
5个月前
Rapid-MLX - 专为 Apple Silicon 打造的极速本地 AI 引擎
推荐MacOS
Rapid-MLX - 专为 Apple Silicon 打造的极速本地 AI 引擎
比 Ollama 快 4.2 倍,17 种工具调用解析器,0.08 秒首字延迟,完整兼容 OpenAI API
4个月前
Pexels - 免费高质量图片视频素材
推荐酷站
Pexels - 免费高质量图片视频素材
全球最受欢迎的免费素材站,300万+精品照片和4K视频,审美高级,免费商用无需署名,API对接自动化
4个月前
TeaCache - 扩散模型免训练推理加速,视频/图片/音频生成提速神器
推荐模型
TeaCache - 扩散模型免训练推理加速,视频/图片/音频生成提速神器
CVPR 2025 Highlight,通过智能缓存跳过冗余时间步,无需重训模型即可大幅加速扩散模型推理。支持Wan2.1/FLUX/HunyuanVideo等20+主流模型
3个月前
Google Gemma 4 12B - 无编码器多模态大模型
推荐模型
Google Gemma 4 12B - 无编码器多模态大模型
Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
3个月前
LTX-2.3 - 开源最强音视频一体生成模型
推荐模型
LTX-2.3 - 开源最强音视频一体生成模型
Lightricks出品22B DiT模型,单一模型同时生成同步视频+音频,支持图生视频/文生视频,蒸馏版8步出片
3个月前
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 Max
推荐模型
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 Max
Qwen3.6-27B正统后继:原生多模态+混合线性注意力架构,262K上下文,终端编程基准超Opus 4.6 Max,Apache 2.0可商用,量化后16GB内存可跑
1个月前
Qwen3.8 微调指南(Unsloth)
推荐教程
Qwen3.8 微调指南(Unsloth)
使用 Unsloth 微调 Qwen3.8-27B 的完整教程:SFT、视觉微调、强化学习、导出
1个月前
Hindsight:让 agent 越用越聪明的记忆系统
推荐软件
Hindsight:让 agent 越用越聪明的记忆系统
LongMemEval 榜单 SOTA(第三方复现背书)——仿生记忆结构:事实/经历/信念/心智模型四层,Docker 一条命令自部署,25+ LLM 提供商含全本地方案
1个月前
LTX-2.5 完整指南:22B 开源视频模型,速度优先
推荐软件
LTX-2.5 完整指南:22B 开源视频模型,速度优先
2K/5秒视频47秒生成,RTX3060可跑,Mac MLX原生支持,多镜头+立体声,免费商用(年入<0M)
28天前
GPD Pocket 4:770g 掌上 Windows 电脑
推荐硬件
GPD Pocket 4:770g 掌上 Windows 电脑
8.8寸 2.5K 144Hz,Ryzen AI 9 HX 370,770g 极致便携,模块化 RS-232/KVM/LTE,车载出差一台搞定
28天前
闲置Mac挖AI:IOTA Train at Home 全民开放,收益实测分析
推荐新闻
闲置Mac挖AI:IOTA Train at Home 全民开放,收益实测分析
闲置Mac变身AI训练节点:Bittensor子网9的Train at Home开放全民参与,按贡献挖SN9 alpha(单币约$6.5),附真实收益测算与避坑指南
22天前
Bonsai 2 27B - 54GB压到5.9GB还留98%智力的三值模型(Qwen3.8-27B官方压缩,笔记本能跑满血27B推理)
推荐模型
Bonsai 2 27B - 54GB压到5.9GB还留98%智力的三值模型(Qwen3.8-27B官方压缩,笔记本能跑满血27B推理)
发布3天下载破150万!54GB的Qwen3.8-27B压到5.9GB还留98.2%智力,传统2bit崩掉的数学题它守住95分,低比特本地部署天花板。
8天前
Mac 上跑本地大模型:该选哪个版本、免审模型用哪个(附下载地址与实测速度)
推荐模型
Mac 上跑本地大模型:该选哪个版本、免审模型用哪个(附下载地址与实测速度)
同一个模型有 4bit/8bit/免审版,怎么选?一句话:稠密选小、MoE 选大。附下载地址与实测速度;2026-09 补测 oMLX 引擎,修正「换引擎不会变快」的旧结论。
7天前
闲置 Mac 挖 AI 币?IOTA(Bittensor SN9)Train at Home 真相与上手指南
推荐新闻
闲置 Mac 挖 AI 币?IOTA(Bittensor SN9)Train at Home 真相与上手指南
把闲置 Mac 变成 AI 训练节点、赚 IOTA Alpha:已核实项目真伪、奖励机制、实测收益样本与风险,附完整上手流程。
22天前
推荐程序员
hacker scripts:比 VS Code 还受欢迎的开源项目
hacker scripts 是比 Visual Sutdio Code 还受欢迎的 GitHub 开源项目,当前 Stars 数已经超过 10,000。据说 hacker scripts 来自一个真实的故事。hacker scripts 是由俄罗斯的一位程序员编写的脚本,可以在宿醉的时候给公司发请假条,可以在适当的时候给老婆发晚归短信,也可以发短信哄老婆,还可以远程煮咖啡!
10年前