站内搜索「推理」共 86 条结果
Kimi 开源 K2.6:1万亿参数 MoE,长程编码与 Agent Swarm 能力行业领先
推荐模型
Kimi 开源 K2.6:1万亿参数 MoE,长程编码与 Agent Swarm 能力行业领先
Moonshot AI 开源 Kimi K2.6,1万亿参数 MoE(激活32B),原生多模态。在 SWE-Bench Pro、长程编码、Agent Swarm 等关键指标上超越 Claude Opus 4.6 和 GPT-5.4。开源模型做到这个水平,闭源阵营的压力来了。
5个月前
Gemma 4 31B Uncensored MAX — BF16 全精度 MLX 去审查模型
推荐模型
Gemma 4 31B Uncensored MAX — BF16 全精度 MLX 去审查模型
prithivMLmods 出品的 Gemma 4 31B 全精度(BF16)去审查版,无量化损失,mlx-vlm 原生支持
5个月前
Open Generative AI — 无审查的开源AI图像/视频生成平台
推荐模型
Open Generative AI — 无审查的开源AI图像/视频生成平台
200+ SOTA模型,无content filters,可自托管。替代Higgsfield/Freepik/Krea/Openart的开源方案
4个月前
GitHub Trending 今日热榜 (2026-05-09)
推荐程序员
GitHub Trending 今日热榜 (2026-05-09)
AI Agent 持续霸榜:Anthropic 金融方案、DeepSeek 终端代理、隐身浏览器、全自动AI交易系统等 9 个热门项目一览
4个月前
Supervision - Roboflow 计算机视觉工具库,统一所有 CV 模型输出
推荐模型
Supervision - Roboflow 计算机视觉工具库,统一所有 CV 模型输出
39K Stars,模型无关的检测/分割/分类接口,内置丰富标注器和数据集工具
4个月前
OpenHuman - 开源个人 AI 超级智能,本地记忆 + 118+ 集成
推荐模型
OpenHuman - 开源个人 AI 超级智能,本地记忆 + 118+ 集成
25K Stars,Rust 构建,本地 Obsidian 知识库,20 分钟自动同步,TokenJuice 压缩降本 80%
4个月前
RuView - 用 WiFi 信号透视墙壁,实时空间感知与生命体征监测
推荐硬件
RuView - 用 WiFi 信号透视墙壁,实时空间感知与生命体征监测
64K Stars,ESP32 节点 起步,无摄像头无穿戴,支持呼吸心率/姿态估计/跌倒检测
4个月前
StemDeck - 本地 AI 音轨分离工具
推荐程序员
StemDeck - 本地 AI 音轨分离工具
将音频分离成人声、鼓、贝斯、吉他、钢琴、其他 6 轨,支持 MP3/WAV 导入和 YouTube URL 粘贴,完全本地运行,无需账号/上传/订阅
3个月前
MiniCPM-V 4.6 - 口袋级多模态大模型,手机端部署的超高效视觉语言模型
推荐模型
MiniCPM-V 4.6 - 口袋级多模态大模型,手机端部署的超高效视觉语言模型
OpenBMB超轻量多模态模型,SigLIP2+Qwen3.5-0.8B,AI Index 13分,三端手机部署
3个月前
Keye-VL — 8B 短视频理解大模型
推荐模型
Keye-VL — 8B 短视频理解大模型
快手开源 8B 多模态模型,专为短视频理解优化,Video-MME 73% 同级最强。
3个月前
LuxTTS - 1GB显存的极速TTS声音克隆
推荐模型
LuxTTS - 1GB显存的极速TTS声音克隆
150倍实时速度,48kHz高清音质,3秒参考音频克隆声音,Apache 2.0免费商用
2个月前
Anthropic揭秘:Claude大脑里的隐藏房间 J-Space
推荐模型
Anthropic揭秘:Claude大脑里的隐藏房间 J-Space
在Claude神经网络深处发现的隐藏思维空间,可监控AI内心想法
2个月前
Hindsight:让 agent 越用越聪明的记忆系统
推荐软件
Hindsight:让 agent 越用越聪明的记忆系统
LongMemEval 榜单 SOTA(第三方复现背书)——仿生记忆结构:事实/经历/信念/心智模型四层,Docker 一条命令自部署,25+ LLM 提供商含全本地方案
1个月前
WeMM-Embedding:微信开源的多模态向量模型
推荐模型
WeMM-Embedding:微信开源的多模态向量模型
微信视觉团队出品,Apache-2.0 可商用——2B 打赢别家 8B,MMEB-v2 新 SOTA;Matryoshka 可变维度,256 维保住 98.7% 性能,视频号/朋友圈搜索同款技术
1个月前
最新开源视觉大模型横评:Qwen3.6 vs Keye-VL-2.0 vs Tarsier2-Recap
推荐模型
最新开源视觉大模型横评:Qwen3.6 vs Keye-VL-2.0 vs Tarsier2-Recap
三家最新开源MoE视觉大模型,全部30B级只激活3B,定位完全不同
1个月前
Qwen3-ASR - 开源最强中文语音识别+时间戳对齐
推荐软件
Qwen3-ASR - 开源最强中文语音识别+时间戳对齐
阿里Qwen团队出品,中文WER开源最低,配套ForcedAligner毫秒级时间戳,视频配音翻译链路的基础设施
1个月前
通义万相 - 阿里AI视频图像生成平台(万相2.6)
推荐软件
通义万相 - 阿里AI视频图像生成平台(万相2.6)
国内首个角色扮演视频生成,文/图生视频、多镜头叙事、音画同步、图文混排绘本,一站式AI创作
1个月前
三大开源 ASR 横评 - VibeVoice-ASR 7B vs Qwen3-ASR vs Whisper
推荐模型
三大开源 ASR 横评 - VibeVoice-ASR 7B vs Qwen3-ASR vs Whisper
Qwen3-ASR 效率碾压、VibeVoice 长音频分人无敌、Whisper 生态覆盖最广——三大 ASR 各守一象限,谁该装谁
1个月前
东南亚口播配音选型:越南语/马来语/泰语 TTS 模型横评
推荐教程
东南亚口播配音选型:越南语/马来语/泰语 TTS 模型横评
中文口播稿出海东南亚怎么配音?覆盖云端统一方案(Qwen-Audio-3.0-TTS/ElevenLabs/MiniMax/豆包)、开源单模型(Scicom/Confucius4)和各语种专用模型(JaiTTS/VieNeu-TTS/Malaysian-TTS),含选型矩阵
1个月前
MiniMax H3 完整使用教程:部署、长视频、实时直播
推荐软件
MiniMax H3 完整使用教程:部署、长视频、实时直播
33B 开源全模态视频模型,从零部署到 Motion Context 长视频拼接、低显存优化、fal.ai H3 Max 实时直播,一份搞定
28天前