站内搜索「GitHub」共 225 条结果
TRELLIS.2:微软开源图生 3D 大模型,3 秒出带 PBR 材质的 3D 资产
推荐模型
TRELLIS.2:微软开源图生 3D 大模型,3 秒出带 PBR 材质的 3D 资产
微软研究院 4B 参数 image-to-3D 模型:O-Voxel 表示搞定任意拓扑+完整 PBR 材质,512³ 仅 3 秒,24GB 显存可本地跑,MIT 协议全开源
1个月前
DSH Desktop - DeepSeek Harness 桌面客户端
推荐软件
DSH Desktop - DeepSeek Harness 桌面客户端
官方Harness的社区桌面驾驶舱:Win/Mac一键安装免Node环境,桌面壳本身也是插件
1个月前
Financial Freedom - 最全赚钱投资指南资源合集
推荐电子书
Financial Freedom - 最全赚钱投资指南资源合集
财富自由主题合集:16本投资书分级书单+16部金融纪录片+美股博主/论坛+Web3工具导航
1个月前
diagram-design - Claude Code图表生成插件
推荐软件
diagram-design - Claude Code图表生成插件
27种图表一键生成,自动匹配你的品牌配色,设计师不会骂的AI图表
1个月前
watermarks-remover - AI生成内容痕迹清洁器
推荐软件
watermarks-remover - AI生成内容痕迹清洁器
剥离AI隐形指纹:文本Unicode/统计水印+图片文档C2PA元数据,agent skill+本地服务
1个月前
video-shotcraft — AI出片直接导出剪映草稿
推荐源码
video-shotcraft — AI出片直接导出剪映草稿
唯一支持导出剪映工程的AI视频skill:底板按镜头切开可精剪,字幕变原生文本轨,音效BGM分轨——AI出粗片你精修。152张镜头配方卡+209动效预览+完整成片模板,5.9k Stars
1个月前
MiniMax Design — AI Agent 商业视频工作台(H3 模型)
推荐软件
MiniMax Design — AI Agent 商业视频工作台(H3 模型)
策划/分镜/生成/剪辑/交付全流程 Agent 串联,无限画布+技能插件生态+商业模板;配开源 H3 视频模型,768P 0.5元/秒、2K 0.8元/秒,年卡低至0.4元/秒
1个月前
算卦 — 传统命理 × 多模型 AI 全栈推演平台
推荐软件
算卦 — 传统命理 × 多模型 AI 全栈推演平台
八字、六爻、紫微、奇门、玄空、择日六大子系统,8600+ 行古籍 RAG + 13+ LLM 流式解读
1个月前
XXG Portrait Rebuild Light — 给人像照片重新打光的 AI Agent 技能
推荐软件
XXG Portrait Rebuild Light — 给人像照片重新打光的 AI Agent 技能
装进 Codex/Claude Code 的人像布光技能:只改光影不重画人,修复塑料皮肤,13种光照配方从伦勃朗光到赛博霓虹
1个月前
BilldDesk - 开源远程桌面,ToDesk 收费的功能它免费
推荐软件
BilldDesk - 开源远程桌面,ToDesk 收费的功能它免费
7.4K stars,WebRTC 远控,不限连接次数不限画质,隐私屏虚拟屏屏幕墙全免费,还支持私有化部署
1个月前
TurboOCR — GPU 极限速度的文档解析器
推荐软件
TurboOCR — GPU 极限速度的文档解析器
OCR/版面/表格/公式全流水线跑在显卡上,PDF 进 Markdown 出,单卡 5090 最快 559 图/秒,比传统 OCR 快 15-90 倍
1个月前
Hindsight:让 agent 越用越聪明的记忆系统
推荐软件
Hindsight:让 agent 越用越聪明的记忆系统
LongMemEval 榜单 SOTA(第三方复现背书)——仿生记忆结构:事实/经历/信念/心智模型四层,Docker 一条命令自部署,25+ LLM 提供商含全本地方案
1个月前
WeMM-Embedding:微信开源的多模态向量模型
推荐模型
WeMM-Embedding:微信开源的多模态向量模型
微信视觉团队出品,Apache-2.0 可商用——2B 打赢别家 8B,MMEB-v2 新 SOTA;Matryoshka 可变维度,256 维保住 98.7% 性能,视频号/朋友圈搜索同款技术
1个月前
Tarsier2-Recap-7B - 字节视频描述专精模型,7B超GPT-4o
推荐源码
Tarsier2-Recap-7B - 字节视频描述专精模型,7B超GPT-4o
字节跳动蒸馏版视频理解模型,DREAM-1K描述F1超越GPT-4o,8.3B参数低门槛部署
1个月前
Qwen3-ASR - 开源最强中文语音识别+时间戳对齐
推荐软件
Qwen3-ASR - 开源最强中文语音识别+时间戳对齐
阿里Qwen团队出品,中文WER开源最低,配套ForcedAligner毫秒级时间戳,视频配音翻译链路的基础设施
1个月前
ganloss-latent-space:ComfyUI 工作流相册
推荐软件
ganloss-latent-space:ComfyUI 工作流相册
有趣的80后程序员的ComfyUI工作流相册:按日期查换脸、数字人、电商产品图、虚拟试穿流程,照着配节点。
1个月前
M5 Max 实测 Qwen3.8-27B MLX 4bit 并发扩展性:1→32 并行全数据
推荐硬件
M5 Max 实测 Qwen3.8-27B MLX 4bit 并发扩展性:1→32 并行全数据
64GB 统一内存本地跑 27B,252 次请求零报错。低并发看响应,高并发看总量,甜蜜区在 N≤4
29天前
video-talkcraft - 口播稿+配音一键成片的 agent skill,78张动效配方卡
推荐Skills
video-talkcraft - 口播稿+配音一键成片的 agent skill,78张动效配方卡
字级配音同步、七层反PPT镜头系统、三重验收自动返工,把Claude Code/Codex变成口播视频动效工作室
29天前
MiniMax H3 完整使用教程:部署、长视频、实时直播
推荐软件
MiniMax H3 完整使用教程:部署、长视频、实时直播
33B 开源全模态视频模型,从零部署到 Motion Context 长视频拼接、低显存优化、fal.ai H3 Max 实时直播,一份搞定
28天前
VideoDevour - 视频吃进去,图文报告吐出来
推荐软件
VideoDevour - 视频吃进去,图文报告吐出来
扔一段视频进去,自动出带章节配图的 Markdown 报告,网课笔记/会议纪要/内容素材一站搞定
26天前