站内搜索「GPU」共 49 条结果
Pixelle-Video — AI 全自动短视频引擎
推荐模型
Pixelle-Video — AI 全自动短视频引擎
输入一个主题,AI 自动完成文案、配图、配音、视频合成,零门槛创作短视频
5个月前
SuperSplat - 浏览器内的 3D 高斯泼溅编辑器
推荐程序员
SuperSplat - 浏览器内的 3D 高斯泼溅编辑器
PlayCanvas 开源的 3D Gaussian Splat 在线编辑器,无需安装,浏览器直接运行,支持检查、编辑、优化和发布 3DGS 场景
4个月前
SD.Next - 接替 A1111 的全能 AI 生成 WebUI
推荐模型
SD.Next - 接替 A1111 的全能 AI 生成 WebUI
支持 Stable Diffusion、SDXL、SD3、FLUX 及视频生成,内置量化引擎与自动调优,跨平台开箱即用
4个月前
fal.ai - 开发者首选的生成式AI媒体平台
推荐模型
fal.ai - 开发者首选的生成式AI媒体平台
1000+图像视频音频3D模型一行API调用,自研推理引擎比竞品快10倍,H100低至$1.2/小时,SOC2企业合规
3个月前
FLUX.1-schnell - 免费商用的最强开源文生图模型
推荐模型
FLUX.1-schnell - 免费商用的最强开源文生图模型
Black Forest Labs出品,4步出图,质量接近Midjourney,Apache 2.0开源可商用
3个月前
mlx-video - Mac原生MLX视频生成库(LTX-2.3+Wan2.2)
推荐MacOS
mlx-video - Mac原生MLX视频生成库(LTX-2.3+Wan2.2)
一个库在Apple Silicon上原生跑LTX-2.3和Wan2.2两大视频模型,纯MLX加速,CLI一行出片,比PyTorch MPS快1.7倍
3个月前
Unlimited-OCR - 百度开源一次性长文档OCR解析模型
推荐模型
Unlimited-OCR - 百度开源一次性长文档OCR解析模型
百度出品,基于DeepSeek-OCR改进,支持一次性解析超长文档、多页PDF,单图640切片+多页1024两种模式,SGLang部署兼容OpenAI API
3个月前
本地跑顶级大模型完整攻略(2千到4万美元硬件方案)
推荐硬件
本地跑顶级大模型完整攻略(2千到4万美元硬件方案)
想自己组装机器在本地跑顶级AI大模型,不依赖任何API?这份攻略从硬件选型到系统配置到模型推荐全讲清楚了,2千美元起步。
2个月前
TRELLIS.2:微软开源图生 3D 大模型,3 秒出带 PBR 材质的 3D 资产
推荐模型
TRELLIS.2:微软开源图生 3D 大模型,3 秒出带 PBR 材质的 3D 资产
微软研究院 4B 参数 image-to-3D 模型:O-Voxel 表示搞定任意拓扑+完整 PBR 材质,512³ 仅 3 秒,24GB 显存可本地跑,MIT 协议全开源
1个月前
CapsWriter-Offline - 按住CapsLock说话松开就上屏的离线语音输入
推荐软件
CapsWriter-Offline - 按住CapsLock说话松开就上屏的离线语音输入
完全离线、0.15秒出字,按住CapsLock说话松开就上屏,再也不用给讯飞交月费了
1个月前
GPD Pocket 4:770g 掌上 Windows 电脑
推荐硬件
GPD Pocket 4:770g 掌上 Windows 电脑
8.8寸 2.5K 144Hz,Ryzen AI 9 HX 370,770g 极致便携,模块化 RS-232/KVM/LTE,车载出差一台搞定
28天前
Asop.uk - AiMetatron官方无审查生成站(H3视频+Krea2图片在线直出)
推荐软件
Asop.uk - AiMetatron官方无审查生成站(H3视频+Krea2图片在线直出)
黑兽模型作者的官方在线站,不用装ComfyUI不用下20G权重,Civitai账号登录就出片,还带OpenAI兼容API。
10天前
MinerU - 文档解析引擎
推荐程序员
MinerU - 文档解析引擎
开源文档解析引擎,OpenDataLab 出品 78k Star。PDF/Word/PPT/Excel/图片一键转 LLM 友好的 Markdown/JSON,公式转 LaTeX、表格转 HTML、跨页表格合并、109 语言 OCR;Pipeline 后端纯 CPU 可跑,VLM 后端精度 95+,另有 mineru.net 在线服务免部署
5个月前
抖音暗水印(盲水印)去除方法 — 技术原理与实战工具
推荐抖音
抖音暗水印(盲水印)去除方法 — 技术原理与实战工具
详解抖音视频隐式水印的嵌入原理、检测方法和去除方案,含开源工具推荐与批量处理脚本
5个月前
Voicebox - 开源 AI 语音工作室,本地替代 ElevenLabs
推荐模型
Voicebox - 开源 AI 语音工作室,本地替代 ElevenLabs
7 引擎 TTS + 语音克隆 + 全局语音输入,本地运行零隐私泄露
4个月前
SadTalker - 单图+音频生成说话人脸动画
推荐模型
SadTalker - 单图+音频生成说话人脸动画
CVPR 2023 论文项目,一张照片+一段音频即可生成逼真的数字人/虚拟主播视频,支持口型同步和表情控制
4个月前
TeaCache - 扩散模型免训练推理加速,视频/图片/音频生成提速神器
推荐模型
TeaCache - 扩散模型免训练推理加速,视频/图片/音频生成提速神器
CVPR 2025 Highlight,通过智能缓存跳过冗余时间步,无需重训模型即可大幅加速扩散模型推理。支持Wan2.1/FLUX/HunyuanVideo等20+主流模型
3个月前
Google Gemma 4 12B - 无编码器多模态大模型
推荐模型
Google Gemma 4 12B - 无编码器多模态大模型
Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
3个月前
Venice.ai - 免审查AI模型API平台,OpenAI兼容
推荐api
Venice.ai - 免审查AI模型API平台,OpenAI兼容
6个免审查模型,OpenAI兼容API,按量付费,最低$0.16/M tokens
3个月前
Seedance 2.5 登陆 Higgsfield,百万美元 AI 电影大赛开赛
推荐模型
Seedance 2.5 登陆 Higgsfield,百万美元 AI 电影大赛开赛
字节 Seedance 2.5 正式上线,Higgsfield 同步启动 100万美元 AI 电影竞赛,比赛期间不限量免费用
1个月前