站内搜索「音频」共 89 条结果

推荐程序员
Anything → NotebookLM - Claude Code Skill 多源内容智能处理器支持微信公众号、YouTube、播客、PDF、300+付费墙绕过等15+种内容源,一键生成播客/PPT/思维导图/Quiz
5个月前

推荐游戏
ggemu-fishing-joy - 基于 PixiJS v8 的高性能 WebGL 捕鱼达人游戏GGEMU.COM 官方旗舰 HTML5 游戏示例,PixiJS v8 + WebGL 2.0 构建,集成 SDK 支持 GCoin 经济系统与直播推流
5个月前

推荐软件
youwee - AI 驱动的跨平台视频下载器Tauri + React 现代化跨平台下载工具,支持 YouTube/TikTok/Instagram 等 1800+ 站点,内置 AI 视频摘要、自然语言视频编辑、字幕工坊、SponsorBlock 等功能,适合内容创作者批量处理视频
5个月前

推荐抖音
MoneyPrinterPlus - AI一键生成短视频+自动发布到抖音/快手/小红书/视频号/B站开源AI短视频生成与自动发布工具,支持LLM文案生成、多平台TTS配音、ffmpeg混剪、Selenium自动发布
5个月前

推荐MacOS
vibevoice-mlx - VibeVoice TTS MLX 推理实现(Mac Studio 部署指南)微软删除官方推理代码后,社区补上的完整 MLX 实现。支持 1.5B/7B 语音合成、零样本语音克隆、量化加速。
5个月前

推荐程序员
VibeVoice 社区版 - PyTorch/CUDA 多 GPU 推理完整代码微软删除官方 TTS 推理代码后,社区 fork 保留的 PyTorch 完整实现。支持单卡/多卡推理、语音克隆、Gradio Demo。
5个月前

推荐模型
VoxCPM2 - 开源无分词器 TTS 模型,30 语言语音合成与声音克隆OpenBMB 开源的 2B 参数文本转语音模型,支持 30 语言、Voice Design 声音设计、可控声音克隆,48kHz 输出,Apache-2.0 可商业使用
4个月前
推荐模型
VoxCPM2 部署与使用指南 —— 30语言TTS + Voice Design + 声音克隆OpenBMB 开源 2B 无分词器 TTS,支持30语言、Voice Design、声音克隆,附 CLI 和 FastAPI HTTP 服务完整用法,可直接给 Agent 调用
4个月前

推荐模型
Open Generative AI — 无审查的开源AI图像/视频生成平台200+ SOTA模型,无content filters,可自托管。替代Higgsfield/Freepik/Krea/Openart的开源方案
4个月前

推荐软件
tab-home - Chrome新标签页个人仪表板扩展Chrome扩展,把新标签页变成双栏仪表板:左侧收藏网址(最多81个),右侧当前标签按域名分组。零依赖零构建,完全本地运行,不联网不上传数据。适合标签页重度用户和隐私敏感者。
4个月前
推荐模型
gemma-skills - Google Gemma 官方 AI 编码技能包Google 官方出品的 Gemma 模型技能库,让 AI 编码助手自动掌握 Gemma 选型、部署、MTP 加速推理,支持 Vercel/Context7 CLI 一键安装
3个月前

推荐MacOS
mlx-video - Mac原生MLX视频生成库(LTX-2.3+Wan2.2)一个库在Apple Silicon上原生跑LTX-2.3和Wan2.2两大视频模型,纯MLX加速,CLI一行出片,比PyTorch MPS快1.7倍
3个月前

推荐酷站
SnapWC 免费在线视频下载工具免费在线视频下载工具,打开网页粘贴链接就能下载YouTube、TikTok、抖音、Instagram等上万个网站的高清视频、字幕和图片,不用安装软件不用注册
3个月前

推荐模型
Seedance 2.0 Skill OS - 导演式 AI 视频生成工作流面向 Seedance 2.0 的模块化 agent-skill 包,导演引擎 + 长序列续写 + 多语言制片工作流,Stars 1.8k+。
2个月前




