站内搜索「声音」共 45 条结果

推荐模型
Seedance 2.0 Skill OS - 导演式 AI 视频生成工作流面向 Seedance 2.0 的模块化 agent-skill 包,导演引擎 + 长序列续写 + 多语言制片工作流,Stars 1.8k+。
2个月前

推荐模型
LTX-2.5 - Lightricks 开源视频生成模型,22B 参数音视频同步83 万下载的开源视频模型天花板——文生视频/图生视频/音视频同步/4K 20 秒,8GB 显存量化可跑
1个月前

推荐教程
东南亚口播配音选型:越南语/马来语/泰语 TTS 模型横评中文口播稿出海东南亚怎么配音?覆盖云端统一方案(Qwen-Audio-3.0-TTS/ElevenLabs/MiniMax/豆包)、开源单模型(Scicom/Confucius4)和各语种专用模型(JaiTTS/VieNeu-TTS/Malaysian-TTS),含选型矩阵
1个月前

推荐软件
MiniMax H3 完整使用教程:部署、长视频、实时直播33B 开源全模态视频模型,从零部署到 Motion Context 长视频拼接、低显存优化、fal.ai H3 Max 实时直播,一份搞定
28天前

推荐源码
Open-LLM-VTuber - 开源语音交互 AI 虚拟伴侣,Live2D 形象+完全离线开源语音交互 AI 虚拟伴侣,13.5K Stars。支持实时语音对话、视觉感知、Live2D 形象,桌面宠物模式可完全离线运行
27天前

推荐源码
LiveTalking - 实时流式数字人引擎,文本/语音驱动虚拟形象对话实时交互流式数字人引擎,9.3K Stars。支持 Wav2Lip/MuseTalk/Ernerf 多模型,WebRTC/RTMP/虚拟摄像头输出,已广泛商用
27天前

推荐程序员
VibeVoice 社区版 - PyTorch/CUDA 多 GPU 推理完整代码微软删除官方 TTS 推理代码后,社区 fork 保留的 PyTorch 完整实现。支持单卡/多卡推理、语音克隆、Gradio Demo。
5个月前












