站内搜索「说话」共 36 条结果

推荐源码
Open-LLM-VTuber - 开源语音交互 AI 虚拟伴侣,Live2D 形象+完全离线开源语音交互 AI 虚拟伴侣,13.5K Stars。支持实时语音对话、视觉感知、Live2D 形象,桌面宠物模式可完全离线运行
27天前

推荐程序员
huashu-design - 一句话生成可交付设计的 AI 设计 Skill跨 agent 通用设计 skill,支持交互原型、PPT、动画、信息图等多种交付物,内置 20 种设计语汇与品牌资产协议,适合产品经理和独立开发者快速出图
5个月前

推荐MacOS
vibevoice-mlx - VibeVoice TTS MLX 推理实现(Mac Studio 部署指南)微软删除官方推理代码后,社区补上的完整 MLX 实现。支持 1.5B/7B 语音合成、零样本语音克隆、量化加速。
5个月前

推荐模型
video-use — AI代理剪辑视频用Claude Code/Codex/Hermes等AI代理剪辑视频,扔素材进文件夹聊天就能拿到成片,自动去填充词调色加字幕,15.8k Stars
2个月前

推荐模型
三大开源 ASR 横评 - VibeVoice-ASR 7B vs Qwen3-ASR vs WhisperQwen3-ASR 效率碾压、VibeVoice 长音频分人无敌、Whisper 生态覆盖最广——三大 ASR 各守一象限,谁该装谁
1个月前

推荐教程
东南亚口播配音选型:越南语/马来语/泰语 TTS 模型横评中文口播稿出海东南亚怎么配音?覆盖云端统一方案(Qwen-Audio-3.0-TTS/ElevenLabs/MiniMax/豆包)、开源单模型(Scicom/Confucius4)和各语种专用模型(JaiTTS/VieNeu-TTS/Malaysian-TTS),含选型矩阵
1个月前

推荐酷站
FlyBrain - 人类第一张完整果蝇脑地图,在你浏览器里活着139255个真实神经元在浏览器里实时运转,果蝇走路受惊全是脑信号涌现的不是动画,它甚至还会自己向Workday提交休假申请
15天前

推荐模型
Hyper3D Rodin - 一张图生成生产级 3D 模型(千万面级 3D 大模型)国产 3D 大模型的天花板:一张图几十秒出生产级 3D 模型,SIGGRAPH 最佳论文团队出品,先试再说
13天前







