站内搜索「语音」共 71 条结果

推荐教程
东南亚口播配音选型:越南语/马来语/泰语 TTS 模型横评中文口播稿出海东南亚怎么配音?覆盖云端统一方案(Qwen-Audio-3.0-TTS/ElevenLabs/MiniMax/豆包)、开源单模型(Scicom/Confucius4)和各语种专用模型(JaiTTS/VieNeu-TTS/Malaysian-TTS),含选型矩阵
1个月前

推荐程序员
MarkItDown - 微软开源文档转 Markdown 工具微软开源的 Python 工具,一键将 PDF/Word/Excel/PPT 等文件转换为 Markdown,支持 OCR 和 MCP
5个月前

推荐程序员
Vercel AI SDK - TypeScript AI 工具包由 Next.js 团队打造的免费开源 TypeScript AI SDK,提供统一的 LLM 提供商接口、流式传输、工具调用、结构化输出、Agent 工作流等能力,支持 React/Vue/Svelte/Node.js
5个月前

推荐程序员
agentic-video-editor - 多 Agent 协作的 AI 视频自动剪辑工具基于 Google Gemini + FFmpeg,通过 Director/Editor/Reviewer 多 Agent 流水线,将原始素材和创意简报自动剪辑成精品广告,支持 YAML 管道配置与风格模板
5个月前

推荐抖音
MoneyPrinterPlus - AI一键生成短视频+自动发布到抖音/快手/小红书/视频号/B站开源AI短视频生成与自动发布工具,支持LLM文案生成、多平台TTS配音、ffmpeg混剪、Selenium自动发布
5个月前

推荐模型
Omniparse — 将任意文档/图片/音视频解析为LLM友好格式Ingest, parse, and optimize any data format:PDF/Word/PPT/Excel、图片、音频、视频一键转结构化Markdown,专为GenAI框架优化
4个月前

推荐模型
Replicate - 一行代码调用数千AI模型AI模型云平台,聚合Flux/GPT-Image/Seedream/Claude等数千个模型,Python/Node/HTTP一行代码接入,支持微调和自定义部署,按用量付费
3个月前












