"speech" 的搜索结果
共找到8个结果(工具7个· 资讯0篇· 技能1个),SeoAIu已按相关性为你排序。
AI工具 (7)
Adobe Podcast:那个能把手机录音修成录音棚音质的免费AI工具
148Adobe Podcast是Adobe推出的免费AI音频增强与播客制作工具,其Enhance Speech功能可一键将手机录音提升至录音棚音质。支持远程录音与文本剪辑,免费版已足够强大。
2026-06-30Deepgram——领先的企业级语音AI平台,提供实时语音识别、合成与全托管语音Agent API
95Deepgram是一家领先的语音AI平台,为开发者提供高精度、低成本的实时语音识别(STT)、文本转语音(TTS)及统一的语音Agent API。其Nova系列模型在准确率和速度上均超越竞品,Aura-2 TTS延迟低于200毫秒,语音Agent API定价仅4.5美元/小时。支持云端与自托管部署,已获超20万开发者信赖。
2026-07-11MiniMax Audio——超拟人语音大模型,从10秒克隆到40+语种,让AI说话像真人一样有温度
89MiniMax Audio是MiniMax旗下的AI语音平台,提供文本转语音、声音克隆、音乐生成等功能。其自研的Speech系列模型支持40+语种、超长文本、情感表达与低延迟交互,已被LiveKit、Pipecat、高途、喜马拉雅等全球头部平台与产品采用。
2026-07-11琅琅配音——永久免费的AI配音神器,1100+主播、80+语言、近20项精细调音
86琅琅配音是一款永久免费的AI配音平台,提供1100+AI主播、80+种语言和10+种情感风格。支持连读、停顿、多音字、局部加速、多人配音等近20项精细调音功能,可逐字调节发音人。内置CC0免版权背景音乐库,支持字幕合成、批量合成、提取文案等效率工具,适合短视频配音、有声书制作、广告宣传等场景。
2026-07-11AssemblyAI——开发者首选的语音识别API,用行业领先的准确率构建下一代语音AI应用
83AssemblyAI提供生产级的语音转文本API,以93.3%+的词准确率和低至$0.15/小时的价格支持99种语言。平台集成了说话人分离、PII识别、摘要生成等语音理解能力,并支持低至300ms延迟的实时流式转录,被超过20万开发者用于构建语音代理、会议记录和对话分析等应用。
2026-07-11NaturalReader——超过1000万用户选择的AI文本转语音工具,从个人阅读到商业配音都够用
83NaturalReader是一款AI文本转语音工具,提供自然的人声朗读,支持PDF、网页、图片等多种格式。具备AI播客生成、语音克隆、多语种配音等功能,适用于个人学习、教育场景及商业视频配音。已服务全球超1000万用户。
2026-07-10场辞-AI视频字幕制作软件|自动加字幕|语音转字幕
58场辞是一款基于语音识别技术的视频字幕制作软件,提供语音转字幕、一键加字幕、视频加字幕、字幕快捷校对等功能。最快5分钟即可完成1小时视频的字幕制作,准确率高达97.5%。支持多轨制作、可视化时间轴编辑、实时预览拖拽缩放字幕,并支持SRT/ASS/XML等多格式字幕导出及一键压制带字幕视频。适用于自媒体、电视台、在线教育、Vlog、短视频等全场景。
2026-07-17