音乐与音频工具
64 个工具
SoundBug(音虫)——内置AI编曲的国产音乐制作软件,让音乐创作不再有门槛
SoundBug(音虫)是一款由国内团队研发的AI音乐制作软件(DAW),内置AI智能编曲、600+虚拟乐器及丰富乐段模板,致力于降低音乐创作门槛。软件已被选为上海市“空中课堂”指定教学平台,深受百万青少年、音乐教师及爱好者喜爱。支持Windows和Mac,一键安装即可开始创作
Listnr——1000+超拟人AI配音与语音克隆工具,142种语言触达全球观众
Listnr是一款功能强大的AI语音生成与克隆平台,提供超过1000种逼真的AI语音,支持142种以上语言和口音。特色功能包括30秒极速语音克隆、AI视频生成器和播客托管服务,帮助内容创作者、营销人员和企业轻松制作多语言音频和视频内容。
Mureka——昆仑天工旗下AI音乐创作平台,让每个人都能创作可发布的专业级歌曲
Mureka是昆仑万维旗下AI音乐创作平台,搭载自研MusiCoT技术体系,V8/V9模型在旋律、人声、编曲上全面超越国际主流竞品。支持自然语言描述、歌词输入、参考歌曲等多维度创作,提供API接口与AI Studio编辑工具。基础会员月费88元,让AI音乐从“能生成”迈向“能发布”。
Vocu AI(悟声)——HuggingFace TTS Arena全球榜首,让AI语音拥有“人味”与情感的国产语音大模型
Vocu AI(悟声)是广州烁谷科技自研的AI语音合成平台,其V3系列模型在HuggingFace TTS Arena盲测中位列全球第一。提供瞬时克隆(3秒样本,相似度95%+)与专业克隆。支持30余种语言与方言,可精准演绎情感,实现影视级性能。提供API接口,助力开发者高效集成
刺鸟配音——永久免费的AI配音神器,200+音色让文字秒变情感语音
刺鸟配音是一款AI智能合成的免费配音软件,拥有200多种声音,支持普通话、粤语、英语及多种方言。提供近300款声音和十余种情感表达,支持短视频配音、影视解说、有声小说等场景。支持网页、App及小程序多端使用
快转字幕——AI智能字幕生成与翻译平台,一站式搞定多语言视频字幕
快转字幕是一款AI驱动的字幕与转录平台,提供音频转文字、AI字幕生成、智能断句重排、近百种语言精准翻译等功能。一站式集成在线编辑、字幕压制与多格式导出,支持MP4、SRT、ASS等格式。识别准确率高达99%,适合视频创作者、字幕组、跨国企业等高效制作多语言字幕视频。
TTSMaker——免费在线文字转语音工具,200+语音风格一键生成
TTSMaker是一款免费的在线AI文字转语音工具,支持多种语言和200+语音风格。无需注册,输入文本即可生成自然逼真的语音,支持调整语速音量并下载MP3。适合视频配音、有声书制作、教育内容创作等场景,让文字轻松“开口说话”。
Lemonaide AI——格莱美制作人驱动的AI旋律生成器,为你的创作注入专业灵感
Lemonaide AI是一款由行业顶尖制作人驱动的AI旋律生成插件。它能一键生成免版税的MIDI旋律与和弦进行,其独家“Collab Club”提供由Lex Luger、Kato On The Track等格莱美获奖制作人训练的专属AI模型。插件支持Windows和macOS,可无缝拖入主流DAW,适合从初学者到专业音乐制作人的各类创作者。
琅琅配音——永久免费的AI配音神器,1100+主播、80+语言、近20项精细调音
琅琅配音是一款永久免费的AI配音平台,提供1100+AI主播、80+种语言和10+种情感风格。支持连读、停顿、多音字、局部加速、多人配音等近20项精细调音功能,可逐字调节发音人。内置CC0免版权背景音乐库,支持字幕合成、批量合成、提取文案等效率工具,适合短视频配音、有声书制作、广告宣传等场景。
听脑AI——98.7%准确率的录音转文字神器,3分钟搞定1小时会议纪要
听脑AI是一款AI驱动的录音转文字与会议纪要工具,支持实时录音转写、文件上传转写、网络音视频解析。基于DeepSeek-R1等大模型实现自动区分发言人、智能摘要、待办提取,3分钟即可完成1小时会议内容整理。支持中英日韩等多语种,年费仅199元,适合职场、学生、创作者等高频音视频处理场景。
大饼AI变声——超低延迟的实时变声器,500+音色让游戏直播更有趣
大饼AI变声是一款专业的实时AI变声器,提供低于100ms的超低延迟和500+精心调校的音色库。无需显卡GPU,仅占约5%CPU资源,普通笔记本电脑也能流畅运行。完美适配游戏开黑、直播互动、社交语聊等多种场景,让声音变身变得简单有趣。
Memo AI——本地运行的AI音视频转文字工具
Memo AI是一款All in One的本地音视频转文字工具,支持将YouTube、播客及本地音视频轻松转为文字稿。提供90+种语言转录翻译、AI摘要、AI思维导图、语音合成等功能。所有数据本地运行,保护隐私,支持Windows和macOS,M系列芯片GPU加速,30分钟音频仅需2分钟完成转录。
WellSaid Labs——用专业声优授权的AI语音,为你的内容配上一副“值钱”的好嗓子
WellSaid Labs是一家企业级AI语音合成平台,其AI模型Caruso仅在专业声优授权的音频上训练。平台提供超逼真、可商用的AI语音,支持逐词精细调音、多语种与方言,被超半数财富500强公司及NPR、LinkedIn等机构采用。
WellSaid Labs——用专业声优授权的AI语音,为你的内容配上一副“值钱”的好嗓子
WellSaid Labs是一家企业级AI语音合成平台,其AI模型Caruso仅在专业声优授权的音频上训练。平台提供超逼真、可商用的AI语音,支持逐词精细调音、多语种与方言,被超半数财富500强公司及NPR、LinkedIn等机构采用。
OptimizerAI——用文字描述生成高质量音效,游戏与视频创作者的AI声音设计工坊
OptimizerAI是一款AI音效生成工具,通过文字提示即可创建游戏、动画、视频等场景的定制音效。支持44.1kHz立体声输出、风格定制与音频变体生成,提供免费试用与付费订阅。适合游戏开发者、视频创作者、动画师及音频设计师使用。
Stable Audio——Stability AI出品,用开源模型在本地生成高质量商用音乐的AI平台
Stable Audio是Stability AI推出的AI音乐生成平台,支持通过文本提示生成最长6分钟的44.1kHz立体声音乐。其开源模型可本地部署,训练数据完全授权,生成的音乐明确支持商用。适合音乐制作人、内容创作者和开发者。
海绵音乐——字节跳动出品的AI音乐创作平台,用一句话或一张图生成你的专属歌曲
海绵音乐是字节跳动推出的AI音乐创作平台,支持通过灵感、歌词或图片一键生成完整歌曲。平台提供多种音乐风格与情绪选项,并具备音色克隆功能,让零基础用户也能轻松创作个性化音乐。作品可直接分享至抖音等社交平台,免费版每日可生成多首歌曲。
Deepgram——领先的企业级语音AI平台,提供实时语音识别、合成与全托管语音Agent API
Deepgram是一家领先的语音AI平台,为开发者提供高精度、低成本的实时语音识别(STT)、文本转语音(TTS)及统一的语音Agent API。其Nova系列模型在准确率和速度上均超越竞品,Aura-2 TTS延迟低于200毫秒,语音Agent API定价仅4.5美元/小时。支持云端与自托管部署,已获超20万开发者信赖。
墨音(魔音工坊)——800+音色、1000+风格的AI配音神器,短视频/有声书创作者都在用
墨音(魔音工坊)是出门问问旗下AI配音平台,搭载自研序列猴子大模型与第五代TTS引擎,提供800+款音色、1000+种风格及近20项精细调音功能。支持多语种、多方言、声音克隆、视频云剪辑与多人协作,广泛应用于短视频、有声书、影视解说等场景,累计服务超600万用户。
悦音AI配音——制片帮旗下在线智能配音神器,近千种音色免费商用
悦音AI配音是制片帮(Zhipianbang)推出的在线AI配音平台,提供近千种音色、多风格情绪主播及AI仿真人情感语音。支持多音字、停顿、数字发音等精细调节,并内置AI违禁词检测。会员可在线生成商用授权书,适合短视频、影视解说、有声读物、游戏动漫等场景。
MetaVoice——让AI语音对话像真人一样自然、有感情的“双工”语音AI平台
MetaVoice是一家专注于研发“双工”(Duplex)语音AI的公司,旨在让AI对话具备真人般的自然感与情感智能。其核心模型MetaVoice-1B拥有12亿参数,支持情感丰富的语音合成与少样本声音克隆,致力于为销售、心理咨询、游戏等场景提供深度对话体验。
Treblo——完全免费、无限制的AI音乐生成器,把任何想法变成一首完整的歌
Treblo(原Sonauto)是一款完全免费、无限制的AI音乐生成应用。用户通过文字描述、歌词或哼唱旋律,即可快速生成带人声和伴奏的完整歌曲。平台提供数千种音乐风格、社区分享功能及“Fancy Mode”提升音质,适合内容创作者、音乐爱好者和任何想尝试音乐创作的人。
Lyrics Into Song AI——输入歌词,AI一键生成完整歌曲的在线音乐创作平台
Lyrics Into Song AI是一款在线AI音乐生成工具,支持将用户输入的歌词快速转化为带有旋律、和声和编排的完整歌曲。平台提供简单描述与专业歌词输入两种模式,支持多种音乐风格、人声选择,并具备AI音乐编辑器、歌词生成器、人声移除器、AI翻唱等扩展功能。免费用户可在线创作并试听,付费用户支持下载与商业使用。
Audo.ai——AI一键音频清理神器,让播客和视频的杂音瞬间消失
Audo.ai(Audo Studio)是一款AI驱动的在线音频清理工具,只需一键即可自动移除背景噪音、减少回声并平衡音量。它专为播客主、视频创作者和远程工作者设计,处理速度比Adobe或Audacity快10倍。免费版提供每月20分钟的处理时长,付费版起价$12/月。
Supertone Shift——把专业声优的声音装进你的喉咙,HYBE旗下超低延迟实时AI变声器
Supertone Shift是一款由HYBE旗下Supertone公司推出的实时AI变声软件,以低至47ms的行业最低延迟和无需独立GPU即可运行的轻量级设计著称。它提供海量由专业声优打造的AI语音角色,支持音高、动态范围、混响等精细调节。适用于游戏开黑、VTuber直播、视频配音等多种场景,深受日本等全球创作者青睐
Voicenotes——AI语音笔记与会议记录工具,让每次对话都变成可搜索的知识资产
Voicenotes是一款AI驱动的语音笔记与会议记录工具,支持一键录音、实时转写、自动生成摘要与行动项。用户可通过自然语言向AI提问,从过往所有对话中检索信息。支持60+种语言自动识别,已获SOC 2 Type II与GDPR合规认证,App Store评分4.8星,全球超85万用户。
Boomy——无需任何音乐基础,在30秒内创作并发布原创歌曲的AI音乐平台
Boomy是一个AI驱动的音乐创作平台,让任何人都能在无需音乐经验的情况下,于几秒内生成原创歌曲。它支持通过选择风格快速创作音乐,并提供基础编辑工具。用户可将作品一键分发至Spotify、Apple Music等40+流媒体平台,获取版税收入。平台采用免费增值模式,适合内容创作者、播客主及音乐爱好者。
Beatoven.ai——为创作者而生的AI音乐生成器,用情感驱动配乐,让版权不再成为创作的绊脚石
Beatoven.ai是一款AI驱动的免版税音乐生成平台,专注于为视频、播客、游戏等场景提供情感化配乐。它通过文本、图像或视频生成独特的背景音乐,支持16种情绪和多种风格定制。其Maestro模型基于完全授权数据训练,并为音乐人提供版税分成,已帮助全球创作者生成数百万首曲目。
TTSMaker(马克配音)——免费可商用的AI文本转语音工具,50+语言300+音色随心选
TTSMaker是一款免费、免注册的AI文本转语音工具,支持50多种语言和300多种语音风格。无需注册,三步即可将文字转为自然语音,生成音频可免费用于商业用途(如视频配音、有声书制作等)。每周提供30000字符免费额度,部分音色不限量使用。
Mubert——实时生成无限免版税音乐的AI平台,为创作者、开发者与品牌提供专属BGM
Mubert是一个AI驱动的实时音乐生成平台,通过文本、图片或情绪生成无限量、独一无二且免版税的音乐。提供从15秒短视频配乐到25分钟长混音的灵活输出,支持API集成与流式播放,已生成超2亿首曲目,服务于全球2800万创作者。
讯飞配音——科大讯飞星火大模型驱动,AI智能配音与虚拟数字人一站式创作平台
讯飞配音是科大讯飞推出的专业AI配音与虚拟数字人创作平台。依托讯飞星火大模型与语音合成技术,提供1000+超拟人音色、多情感语调控制、一句话声音复刻及2步生成虚拟数字人视频等能力。支持中英混合、12种方言及多国外语,适合短视频、宣传片、教育培训等场景,已服务数万用户。
Wondercraft——用对话驱动视频与音频创作的AI工作室,让专业内容生产从“周”缩短到“分钟”
Wondercraft是一个AI驱动的视频与音频创作平台,通过内置AI代理“Wonda”,用户用自然语言对话即可完成播客、广告、培训视频等内容的生产与编辑。平台集成ElevenLabs超拟真语音,支持30+语言、语音克隆与团队协作,已被Spotify、Amazon、世界银行等机构采用。
Uberduck——让AI说、唱、Rap的全能语音工坊,5000+声音任你调遣
Uberduck是一款AI语音与音乐创作平台,提供文本转语音、语音克隆、文本转唱/说唱及AI音乐生成等功能。平台拥有5000+ expressive voices,支持70+语言和数百种音乐风格,适合创作者、音乐人、营销人员快速生成专业级音频内容。
Suno——用一句话生成完整歌曲的AI音乐神器,全球超1亿人的创作新宠
Suno是一款AI音乐生成平台,输入任何想法即可在30秒内生成包含人声、歌词和编曲的完整歌曲。2026年3月发布的V5.5版本新增声音克隆、自定义模型和个性化学习功能。平台支持8分钟超长歌曲生成,覆盖最广泛的音乐风格。免费用户每日可生成50首歌曲,付费版低至$8/月。全球用户超1亿,付费用户达200万,年度经常性收入3亿美元
讯飞听见——不止于转写,更懂你的AI语音记录与洞察伙伴
讯飞听见是科大讯飞旗下的AI语音记录与转写平台,提供实时录音转文字、音视频文件转写、AI智能摘要与自适应纪要生成等服务。搭载讯飞星火等大模型,支持中英粤混合及多地方言识别,1小时音频最快5分钟出稿,准确率最高达98%。面向个人及企业用户,提供从会议记录到知识资产沉淀的一站式解决方案。
AssemblyAI——开发者首选的语音识别API,用行业领先的准确率构建下一代语音AI应用
AssemblyAI提供生产级的语音转文本API,以93.3%+的词准确率和低至$0.15/小时的价格支持99种语言。平台集成了说话人分离、PII识别、摘要生成等语音理解能力,并支持低至300ms延迟的实时流式转录,被超过20万开发者用于构建语音代理、会议记录和对话分析等应用。
SOUNDRAW——100%版权安全的AI音乐生成器,每首曲子都允许商用和分成
SOUNDRAW是一款AI音乐生成平台,其训练数据完全来自自有制作人原创曲库。用户可通过混搭曲风、调节强度与长度生成无限免版税音乐,并可导出分轨(Stems)用于专业混音。授权协议允许商用、发行与保留全部版税,适合内容创作者与音乐人。
LOVO AI——集成AI视频编辑器的拟人化TTS平台,500+声音、100+语种
LOVO AI是一款高拟真文本转语音与视频创作平台,核心产品Genny集成语音生成与在线视频编辑,提供500+声音、100+语言及AI脚本撰写、自动字幕等功能。支持语音克隆与团队协作,适合内容创作者、营销人员和教育培训者使用。
Typecast——用700+真人声库和“智能情感”技术,为每个故事找到对的声音
Typecast是一个AI语音与视频内容创作平台,提供基于真人录制的700+声音库和语音克隆功能。其核心的Smart Emotion技术能自动为文本匹配语调与情感,并支持API集成与移动端同步,适合从个人创作者到企业的各类配音需求。
FakeYou——AI名人语音与视频生成器,让“任何人”说你想听的话
FakeYou是一款AI语音与视频生成工具,允许用户用大量名人、动漫角色等声音,通过文本或语音生成音频。支持简单语音克隆,部分声音为社区训练(非官方授权),适合娱乐、梗图创作和创意内容。
Voicemaker——高性价比AI配音平台,130+语种、1500+声音,免费标准TTS无限使用
Voicemaker是一款AI文本转语音工具,提供130+语言和1500+声音选择,支持情绪控制、语音克隆、语音转语音及API集成。ProPlus模型支持SSML与语音效果,免费版提供无限标准配音。适用于视频配音、课程制作与IVR系统。
Murf AI——从配音工作室到实时语音Agent,用AI生成专业级人声
Murf AI是一款AI语音生成与对话平台,提供200+超拟真声音、20+语言及克隆功能。其Falcon TTS API以行业领先的55ms延迟支持实时语音Agent部署,Studio编辑器可同步音频与视频,适用于视频配音、课程制作与智能客服等场景。
Krisp——AI降噪与会议助理,让远程沟通更清晰高效
Krisp是一款AI语音平台,提供双向降噪、AI口音转换和会议智能助理功能。它能实时转录、生成摘要和行动项,支持多语言翻译,并集成到Zoom、Teams等会议工具中。个人和团队版均有免费试用。
Mureka——用一句话灵感生成完整原创歌曲,支持自定义歌手与混音
Mureka是一款AI音乐生成平台,用户通过描述灵感即可生成带人声的完整歌曲。平台提供自定义歌词、参考歌曲混音、自定义歌手声音等进阶功能,主打高音质输出。付费计划起价$7.17/月,适合内容创作者、独立音乐人及对音乐品质有要求的普通用户。
MiniMax Audio——超拟人语音大模型,从10秒克隆到40+语种,让AI说话像真人一样有温度
MiniMax Audio是MiniMax旗下的AI语音平台,提供文本转语音、声音克隆、音乐生成等功能。其自研的Speech系列模型支持40+语种、超长文本、情感表达与低延迟交互,已被LiveKit、Pipecat、高途、喜马拉雅等全球头部平台与产品采用。
Noiz AI——不只是“人声克隆”,用声音模型再造数字世界的“物理感”
Noiz AI是一家专注于全维度声音生成的AI技术公司,覆盖语音、音效、环境声、音乐等。其AudioX-Turbo模型支持“万物生音”(Anything-to-Audio),能通过文本、视频或图像在0.24秒内生成10秒高质量声音,已开源并服务约120万全球用户。
天谱乐——用对话式AI创作音乐与视频,一键生成完整作品
天谱乐是趣丸科技旗下的AI音乐品牌,提供音乐与视频生成的全链路创作平台。其核心产品“Tunee”支持对话式指令完成编曲、人声与视觉生成,生成最多5分钟的完整歌曲;TemPolor Melo-D则是全球首款生成式AI吉他。平台致力于通过模型、Agent和硬件三维布局,降低音乐创作门槛。
语音 AI——一款实时变声与语音克隆工具,堪称游戏直播与内容创作领域的“语音皮肤”。
Voice AI是一款面向Windows的实时语音变换与克隆平台,通过虚拟麦克风技术将声音实时应用到游戏、直播、会议等场景。提供数百种音色库与自定义克隆功能,支持与Discord、Zoom、OBS等应用集成,已服务全球数百万创作者与游戏玩家。
LALAL.AI——专业级AI音轨分离工具,从人声提取到VST插件,音乐制作人的“声音拆解师”
LALAL.AI是一款AI驱动的专业音轨分离平台,通过深度学习模型精准提取人声、鼓、贝斯、吉他等乐器。2025年发布Andromeda模型,在Meta基准测试中名列商业工具第一。现已推出支持7轨分离的VST插件,可直接在DAW中本地运行,保护未发布作品隐私。
Udio——用文字描述就能生成完整歌曲的AI音乐创作平台
Udio是一款AI音乐生成工具,用户通过文字描述即可生成带人声和伴奏的完整歌曲。它支持音频上传混音、音轨分离下载、歌词编辑、人声复制等进阶功能,并以出色的音频质量著称,尤其擅长处理摇滚、爵士等原声乐器为主的音乐风格。
Notta——AI会议记录与转写工具,把语音对话变成可搜索的知识库
Notta是一款AI会议记录工具,支持58种语言的实时转写与翻译。它能将会议、访谈或讲座内容自动生成文字稿、摘要,并通过“Notta Brain”功能进一步生成PPT和信息图等可视化交付物。适合高管、销售、咨询师和研究人员提升会议信息利用效率。
Voicemod—— 实时变声器与音效板,让游戏语音和直播 “活” 起来
Voicemod是一款实时变声器软件,提供丰富的AI变声器和音效库,支持在游戏、直播、语音通话等场景中即时变换声音或播放搞笑音效。它通过虚拟麦克风技术无缝集成,无需额外硬件即可使用。
Flow Music——和AI音乐制作人对话,从零开始创作完整歌曲
Flow Music是一个AI音乐创作平台,用户可以通过与AI“制作人”对话来生成完整歌曲,支持风格控制、细节调整和音轨分离。它集成了Lyria 3等前沿音乐模型和Veo视频模型,支持导出至主流DAW,是一个从灵感到发布的完整音乐创作空间
NaturalReader——超过1000万用户选择的AI文本转语音工具,从个人阅读到商业配音都够用
NaturalReader是一款AI文本转语音工具,提供自然的人声朗读,支持PDF、网页、图片等多种格式。具备AI播客生成、语音克隆、多语种配音等功能,适用于个人学习、教育场景及商业视频配音。已服务全球超1000万用户。
音剪——喜马拉雅出品的一站式音频创作平台,从降噪到AI有声书全包圆
音剪是喜马拉雅推出的在线音频编辑与AI创作平台,提供AI降噪、智能配乐、AI有声书生成、角色音切换、自动分段等功能。无需下载,支持边看文稿边录制,降低音频制作门槛,适合播客、有声书创作者及音频内容生产者。
Clipchamp——微软官方AI视频编辑器,在浏览器里免费剪片
Clipchamp是微软出品的在线视频编辑器,集成AI自动字幕、文本转语音、噪音抑制等功能,并内置免版税素材库。无需下载,支持高画质导出,无使用限制,面向Windows与Mac用户提供从录制到剪辑的一站式解决方案。
VEED.IO——浏览器里的AI视频工作室,从生成到字幕一站式搞定
VEED.IO是一个在线AI视频编辑平台,支持文本生成视频、自动字幕、AI配音、去除背景噪音和8K增强等功能。它集成了Sora 2、Veo 3.1等前沿模型,提供从录制、编辑到一键发布的完整工作流,被Google、Meta等团队使用,适合创作者快速制作高质量视频内容
IBM——全球领先的企业级AI、混合云与关键应用现代化解决方案提供商
IBM(国际商业机器公司)是全球知名的企业级技术与咨询公司,提供包括watsonx AI平台、混合云基础架构、关键应用现代化(如IBM Bob™)、数据与自动化解决方案在内的企业技术。其服务覆盖IT、金融、电信、制造等多个行业,旨在帮助企业实现智能化转型。
通义听悟——开会听课再也不用疯狂敲键盘,AI自动帮你记重点的免费神器
通义听悟是阿里云推出的AI音视频助手,基于通义大模型实现实时语音转文字、智能摘要、多语言翻译、发言人区分等功能。支持上传最长6小时音视频文件,一键生成会议纪要、思维导图和待办事项。免费版每日提供48小时实时记录额度。适合职场人、学生、记者等需要频繁处理音视频内容的群体。
ElevenLabs——让AI说话像真人一样有感情的语音合成神器,有声书播客游戏全搞定
ElevenLabs是一家AI音频研究公司,提供文本转语音、语音克隆、语音智能体等产品。其AI模型能生成具有自然语调、情感和语境理解能力的人声,支持70多种语言和90多种语言的语音识别。平台提供超1万种音色,已被超过750万创作者和企业信赖,广泛应用于有声书、播客、视频游戏、客服等领域。
Adobe Podcast:那个能把手机录音修成录音棚音质的免费AI工具
Adobe Podcast是Adobe推出的免费AI音频增强与播客制作工具,其Enhance Speech功能可一键将手机录音提升至录音棚音质。支持远程录音与文本剪辑,免费版已足够强大。
简单听记:那个藏在百度网盘里的AI会议记录员,到底能帮你省多少事?
简单听记是百度网盘推出的AI语音转文字工具,整合文心一言大模型,支持会议、访谈、课堂录音转写,智能生成纪要,准确率高达97%。全平台可用,连续包月25元。
音述AI:更懂中文的AI音乐创作社区与零门槛智能写歌平台
音述AI是专为中文用户打造的AI音乐创作平台,定位为“全球首个AI音乐社区”。平台无需乐理知识,用户通过文字描述、心情、故事或图片、语音、参考哼唱等多模态输入即可一键生成包含旋律、编曲和AI人声的完整歌曲
讯飞智作:科大讯飞旗下超1210万用户选择的AIGC一站式智能配音与虚拟人创作平台
讯飞智作是科大讯飞推出的AIGC内容创作平台,于2023年4月正式发布,定位为一站式智能配音与虚拟人应用服务平台。平台运用语音识别、语义理解、语音合成、NLP及星火大模型等AI核心技术,提供AI音频制作、AI视频生成、虚拟人形象构建与驱动、多模态交互等一站式服务。核心功能包括:AI配音(文字转语音,支持多语种多风格发音人)、虚拟主播播报(2步生成数字人视频)、数字分身定制(5分钟视频打造专属虚拟形象)、一句话声音复刻、AI分镜创作、PPT转视频、图文转视频等。平台提供300余个公共形象、1000余个创意模板及1000余个发音人资源,累计服务用户超1210万,聚集约500万AI创作者