AI工具分类聚合库 [949 个收录]
全网最全的 AI 生产力工具雷达。包含大语言模型、图片生成、智能音频、视频渲染及自动化编程开发工具,一键直达官方及评测详情。
支持 GraphQL 与 Redis 缓存,可一键读取 949 个工具的参数:
Krisp
KrispKrisp是人工智能驱动的音频处理软件,提升通话和会议的语音质量。通过先进的AI技术,能实时消除背景噪音和人声干扰,让通话更加清晰。Krisp支持双向降噪,能消除你听到的噪音,能确保对方听不到你的背景杂音。具备人声分离功能,能突出主讲人的声音,让会议记录更加准确。Krisp提供会议转录和摘要功能,支持多种语言,帮助用户快速整理会议内容。最新版本增加了口音转换功能,能将不同口音的语音转换为标准发音,进一步提升沟通效率。Krisp适用于多种场景,包括远程办公、在线会议和播客制作等。支持Windows、Linux、Mac、Android和iOS等多种操作系统,确保用户在不同设备上都能使用。
Soundraw
SoundrawSoundraw是专为创作者打造的AI音乐生成器,能根据用户设置的参数(如流派、情绪、乐器、时长等)快速生成背景音乐。用户可以通过简单的操作,选择音乐风格(如流行、嘻哈、古典等),调整节奏、音量、乐器组合等,生成符合需求的音乐片段。Soundraw 的优势是生成的音乐是免版税的,用户可以将这些音乐用于视频创作、播客、广告等多种场景,无需担心版权问题。
Boomy
BoomyBoomy是AI驱动的音乐创作平台,支持用户通过选择不同的音乐风格和流派,快速生成原创音乐作品。平台提供直观的界面和强大的编辑工具,支持音乐的个性化定制和分发。用户能轻松将创作上传至主流流媒体平台。Boomy适合专业音乐人,音乐爱好者和初学者,能降低音乐创作的门槛,让音乐创作变得更加便捷和普及。
Lemonaid
LemonaideLemonaid是一款AI音乐生成工具,专为专业音乐人设计,能自动生成具有旋律、和声和节奏的音乐作品。提供多种风格的音乐生成模式,用户可以根据个人喜好选择音乐类型和节拍,自定义音乐生成过程。Lemonaid的生成效果逼真,音乐质量高,适用于背景音乐、电影配乐、游戏音效等领域。Lemonaid提供Mac和Windows软件下载。
LALAL.AI
LalalLALAL.AI是AI音乐音频处理工具,能快速、精准地将音频或视频中的人声、伴奏、鼓、贝斯等不同音轨分离,支持多种音频和视频格式(如MP3、WAV、MP4等)。工具提供免费的批量上传功能,用户能上传多达20个文件进行处理。LALAL.AI具备去除回音、混响和降噪等功能,能有效提升音频处理质量。工具提供数字声音克隆功能,帮助用户创建个性化的数字声音副本。
Audo Studio
AudoAudo Studio 是AI音频处理工具,能快速去除背景噪音、增强语音。工具操作简单,只需一键能完成音频清理,适合播客、YouTube 创作者和音频视频制作人员使用。Audo Studio 提供多种计划,用户能根据需求选择。工具核心优势在于高效、便捷和高质量的音频处理,能显著提升音频的清晰度和专业性。
AssemblyAI
AssemblyaiAssemblyAI是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。
IBM Watson文字转语音
IbmIBM Watson文字转语音是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。
RESEMBLE.AI
ResembleRESEMBLE.AI 是基于人工智能技术生成逼真和个性化语音的平台。通过深度学习算法分析真实人类声音样本,学习其独特的发声模式和语言特征,然后根据用户输入的文本生成相似的语音。可以用于多种应用场景,如内容创作、电影和动画产业、广告行业以及个人使用等。
讯飞智作
Peiyin讯飞智作是科大讯飞推出的一站式AIGC内容创作平台,基于人工智能技术提供文字转语音、虚拟数字人视频制作等服务。用户可以轻松实现音视频内容的快速生成,无需专业技能即可创作出高质量的媒体作品。广泛应用于媒体、教育、企业等多个领域,助力内容创作者提升工作效率,实现创意的快速落地。
Clipchamp AI旁白生成器
ClipchampClipchamp AI 旁白生成器是Clipchamp推出的在线AI语音生成工具,能将文本快速转换为逼真的语音画外音。工具支持 400 多种声音和 80 种语言(包括中文),用户能自由调节语调、情感和语速(0.5 倍至 2 倍),添加自然的字幕提升视频无障碍体验。Clipchamp 能轻松满足社交媒体视频、企业演示和教育内容登多种需求,是创作者提升视频质量的利器。
Speechify
SpeechifySpeechify 是强大的文字转语音(TTS)工具,支持多平台(如 iPhone、iPad、Android、Mac、网页版、Chrome 扩展等),能轻松朗读任何文档、文章、书籍、PDF和电子邮件。工具通过 AI 技术将文本内容转换为自然流畅的语音,提供 200+ 种语音选择,覆盖 60+ 种语言,支持声音克隆。Speechify 能帮助用户提升阅读速度至 4.5 倍,节省时间。工具适合有阅读障碍的人群,能广泛应用在学习、工作和日常阅读中,助力超过 5000 万用户高效获取信息。
Veed AI Voice Generator
VeedVeed AI Voice Generator是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。
Typecast
TypecastTypecast 是先进的AI语音生成平台,支持将文本高效转化为自然流畅的语音内容。平台提供丰富多样的语音风格,涵盖不同年龄、性别和场景,支持多语言生成,能通过智能情感识别技术,根据文本上下文自动调整语音的情感和语调。支持用户上传音频样本进行语音克隆,实现个性化语音定制。Typecast 操作简单,界面友好,广泛应用在视频制作、音频创作、教育等领域,助力创作者快速生成高质量的语音内容,提升工作效率。
Murf AI
MurfMurf AI 是多功能的AI语音生成器,专为企业和创作者设计。工具支持 200 多种语音和 20 多种语言,能快速将文本转换为逼真的语音配音。用户能通过语音克隆、风格调整等功能,生成自然流畅的语音内容,适用广告、培训、播客、有声读物等多种场景。Murf AI提供 API 和多平台集成,帮助企业高效制作语音内容,降低制作成本,提升生产效率,是全球众多企业信赖的语音解决方案。
LOVO AI
LovoLOVO AI是专业的AI文字转语音工具,提供500+声音和100种语言的文本转语音服务。专为营销、培训、社交媒体等视频内容创作设计,支持无缝音频视频同步、自动字幕生成、AI写作辅助和声音克隆技术。LOVO AI通过其易用的界面和强大的编辑工具,帮助用户节省时间和成本,提升内容的全球吸引力和专业度。
Play.ht
PlayPlay.ht是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。
NaturalReader
NaturalreadersNaturalReader 是AI文本转语音工具,能将各类文本转换为自然流畅的语音,支持 PDF 等 20 多种格式和 50 多种语言。工具特色功能包括由大型语言模型驱动的多语言语音、语音克隆技术及内容感知能力,使语音更自然、更像人类。NaturalReader 的 AI 语音生成器工作室支持用文本创建旁白音频,适用 YouTube、培训、在线学习、有声读物等多种商业用途,是提升文本可访问性和内容创作效率的强大工具。
FakeYou
FakeyouFakeYou 是AI文本转语音平台,用户输入文本,选择喜欢的卡通角色或名人声音,角色能“说出”自己想要的内容。平台支持文本到语音、语音转换、语音克隆等多种功能,且提供零样本语音合成技术,没有大量样本也能生成逼真的声音。FakeYou 拥有丰富的角色声音库,包括米奇、瑞克、比尔·盖茨等,广泛应用在创意视频、音频制作和个人娱乐等领域,深受全球用户喜爱。
Mubert
MubertMubert 是AI音乐生成平台,通过简单易用的方式为用户提供个性化的音乐创作和使用体验。用户可以通过输入关键词(如音乐风格、情绪、场景等)来生成符合需求的免版税音乐,适用于视频背景、播客配乐、商业项目等多种场景。提供了多个功能模块,包括 Mubert Render(快速生成背景音乐)、Mubert Studio(艺术家上传样本并创作)、Mubert API(为开发者提供定制化音乐解决方案)、Mubert Play(适合生活场景的音乐播放)等。
WellSaid
WellsaidWellSaid 是AI 语音生成工具,提供高质量、自然逼真的语音生成服务。工具拥有超过120种自然声音,涵盖多种语言和风格,基于专业配音演员的授权录音,确保语音的高质量和多样性。工具支持团队协作、发音库管理、自定义语音等功能,同时符合 SOC2 和 GDPR 标准,保障数据安全与隐私。WellSaid 提供强大的 API 集成,适用企业级应用,如培训、营销、产品体验等,帮助企业高效生成语音内容,提升工作流程效率。
Voicemod
VoicemodVoicemod 是强大的AI实时语音变声工具,提供音效控制界面。工具基于先进的 AI 技术,让用户能在语音通话、游戏、直播等场景中轻松改变声音,提供超过150种变声效果和数千种音效。工具支持 Windows 和 macOS 系统,还与 Discord、Steam 等平台无缝集成。用户用热键能快速切换音效,通过 Voicelab 创作个性化声音。Voicemod 简单易用的界面和强大的功能,让语音互动更加有趣和多样化。
Listnr
ListnrListnr 是先进的AI语音合成工具,能将文本快速转化为自然流畅的语音。工具支持超过142种语言和1000多种声音风格,支持用户克隆自己的声音。Listnr 生成的语音极为逼真,与真人无异,适合多种场景,如视频配音、播客制作、有声读物创作、社交媒体内容生成等。工具提供情感调整、语速控制等高级功能,操作简单,界面友好,是内容创作者和企业用户的理想选择。
Voice.ai
VoiceVoice.ai 是先进的实时AI变声工具,提供高质量的语音解决方案。平台支持文本到语音(TTS)、语音克隆、语音变声等多种功能,能生成高度逼真的语音,支持多种语言和方言。Voice.ai 提供企业级语音Agent,neng 自动化处理电话通话,帮助企业降低成本、提高效率。Voice.ai 强大的 API 和 SDK 为开发者提供灵活的集成方案,适用直播、游戏、培训等多种场景。Voice.ai 以低延迟、高合规性和易于扩展的特点,为企业和个人提供高效、个性化的语音交互体验。
Voicemaker
VoicemakerVoicemaker.in是功能丰富的AI文字转语音在线平台,支持130+种语言和1000+种AI语音音色。用户可自由调整语速、音调、音量、强调语气等参数,支持SSML高级控制和多语音混合编辑。平台提供语音克隆、Speech-to-Speech转换、RESTful API等高级功能,生成的音频可下载为MP3格式并享有商业使用权。适合播客制作、视频配音、有声读物和电子学习等多种场景。
MetaVoice
ThemetavoiceMetaVoice是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。
Producer.ai
RiffusionProducer.ai 是AI 音乐创作平台。通过先进的 AI 技术,为用户提供了一个简单易用的音乐创作环境,帮助用户激发创造力并快速生成音乐作品。用户可以通过自然语言与平台的核心功能,Producer 进行交互,生成音乐、歌词,进行混音和替换作品中的部分段落。用户能上传或录制自己的音频,用于进一步的创作。Producer.ai 的界面友好,操作简单,适合所有水平的创作者。平台采用了最新的音乐模型 FUZZ-2.0,能生成高质量的音乐作品。
网易天音
Tianyin网易天音是网易推出的一站式AI音乐创作工具,为用户提供简单易用的音乐创作。音乐爱好者或者歌手只需输入灵感,AI能辅助完成词、曲、编、唱,生成AI初稿后,支持词曲协同调整。用户无需专业音乐知识,通过选择风格、节奏等参数,快速生成个性化的音乐作品。网易天音丰富的模板和智能生成功能,让音乐创作变得简单又高效,适合音乐爱好者、内容创作者和专业人士使用。
Notta
NottaNotta是语音转文本工具,能将音频和视频内容实时转录成文字,支持多达 58 种语言。工具自动生成会议摘要、提取关键信息和行动项,将重要内容剪辑成片段分享给团队成员。Notta 具备会议录制、日程安排等功能,支持与 Slack、Salesforce、Notion 等多种常用工具无缝集成,极大地提升工作效率。Notta适用任何现代设备,如PC、智能手机和平板电脑,从麦克风转录在线会议、网页音频、音频文件和现场录音,Notta都能处理,是提升会议效率和团队协作的利器。
BGM猫
BgmcatBGM猫是北京灵动音科技有限公司推出的AI智能生成BGM音乐的工具,用户只需选择音乐时长和对应标签工具能自动生成BGM。工具具提供多种音乐风格和场景选项,如节奏感、爵士、轻音乐、旅行、搞笑等,帮助用户轻松找到合适的背景音乐,提升视频的吸引力和专业度。BGM猫能简化音乐创作过程,让视频制作更加便捷高效。
Adobe Podcast
PodcastAdobe Podcast 是Adobe推出的在线AI音频录制和编辑工具,专为播客创作者、声音工作者及内容创作者设计。工具基于 AI 技术优化语音质量,去除背景噪音和回音,让声音清晰且专业。用户无需下载软件,直接在浏览器中即可录制、编辑音频,支持多人远程协作。Adobe Podcast提供转录功能,支持多种语言,可将音频转换为视频,生成字幕,方便在不同平台分享,助力创作者高效产出高质量音频内容。
Uberduck
UberduckUberduck是一个开源的AI语音生成和合成的社区,该平台提供了超过5000多种声音帮助用户制作AI配音和语音,用户可以从文本生成逼真的语音、歌唱和说唱,创建自定义语音克隆。支持多种语言,提供API访问,开发者能将这些功能集成到自己的应用程序中。
魔音工坊
Moyin魔音工坊是一款专业的AI配音工具,拥有800多款声音和1000多种风格,满足从视频配音到有声书的广泛需求。魔音工坊提供丰富的功能,包括语速调整、多音字选择、停顿控制等,确保文字转语音的效果逼真自然。用户可以轻松下载无损音频文件,享受便捷的配音体验。魔音工坊还提供会员服务,带来更多特权和优惠,是内容创作者和专业人士的理想选择。
BeatBot
BeatbotBeatBot是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。
beatoven.ai
Beatovenbeatoven.ai是AI音乐生成平台,旨在为视频、播客和游戏制作者提供版权免费的背景音乐。用户只需输入音乐想法,能快速生成超过250种风格的音乐。平台支持个性化定制,包括音乐长度、风格、情绪和乐器选择,满足不同创作需求。beatoven.ai的音乐具有高质量混音和母带处理,适合直接使用。提供灵活的定价方案,包括免费版、标准版和高级版,适应不同用户的预算和需求。
悦音配音
Yueyin悦音配音是由深圳制片帮网络科技有限公司开发的AI+真人配音平台,已服务超1000万用户、累计合成音频突破3亿条。平台提供数百款发音人和近千种风格选择,涵盖男声、女声、童声、方言及多语种,支持语速调节、多音字处理、停顿调节、情绪选择等精细化编辑功能。输入文字3秒即可生成拟人音频,支持MP3/WAV无损格式导出,是自媒体创作者和商业用户的专业配音工具。
ACE Studio
AcestudioACE Studio是时域科技推出的免费AI音乐合成工具,基于AI技术帮助用户快速生成专业品质的歌声和乐器演奏。工具提供歌声合成、AI小提琴、声线转换和克隆等功能,支持用户通过简单的MIDI输入或声音样本创建音乐作品。ACE Studio具备音频分离、采样生成等辅助工具,及与数字音频工作站(DAW)的无缝集成能力,极大地简化音乐制作流程,适合音乐制作人、作曲家、教育者及音乐爱好者使用。
网易云音乐·X Studio
Xstudio网易云音乐·X Studio是网易云音乐与小冰公司联合推出的免费AI歌手音乐创作软件,支持Windows和macOS双平台。用户导入MIDI文件和歌词后,3秒内即可生成专业歌手水准的AI演唱干声,支持滑音、转音、颤音、咬字等多维度参数精细调节。平台提供约27位风格各异的AI歌手(涵盖流行、民谣、国风、电子、摇滚、戏曲等曲风),最高支持30轨AI合唱,面向音乐创作者和爱好者。
ElevenLabs
TryElevenLabs 是AI文字转语音平台,为开发者、创作者和企业提供逼真的语音合成解决方案。核心产品包括文本转语音(支持包括中文在内的 29+ 语言、10,000+ 声音)、AI 配音、语音克隆、音乐生成等功能。平台以超低延迟、情感丰富的语音质量著称,广泛应用在有声书、视频配音、客服中心和内容本地化等场景。
Stable Audio
StableaudioStableAudio 是Stability AI 提供的AI音乐创作平台。平台通过文本生成音乐(Text-to-Audio)和音频生成音频(Audio-to-Audio)的方式,用户只需输入文字描述或上传音频素材,能生成符合要求的音乐。平台支持生成长达3分钟的音频,格式为44.1kHz立体声。平台生成的音乐能用在商业项目。平台适合音乐创作者、制作人及对音乐创作感兴趣的普通用户。
大饼AI变声
Dubbing大饼AI变声(Dubbing.tech)是一款功能强大、免费专业的实时语音变声软件,是国内首款基于AI深度学习的声音引擎,并且支持全场景切入,兼容和支持多种游戏以及语音客户端。该AI变声软件的音色丰富多样,有数百种音色可供选择,并且每期提供免费的变声音色。除了实时变声,大饼声音引擎SaaS版还提供了文字转语音、声音克隆、声音定制、声音转换等功能,全方位地满足对多元声音的需求。
快转字幕
Kzzimu快转字幕是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。
Audiobox
AudioboxAudiobox是Meta推出的免费AI语音和声音生成模型,能结合语音输入和自然语言文本提示生成语音和音效。模型包含Audiobox Speech(专注语音生成)和Audiobox Sound(专注音效生成)等专业模型,底层基于共享的自监督模型Audiobox SSL。Audiobox具备语音风格转换等独特功能,是首个实现语音与文本双输入自由语音风格转换的模型。Audiobox能降低音频创作门槛,让任何人都能轻松创作出个性化的音频内容,能用在视频、播客、游戏等多种场景。
Suno
SunoSuno是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。
Reecho睿声
ReechoReecho睿声是一个超拟真瞬时AI语音克隆平台,利用先进的AI语音技术,允许用户通过上传或录制一段音频样本,来创建并克隆特定的声音角色。该平台的特点是能够快速地从较短的音频样本中克隆声音,而不需要长时间的训练过程。Reecho睿声基于中文领域领先的SOTA语音大模型技术,可一定程度上理解文本上下文,并以与真人几乎无异的表现力、情感、韵律和音色来基于文本生成人声音频,并且支持以5秒极短样本进行瞬时语音克隆。
Deepgram
DeepgramDeepgram是一个提供先进的AI语音识别和自然语言处理技术的平台,核心功能是强大的语音到文本(Speech-to-Text)和文本到语音(Text-to-Speech)API,让开发者能够快速将语音转录和理解功能集成到他们自己的应用程序和服务中。 Deepgram声称其服务在准确性、成本效益和速度方面都具有行业领先优势,它的GPU基础设施优化了语音和语言模型的性能,提供了高达40倍的转录速度和便宜3~5倍的成本。
蓝藻AI
Aigc蓝藻AI是云知声公司开发的人工智能内容创作平台,专注于AI声音克隆、文字配音和文案创作服务。用户可以通过该平台训练克隆个性化的语音模型,生成与原音相似的合成音频,或选择多样的AI发音人进行文字配音,同时提供细致的声音调节选项。此外,蓝藻AI还能基于提示词或模板自动生成文案,并辅助用户进行文案编辑。
音虫
Soundbug音虫SoundBug是一款由国内团队研发的数字音频工作站(DAW)软件,以其简洁直观的用户界面和易于上手的操作特点,为音乐爱好者和音乐学习者提供了一套完整的音乐制作工具。SoundBug支持Windows和Mac电脑端使用,内置了AI编曲、丰富的音色库和必要的音频编辑功能,致力于帮助更多的音乐爱好者体会音乐创作的乐趣。