AI工具分类聚合库 [949 个收录]
全网最全的 AI 生产力工具雷达。包含大语言模型、图片生成、智能音频、视频渲染及自动化编程开发工具,一键直达官方及评测详情。
支持 GraphQL 与 Redis 缓存,可一键读取 949 个工具的参数:
EmotiVoice
需求人群 EmotiVoice可用于语音合成应用,包括人机交互、教育、娱乐等领域。 产品特色 支持英语和中文 拥有超过2000种不同的语音 提供情感合成功能
AdutorAI
需求人群 AdutorAI适用于各种场景,包括会议记录、学习笔记、个人思考等。它是一个多功能的工具,可简化文本处理过程。 产品特色 将口述的话语转换为清晰、无误的文本 处理长达3分钟的音频剪辑 轻松保存和编辑转录内容 编辑、精炼和完善转录内容 使用AI总结、翻译、调整文本长度等功能 适用于会议记录、学习笔记、个人思考等场景
Lyria
需求人群 DeepMind 音乐生成器可用于音乐创作、音乐制作和音乐风格转换等场景。 产品特色 生成高质量的音乐作品 执行转换和延续任务 提供风格和表演控制 创建新的音乐或器乐部分 将音频从一种风格或乐器转换为另一种 创建器乐和人声伴奏
luca.ai
需求人群 家长、教育者、学校和教师 使用场景 家长可以通过LUCA定制故事,帮助孩子提高阅读能力。 教师可以利用LUCA的语音识别功能,对学生进行实时干预。 学校可以采用LUCA的个性化教学,提升学生的阅读水平。 产品特色 定制故事 语音识别 个性化教学
Jamit.app
需求人群 用户可以在Jamit上聆听不同类型的故事,创作者可以在平台上发展自己的社区并与听众互动。 产品特色 原生音频娱乐 全球覆盖和分布式托管 互动奖励和独特NFT体验 自由创建和发展社区
Transcriptmate.com
需求人群 适用于播客制作人、YouTuber、记者和其他需要将音频转化为文本的人士。 产品特色 将音频文件转换为文本 支持长达3小时的录音文件 高准确度的转录结果 支持多种语言 支持多种文本格式保存 安全支付
Emastered
需求人群 音乐制作、音频后期处理 产品特色 上传音轨并自动应用专业处理 提供高质量的音频母带 提供自定义参数调节功能
Insanely Fast Whisper
需求人群 适用于需要大量语音输出的场景 产品特色 快速将文本转换为语音 高质量的语音输出 可选择多种语音类型和速度
MyNeo AI
需求人群 适用于各种沟通场景,包括社交聊天、工作沟通、语言学习等。 使用场景 使用 MyNeo AI 与朋友进行智能聊天 在工作中使用 MyNeo AI 进行语音输入和翻译 通过 MyNeo AI 学习外语并进行语音对话 产品特色 个性化 AI 助手 智能键盘输入 语音识别与翻译 智能聊天功能
StyleTTS 2
需求人群 适用于文本转语音合成任务 产品特色 通过风格扩散生成最适合文本的风格 使用大型预训练的 SLMs 作为判别器 具有创新的可微持续时间建模 在单说话人和多说话人数据集上实现人级别的 TTS 合成
Relevant
需求人群 用于协助播客制作和提供实时内容建议的工具 产品特色 实时内容建议 话题检测和过滤 实时转录
Nonoisy
需求人群 适用于需要音频后期处理的创作者,包括播客制作人和视频创作者。 使用场景 播客制作人使用Nonoisy去除背景噪音,提升音频质量 视频创作者利用Nonoisy进行音频后期处理,提高视频制作效率 音乐人使用Nonoisy调整音频音量平衡,提升作品质量 产品特色 去除背景噪音 音频后期处理 音量平衡调整 快速处理
RealtimeTTS
需求人群 适用于语音助手和需要即时音频反馈的应用 产品特色 实时流式合成和播放 高级句子边界检测 模块化引擎设计
OnePlus AI Music Studio
需求人群 OnePlus AI Music Studio适用于音乐制作爱好者、专业音乐人和创作人士,他们可以使用该工具创作、制作和定制自己的音乐作品。 产品特色 AI创作 智能合成 自动和声 实时音频处理
Soundbite
需求人群 用于改善企业内部沟通、提高员工参与度、节约时间 使用场景 将重要通知推送到员工的 Microsoft Teams、SMS 等设备 节省使用视频、播客和员工通信应用的费用 通过高级报告了解组织和个人的参与情况 产品特色 提供多渠道通知 类似消费者的体验 消除视频、播客和员工通信应用的需要 提供高级报告,展示详细参与情况
Rythmex Converter Online
需求人群 用户可以用Rythmex来转录采访音频、录音或视频通话、教育音频或视频等各种场景。 使用场景 转录采访音频 转录视频通话 转录教育音频 产品特色 上传音频或视频文件 选择对应语言 编辑并下载转换后的文本
Whisper
需求人群 适用于需要进行语音识别的应用场景,如语音助手、语音转写等。 产品特色 多语言语音识别 语音翻译 语种识别
MAIVE
需求人群 适用于音乐家、播客主的 AI 艺术应用程序,可生成与音频配套的引人入胜的 AI 视频、reels 和图像。 产品特色 导入音频并生成与之配套的艺术作品 生成 AI 艺术图像 导出音乐视频和 reels
Voice Changer
需求人群 用于游戏开发、视频制作、内容创作等 使用场景 游戏开发者使用AI语音转换器为游戏角色生成声音 视频制作人员使用AI语音转换器为动画角色配音 内容创作者使用AI语音转换器为社交媒体内容生成吸引人的语音 产品特色 将声音转换为另一个角色 控制情感和交付方式 编辑和微调配音 选择和定制声音 自定义声音的高级设置 生成高质量音频
Jat Ai Hub
需求人群 Jat Ai Hub适用于需要大量创作的个人、企业和创作者,可以用于写作、内容改进、广告创作等场景。 产品特色 文章生成 内容改进 文字转语音 图像创建 代码生成
Toolsummary
需求人群 用户可以使用Finest AI tools at your Fingertips来处理图像、编辑视频、写作、将语音转换为文字等。 产品特色 AI图像处理 AI视频编辑 AI写作助手 语音转文字
AudioStrip
需求人群 音乐人使用AudioStrip来分离人声和伴奏,以便进行混音和后期制作。 使用场景 音乐人使用AudioStrip分离人声和伴奏,进行混音 DJ使用AudioStrip分离人声,制作混音 音乐制作人使用AudioStrip进行音频处理 产品特色 完美的人声分离 多首歌曲的轻松分离 使用AI转录音乐 即时AI母带处理
Merse
需求人群 用户可以使用Merse记录自己的生活、故事、经历等,并将其转化为不同形式的记录,让自己的故事得以传承。 产品特色 记录生活、故事、经历等 转化为漫画、书籍、电影、语音记录、自传等形式 传承用户的故事、经历
DuckTrack
需求人群 用于记录和回放计算机的鼠标、键盘操作和屏幕录制,适用于训练计算机代理模型、教学演示和用户行为研究等场景。 产品特色 准确记录鼠标和键盘操作 提供屏幕录制功能 支持暂停 / 恢复录制以屏蔽私人信息
Malloy
需求人群 适用于各种视频转录场景 产品特色 准确识别行业术语和地方俚语 快速、准确、经济实惠 与专业人工转录相结合,确保质量
Soundify
需求人群 适用于需要优化、编辑音频的各种场景,如视频制作、播客、混音等 使用场景 使用Soundify提升混音音质 使用Soundify减少播客录音的背景噪音 使用Soundify修复老录音带的杂音和损坏 产品特色 音频修复 音质增强 去噪 音频切割 调整播放速度
StockmusicGPT
需求人群 适用于个人和商业项目中需要背景音乐的场景 使用场景 个人视频制作 商业广告 电影配乐 产品特色 选择音乐类型 自定义设置 生成符合需求的音乐作品 下载和分享创作的背景音乐
Blerp Sound Memes. AI TTS Voices Emotes GIFS
需求人群 用于聊天和直播社区中播放声音模因、表情GIF和声音提示。 使用场景 观众可以在Twitch上使用Blerp Sound Memes分享声音模因 主播可以在YouTube上使用Blerp Sound Memes播放声音提示 观众可以在Tiktok上使用Blerp Sound Memes收集频道积分 产品特色 AI TTS声音模因 表情GIF 声音提示 多语言支持 聊天面板 频道积分 WalkOn Sounds
AI Grammar & Translate
需求人群 ["学生","专业作家","需要高效沟通的人"] 使用场景 我打开APP,语音对着手机说了一段话,APP自动识别转换成文字 我在APP里写了一篇英文文章,点击语法纠正,APP自动校正了我的语法错误 我用APP把这篇文章翻译成了法语 产品特色 语音转文字,支持20余种语言 写作辅助,语法纠正 支持20多种语言互译
Earkind
需求人群 用于听取人工智能相关新闻、笑话和研究论文解读的播客 产品特色 使用语言模型和文本转语音技术生成播客剧集描述 提供有趣且非正式的播客内容 包含主持人和角色之间的对话,涵盖人工智能新闻、笑话和研究论文解读
ClipGlow
需求人群 ["为社交媒体视频添加字幕","增强视频的音频效果","快速高效地剪辑和导出视频"] 使用场景 上传一段舞蹈视频,使用网站提供的工具自动生成字幕并导出 记录一段生活短视频,利用网站为其添加音频特效 上传一段采访视频,使用交互式编辑工具精细调整生成的字幕 产品特色 AI语音转文字 交互式编辑字幕 动态字幕样式 一键导出视频 音频效果集成
VoiceRec
需求人群 ["录制会议","听写笔记","收集灵感"] 使用场景 录制课堂笔记,转成文字方便整理 开会时开启录音,结束后转文字分享给与会人员 采访时同时录音,转换文字后编辑成文章发布 产品特色 语音录制 语音转文字 支持多语言 支持导出
DubbingAI
需求人群 ["游戏玩家可选择不同的游戏人物语音沉浸式游戏","主播可塑造自己的语音形象吸引更多观众","用户可在社交平台中体验不同的语音效果"] 使用场景 玩家可在《英雄联盟》游戏中将自己的语音转换为人物吉恩的语音效果 主播在直播吃鸡游戏时使用不同语音与队友聊天 用户在Discord社交平台与好友聊天时转换自己的语音 产品特色 实时转换语音效果 1000多种语音和100多种语言可供选择 资源占用极低(只占用2-3%的CPU) 支持多个平台(Windows、Mac等) 支持各类游戏软件和社交平台 支持多种语音效果(游戏人物、动漫人物、名人等)
GPT4Audio
需求人群 适用于需要将音频转录为文本的个人、学生、专业人士和企业等 产品特色 将音频文件转录为文本 支持多种语言的翻译 通过麦克风进行口述,实时生成文本和音频录音
free text Into Speech
需求人群 可以用于将文字内容转换为语音,方便听写、朗读、学习等场景。 产品特色 支持多种语言的文本转语音 自然的发音 免费使用,无需注册 转换速度快
Whisper Memo Dictation
需求人群 可以用于将语音备忘录转录为文字的场景。 使用场景 将会议记录的语音备忘录转为文字备份。 在学习时使用语音备忘录记录要点,然后转为文字复习。 在旅行中使用语音备忘录记录旅行日志,然后转为文字保存。 产品特色 轻松录制和转录音频文件 无需互联网进行转录 所有数据在设备上处理 即时获取转录结果 自动检测语言 支持 5 个转录结果 界面简单易用 后台录制 分享转录结果至邮件和其他应用
DDLE.DEV
需求人群 ["向用户演示网站","产品推广","网络营销"] 使用场景 创建1分钟网站演示视频,向用户展示产品 生成演示链接,在社交媒体上分享 作为网络营销素材,吸引用户点击 产品特色 全屏录制网站 AI生成语音解说 生成立即分享链接 无需下载使用
Vibrato
需求人群 商务电话助手 使用场景 使用Vibrato与客户进行商务谈判 让Vibrato帮助你预约会议和安排行程 让Vibrato帮你节省电话费用和谈判账单 产品特色 多功能的任务处理 实时语音和文字记录 模拟人类声音和智能 自动导航电话系统 节省用户实际费用
Gladia
需求人群 虚拟会议、工作协作、内容制作、呼叫中心 产品特色 实时语音转文本 多语种翻译 音频智能分析
Narrativ.ai
需求人群 在需要多任务处理或者方便听取新闻的场景下使用 使用场景 在上班途中,通过Narrativ.ai听取最新新闻 在做家务的时候,使用Narrativ.ai朗读文章 在运动锻炼时,通过Narrativ.ai听取感兴趣的新闻 产品特色 将书面文章翻译成朗读的音频 流式传输最新新闻 使用克隆声音进行智能朗读
Speechnotes
需求人群 Speechnotes适用于需要快速、准确和私密转录的任何人,如笔记记录、访谈转录、学生记录讲座、博客作者、播客制作人等。 使用场景 学生使用Speechnotes转录讲座笔记 播客制作人使用Speechnotes将录音转为文字内容 博客作者使用Speechnotes进行口述写作 产品特色 实时语音输入 音频和视频录音的自动转录 语音指令用于标点和格式设置 自动大写 易于导入和导出选项
Read
需求人群 适合需要每日了解相关新闻和事件的用户,无需阅读大量内容即可快速获取关键信息 使用场景 金融从业人员使用Read获取每日金融资讯 商业管理者使用Read了解关键行业信息 研究人员使用Read跟进学术领域更新 产品特色 人工智能生成个性化音频新闻 支持邮件订阅功能 提供个性化内容推荐
ITOKA
需求人群 音乐制作、音乐交流、音乐欣赏 使用场景 使用 Muse 引擎制作个人音乐作品 在 MuXiv 市场购买喜欢的音乐作品 通过 Itoka Jukebox 在 Discord 上与朋友们一起欣赏音乐 产品特色 使用 Muse 引擎制作个性化音乐 在 MuXiv 市场买卖或竞拍音乐 通过 Itoka Jukebox 在 Discord 上体验 24/7 Web3 音乐
Merlin Sound ID
需求人群 户外爱好者、鸟类观察者、生态保护人士 使用场景 户外鸟类观察者可以使用Merlin Sound ID来辨别不同鸟类的歌声。 生态保护人士可通过Merlin Sound ID记录鸟类分布情况,为保护工作提供数据支持。 普通用户也可以通过Merlin Sound ID学习鸟类歌声,增进对自然环境的了解。 产品特色 实时识别鸟类歌声 比对录音与Merlin数据库 支持多地区鸟类 通过智能手机录音参与贡献
DapperGPT
需求人群 DapperGPT 可应用于写作、聊天、笔记记录等场景 使用场景 使用 DapperGPT 编写文章并自动填充表单 使用 DapperGPT 进行智能搜索和语音转文字 使用 DapperGPT 记录笔记和生成语音文件 产品特色 智能搜索功能,类似于 Spotlight 语音转文字和文字转语音功能 AI 笔记功能,可快速记录和保存重要信息 Chrome 插件,可在常用网站上自动填充表单 自定义功能,个性化设置
Readbox
需求人群 用户可以使用Readbox将他们喜欢的书面内容转换成播客,以适应他们的生活方式。创作者可以通过Readbox让他们的作品触达新的受众群体,提高作品的价值。 使用场景 将一篇长文转换成播客以便在通勤途中收听 将一篇博客文章转换成播客以方便在健身时收听 将一篇新闻报道转换成播客以便在做家务时收听 产品特色 将书面内容转换成播客 支持高质量内容 支持创作者 遵循开放标准 通过电子邮件提交内容 在喜爱的播客播放器上收听
Xound.io
需求人群 ["YouTuber","TikToker","播客主持人","内容创作者"] 使用场景 Jake H称赞该系统音频增强效果惊人、必备工具 YouTuber Alex R表示不再担心拍摄时的房间噪音 播客主持人Jessica M表示该APP保证每期节目都有出众体验 产品特色 背景噪音去除 音高校正 音频质量提升
Echonotes
需求人群 ["会议纪要","访谈录音整理","创意写作草稿","项目进展跟踪","备忘录与任务清单","学习笔记整理"] 使用场景 将团队会议讨论内容转化生成会议纪要 将采访录音快速转化为文字进行引用和分析 口述创作草稿,形成初步手稿 产品特色 语音转文字,快速记录想法 支持多种格式转换输出 AI辅助进行智能化处理 可编辑的笔记界面 可导出多种文件格式