AI工具分类聚合库 [949 个收录]
全网最全的 AI 生产力工具雷达。包含大语言模型、图片生成、智能音频、视频渲染及自动化编程开发工具,一键直达官方及评测详情。
支持 GraphQL 与 Redis 缓存,可一键读取 949 个工具的参数:
SiteGuide
需求人群 适用于需要帮助访客找到正确信息的网站,特别是那些访客技术水平较低或视力有问题的网站。 使用场景 一家电商网站使用SiteGuide帮助访客找到他们想要的商品 一家医疗网站使用SiteGuide帮助访客找到他们需要的医疗信息 一家旅游网站使用SiteGuide帮助访客找到他们想要的旅游信息 产品特色 学习您的网站并帮助访客找到他们想要的信息 访客可以直接向SiteGuide提问 SiteGuide会回答访客并引导他们到您网站上的正确信息部分 帮助您了解访客的需求 帮助您添加内容以提高转化率 使用专利技术,只需使用您的声音即可自动打开正确的信息 适用于Wix网站,只需添加一行代码即可使用
Magicast.ai
需求人群 用户可以使用Magicast.ai快速获取各种主题的播客,包括股票市场回顾、数字无障碍、教育、新闻摘要、创业、爱好等。 产品特色 从多个数据库中收集信息 将信息编译成自然而然的、人类般的合成语音音频文件 提供各种主题的播客,包括股票市场回顾、数字无障碍、教育、新闻摘要、创业、爱好等
Respeecher Marketplace
需求人群 ["游戏角色配音","影视作品配音","视频创作配音","语音设计"] 使用场景 游戏公司使用Respeecher为新游戏中不同性别、年龄的角色配音 YouTuber使用Respeecher将自身声音转换为卡通人物的声音 配音员使用Respeecher将自己的配音转换为明星的声音 产品特色 语音转换:支持男声转女声、改变语音年龄、语言转换等 语音塑造:可对语音的音调、音色、语速等参数进行调整 语音配音:可实现人声配音,适用于影视、游戏等领域
I2VGen-XL
需求人群 I2VGen-XL适用于需要使用AI模型和数据集的用户,包括开发者、研究人员、企业等。 使用场景 一个图像识别应用需要使用一个预训练的模型,可以在I2VGen-XL平台上搜索并下载相应的模型。 一个自然语言处理研究人员需要一个中文分词数据集,可以在I2VGen-XL平台上搜索并下载相应的数据集。 一个企业需要使用一个语音识别模型进行客服自动化,可以在I2VGen-XL平台上购买相应的付费服务。 产品特色 提供丰富的AI模型和数据集 支持多种AI任务 上传、下载和分享模型和数据集 提供API接口进行调用 提供免费和付费两种服务
Singify
需求人群 FineShare Singify可供音乐人、内容创作者和任何想要使用他们最喜欢的声音创建独特的AI歌曲翻唱的人使用。 产品特色 从100多个AI声音模型库中选择 添加您最喜欢的歌曲 只需单击即可生成AI歌曲翻唱
Audionotes Pro
需求人群 适用于个人、工作和学习等场景 产品特色 记录语音笔记 上传音频文件 创建文本笔记 生成结构化文本摘要 生成内容 聊天和搜索功能 社交分享功能
Loom AI
需求人群 适用于各种工作场景,如远程办公、协作会议、培训教育等 产品特色 自动生成标题 自动生成视频摘要 创建章节划分 智能识别任务并分配 删除语音中的填充词 自动裁剪静默部分
Amadeus Code
需求人群 Amadeus Code适用于所有需要音乐创作灵感的音乐人,无论是专业音乐人还是业余爱好者。 使用场景 一位刚开始学习音乐创作的学生使用Amadeus Code生成了一首完整的歌曲 一位专业音乐人使用Amadeus Code获得了新的创作灵感,并将生成的MIDI文件导入到他的DAW中 一位业余爱好者使用EAmadeus Code创建了一个新的和弦进程,并将其用于他的下一个音乐项目 产品特色 使用人工智能技术生成无限的旋律和和弦进程 创建完整的歌曲草图或部分 将MIDI文件共享到DAW 免费试用期内使用所有功能 付费用户每月保留无限数量的歌曲,并获得音频和MIDI文件
Ello
需求人群 ["英语阅读能力较弱的儿童","希望提高孩子英语阅读兴趣的家长"] 使用场景 5-7岁儿童可以使用Ello独立阅读适合其水平的图书 父母可以查看孩子在Ello上的阅读进度 孩子可以通过Ello获得奖励以激发学习兴趣 产品特色 倾听儿童朗读真实图书 语音识别评估读法 提供即时反馈与辅导 奖励系统激发学习兴趣
MiniMax开放平台
需求人群 会议纪要、摘要提取等总结说明场景 使用场景 通过 MiniMax 开放平台提取会议纪要,节省总结时间。 利用 MiniMax 开放平台生成摘要,提高阅读效率。 使用 MiniMax 开放平台合成语音,打造有声小说。 产品特色 精确的信息提取能力 高质量的文本理解能力 语音合成能力
Unreal Speech
需求人群 Unreal Speech适用于任何需要将文本转换为语音的应用场景,例如语音助手、有声书、自动化电话系统等。 使用场景 将电子书转换为有声书 为语音助手添加个性化的声音 创建自定义的语音内容 产品特色 通过API将文本转换为语音 支持多种声音和格式选项 实时演示和与其他语音合成引擎比较 根据使用量提供折扣定价
Pronounce
需求人群 Pronounce适用于需要提高英语发音的个人和专业人士。 使用场景 学生使用Pronounce来提高英语口语能力 职场人士使用Pronounce来改善英语发音 英语学习者使用Pronounce来练习发音 产品特色 实时反馈英语发音 跟踪语法、发音和流利度 提供行动建议和练习
TranscribeAudio
需求人群 适用于需要将音频文件转换为文字的个人、团队或企业 产品特色 快速准确的音频转文本 支持导出为PDF或SRT文件 自动识别说话者 即将推出的功能包括生成摘要和行动项,以及识别关键词
Whisper Turbo
需求人群 语音识别和转文字 使用场景 将语音转文字 流式语音识别 利用GPU加速Whisper 产品特色 音频格式转换 兼容OpenAI Whisper API GPU加速 流式和一次性推理
Suno AI
需求人群 Suno AI适用于音乐创作、语音合成、配音等场景 产品特色 创作多种风格的音乐 生成自然流畅的语音 提供丰富的音乐和语音效果 界面简洁友好 支持多种输出格式
LMNT
需求人群 语音创作适用于各种创作场景,包括广告配音、有声读物、游戏角色配音等。 产品特色 创建感情丰富、人类般的语音 定制化声音选择 简单易用的界面 丰富的功能 灵活合理的定价
OneAudio
需求人群 ["记录会议","整理笔记","写作准备","学习复习"] 使用场景 使用 OneAudio 记录重要会议,获得会议记要 录制思维脉络,由 OneAudio 智能地生成文字笔记 语音记录文字创作灵感,再由 OneAudio 转成可分享的笔记 产品特色 实时语音转文字 智能汇总关键点 支持多语言转换 提供在线编辑修改功能 计划支持上传音频文件
Kloud Chat
需求人群 个人助手应用适用于各种场景,包括旅行规划、语言学习、编码和学校作业辅助等。 产品特色 计划旅行 学习新语言 获取编码或学校作业的帮助 生成图片
Mind Meld Canvas AI
需求人群 适用于个人创作者、学术研究者和商业用户 产品特色 智能写作 内容生成 事实核查 协作功能 生成 AI 图像 生成 AI 代码 语音转文字
ImageBind
需求人群 用于多模态数据分析和处理 产品特色 多模态AI 一种嵌入将它们绑定在一起 支持零样本和少样本识别
WisprNote
需求人群 用于转录语音备忘录、会议记录、访谈录音等场景 产品特色 支持常见的音频和视频格式 多种导入和导出方式 提供 Turbo 模式和 Standard 模式
Spotify Voice Translation
需求人群 该功能面向所有Spotify高级会员和免费用户。使用该功能可以听到其他语言版本的热门播客内容,无需再被语言障碍所限制。 使用场景 用户可以听到Lex Fridman、Armchair Expert等热门英语播客的西班牙语版本 用户可以保留原主播Dax Shepard独特的语音风格,听他的播客西班牙语翻译版本 用户可以听到德语和法语版本的热门播客,例如The Rewatchables和Trevor Noah的节目 产品特色 支持播客语音翻译成其他语言 翻译语音保留原主播的语音风格 利用OpenAI语音生成技术,提供逼真自然的翻译体验
EmoPP
需求人群 ["情感语音合成","对话系统","语音助手"] 使用场景 可以应用于需要情绪表达的语音合成系统中,如虚拟角色、对话机器人、语音助手等。 可以用来研究不同情绪下的语音韵律规律。 可以用来提高语音合成的自然性和情感表现力。 产品特色 情绪感知的韵律分析 提高语音合成的情绪表达能力
CLONEDUB
需求人群 适用于需要配音的视频和播客的用户 使用场景 将英语视频配音成西班牙语 将德语播客配音成法语 将日语视频配音成英语 产品特色 高质量快速配音 支持多种输入/输出格式 支持多种语言
VideoDubber
需求人群 适用于需要将视频内容翻译为不同语言的用户,如 Youtubers、企业广告宣传等。 使用场景 Youtuber 使用 VideoDubber 将视频内容翻译为多种语言,扩大受众规模。 企业使用 VideoDubber 将广告视频翻译为不同语言,拓展全球市场。 个人用户使用 VideoDubber 将家庭视频翻译为外语字幕,方便亲友观看。 产品特色 AI 视频翻译 语音合成 多语种支持 免费试用 低廉的价格 无水印内容 下载字幕 帮助中心支持
Speechki
需求人群 适用于创建有声书籍、有声杂志、有声文章等 产品特色 AI 生成自然真实的有声读物 提供 341 种自然音色的声音 支持 77 种语言 定制声音 在 15 分钟内获得完整的有声读物
Fluxon
需求人群 Fluxon可以用于创建各种情境下的人声音频,如营销视频、演示视频、有声书、游戏NPC声音、翻译/配音、聊天机器人、播客等。 产品特色 克隆任何声音 创建对话 合成单一声音 创建嘴唇同步视频 训练自定义声音
AudioBriefs
需求人群 适用于WhatsApp Web的消息转录和摘要 使用场景 将语音消息转换为文字 快速获取语音消息摘要 节省时间 产品特色 将WhatsApp的语音消息转换为文字 提供快速的语音消息摘要 节省时间
Voice-Swap
需求人群 适用于制作演示音频、写歌时需要一个更像你所写歌手的声音、将男声转化为女声或女声转化为男声 产品特色 通过 AI 将你的声音转化为特约艺术家之一的声音 促进远程合作 使艺术家从新的视角听到他们的创意 允许制作人无需支付录音室费用就可以创建逼真的演示
Brainy Buddy
需求人群 Brainy Buddy可以在各种场景下使用,包括但不限于学习、工作、娱乐等。 使用场景 在学习中,可以向Brainy Buddy提问问题,获取知识和解答 在工作中,可以使用Brainy Buddy提供的信息和建议来辅助决策 在娱乐中,可以与Brainy Buddy进行对话和互动,获得娱乐和乐趣 产品特色 回答问题 提供信息和建议 完成任务 语音识别和自然语言处理 自然对话
Mastermallow
需求人群 Mastermallow AI Audio Mastering适用于所有需要音频处理的场景,包括音乐制作、播客制作、内容创作等。 使用场景 将原始音频转化为专业级音频轨道 为播客节目增强音频质量 为音乐作品添加母带效果 产品特色 智能音频分析和增强 原音频与母带效果对比 高质量音频下载
Reppi
需求人群 适用于课堂、会议等场景 使用场景 在会议上记录重要讨论内容 学习课堂笔记的替代方案 帮助听力障碍者理解会话内容 产品特色 高准确度的语音转文字 自动摘要和语言检测 快速转录,节省时间
Tailor
需求人群 用户可以通过选择自己感兴趣的话题和添加喜欢的来源,定制属于自己的播客和新闻简报。适用于希望过滤信息噪音、个性化获取内容的用户。 产品特色 根据用户选择的兴趣领域定制播客和简报 支持添加来源如报纸、Youtube频道、播客等 使用人工智能技术过滤信息噪音 提供文本和音频格式的播客和简报
SpeechPulse
需求人群 SpeechPulse可以在各种场景下使用,包括办公文档编辑、网页浏览、文件转录、视频字幕生成等。 产品特色 实时语音识别 转录音视频文件 生成字幕 支持多种语言 离线使用 支持翻译功能
AVbeam
需求人群 用于比对多个音频文件,识别相匹配的音频片段 使用场景 比对多个音频文件,查找相同的音频片段 识别不同音频文件中相似的音频片段 验证音频文件的完整性和一致性 产品特色 多个音频文件的比对 部分匹配的音频片段识别 支持多种音频格式 显示匹配的时间偏移和相似度 内置波形查看器和音频播放器
Kits AI
需求人群 Kits AI 适用于音乐创作、音频处理、语音合成等场景。 使用场景 使用 Kits AI 将一首歌曲中的人声分离出来进行混音 使用 Kits AI 训练一个自己的 AI 声音模型 使用 Kits AI 将文字转换为具有指定声音的语音 产品特色 AI 声音转换 AI 声音克隆 文字转语音 声音分离 官方授权 AI 声音库 免版税声音库 社区声音库 YouTube Covers 和数据集
Just Story It
需求人群 用户可以使用Just Story It创作自己的音频故事,也可以在Discovery Stories库中收听其他用户创作的音频故事。 使用场景 小明使用Just Story It创作了一部自己的音频故事,并分享给了朋友们。 小红在Discovery Stories库中发现了一部非常有趣的音频故事,收听后感觉非常满意。 李华订阅了Just Story It的服务,每月可以创作一定数量的音频故事,非常适合他的需求。 产品特色 基于AI技术的音频故事创作 创建角色和环境,选择流派、时长和自定义输入 Discovery Stories库收听其他用户创作的音频故事 每月订阅平台,获得一定的配额 多种套餐,适合不同用户的需求
Knowbase
需求人群 适用于需要管理大量文件和知识的个人和团队 产品特色 上传各种文件 通过与ChatGPT的聊天访问文件 支持多种语言 提供免费计划
Grro
需求人群 Grro适用于所有想要通过跨推荐推广播客的人。它可以帮助您快速增加听众,并提供即时的跨推荐机会。 使用场景 一个新的播客主人可以使用Grro来快速增加他们的听众。 一个经验丰富的播客主人可以使用Grro来提高他们的跨推荐推广活动的效率。 一个播客广告商可以使用Grro来找到与他们的目标受众相关的播客。 产品特色 AI-powered跨推荐推荐 深入分析听众习惯 即时跨推荐机会 导出CSV文件 免费使用
PlotPilot
需求人群 PlotPilot可用于创作沉浸式故事、阅读有声书、发展创作灵感等场景 产品特色 将简单故事想法转化为引人入胜的音频叙事 在iPhone、Apple Watch或Mac上生成沉浸式有声书 选择叙述者和在每章末尾引导故事的方向
Speaking AI
需求人群 适用于个人创作、娱乐等场景 产品特色 提供自然的对话生成语音 实现零样本语音克隆 捕捉独特的音调、音高和调节
AIbstract
需求人群 AIbstract适用于需要个性化、原创、免版税音乐的个人和专业人士,包括音乐爱好者、音乐家、内容创作者和组织。 使用场景 一位音乐爱好者使用AIbstract生成一首个性化的背景音乐,用于自己的视频作品 一位音乐家使用AIbstract生成一首原创的音乐作品,用于自己的专辑 一家组织使用AIbstract生成一首免版税的音乐,用于商业用途 产品特色 生成个性化、原创、免版税音乐 无需音乐技能 实时播放音乐 表达音乐需求的直观和易用的方式 云计算运行,可以在任何设备上使用 音乐完全属于用户,可以自由使用
sonoteller
需求人群 歌曲创作、音乐分析、情感分析 产品特色 分析歌曲歌词 分析歌曲音乐元素 提供有关歌曲的详细信息 提供API Pricing & Plans
Imitator
需求人群 适用于游戏、角色动画、虚拟现实和远程会议系统等领域。 使用场景 游戏中的角色动画 虚拟现实应用 远程会议系统 产品特色 个性化语音驱动的3D面部动画 生成具有准确唇部闭合的个人特定运动序列 计算主体的风格嵌入
Briefy - AI-powered content summarizer
需求人群 用于阅读长篇文章、研究论文、新闻报道等,快速获取内容要点 产品特色 将冗长的内容转化为简洁的摘要 支持多种语言 用户界面直观易用
Bespoke
需求人群 适用于任何人想要定制化自己听到的播客内容的场景 产品特色 一键生成符合你要求的定制播客 提供多样化的主题和内容选择 定制播客时长和深度
Instant Singer
需求人群 用户可以使用instantsinger克隆自己的声音,并将其应用于任何歌曲中。这对于想要在音乐领域尝试新事物的人来说是一个很好的工具。 使用场景 用户可以使用instantsinger将自己的声音应用于他们最喜欢的歌曲中。 歌手可以使用instantsinger来尝试新的声音和风格。 音乐制作人可以使用instantsinger来为他们的客户提供更多的音乐选择。 产品特色 克隆你的声音 替换任何歌手的声音 录制自己的声音 将任何歌曲转换为自己的声音 免费试用 三种套餐可供选择
Voices AI
需求人群 Voices AI适用于需要语音转换、音频增强和声音克隆的用户,包括内容创作者、市场营销人员、教育工作者和普通用户。 产品特色 广泛的声音库 为内容创作者提供行业标准的配音 提供有趣的娱乐功能 高质量的音频 直观的界面 隐私保护 克隆自己的声音 AI音频增强