Listen411是一款极速音频与视频转录平台,支持 MP3、MP4、WAV 等格式,仅需 1 分钟即可转录 1 小时内容。系统自动识别英语、西班牙语、法语等语言,并导出纯文本、SRT、VTT、JSON 等格式,适用于播客、字幕制作与内容分析。
Bocca是一款专为macOS用户打造的AI语音转文本应用,无需联网即可在任何软件中使用。支持多语言语音输入,转写内容即时粘贴,无需切换窗口,保障隐私安全。适合内容创作者、播客、项目经理等高效录入文字,提高创作与办公效率。
AudioX是一站式 AI 音频创作平台,支持从文本、图像与视频中快速生成高质量音效、语音与配乐,涵盖视频转音频、图像生成环境声、AI 会说话头像等功能。平台提供统一积分机制与免费工具,适合内容创作者、播客制作与短视频剪辑使用,助力高效生成沉浸式音频体验与创意内容。
Vogue AI是一款专注视觉内容创作的 AI 平台,融合AI宝宝生成器、播客短视频工具与 Veo 3视频生成等功能,支持高质量图像与视频生成。平台采用统一账户与积分体系,无需专业技能即可快速创作病毒式社交内容,适合家庭纪念、内容创作者与社媒营销使用。
MusicCreator AI是一款免版权AI音乐生成平台,用户可通过文本或歌词输入,快速创作专业音乐,支持视频、播客、广告等多种内容场景,无需音乐技能,几秒即可生成可商用曲目。
Vozart AI是一款在线 AI 音乐与歌词生成平台,支持从文本描述快速生成高质量原创音乐,集成歌词创作、音频分离、音效生成与图像转音乐等功能,操作简单、无需音乐基础,适用于短视频、播客、广告、游戏等多场景,所有作品均为免版权可商用。
EasyVoice是一款免费开源的文本转语音工具,轻松快速的将长篇次小说、剧本文字等等批量变成真人朗读声音!它支持多角色配音、语音试听、自定义语速与音调,并接入各种 TTS 合成引擎(Microsoft Azure TTS, OpenAI, Edge-TTS)等朗读内容输出。可以用到制作生成使用不同人声音轨的有声书剧或者播客脚本等等!
音刻(Inkr)是一款基于 AI 的多语言音视频转录工具,支持极速转录、说话人识别与智能笔记生成,适用于会议记录、采访整理、字幕制作等场景。FLASH 模式转录速度提升 8 倍,支持100+语言,助你高效捕捉每一段语音内容。
UntitledPen是一个AI驱动的语音生成平台,帮你的内容打造最自然流畅的旁白。 基于最先进的 GPT 音频生成模型,支持多语言、高质量音频,适用于视频/播客/广告/教育培训等多种情景下的配音需求。并通过智能编辑器让文本优化更加便捷,支持 Markdown 格式,输出 128kbps 及以上的标准音质,确保音质清晰动听。
趣丸千音(All Voice Lab)是趣丸科技推出的AI语音创作平台。以自研的MaskGCT语音大模型为核心,提供一站式智能语音解决方案。集成文本转语音、视频翻译、声音克隆等多元能力,支持多语种多音色互换,帮助全球用户高效创作,告别语言障碍。
ScreenApp是一款纯浏览器端的 AI 录屏与内容总结平台。不需要下载,使用网页或Chrome拓展,实时抓取屏幕、系统音、麦克风和摄像头,并在云端自动完成 转录、翻译、摘要、行动项提取与对话式检索。作为超百万用户信赖的 “第二大脑”,它通过智能转录、自动总结与深度整合,让每段录音、每场会议都成为可追溯、可利用的价值资产。
Bland AI是一款专为现代企业打造的超逼真 AI 语音呼叫解决方案,核心功能是通过 对话式人工智能(Conversational AI) 模拟真人客服,自动化处理企业客户交互场景,助力企业提升客户体验、降低运营成本,适用于销售、客户支持、日程管理等多场景。
AI Voice Cloning是一款基于先进人工智能技术的语音克隆工具,致力于以极简流程生成高度逼真的克隆语音。通过自动提炼录入音频里面特殊的音色、语调以及所传达的情感情绪,并创造出与原录制有非常高相似度的人声
一款AI播客生成工具,旨在将文本或链接内容自动转换为自然流畅的音频录制。它的用法特别简单,你只要把感兴趣的文字、链接,甚至自己平时学习积累的资料文件或者文本上传,就能一键生成中英文播客,还是「对话」形式。
一款离线可无限使用的AI智能语音转文字的工具。支持离线AI音频转文字、视频生成字幕,本地存储、隐私保护,支持显卡加速、字幕编辑、字幕翻译(Google翻译),会员无限制使用,最新版支持私有云功能,可自动备份手机相册文件,还可以不限带宽、不限流量外网访问。
一款本地视频翻译、配音和语音克隆工具,专为跨语言视频本地化打造。它兼容国内外主流视频平台,支持 OpenAI API 规范的大模型,并默认采用 CosyVoice 声音,亦可自定义语音克隆。
一款在线AI语音克隆平台,仅需3秒音频样本即可快速创建超逼真定制语音,精准复刻原始说话者的情感细节。支持英语、中文、日语、韩语等多语种实时合成,界面简洁直观易操作,严格采用银行级加密保障隐私安全。
一款利用Suno AI技术为狗狗创建个性化放松音乐的平台。它的目标是帮助宠物主人为他们的狗狗提供一个 舒缓、愉悦的听觉环境,以减少焦虑、压力或分离不安。
一款AI文本到音乐生成工具,主要功能是将用户输入的文本或歌词转换成音乐。用户只需输入文字描述或歌词、选择相应的音乐风格和节奏,平台就会自动生成和谐的音乐作品。
API.box是一个专注于提供和整合先进 AI 接口的平台,主要面向 AI 音乐创作和相关音频生成应用。
Plazmapunk是一款AI音乐视频生成平台,支持上传音乐或使用 AI 音轨生成器,结合多种视觉风格(如 Kandinsky、SDXL)、GPT 场景编辑器与多比例格式,快速生成高质量视频,适用于音乐发布、社交创作及开发者集成。
AiMusic FM是一个AI在线音乐生成平台,主要功能是帮助用户通过多种创作模式迅速生成原创音乐。简单来说,它利用先进的 AI 算法,让用户只需输入文本描述、上传图片、提供歌词或音乐样本,就能自动生成符合特定风格和情绪的乐曲。
Singify是一个AI音乐和歌曲生成工具,帮助用户轻松创作高质量音乐,无论是原创歌曲、背景音乐还是 AI 翻唱。它支持文本转音乐、AI歌词创作、AI 翻唱等功能,让音乐创作变得更加智能化和高效。
Ditto Speak是一个AI语音克隆和语音生成平台,能够从 音频样本 中捕捉语音模式,并生成 高质量的合成语音,适用于 个性化语音创建、视频配音、播客制作 等场景。
F5-TTS是一个 先进的文本转语音(TTS)平台,利用AI 技术将文本转换为 自然、富有表现力的语音。F5-TTS提供零样本声音克隆、多语言支持和情感表达能力,适用于 配音、有声书、电子学习、营销推广 等场景。
Listnr AI是一个 AI 驱动的文本转语音(TTS)平台,提供 1000+ 种逼真的 AI 语音,支持 142+ 种语言,适用于 视频配音、播客、有声书、社交媒体内容 等场景。
一款AI驱动的语音生成平台,提供400+种逼真的AI语音,可以将文本转换为逼真的语音,适用于 视频配音、有声书、教育内容、广告营销 等场景。
Voicv是一个以AI 技术为核心的尖端多语言语音处理平台,主打声音克隆、文本转语音、语音转文本三大核心服务,凭借零样本学习、高保真输出、多语言适配等优势,让任何人、任何时间能够“轻轻松松”地复制想要的输出音频,就如“拷贝粘贴”一样简单。
SunoAiFree是一个 AI 音乐生成工具,可以帮助用户 从文本提示中创建带有人声和乐器的原创歌曲。它是 Suno AI 的替代方案,提供 免费音乐创作服务,让用户能够快速生成各种风格的音乐。
ocalRemoverOak是一个在线人声分离工具,可以帮助用户 从音频或视频文件中提取人声或伴奏。它支持 MP3、WAV、FLAC、MP4、MKV 等多种格式,并且可以直接解析 YouTube 和Suno.com 链接。