AI音频与语音 — AI 工具导航

AI音频与语音

Wispr Flow

Wispr Flow

AI 语音输入与语音转文字工具,可把自然口语整理成清晰文字,适合写邮件、文档、笔记和日常办公输入。

AI 语音输入与语音转文字工具,可把自然口语整理成清晰文字,适合写邮件、文档、笔记和日常办公输入。
SteelSeries Sonar

SteelSeries Sonar

SteelSeries Sonar是SteelSeries GG推出的免费虚拟声卡与游戏音频控制工具,支持游戏音、语音与媒体音分离调节,并提供降噪、均衡器与脚步增强等功能。

SteelSeries Sonar是SteelSeries GG推出的免费虚拟声卡与游戏音频控制工具,支持游戏音、语音与媒体音分离调节,并提供降噪、均衡器与脚步增强等功能。
ElevenLabs

ElevenLabs

全球知名AI语音生成和声音克隆平台,支持自然语音、多语言配音和API。

全球知名AI语音生成和声音克隆平台,支持自然语音、多语言配音和API。
通义听悟

通义听悟

阿里云智能会议助手,支持音视频转写、摘要、待办提取和多语言翻译。

阿里云智能会议助手,支持音视频转写、摘要、待办提取和多语言翻译。
Adobe Podcast

Adobe Podcast

Adobe 推出的在线音频增强工具,提供语音增强、录音检查和播客制作辅助,适合普通用户改善人声录音质量。

Adobe 推出的在线音频增强工具,提供语音增强、录音检查和播客制作辅助,适合普通用户改善人声录音质量。
Suno

Suno

AI音乐生成平台,可根据文本生成歌曲和伴奏片段。

AI音乐生成平台,可根据文本生成歌曲和伴奏片段。
OpenVoice

OpenVoice

开源声音克隆项目,可用少量样本生成多语言音色,适合研究和本地实验。

开源声音克隆项目,可用少量样本生成多语言音色,适合研究和本地实验。
NVIDIA Broadcast

NVIDIA Broadcast

NVIDIA实时音视频增强工具,提供AI降噪、虚拟背景和摄像头增强。

NVIDIA实时音视频增强工具,提供AI降噪、虚拟背景和摄像头增强。
AudioCraft

AudioCraft

Meta开源音频生成研究项目,包含MusicGen等音乐生成模型。

Meta开源音频生成研究项目,包含MusicGen等音乐生成模型。
腾讯会议AI小助手

腾讯会议AI小助手

腾讯会议内置AI能力,支持会议纪要、智能总结和协作整理。

腾讯会议内置AI能力,支持会议纪要、智能总结和协作整理。
iZotope RX

iZotope RX

专业音频修复软件,提供AI辅助降噪、去混响、去爆音和音频修复。

专业音频修复软件,提供AI辅助降噪、去混响、去爆音和音频修复。
Stable Audio

Stable Audio

Stability AI音频生成工具,可生成音乐、音效和背景音。

Stability AI音频生成工具,可生成音乐、音效和背景音。
腾讯云语音合成

腾讯云语音合成

腾讯云TTS服务,提供多音色语音合成和企业级语音接口。

腾讯云TTS服务,提供多音色语音合成和企业级语音接口。
Whisper

Whisper

OpenAI开源语音识别模型,适合多语言转写、字幕和本地语音处理。

OpenAI开源语音识别模型,适合多语言转写、字幕和本地语音处理。
腾讯云语音识别

腾讯云语音识别

腾讯云ASR语音识别服务,支持实时转写、录音文件识别和会议字幕等企业应用。

腾讯云ASR语音识别服务,支持实时转写、录音文件识别和会议字幕等企业应用。
Audacity OpenVINO AI Plugins

Audacity OpenVINO AI Plugins

Audacity结合AI插件可进行语音分离、降噪和音频修复。 支持开源或免费安装/体验,适合开发者按需接入模型与工作流。

Audacity结合AI插件可进行语音分离、降噪和音频修复。 支持开源或免费安装/体验,适合开发者按需接入模型与工作流。
百度智能云语音合成

百度智能云语音合成

百度AI语音合成能力,支持多场景中文发音人与API接入。

百度AI语音合成能力,支持多场景中文发音人与API接入。
Udio

Udio

AI音乐创作平台,适合生成歌曲、旋律和创意音乐片段。

AI音乐创作平台,适合生成歌曲、旋律和创意音乐片段。
百度智能云语音识别

百度智能云语音识别

百度语音识别能力,适合中文语音转文字、输入法、客服和音视频字幕场景。

百度语音识别能力,适合中文语音转文字、输入法、客服和音视频字幕场景。
LALAL.AI Voice Cleaner

LALAL.AI Voice Cleaner

AI人声分离和降噪工具,可从音频中提取清晰语音。

AI人声分离和降噪工具,可从音频中提取清晰语音。