文本转语音

Speech

Speech-02 是 MiniMax 推出的先进文本到语音模型，支持零样本语音克隆和高质量语音合成，具备多语言支持和情感控制功能。采用自回归 Transformer 和 Flow-VAE 架构提升语音自然度和相似度，适用于配音、有声读物、智能助手等多种场景。提供 HD 和 Turbo 两个版本，满足不同性能需求。

AI项目与工具 2025年06月11日 33 点赞 0 评论 532 浏览

TTSMaker马克配音

免费的AI配音平台，可以将文本转换成语音，支持50多种语言和300多种语音风格

创作工具 2026年06月23日 0 点赞 0 评论 526 浏览

Fish Audio

Fish Audio是一款生成式AI文本转语音（TTS）和声音克隆平台，支持多种语言和声音风格，可将文本转换为自然流畅的语音。用户可上传音频样本克隆特定人物的声音，并通过API接口集成到应用程序中。Fish Audio适用于视频制作、有声读物、语音助手、教育与培训以及娱乐创意等领域，满足个性化语音内容生成需求。

AI项目与工具 2025年06月11日 79 点赞 0 评论 522 浏览

酷音

酷音网是一个真人配音与AI配音、视频拍摄与制作、音乐作词与谱曲、视频策划与创意等领域的创作、交易、推广运营于一体的音视频交易服务平台，致力于打造专注音视频领域的商业生态圈。

创作工具 2026年06月23日 0 点赞 0 评论 521 浏览

Avatar AI

人工智能成像模型，可以从你的照片中生成逼真的4K头像。它将方形头像扩展为2:3的4K全尺寸AI照片，并可以将其动画化为带有文本转语音或您自己的声音的AI视频。

Ai绘画生成 2026年06月23日 0 点赞 0 评论 520 浏览

Chatterbox是Resemble AI推出的开源文本转语音（TTS）模型，基于0.5B规模的LLaMA架构，用超过50万小时精选音频训练。它支持零样本语音克隆，仅需5秒参考音频即可生成高度逼真的个性化语音，并具备情感夸张控制功能，可调节情绪、语速和语调。Chatterbox还拥有超低延迟的实时语音合成能力，延迟低至200毫秒以下，适用于交互式应用。此外，它采用安全水印技术防止滥用，适用于内容

AI项目与工具 2025年06月11日 55 点赞 0 评论 517 浏览

声动视界

SoundView是一款面向带货短视频的AI工具，提供视频翻译、文本转语音及视频配音等服务，支持100多种语言，能有效提升视频完播率和客户咨询率，同时具备音色模仿功能，助力用户优化素材复用。主要应用于跨境电商、社交媒体营销、教育培训、企业宣传及旅游业等领域。

AI项目与工具 2025年06月12日 53 点赞 0 评论 513 浏览

Indic Parler

Indic Parler-TTS 是一款由 Hugging Face 与 AI4Bharat 联合开发的多语言文本到语音模型，支持 20 种印度语言和英语，提供 69 种独特语音。该模型基于深度学习架构，通过描述性文本输入实现对音调、语速、情感等参数的灵活控制，适用于多种语音合成场景。在低资源语言上表现优异，具备高自然度和清晰度的语音输出能力。

AI项目与工具 2025年06月12日 55 点赞 0 评论 499 浏览

IndexTTS

IndexTTS 是一款由 B 站开发的高性能文本转语音系统，专注于中文语音合成，支持拼音纠正、精准停顿控制和高自然度语音输出。采用混合建模方法，结合汉字与拼音，提升发音准确性。系统具备零样本语音克隆能力，音质优秀，广泛应用于内容创作、在线教育、智能客服等领域。训练数据丰富，性能指标优异，包括低字词错误率、高扬声器相似性和高主观音质评分。

AI项目与工具 2025年06月12日 15 点赞 0 评论 493 浏览

Text To Speech

构建自然说话的应用和服务，从 147 种语言和变体中选择 456 种语音

创作工具 2026年06月23日 0 点赞 0 评论 489 浏览

文本转语音

首页

文本转语音

列表

默认

浏览次数

发布日期