语音 - 智狐AI导航

Fish Speech

Fish Speech是一款开源的文本到语音（TTS）工具，支持中文、英文和日文。它通过大约15万小时的多语种数据训练，实现了接近人类水平的语音合成效果。该工具的特点包括低显存需求（仅需4GB）、快速推理速度、高自定义性和灵活性。Fish Speech支持多种语音生成模型，如VITS2、Bert-VITS2等，适用于智能助手、自动客服、语言学习等多个领域。

AI项目与工具 2025年06月12日 14 点赞 0 评论 787 浏览

Text

将文本转换成歌曲的工具。它使用自然语言处理将文本输入转换为音频组合。该工具允许用户从各种音乐风格和乐器中进行选择，以及调整节奏、键和动态等参数。生成的音轨可以导出为高...

Ai语音工具 2026年06月23日 0 点赞 0 评论 787 浏览

Speechify

Speechify是一款文本转语音的应用程序，通过将文本转换成自然的声音，帮助你理解和记住更多你所阅读的内容。它可以在Chrome、iOS、Android和Mac上使用。

创作工具 2026年06月23日 0 点赞 0 评论 787 浏览

TTS-vue

TTS-Vue是一个开源的桌面应用程序，它利用了微软的语音合成技术，为用户提供了一个简单易用的文本到语音转换工具。

Ai语音工具 2026年06月23日 0 点赞 0 评论 789 浏览

Podcastfy

Podcastfy 是一款基于生成式人工智能技术开发的开源工具，可将网络文章、PDF 文件及纯文本转化为多语言对话式音频。它不仅支持多源文本合并，还具备强大的文本转语音功能，允许用户选择不同的语音模型来优化音频效果。此外，其开源特性便于开发者根据需求进行个性化定制，广泛适用于内容摘要、语言本地化、教育材料转化等多个领域。

AI项目与工具 2025年06月12日 18 点赞 0 评论 790 浏览

Offer蛙

Offer蛙是一款AI驱动的面试辅助工具，支持实时语音识别与答案生成，结合高频题库和简历信息，为用户提供专业级回答。具备代码题优化、多平台适配及隐私保护功能，适用于技术面试和线上面试场景，提升面试表现与专业形象。

AI项目与工具 2025年06月11日 31 点赞 0 评论 790 浏览

睿声Reecho

一款专注于5秒瞬时语音克隆和超拟真语音合成的AI语音克隆平台。

Ai语音工具 2025年06月05日 83 点赞 0 评论 791 浏览

Unmute

Unmute 是 Kyutai 推出的低延迟语音交互系统，专注于语音转文字和文字转语音功能。基于先进 AI 模型，提供实时、高效的语音交互体验，支持用户与 AI 进行语音交流，并能将文字内容快速转换为自然流畅的语音输出。其低延迟处理能力实现无缝交互，具备快速集成、随时打断、10秒生成声音、多样化调整等功能，适用于在线教育、智能客服、语音助手、游戏娱乐和企业会议等场景。

AI项目与工具 2025年06月11日 58 点赞 0 评论 792 浏览

HMoE

HMoE（混合异构专家模型）是腾讯混元团队提出的一种新型神经网络架构，旨在提升大型语言模型的性能和计算效率。通过引入不同规模的专家来处理不同复杂度的输入数据，HMoE增强了模型的专业化程度，并采用了新的训练目标和策略，如P-Penalty Loss，以提高参数利用率和计算效率。HMoE在多个预训练评估基准上表现出色，适用于自然语言处理、内容推荐、语音识别、图像和视频分析以及多模态学习等领域。

AI项目与工具 2025年06月12日 90 点赞 0 评论 793 浏览

字幕酱

字幕酱是一个在线字幕生成工具，利用 AI 深度学习技术，提供自动字幕生成、字幕翻译、字幕格式转换等功能。

字幕配音 2025年06月05日 35 点赞 0 评论 794 浏览

语音

首页

语音

列表

默认

浏览次数

发布日期