音频

Aero

Aero-1-Audio 是一款基于 Qwen-2.5-1.5B 的轻量级音频模型,拥有 1.5 亿参数,专注于长音频处理,支持连续 15 分钟音频输入并保持上下文连贯性。在语音识别、复杂音频分析及指令驱动任务中表现出色,具备高效的训练方法和多任务处理能力,适用于语音助手、实时转写、归档理解等场景。

Muyan

Muyan-TTS是一款面向播客场景的开源文本转语音工具,基于超10万小时播客数据训练,支持零样本语音合成与说话人适配,可在0.33秒内生成1秒音频,适合实时与长内容合成。支持本地部署与API调用,应用于播客、有声书、视频配音、AI角色及新闻播报等领域,兼具高效性与灵活性。

Arctime

简单、强大、高效的跨平台字幕制作软件

OmMuse

OmMuse 是一个面向音乐家和制作人的在线音乐创作平台,它提供了一系列的工具和资源来帮助用户创作和制作音乐。

海绵音乐

海绵音乐,一个精选音乐的聚集地,致力于为用户提供各种风格的治愈系音乐。

Adobe Podcast

Adobe Podcast是一个基于Web的平台,提供AI音频录制和编辑功能。用户可以轻松录制、转录、编辑和分享高质量的音频内容,效果清晰明了。

码智作

一个二维码制作工具,码智作可以快速将文字、图片、视频和音频等内容制作成二维码。

NaturalReader

NaturalReaders是一个提供文本到语音转换服务的网站。

ecrett music

Ecrett Music 是一个利用人工智能技术帮助用户高效创作免版税音乐的在线平台。它允许用户通过设定场景、情感及音乐类型等参数自动生成背景音乐,并提供多种编辑选项以满足个性化需求。同时,该平台还具备强大的音乐管理和匹配功能,适用于视频、游戏、播客等多个领域。