模型
Chatterbox
Chatterbox是Resemble AI推出的开源文本转语音(TTS)模型,基于0.5B规模的LLaMA架构,用超过50万小时精选音频训练。它支持零样本语音克隆,仅需5秒参考音频即可生成高度逼真的个性化语音,并具备情感夸张控制功能,可调节情绪、语速和语调。Chatterbox还拥有超低延迟的实时语音合成能力,延迟低至200毫秒以下,适用于交互式应用。此外,它采用安全水印技术防止滥用,适用于内容
Pirate Diffusion
Pirate Diffusion 是一个提供基于云的 AI 图像生成器网站。它允许用户使用各种模型和样式创建逼真和艺术的图像。
Promptriever
Promptriever是一款基于自然语言处理的新型检索模型,融合了大型语言模型提示技术与信息检索优势。它通过双编码器架构及指令训练集优化,实现了对复杂查询的高度适应性与鲁棒性,适用于搜索引擎优化、智能助手、企业内部搜索及学术研究等多个领域。
SkyReels Ai
一个由昆仑万维推出的AI短剧平台,集成了视频大模型与3D大模型,能够通过AI一键生成完整剧本、分镜、人物对白与背景音乐,支持角色形象、音色与分镜的自定义调整。
AssemblyAI
一个提供将音频文件、视频文件和实时语音转录为文字的平台,提供了一个简单的API,允许用户访问用于转录和语音理解的即可用的AI模型。
