MyColorSpace 一款用于生成颜色调色板和颜色渐变工具的网站,用户只需输入一个颜色,MyColorSpace便会自动生成与之搭配的多种颜色组合,适合设计、艺术创作等多种用途。 调色配色 2025年06月05日 88 点赞 0 评论 313 浏览
OpenAudio S1 OpenAudio S1是Fish Audio推出的文本转语音(TTS)模型,基于200万小时音频数据训练,支持13种语言。采用双自回归架构和RLHF技术,生成自然流畅的语音,支持50多种情感和语调标记。具备零样本和少样本语音克隆功能,仅需10到30秒音频即可生成高保真声音。适用于视频配音、播客、游戏角色语音、虚拟助手、游戏娱乐、教育培训及客服系统等场景。提供40亿参数完整版和5亿参数开源版,满足 AI项目与工具 2025年06月11日 28 点赞 0 评论 313 浏览
Dream Machine AI Luma Labs 开发的一种先进的AI模型,可以通过文本和图像快速生成运动流畅、具有电影品质和戏剧元素的 5 秒视频剪辑,将静态快照转变为动态故事。 Ai视频生成 2025年06月05日 64 点赞 0 评论 312 浏览
CosyVoice 2.0 CosyVoice 2.0是一款基于深度学习的语音生成大模型,通过有限标量量化技术和新型架构设计,在发音准确性、音色一致性和韵律表达方面表现出色。其支持流式推理,延迟低至150ms,广泛应用于智能助手、有声读物、视频配音及语言学习等领域,同时具备多语言支持和情感控制等功能。 AI项目与工具 2025年06月12日 10 点赞 0 评论 312 浏览
HourOne Ai 一款AI数字人视频生成器,可以在几分钟内通过文本生成专业视频,它提供定制的视频模板、不同口音和语言的AI数字人等功能。 Ai视频生成 2025年06月05日 97 点赞 0 评论 312 浏览
Llasa TTS Llasa TTS是基于LLaMA架构的开源文本转语音模型,支持高质量语音合成、情感表达和音色克隆。采用单层VQ编解码器和Transformer结构,具备多语言支持及长文本处理能力,适用于智能助手、有声读物、游戏娱乐等场景。模型提供不同参数规模版本,支持零样本学习,提升语音自然度和表现力。 AI项目与工具 2025年06月12日 71 点赞 0 评论 311 浏览
GenFM GenFM是一款由ElevenLabs开发的AI工具,可将PDF、文章、电子书等内容转换为多角色播客音频。它支持32种语言,具备自动化声音选择、人性化填充词添加及高度定制化功能,适用于教育、播客制作、有声书创作、商业推广等多个领域。 AI项目与工具 2025年06月12日 85 点赞 0 评论 311 浏览
Speechki Speechki 是一款高效文本转语音工具,支持多语言和多种语音选择,具备实时校对、角色管理和精准音频控制功能。用户可通过可视化编辑器灵活调整语速、语调和音高,适用于内容创作、教育、企业营销等多种场景。同时支持与 ChatGPT 集成,提升文本转音频的效率和实用性。 AI项目与工具 2025年06月12日 50 点赞 0 评论 311 浏览
风平智能 风平智能提供一站式AI解决方案,涵盖虚拟数字人定制、AI短视频生成、数字人直播、IP培育及交易等功能。平台利用先进AI技术,支持多语言互动,服务于金融、教育、医疗等行业,推动数字人技术在元宇宙时代的广泛应用。 AI项目与工具 2025年06月12日 15 点赞 0 评论 309 浏览