AI

天谱乐

天谱乐是一款由趣丸科技推出的支持多模态输入的音乐生成工具,涵盖文本、图片及视频生成音乐功能。它能够准确理解音乐复杂特性并生成高契合度配乐,同时提供专家模式和音乐编辑功能,适用于音乐创作、短视频配乐、影视配乐及个人娱乐等多个领域。

GPT-SoVITS

一个强大的语音合成工具,特别适合需要快速生成特定人声的场景。它通过先进的技术实现了高质量的语音克隆和文本到语音转换,支持多种语言,并提供了易于使用的WebUI工具。

秘塔翻译

秘塔翻译,专业的AI法律翻译,专为法律人训练的机器翻译系统.。

Kokoro

Kokoro-TTS是一款由hexgrad开发的轻量级文本转语音工具,基于StyleTTS 2与ISTFTNet架构,支持多种语音风格和自然语调,具备实时处理能力。支持美式与英式英语,提供10种语音包,适用于教育、游戏、客服等多种场景。支持本地部署与API集成,确保数据安全与高效运行。

BriefGPT AI论文速递

BriefGPT AI是一个AI论文速递网站,它可以帮助研究人员快速发现AI领域的最新研究进展。BriefGPT AI每天持续更新顶级会议和期刊上发表的AI相关论文,并提供论文标题、简要摘要以及论文PDF下载链接。

PixVerse

PixVerse是一款短视频制作工具,其基础功能包括文生视频和图生视频。这款工具由国人团队开发,主要面向用户免费开放,支持多模态输入,如图像、文本和音频,能够将这些输入快速转...

Buysmart.AI

Buysmart.AI,基于大模型的智能电商购物ai助手,百度“文心杯”创业大赛一等奖。

Reel.AI

Reel.AI是一款利用AI技术生成短视频内容的应用程序,支持文本、图片等多种输入形式,生成高质量的短剧和视频内容。其核心功能包括文本到视频转换、多模态内容生成、情感共鸣驱动的短剧创作及交互式体验设计。Reel.AI基于自主研发的Reel Diffusion模型,广泛应用于娱乐消费、内容创作、广告营销及教育等领域。

MooER

MooER是一款基于国产全功能GPU训练的开源音频理解大模型,由摩尔线程推出。它能够进行中文和英文的语音识别,并具备中译英的语音翻译能力。MooER在Covost2中译英测试集中取得25.2的BLEU分数,接近工业级标准。其主要功能包括语音识别、语音翻译、高效率训练以及开源模型。该模型采用深度学习架构和端到端训练模式,具有强大的多语言处理能力和广泛的适用性。

StoryDiffusion

StoryDiffusion 是一种基于 AI 的图像和视频生成框架,通过 Consistent Self-Attention 和 Semantic Motion Predictor 技术,实现从文本到连贯图像和视频的转化,支持用户高效生成高质量视觉内容,广泛应用于动漫、教育、广告及影视等领域。