生成

MAETok

MAETok是一种基于掩码建模的图像标记化方法,通过自编码器结构学习更具语义丰富性的潜在空间,提升图像生成质量与训练效率。它支持高分辨率图像生成,具备多特征预测能力和灵活的潜在空间设计,适用于娱乐、数字营销、计算机视觉等多个领域。实验表明其在ImageNet数据集上表现优异。

Meta Movie Gen

Meta公司推出的能够通过简单的文本输入生成视频和声音的AI工具。MetaMovieGen可以创建长达16秒的逼真视频片段,并支持将图像转化为视频,添加音乐和音效。

Fugatto

Fugatto是一款由英伟达开发的音频合成与转换模型,利用增强型Transformer架构实现了从文本到音频的高效转化。它支持多种音频生成任务,如音乐创作、声音效果设计及语音合成,并可通过ComposableART技术实现对声音属性的精细调控。此外,Fugatto擅长生成动态变化的声音景观,广泛应用于音乐创作、声音设计及广告音频制作等领域。

Stableboost

Stableboost 是一种有趣且简单的方法来释放您的创造力并制作个性艺术化照片的AI工具。

Loopy AI

字节跳动和浙江大学联合开发的音频驱动的AI视频生成模型,能够将静态图像转化为动态视频,实现音频与面部表情、头部动作的完美同步。

Pika 2.0

Pika 2.0是一款由Pika Labs开发的AI视频生成工具,具备强大的文本对齐、动作渲染及场景元素整合功能。它能将详细提示转化为连贯且富有想象力的视频剪辑,同时提供自然的动作效果和可信的奇幻物理表现。此外,Pika 2.0支持用户上传和定制化场景元素,通过先进的图像识别技术实现无缝集成,为创作者提供更精细的控制权。这款工具适用于媒体娱乐、电商、教育、工业、医疗和个人创作等多个领域。

Pagen

Pagen是一款依托AI技术的页面生成工具,专注于帮助企业快速构建美观且高效的着陆页。它提供多种专业模板、实时预览功能及强大的SEO与分析工具,支持市场营销、初创企业、电子商务等多个应用场景,助力用户优化在线业务并提升转化率。

Neural Canvas

一个由人工智能驱动的漫画生成工具,它允许用户发挥创造力并创建由人工智能生成的漫画。它提供多种风格和角色,将您的故事转化为逼真的漫画。