AI

VALL-E

VALL-E一种用于文本到语音合成 (TTS) 的语言建模方法。具体来说,我们使用从现成的神经音频编解码器模型派生的离散代码来训练神经编解码器语言模型(称为 VALL-E),并将 TTS 视为...

CodeCV

CodeCV是一款面向互联网从业者的在线简历制作工具,支持Markdown和所见即所得编辑模式。它提供多种免费模板,并具备AI辅助功能,如简历润色和中英互译。用户可自由选择模板并专注内容创作,系统自动完成排版和分页,支持多格式导出,广泛应用于个人求职、职业发展、学生实习、自由职业和跨区域求职等场景。

Zona

Zona是一款基于AI技术的音乐生成工具,用户可通过输入创意或选择模板即时生成专业级别的音乐作品。该工具支持移动便携,具备个性化定制、创意激发及多功能编辑能力,广泛适用于个人娱乐、音乐教育、创意激发及社交媒体内容制作等多个领域。

LivePPT

LivePPT是一款依托AI技术的高效PPT制作工具,能够快速生成包含专业排版与配色的演示文稿。支持用户通过输入关键词或粘贴文本的方式创建内容,并提供丰富的自定义选项,如模板风格调整、页数设定及后续美化处理。该工具广泛应用于职场、教育及生活领域,极大提升了文档制作效率。

TransPixar

TransPixar是由多所高校及研究机构联合开发的开源文本到视频生成工具,基于扩散变换器(DiT)架构,支持生成包含透明度信息的RGBA视频。该技术通过alpha通道生成、LoRA微调和注意力机制优化,实现高质量、多样化的视频内容生成。适用于影视特效、广告制作、教育演示及虚拟现实等多个领域,为视觉内容创作提供高效解决方案。

Xiaomi MiMo

Xiaomi MiMo 是小米推出的推理型大模型,具备强大的数学推理与代码生成能力。通过预训练与后训练相结合,利用大量高价值语料及强化学习算法,在 7B 参数规模下实现超越更大模型的表现。支持多场景应用,包括教育、科研、软件开发等,已开源至 HuggingFace,便于开发者使用与研究。

羚珑

羚珑是京东旗下的智能设计平台,由京东零售用户体验设计部自主研发。这款平台旨在解决商家及企业在运营过程中的设计效率、品质、一致性问题,提供智能设计解决方案。

GPT-SoVITS

一个强大的语音合成工具,特别适合需要快速生成特定人声的场景。它通过先进的技术实现了高质量的语音克隆和文本到语音转换,支持多种语言,并提供了易于使用的WebUI工具。

TripoSR

TripoSR是一款由Stability AI与VAST联合开发的开源3D生成模型,能够在不到0.5秒内从单张2D图像生成高质量的3D模型。基于Transformer架构和大型重建模型(LRM)设计,采用先进的图像编码、三平面NeRF表示及优化训练策略,支持无GPU设备运行。适用于游戏开发、影视制作、建筑设计、产品设计等多个领域,具有高效、高精度和广泛适用性的特点。

GPDiT

GPDiT是一种由多所高校和企业联合开发的视频生成模型,结合了扩散模型与自回归模型的优势,具备高质量视频生成、视频表示学习、少样本学习和多任务处理能力。其核心技术包括轻量级因果注意力机制和无参数的旋转基时间条件策略,提升了生成效率与质量。该模型适用于视频创作、编辑、内容理解及创意生成等多种应用场景。