AI

Superhuman

Superhuman是一款AI驱动的电子邮件客户端,提供智能分类、快速回复、阅读状态追踪及团队协作等功能,帮助用户提升邮件管理效率。它还具备社交洞察与日历集成特性,支持用户在一个平台内全面掌控邮件和日程安排,从而专注核心任务。

AskNow AI

一个创新的AI问答平台,AskNow AI使用户能够与不同领域的各种知名人士和专家进行个性化的音频对话。

Ruyi

Ruyi是一款基于DiT架构的图生视频大模型,支持多分辨率和多时长的视频生成,具有首帧、首尾帧控制、运动幅度调整及镜头方向控制等功能。它通过Casual VAE模块和Diffusion Transformer实现视频数据的压缩与生成,旨在降低动漫和游戏内容的开发周期和成本。目前,Ruyi-Mini-7B版本已开源。

蝉镜-AI数字人

蝉镜作为一个数字人视频创作平台,提供了一个全新的内容创作方式。用户可以通过选择和定制数字人角色,生成个性化的视频内容和口播文案。

LongVILA

LongVILA是一款专为长视频理解设计的视觉语言AI模型,由多家知名研究机构共同开发。它具备强大的长上下文处理能力和多模态序列并行性,能在大量GPU上高效训练,无需梯度检查点。LongVILA通过五阶段训练流程,结合大规模数据集构建和高性能推理,显著提升了长视频字幕的准确性和处理效率。此外,它还支持多种应用场景,包括视频字幕生成、内容分析、视频问答系统等。

Muyan

Muyan-TTS是一款面向播客场景的开源文本转语音工具,基于超10万小时播客数据训练,支持零样本语音合成与说话人适配,可在0.33秒内生成1秒音频,适合实时与长内容合成。支持本地部署与API调用,应用于播客、有声书、视频配音、AI角色及新闻播报等领域,兼具高效性与灵活性。

eCommerce ChatGPT Prompts

ChatGPT电子商务提示是一个工具,为建立电子商务商店和营销活动提供现成的食谱。它生成200多万个预先构建的电子商务提示和多达10个个性化提示参数,以满足所有电子商务营销需求,...

书生·筑梦2.0

它不仅提供了更大的创作灵活性,还通过高质量的视频输出满足了用户对画质和帧率的高需求。Vchitect 2.0及其配套的VEnhancer框架,为视频内容创作者提供了强大的工具,以创造更加生...