视频

VideoPhy

VideoPhy是一款由UCLA和谷歌研究院联合开发的基准测试工具,旨在评估视频生成模型的物理常识能力。它包含688条描述性字幕,通过人类和自动评估方式,衡量生成视频是否符合物理规则。VideoPhy不仅揭示了现有模型的不足,还推出了自动评估工具VideoCon-Physics,以推动模型性能的提升。其应用场景广泛,包括视频生成模型开发、计算机视觉研究、教育与培训以及娱乐产业等。

Taskade

Taskade是一个创新的AI驱动工作空间,它通过提供强大的自动化工具和协作功能,帮助现代团队提升工作效率。

知乎

基于问答的内容生产方式和独特的社区机制

Vatic AI

Vatic AI 是一款利用先进 AI 技术的视频生成工具,能够将文本快速转化为视频内容,支持移动设备操作,具备一键生成、个性化定制及多平台适配等功能。适用于社交媒体、教育、营销、新闻等多个领域,提升内容创作效率与质量。

VideoRefer

VideoRefer是由浙江大学与阿里达摩院联合开发的视频对象感知与推理系统,基于增强型视频大型语言模型,实现对视频中对象的细粒度理解与分析。其核心包括大规模视频数据集、多功能空间-时间编码器和全面评估基准,支持对象识别、关系分析、推理预测及多模态交互等功能,适用于视频剪辑、教育、安防、机器人控制和电商等多个领域。

LivePortrait

利用AI技术将静态照片转换为视频,展现逼真的面部表情和动作。

TheoremExplainAgent

TheoremExplainAgent(TEA)是一款基于多模态技术的AI工具,可生成超过5分钟的数学与科学定理解释视频,涵盖多个STEM领域。它结合文本、动画和语音,提升抽象概念的理解效果,并具备自动错误诊断功能。通过TheoremExplainBench基准评估,TEA在准确性、逻辑性和视觉表现上均表现优异,适用于在线教育、课堂教学和学术研究等多种场景。

百度智能漫画

百度文库推出的一项AI漫画生成功能,它利用人工智能技术,让用户能够轻松创作漫画。用户只需输入一句话,即可在几分钟内生成完整的漫画故事分镜和脚本。

黑罐头素材网

一站式素材共享平台。黑罐头素材网只要为影像创作者提供贴纸、花字、音效等影像创作相关素材。

划词翻译

划词翻译是一款安装在桌面端浏览器里的扩展程序。