BAGEL BAGEL是字节跳动开源的多模态基础模型,拥有140亿参数,采用混合变换器专家架构(MoT),通过两个独立编码器捕捉图像的像素级和语义级特征。它能够进行图像与文本融合理解、视频内容理解、文本到图像生成、图像编辑与修改、视频帧预测、三维场景理解与操作、世界导航以及跨模态检索等任务。BAGEL在多模态理解基准测试中表现优异,生成质量接近SD3,并适用于内容创作、三维场景生成、可视化学习和创意广告生成等 AI项目与工具 2025年06月11日 92 点赞 0 评论 326 浏览
adAI艾达艾 adAI艾达艾是一款基于AI技术的在线PPT生成工具,能够快速生成高质量的图文并茂PPT文档。用户只需输入需求描述,工具便能智能匹配内容与图片,生成符合要求的PPT文件。此外,它提供免费下载服务,支持多种编辑软件,并允许用户自定义语言及背景风格。主要应用场景包括商务演示、教育培训、会议报告以及个人简历等。 AI项目与工具 2024年11月19日 24 点赞 0 评论 326 浏览
EMO2 EMO2是一种由阿里巴巴智能计算研究院开发的音频驱动头像视频生成技术,通过音频输入和静态人像照片生成高质量、富有表现力的动态视频。其核心技术包括音频与手部动作的协同建模、扩散模型生成视频帧,以及高精度音频同步。该工具支持多样化动作生成,适用于虚拟现实、动画制作和跨语言内容创作等场景,具备自然流畅的视觉效果和丰富的应用场景。 AI项目与工具 2025年06月12日 62 点赞 0 评论 326 浏览
魔音工坊 魔音工坊是由北京小问智能科技有限公司开发的一款配音软件,为用户提供一站式AI配音服务。它被广泛应用于短视频制作、有声书、广告、宣传纪录片等领域,是一款专业的AI语音配音与... Ai语音工具 1970年01月01日 0 点赞 0 评论 326 浏览
秒画趣拍APP 秒画趣拍APP是一款由商汤科技推出的AI创意写真与视频制作工具,支持用户通过上传照片快速生成高质量写真和视频作品。其核心功能包括AI视频换脸、模板DIY、社区互动及隐私保护,适用于个人娱乐、社交分享和创意表达等多种场景。用户可通过App或微信小程序使用,操作便捷,适合广泛人群。 AI项目与工具 2025年06月12日 27 点赞 0 评论 326 浏览
幻图AI 幻图AI是一款基于AI技术的免费图像处理工具,支持文生图、图片和视频换脸、换装、头像定制等功能。用户通过简单的操作即可生成高质量的创意图像和视频,广泛应用于社交媒体、电商、广告设计和教育培训等领域,提供高效且个性化的视觉创作体验。 AI项目与工具 2025年06月12日 70 点赞 0 评论 326 浏览
RuoYi AI RuoYi AI 是一个集成了本地 RAG 方案和多模型支持的全栈式 AI 开发平台,提供高效的代码管理、数据隐私保护和丰富的多媒体功能。支持多种大语言模型接入,具备微信扩展、插件系统和支付接口,适用于企业及个人开发者构建智能应用。 AI项目与工具 2025年06月12日 42 点赞 0 评论 326 浏览
Pippo Pippo是由Meta Reality Labs研发的图像到视频生成模型,可基于单张照片生成多视角高清人像视频。采用多视角扩散变换器架构,结合ControlMLP模块与注意力偏差技术,实现更丰富的视角生成和更高的3D一致性。支持高分辨率输出及细节自动补全,适用于虚拟现实、影视制作、游戏开发等多个领域。技术方案涵盖多阶段训练流程,确保生成质量与稳定性。 AI项目与工具 2025年06月12日 38 点赞 0 评论 325 浏览