ImagePulse ImagePulse是由魔搭社区推出的开源项目,专注于图像理解和生成模型的数据集支持。它通过将复杂任务拆解为“修改、添加、移除”“风格迁移”“人脸保持”等原子能力,构建专门的数据集,提升模型在特定任务上的性能。项目提供开源脚本,支持数据集的生成与扩展,并结合多种技术资源实现多模型协同,适用于艺术创作、视频制作、产品展示等多个领域。 AI项目与工具 2025年06月11日 71 点赞 0 评论 358 浏览
Resona V2A 专注于将视频内容自动转化为高质量音频。Resona V2A通过分析视频中的视觉元素,Resona V2A 能够生成与视频内容相匹配的声音设计、音效和环境音。 Ai视频生成 2025年06月05日 11 点赞 0 评论 358 浏览
Step R Step R-mini是一款由阶跃星辰推出的推理模型,具备主动规划、尝试与反思能力,适用于数学、逻辑推理、代码开发及文学创作等多种场景。模型基于慢思考机制,支持深度推理与多步骤验证,表现优异。其技术特点包括强化学习、数据质量优化、测试时计算扩展及模型规模增长,实现文理兼修,广泛应用于教育、科研、企业办公等领域。 AI项目与工具 2025年06月12日 43 点赞 0 评论 358 浏览
Aligner Aligner是由北京大学团队开发的大语言模型对齐工具,通过学习对齐答案与未对齐答案之间的差异来提升模型性能。采用自回归seq2seq结构,在Q-A-C数据集上训练,无需RLHF流程。具备高效、灵活、即插即用等特点,支持多模型兼容,提升模型帮助性和安全性。适用于多轮对话、价值观对齐及MoE架构优化等场景。 AI项目与工具 2025年06月12日 44 点赞 0 评论 358 浏览
MobileVD MobileVD是Qualcomm AI Research团队开发的首个面向移动端优化的视频扩散模型,基于Stable Video Diffusion架构,通过降低帧分辨率、多尺度时间表示和剪枝技术,显著提升模型效率。其具备高效的去噪能力和低资源消耗,适用于短视频生成、视频编辑、游戏动画及互动视频等多种应用场景,为移动设备上的视频生成提供了强大支持。 AI项目与工具 2025年06月12日 61 点赞 0 评论 357 浏览
TreeMind树图 – AI思维导图 新一代 AI思维导图,AI一键生成思维导图、百万导图模板库、多人实时协作等超强功能 创作工具 1970年01月01日 0 点赞 0 评论 357 浏览
Tarsier2 Tarsier2是字节跳动研发的大规模视觉语言模型,擅长生成高精度视频描述并在多项视频理解任务中表现优异。其核心技术包括大规模数据预训练、细粒度时间对齐微调以及直接偏好优化(DPO)。该模型在视频问答、定位、幻觉检测及具身问答等任务中均取得领先成绩,支持多语言处理,具有广泛的应用潜力。 AI项目与工具 2025年06月12日 59 点赞 0 评论 357 浏览