Free Video Free Video-LLM是一种无需训练的高效视频语言模型,基于提示引导的视觉感知技术,可直接对视频内容进行理解和推理,适用于视频问答、内容分析等多种场景。通过时空采样优化和减少视觉标记,它在保持高性能的同时显著降低了计算复杂度。 AI项目与工具 2025年06月12日 50 点赞 0 评论 631 浏览
StreamingT2V StreamingT2V是由Picsart AI Research等团队联合发布的一款创新的AI视频生成模型。它能生成长达1200帧、时长为2分钟的视频,大大超越了先前模型的时长限制,如Sora模型。Streaming... Ai视频生成 2026年09月27日 0 点赞 0 评论 630 浏览
AudioGen.co 一款由AI驱动的可以生成各种音频内容的平台,包括样品、乐器、音效和纹理。用户可以生成高质量的、适合制作专业的具有无限的变化音乐的声音 Ai语音工具 2025年06月05日 96 点赞 0 评论 628 浏览
DrivingDojo DrivingDojo是一个由中国科学院自动化研究所与美团无人车团队合作研发的数据集,包含18,000个视频片段,涵盖全面的驾驶操作、多智能体交互及开放世界驾驶知识。它定义了动作指令跟随(AIF)基准,用于评估世界模型的预测能力,并支持自动驾驶算法开发、世界模型训练、多智能体交互模拟及罕见事件处理等多个应用场景。 AI项目与工具 2025年06月12日 85 点赞 0 评论 628 浏览
Faster Whisper Faster Whisper 是一款基于 OpenAI Whisper 模型的高效语音识别工具,利用 CTranslate2 引擎显著提升转写速度并降低内存消耗。它支持多语言处理,可应用于实时语音转写、视频字幕生成、客户服务、医疗记录等领域。其核心技术包括 8 位量化、语音活动检测(VAD)及模型优化,同时提供灵活的 API 接口供开发者集成。 AI项目与工具 2025年06月12日 30 点赞 0 评论 627 浏览
VidMe AI 一个用户生成内容(UGC)视频创作平台,专注于利用AI生成高质量的视频内容,只要应用在TikTok、Instagram 和YouTube Shorts 等社交媒体平台上。 Ai视频生成 2025年06月05日 77 点赞 0 评论 626 浏览
VidAU AI 能够简单地通过产品链接或描述生成引人入胜的营销视频,还有换脸、视频翻译、字幕翻译、水印或字幕去除等视频编辑功能 Ai视频生成 2025年06月05日 87 点赞 0 评论 626 浏览
文本到视频生成:CogVideoX (2024) 和 CogVideo (ICLR 2023) 文本到视频生成:CogVideoX (2024) 和 CogVideo (ICLR 2023) 视频生成 2025年06月26日 0 点赞 0 评论 626 浏览
V-JEPA 创新的自监督学习模型,它通过预测视频帧的特征表示来学习视频的视觉表示。这种方法不仅能够处理视频内容,还能在图像任务上表现出色,具有广泛的应用潜力。 Ai平台模型 2026年09月27日 0 点赞 0 评论 626 浏览
Stable video diffusion online 免费激活您的图像,用 Stable Video Diffusion online 让图片动起来! Ai视频生成 2026年09月27日 0 点赞 0 评论 626 浏览