开源 - 智狐AI导航

是一个多模态视频数据集，它为AI模型提供了丰富的上下文信息，使其能够更深入地理解视频内容。这个数据集在视频内容分析、情绪分析、故事叙述理解、媒体编辑和多模态学习等领域具...

Ai平台模型 2026年06月23日 0 点赞 0 评论 347 浏览

一个先进的计算机控制智能体，它通过观察屏幕截图和执行鼠标键盘动作来完成复杂的任务。它利用VLM和强化学习环境，可以在真实计算机屏幕上执行多步骤任务。

Ai平台模型 2026年06月23日 0 点赞 0 评论 346 浏览

创新的语音翻译大模型，它通过端到端的设计和深度学习技术，实现了高质量的实时语音翻译。无论是在国际会议、教育培训、旅游导航还是客户服务和医疗咨询等场景中，Gummy都能提供高...

Ai平台模型 2026年06月23日 0 点赞 0 评论 345 浏览

一个强大的图像超分辨率工具，它利用深度学习和生成对抗网络，在没有真实高分辨率图像作为参考的情况下，通过合成退化过程来提升低分辨率图像的质量。

Ai平台模型 2026年06月23日 0 点赞 0 评论 344 浏览

一个开源的集成开发环境（IDE），专注于利用人工智能技术快速生成React和Tailwind CSS的UI组件。

Ai平台模型 2026年06月23日 0 点赞 0 评论 340 浏览

一个强大的图像到视频的生成模型，它通过创新的方法解决了AI视频合成过程中的语义准确性、清晰度和时空连续性的挑战。用户可以轻松地将静态图像转换为高质量的动态视频，生成的视...

Ai平台模型 2026年06月23日 0 点赞 0 评论 340 浏览

一个功能强大、操作简便的 AI 图像生成工具，它通过深度学习技术实现了快速、高质量的逼真人物图像生成。该工具不仅在技术上实现了突破，还在应用场景上展现了广泛的潜力，无论是...

Ai平台模型 2026年06月23日 0 点赞 0 评论 340 浏览

MGIE 是苹果团队开源的一款 AI 图像编辑工具，它利用多模态大模型来增强图像编辑的指令引导能力。用户只需拍摄照片并输入文字指令，MGIE 便能够自动进行图像编辑，实现用户所需的...

Ai绘画生成 2026年06月23日 0 点赞 0 评论 340 浏览

无论是在线使用还是本地部署，它都为用户提供了灵活、高效的代码生成解决方案。此外，通过提供编辑功能和代码导出，它满足了用户对代码调整和个性化的需求。

Ai平台模型 2026年06月23日 0 点赞 0 评论 339 浏览

它提供了一种快速、高效且训练无关的方法来生成一致性图像，特别适用于需要保持主题一致性的应用场景。它不仅能够处理单主题场景，还能够应对多主题挑战，并与现有的图像编辑工具...

Ai平台模型 2026年06月23日 0 点赞 0 评论 334 浏览

开源

首页

开源