图像

MarDini

MarDini是一款融合掩码自回归(MAR)和扩散模型(DM)的先进视频生成工具,支持视频插值、图像到视频生成、视频扩展等多种任务。它通过优化计算资源分配,提高了视频生成的效率与灵活性,并具备从无标签数据中进行端到端训练的能力,展现出强大的可扩展性与效率。

Removal.AI

一款抠图去除图像背景多功能工具,Removal.AI 提供了一个自动化流程,可以快速、准确地从图像中去除背景,使用户几乎可以立即获得透明的背景图像。

AI游戏素材生成器

AI游戏素材生成器是一个创新的游戏开发辅助工具,它通过AI技术简化了游戏美术资源的创作过程。这个平台不仅为独立开发者和小团队节省了成本,也为大型团队提高了工作效率,使得游...

F

F-Lite是一款由Freepik与FAL开源项目联合开发的10B参数文本到图像生成模型,基于版权安全数据集训练,支持商业应用。它采用T5-XXL文本编码器,结合扩散模型架构,实现高精度图像生成。支持多分辨率输出,包含256、512和1024像素,并推出专为纹理优化的F-Lite Texture版本。模型通过强化学习和多项优化技术提升生成质量与效率,适用于创意设计、内容创作、游戏开发等多个领域。

Migician

Migician是一款由多所高校联合开发的多模态大语言模型,专为多图像定位任务设计。它基于大规模数据集MGrounding-630k,采用端到端架构和两阶段训练方法,支持跨图像精准定位与多任务处理。Migician适用于自动驾驶、安防监控、医疗影像等多个领域,具有高效的推理能力和灵活的输入方式。

CF Spark Art

CF Spark Art 只需一句文本和点击就可生成 AI 图像。这个 AI 艺术生成器通过单个文本提示和您选择的图像比例生成独特的图像变化。

SelfyzAI

SelfyzAI是一款由万兴科技推出的AI驱动型照片和视频编辑工具,具备照片舞蹈动画、AI艺术滤镜、面部修图、背景替换及身体编辑等功能。它能够将静态图像转换为动态视频,适用于社交媒体内容创作、个人照片优化及创意摄影等多种场景,提升用户的视觉表达能力与趣味性体验。

Translate Now

Translate Now是一款免费的翻译应用程序,可让您在 100 多种语言之间翻译文字、语音和图像。它使用 Google 翻译技术,提供快速、准确的翻译。

InternVL

InternVL是由上海人工智能实验室开发的多模态大模型,融合视觉与语言处理能力,支持图像、视频、文本等多种输入。其基于ViT-MLP-LLM架构,具备多模态理解、多语言处理、文档解析、科学推理等能力,广泛应用于视觉问答、智能客服、图像分析等领域。模型采用动态高分辨率与渐进式训练策略,提升处理效率与准确性。