图像 - 智狐AI导航

OmniVision

OmniVision是一款面向边缘设备的紧凑型多模态AI模型，参数量为968M。它基于LLaVA架构优化，能够处理视觉与文本输入，显著降低计算延迟和成本。OmniVision支持视觉问答、图像描述等功能，广泛应用于内容审核、智能助手、视觉搜索等领域。

AI项目与工具 2025年06月12日 37 点赞 0 评论 889 浏览

AnyPaint

AnyPaint是一款集成了文本到图像、图像编辑及3D模型生成等功能的AI图像生成工具，支持多种创作需求。其主要功能包括绘画生成、一键AI操作、模型库管理、IP-Adapter插件应用等，能够满足不同用户的创作需求，同时提供本地化工具提升创作效率。

AI项目与工具 2025年06月12日 81 点赞 0 评论 625 浏览

Florence

Florence-2是微软Azure AI团队研发的多功能视觉模型，支持图像描述、目标检测、视觉定位和图像分割等功能。该模型基于Transformer架构，采用序列到序列学习方法，利用自注意力机制实现多模态信息融合。通过训练大规模数据集，Florence-2在多个应用场景中表现出色，包括图像和视频分析、内容审核、辅助驾驶、医疗影像分析以及零售和库存管理。

AI项目与工具 2025年06月12日 67 点赞 0 评论 523 浏览

MagicQuill

MagicQuill是一款基于AI的开源图像编辑工具，提供智能化的局部编辑功能。其核心功能包括AI驱动的智能建议、精确的像素级编辑（如添加、删除和颜色调整），以及多种定制化工具（如添加笔刷、减去笔刷和颜色笔刷）。此外，它还具备实时意图预测和参数调整能力，支持多模态大语言模型和扩散模型的协作，适用于个人娱乐、教育、专业设计及商业应用等多个领域。

AI项目与工具 2025年06月12日 85 点赞 0 评论 798 浏览

Voyage Multimodal

Voyage Multimodal-3 是一款多模态嵌入模型，能够处理文本、图像以及它们的混合数据，无需复杂文档解析即可提取关键视觉特征。它在多模态检索任务中的准确率显著高于现有最佳模型，支持语义搜索和文档理解，适用于法律、金融、医疗等多个领域的复杂文档检索任务。

AI项目与工具 2025年06月12日 27 点赞 0 评论 711 浏览

创作星

创作星是一款基于AI技术的多功能对话工具，集成了AI聊天、AI绘画、AI视频制作及文本生成等多项功能。它能够适应多种场景需求，如工作咨询、学术讨论、日常闲聊等，并提供便捷的操作体验。无论是创意激发还是实际应用，创作星都展现出强大的实用性和创新性。 ---

AI项目与工具 2025年06月12日 99 点赞 0 评论 895 浏览

TensorPix

TensorPix是一个利用AI技术进行视频和图像处理的在线平台，支持视频放大至4K分辨率、图像增强、在线视频压缩及图像生成等功能。它适用于多种应用场景，如视频聊天录像增强、视频内容创作、旧视频修复以及低帧率视频优化等。TensorPix提供免费及不同级别的付费订阅方案，以满足个人和企业需求。

AI项目与工具 2025年06月12日 62 点赞 0 评论 754 浏览

Pixtral Large

Pixtral Large是一款由Mistral AI开源的超大规模多模态模型，具备1240亿参数，支持文本、图像和图表的理解与生成。它拥有128K的上下文窗口，能在多语言环境中处理复杂文档和多图像场景，广泛应用于教育、医疗、客服和内容审核等领域。

AI项目与工具 2025年06月12日 39 点赞 0 评论 762 浏览

PixelWave Flux

PixelWave Flux.1-dev 03 是一款基于 FLUX.1-dev 模型优化的 AI 图像生成工具，具备卓越的模型泛化能力和细节处理能力。它支持多种艺术风格生成，如摄影、动漫等，同时通过微调提升了图像的写实性和审美质量。该工具采用混合精度训练和多分辨率采样技术，适用于艺术创作、游戏开发、电影制作及广告设计等多个领域。 ---

AI项目与工具 2025年06月12日 68 点赞 0 评论 615 浏览

RAG

RAG-Diffusion是一种区域感知型文本到图像生成工具，采用区域硬绑定与区域软细化两阶段策略，实现对图像区域的精确控制与细节优化。该工具支持图像重绘，无需额外内绘模型，且具备免微调特性。其主要应用场景包括数字艺术创作、广告设计、游戏开发及影视制作等领域，能够显著提升工作效率并满足个性化需求。

AI项目与工具 2025年06月12日 48 点赞 0 评论 496 浏览

图像

首页

图像

列表

默认

浏览次数

发布日期