图像 - 智狐AI导航

WebSSL

WebSSL是由Meta和纽约大学等机构开发的视觉自监督学习模型，基于大规模网络图像数据训练，无需语言监督即可学习有效视觉表示。其包含多个变体，参数规模从3亿到70亿不等，在多模态任务如视觉问答、OCR和图表理解中表现出色。通过筛选含文本图像数据，显著提升特定任务性能。模型具备良好的扩展性，适用于智能客服、文档处理、医疗影像分析等多个领域。

AI项目与工具 2025年06月11日 92 点赞 0 评论 811 浏览

IC

IC-Light是一款由张吕敏开发的AI图像处理工具，专注于图像的光源操纵和光影重构，支持基于文本和背景条件下的图像重照明。该工具适用于多种场景，包括个人照片编辑、专业摄影后期、电商产品展示、广告和海报设计等。IC-Light具备自动抠图、光源方向选择、文本条件重照明等功能，并且支持开源获取。

AI项目与工具 2024年01月01日 56 点赞 0 评论 811 浏览

LatentLM

LatentLM是一款由微软与清华大学合作开发的多模态生成模型，能够统一处理文本、图像、音频等多种数据类型。它基于变分自编码器（VAE）和因果Transformer架构，支持自回归生成与跨模态信息共享，特别擅长图像生成、多模态语言模型及文本到语音合成等任务，其提出的σ-VAE进一步提升了模型的鲁棒性。

AI项目与工具 2025年06月12日 67 点赞 0 评论 811 浏览

AISEO Art

AISEO Art是一款基于AI技术的艺术生成平台，支持用户通过文本提示生成个性化视觉艺术作品。平台提供包括AI头像生成、图像变体、艺术模板选择及滤镜应用在内的多项功能，适用于广告设计、数字艺术创作、游戏开发及社交媒体营销等多个场景，助力用户高效产出高质量视觉内容。

AI项目与工具 2025年06月12日 81 点赞 0 评论 811 浏览

Publer AI Assist

Publer AI Assist 使用最新的人工智能技术帮助您在几秒钟内生成内容、创建令人惊叹的图像并像专业人士一样回复评论。

裂变增长 2025年06月05日 66 点赞 0 评论 811 浏览

ICEdit

ICEdit是由浙江大学与哈佛大学联合开发的指令式图像编辑框架，基于扩散变换器实现自然语言驱动的图像修改。支持多轮编辑、风格转换、对象替换等功能，具有高效处理能力（单张图像约9秒）。采用LoRA-MoE混合微调策略，降低资源需求，适用于创意设计、影视制作、社交媒体等多个领域。开源且提供在线体验，便于研究与应用。

AI项目与工具 2025年06月11日 85 点赞 0 评论 812 浏览

Amazon Bedrock

Amazon Bedrock是一款由AWS推出的完全托管型AI服务平台，集成了多家顶级AI公司的基础模型，支持企业通过单一API访问高性能模型。它提供了从基础模型接入、微调到代理构建的一系列功能，包括检索增强生成（RAG）、自动推理检查及多Agent协作等特性。此外，其模型蒸馏技术能够有效提升效率并降低运行成本，广泛适用于文本生成、虚拟助手、图像生成等多种应用场景。

AI项目与工具 2025年06月12日 88 点赞 0 评论 812 浏览

纳米搜索

纳米搜索是一款由360集团开发的多功能AI搜索引擎，支持文字、语音、拍照和视频等多种搜索方式，涵盖从简单到复杂的全方位解答方案。它整合了16款顶尖大模型能力，配备了智能工具，如写作、翻译和旅游规划助手，旨在提升多场景下的操作效率。此外，其独特的AI脱口秀功能，能将搜索结果转化为视频内容，为用户提供更直观的知识获取体验。

AI项目与工具 2025年06月12日 13 点赞 0 评论 812 浏览

Click2Mask

Click2Mask 是一种创新的图像编辑工具，通过点击操作实现局部内容的高效编辑。它采用动态遮罩生成技术，并结合混合潜在扩散（BLD）模型及基于 CLIP 的语义损失，使用户无需复杂操作即可完成图像编辑。该工具支持局部内容添加、自由形式编辑等功能，适用于数字艺术创作、照片编辑、社交媒体内容制作及广告设计等场景。

AI项目与工具 2025年06月12日 83 点赞 0 评论 813 浏览

Boow

Boow-VTON是一种基于先进图像生成技术和数据增强方法的虚拟试衣技术，无需精确遮罩即可实现高质量试穿效果。该工具通过试穿定位损失和注意力机制，精准识别试穿区域并确保服装自然贴合人体，支持多服装试穿且操作简便。其应用场景包括在线购物、时尚零售、个性化推荐、社交媒体互动及服装设计等多个领域，具有广泛的商业应用价值。

AI项目与工具 2025年06月12日 49 点赞 0 评论 813 浏览

图像

首页

图像

列表

默认

浏览次数

发布日期