图像处理

Gemma 3n

Gemma 3n 是谷歌 I/O 开发者大会推出的端侧多模态 AI 模型,基于 Gemini Nano 架构,采用逐层嵌入技术,将内存占用压缩至 2-4B 参数模型水平。支持文本、图像、短视频和音频输入,可生成结构化文本输出,并具备音频转录、情感分析等功能。可在本地设备运行,响应时间低至 50 毫秒,适用于语音助手、内容生成和学术任务定制。

CodeFormer

CodeFormer是一款由南洋理工大学和商汤科技合作开发的AI照片和视频修复工具。它利用变分自动编码器(VQGAN)和Transformer技术,能够对模糊和马赛克处理过的照片或视频进行高质量修复。CodeFormer支持图片和视频的高清修复,操作简便且为开源免费软件,适用于家庭相册修复、社交媒体照片优化及专业图像处理等多种场景。

Artbreeder

Artbreeder 将创造力和协作结合在一起。重新混合您看到的任何图像,使其成为您自己的图像。关注您最喜爱的创作者,并与充满活力的 AI 艺术社区分享您的作品。

StyleShot

StyleShot 是一个开源的AI图像风格迁移模型,能够实现文本和图像驱动的风格迁移。它利用风格感知编码器和内容融合编码器,捕捉和再现风格细节,生成高质量的风格化图像。主要应用场景包括艺术创作、社交媒体、游戏开发和电影视频制作。

CogAgent

CogAgent是一款由清华大学与智谱AI联合开发的多模态视觉大模型,专注于图形用户界面(GUI)的理解与导航。它具备视觉问答、视觉定位、GUI Agent、高分辨率图像处理及多模态能力,可应用于自动化测试、智能交互、多模态人工智能应用开发、企业级AI Agent平台等多个领域。CogAgent在多个基准测试中表现出色,尤其在GUI操作数据集上显著超越现有模型。

SVG Converter

SVG Converter是一款高效的在线矢量转换工具,可将多种位图格式(如JPG、PNG、BMP)转换为SVG、AI、EPS等矢量格式。支持高精度输出、像素级调整、多层结构及颜色自定义,操作简便,适用于网页设计、图形编辑、Logo制作等多个领域。

StartAI

StartAI 是一款基于 Adobe Photoshop 的 AI 图像处理工具,支持文生图、局部重绘、线稿上色、无损放大等功能,提升设计效率。兼容 Photoshop CC2015 及以上版本,支持 Stable Diffusion、Midjourney 等主流引擎,提供 100 多种艺术风格,适用于广告设计、UI 设计、摄影后期及艺术创作等多种场景。

imgkits

Imgkits 是一个基于人工智能的图像处理平台,提供去除水印、对象移除、背景替换、艺术化滤镜应用、照片修复及增强等多功能服务。该工具旨在提升图片质量和视觉效果,适用于社交媒体、电商、广告设计和个人照片编辑等多个领域。平台注重用户隐私,确保数据的安全性和高效性。

Prodia AI

ProdiaAI是一款基于人工智能技术的艺术画生成工具,可以通过简单的用户输入自动生成各种类型的绘画作品。