GroundingBooth GroundingBooth 是一种创新的文本到图像定制框架,通过结合文本-图像对齐模块和遮罩交叉注意力层,实现了前景主体与背景对象的空间精准对齐。其核心功能包括单主题与多主题定制、身份保留、文本-图像一致性保障及复杂场景下的高精度生成。该工具广泛应用于个性化商品定制、艺术创作、游戏设计、广告营销等多个领域,为视觉内容创作提供了强大的技术支持。 AI项目与工具 2025年06月12日 20 点赞 0 评论 306 浏览
Qihoo Qihoo-T2X是由360 AI研究院与中山大学联合研发的高效多模态生成模型,基于代理标记化扩散 Transformer(PT-DiT)架构。该模型通过稀疏代理标记注意力机制显著降低计算复杂度,支持文本到图像、视频及多视图生成。具备高效生成能力和多任务适应性,适用于创意设计、视频制作、教育、游戏开发及广告等多个领域。 AI项目与工具 2025年06月12日 26 点赞 0 评论 296 浏览
PIA PIA是一款个性化图像动画生成器,可以生成具有高运动可控性和强文本和图像对齐性的视频,与条件图像对齐,通过文本实现动作控制,与各种个性化T2I模型兼容,无需特定调整。 Ai开源项目 2025年06月05日 51 点赞 0 评论 294 浏览
Alpaca Ai | Photoshop插件 Alpaca是一个针对 Adobe Photoshop 的插件,可以将草图转化为栩栩如生的艺术作品。 Ai图片处理 2025年06月05日 62 点赞 0 评论 294 浏览
Fluid Fluid是一种基于连续标记和随机生成顺序的文本到图像生成模型,具有卓越的视觉表现力和全局结构捕捉能力。它通过自回归架构和Transformer模型,逐步预测序列中的下一个元素,构建与文本提示相匹配的高质量图像。Fluid在多个基准测试中取得了优异成绩,并广泛应用于艺术创作、媒体娱乐、广告营销等领域。 AI项目与工具 2025年06月12日 47 点赞 0 评论 292 浏览
SwiftBrush V2 SwiftBrush V2 是一款基于文本到图像的单步扩散模型,通过改进权重初始化、LoRA训练及夹紧CLIP损失等技术,实现了与多步Stable Diffusion模型相媲美的性能。它无需真实图像数据即可训练,显著提升了生成速度和图像质量,广泛应用于艺术创作、游戏开发、虚拟现实等领域。 AI项目与工具 2025年06月12日 21 点赞 0 评论 291 浏览
混元图像2.0 混元图像2.0是腾讯开发的AI图像生成工具,支持文本、语音、草图等多种输入方式,具备实时生成能力。其采用单双流DiT架构和多模态大语言模型,生成图像写实性强、细节丰富,且响应速度快,适用于创意设计、广告营销、教育、游戏等多个领域。用户可通过网页端直接操作,实现高效的图像创作体验。 AI项目与工具 2025年06月11日 41 点赞 0 评论 287 浏览
Anime Art Anime Art 是一款基于AI技术的动漫风格图像生成工具,用户可通过文本描述或图片输入生成个性化艺术作品。支持多种AI模型和艺术风格选择,同时集成AI聊天功能,适用于角色扮演和文本互动场景。该工具可用于个人创作、社交媒体、教育、商业营销及游戏影视开发等领域,具有广泛的适用性和创造性价值。 AI项目与工具 2025年06月12日 31 点赞 0 评论 280 浏览
Show Show-o 是一款基于统一 Transformer 架构的多模态 AI 工具,集成了自回归和离散扩散建模技术,可高效处理视觉问答、文本到图像生成、图像修复与扩展以及混合模态生成等多种任务。其创新性技术显著提高了生成效率,减少了采样步骤,适用于社交媒体内容创作、虚拟助手、教育与培训、广告营销、游戏开发及影视制作等多个领域。 AI项目与工具 2025年06月12日 86 点赞 0 评论 276 浏览
ELLA ELLA(Efficient Large Language Model Adapter)是一种由腾讯研究人员开发的方法,旨在提升文本到图像生成模型的语义对齐能力。它通过引入时序感知语义连接器(TSC),动态提取预训练大型语言模型(LLM)中的时序依赖条件,从而提高模型对复杂文本提示的理解能力。ELLA无需重新训练,可以直接应用于预训练的LLM和U-Net模型,且能与现有模型和工具无缝集成,显著提升 AI项目与工具 2024年01月01日 74 点赞 0 评论 276 浏览