MnnLlmApp MnnLlmApp 是阿里巴巴基于 MNN-LLM 框架开发的开源 Android 应用,支持多种大语言模型在本地运行。具备多模态交互能力,可处理文本、图像、音频等多种输入输出任务。应用经过 CPU 推理优化,运行效率高,支持离线使用,保障数据安全。内置 Qwen、Gemma、Llama 等主流模型,适用于内容创作、智能助手、语言学习及创意设计等多种场景。 AI项目与工具 2025年06月12日 60 点赞 0 评论 384 浏览
OCRmyPDF OCRmyPDF 是一款开源的命令行工具,用于将扫描 PDF 转换为可搜索、可编辑的文档。基于 Tesseract OCR 引擎,支持 100 多种语言,具备图像优化、纠偏、清洁等功能,提升识别准确率。支持多核处理与批量操作,适合高效处理大量文件,且完全离线运行,保障数据安全。 AI项目与工具 2025年06月12日 39 点赞 0 评论 174 浏览
MILS MILS是由Meta AI开发的一种无需额外训练即可为大型语言模型(LLM)提供多模态能力的框架。它通过多步推理、评分反馈和迭代优化,实现图像、视频、音频等多模态内容的生成与理解。MILS支持零样本描述生成、风格迁移、跨模态推理等任务,适用于内容生成、多模态检索、视觉问答等多个场景,具备高效、灵活和无需训练的优势。 AI项目与工具 2025年06月12日 31 点赞 0 评论 118 浏览
JoggAI JoggAI是一款基于AI技术的头像生成工具,可根据文本描述创建个性化的写实或卡通风格头像,并支持动态表情与动作。用户可通过简单操作自定义面部特征、服装、背景等细节,适用于社交媒体、数字营销、游戏开发及教育等多个领域,具备高度灵活性与易用性。 AI项目与工具 2025年06月12日 53 点赞 0 评论 348 浏览
Outrank Outrank 是一款基于 AI 的 SEO 内容生成与管理工具,具备自动化关键词研究、文章生成、内容发布及性能分析等功能。它支持多语言内容创作,可与主流平台和工具集成,适用于企业、营销团队和内容创作者,帮助提升网站流量与搜索排名。 AI项目与工具 2025年06月12日 70 点赞 0 评论 153 浏览
DiffSplat DiffSplat是一款高效的3D生成工具,能够根据文本或图像快速生成高质量的3D高斯点云。它基于预训练的文本到图像扩散模型,结合2D先验知识和3D渲染损失机制,确保生成内容在多视角下保持一致。支持文本、图像或组合输入,具备可控生成能力,适用于3D内容创作、图像重建及多种下游应用。 AI项目与工具 2025年06月12日 72 点赞 0 评论 368 浏览
FaceFancy FaceFancy是一款集成AI换脸、图像编辑与创意生成功能的应用,支持照片和视频换脸、多种风格头像生成、年龄与性别变换、旧照修复及特效滤镜等功能,适用于创意娱乐、个人形象设计及社交分享等场景,提升用户创作体验。 AI项目与工具 2025年06月12日 27 点赞 0 评论 291 浏览
UnZipLoRA UnZipLoRA是一种由伊利诺伊大学厄巴纳-香槟分校研发的图像处理技术,能够将图像内容与风格分离,并分别以两个LoRA模型表示。该技术通过提示分离、列分离和块分离策略,有效解决内容与风格纠缠的问题,支持高效训练和兼容性组合。可用于艺术创作、图像编辑、风格迁移及个性化图像生成等场景,提升图像处理的灵活性和可控性。 AI项目与工具 2025年06月12日 81 点赞 0 评论 382 浏览
VARGPT VARGPT是一款多模态大语言模型,整合了视觉理解和生成任务于统一的自回归框架中。它通过next-token和next-scale预测机制,支持文本与图像的混合输入和输出,具备高效的视觉生成能力。模型采用三阶段训练策略,提升了在视觉问答、推理及图像生成任务中的表现。适用于多模态内容创作、指令到图像合成等场景。 AI项目与工具 2025年06月12日 17 点赞 0 评论 169 浏览
Raphael Raphael 是一款基于 Flux.1-Dev 模型的 AI 图像生成工具,无需注册即可使用。支持多种艺术风格,提供高质量图像生成,具备快速处理能力和严格的隐私保护机制。适用于艺术创作、内容设计、营销、游戏开发等多个领域,适合个人及商业用途。 AI项目与工具 2025年06月12日 100 点赞 0 评论 495 浏览