PaliGemma 2 mix PaliGemma 2 Mix 是谷歌 DeepMind 推出的多任务视觉语言模型,支持图像描述、目标检测、OCR、文档理解等功能。模型提供多种参数规模和分辨率选项,适用于不同场景。其基于开源框架开发,易于扩展,可通过简单提示切换任务。适用于科学问题解答、文档分析、电商内容生成等多个领域。 AI项目与工具 2025年06月12日 23 点赞 0 评论 590 浏览
DynamicCity DynamicCity是由上海AI Lab开发的大规模动态场景生成框架,支持高质量4D LiDAR场景的生成与重建,适用于自动驾驶、机器人导航、虚拟现实等多个领域。该框架基于VAE和DiT模型,实现高效的场景编码与生成,支持轨迹引导、指令驱动生成和动态修复等多种应用,展现出优异的性能和广泛的应用潜力。 AI项目与工具 2025年06月12日 63 点赞 0 评论 590 浏览
VtripGPT VtripGPT是一款专为旅游领域设计的AI大模型,采用Transformer架构,结合增量预训练和微调技术,可生成高质量的旅游相关文本回复。它具备对话生成、个性化旅游攻略提供、行程定制、商品推荐以及智能问答等功能,旨在提升旅游规划效率并优化用户体验。VtripGPT已成功应用于多个国家和地区,覆盖了从旅游攻略生成到商品推荐的多种应用场景。 AI项目与工具 2025年06月12日 50 点赞 0 评论 590 浏览
Upscayl Upscayl 是一款效果非常出众的图片放大变清晰图片处理软件,通过使用高级的 AI 模型来升级低分辨率图像,使得模糊的图片即使放大也同样清晰。 Ai图片处理 2025年06月05日 97 点赞 0 评论 590 浏览
ReasonIR ReasonIR-8B 是由 Meta AI 开发的推理密集型检索模型,基于 LLaMA3.1-8B 训练,采用双编码器架构,提升复杂查询处理能力。结合合成数据生成工具,增强模型在长上下文和抽象问题中的表现。在多个基准测试中表现优异,适用于问答系统、教育、企业知识管理和科研等领域。 AI项目与工具 2025年06月11日 11 点赞 0 评论 591 浏览
OmniAI OmniAI是一款基于OCR与NLP技术的智能文档处理平台,支持多种文件格式的数据提取与分类。其核心功能包括批量处理、结构化数据输出以及自定义模型开发,适用于财务审计、客户服务、法律合规、医疗健康及保险理赔等多个领域,为企业提供高效的文档智能化解决方案。 AI项目与工具 2025年06月12日 79 点赞 0 评论 591 浏览
Aperty Aperty是一款智能AI人像照片编辑器,专为摄影师设计,支持MacOS和Windows系统,或作为Photoshop和Lightroom的插件使用。它基于先进的AI技术,能够快速去除瑕疵、平滑皮肤、提亮眼睛、增强笑容,同时保留自然美感。Aperty支持批量修图,提高工作效率,并内置超过50种AI预设,一键应用专业级编辑效果。此外,它还提供化妆工具和灯光控制功能,适用于婚礼摄影、时尚摄影、家庭摄影 AI项目与工具 2025年06月11日 81 点赞 0 评论 591 浏览
Promptport提示词 Promptport是一款专为ChatGPT定制的创意AI工具。它允许用户在平台上创建、优化和分享 ChatGPT 的提示词。用户可以自行创建 ChatGPT 提示词,并使用标签对它们进行分类。 Ai提示指令 2025年06月05日 15 点赞 0 评论 592 浏览