生成

SpatialLM

SpatialLM 是一款由群核科技推出的开源空间理解多模态模型,能通过分析普通手机拍摄的视频生成详细的 3D 场景布局,涵盖房间结构、家具摆放等信息。它结合大语言模型与点云重建技术,实现空间认知与语义标注,并支持低成本数据采集。该模型适用于具身智能训练、AR/VR、建筑设计等多个领域,具备物理规则嵌入和结构化场景生成能力。

TRELLIS

TRELLIS是一款由清华大学、中国科学技术大学及微软研究院共同开发的3D生成模型,利用Structured LATent(SLAT)表示法,通过文本或图像提示生成高质量、多样化的3D资产。它融合了稀疏的3D网格结构与密集视觉特征,支持多格式输出及局部编辑,无需拟合训练即可生成细节丰富的模型。此外,TRELLIS具备两阶段生成流程,可灵活适应不同需求。

清昴智能

聚焦于AIGC、自动驾驶、AIoT等领域,旨在解决复杂AI模型在各类设备上的高效部署问题。MLGuider针对当前主流的硬件环境进行适配与优化,包括但不限于Nvidia、AMD、华为昇腾以及其他...

Tersa

Tersa 是一款开源免费的 AI 工作流构建平台,提供直观的拖放界面,支持 77 个主流 AI 模型,如 GPT-4o、Claude 3.5 Sonnet、DALL-E 3 和 Whisper 等,适用于文本生成、图像视频创作、音频转录和代码优化等多种任务。用户可通过拖放文件快速构建复杂流程,无需编程基础,广泛应用于内容生成、代码审查、原型开发和多模态功能集成等领域。

Sheet+

Sheet+ 是一个由人工智能驱动的工具,帮助用户为Google Sheets和Excel生成公式,将公式转化为简单的解释,并提供调试器功能,帮助识别和解决公式错误。

TenereTeam AI工具集

TenereTeam为用户提供了一个广泛的目录,其中包含35个类别的1000 +多个创新AI工具。这些工具涵盖了人工智能的各个方面,包括文案、图像生成和 ChatGPT。

VideoLLaMA3

VideoLLaMA3 是阿里巴巴开发的多模态基础模型,支持视频与图像的深度理解和分析。基于 Qwen 2.5 架构,结合先进视觉编码器与语言生成能力,具备高效时空建模与多语言处理能力。适用于视频内容分析、视觉问答、字幕生成等场景,提供多种参数版本,支持灵活部署。

Pony Diffusion

一个擅长生成高质量、风格化、可爱动物主题的AI动漫艺术图片生成器,可以生成高质量的非真实感图像,涵盖各种风格,增强创造力和艺术表现力。

Fabrie AI

Fabrie AI,设计师的在线设计协作平台 ,基于Fabrie白板构建的AI驱动的设计工具。它可以帮助工业设计师、时装设计师和室内设计师在几秒钟内快速生成带有草图的逼真渲染。

Mubert

人类×人工智能生成音乐,对于您的视频内容、播客和应用程序