AI

Scenethesis

Scenethesis是NVIDIA推出的AI框架,可通过文本生成高质量的3D场景。它结合LLM与视觉技术,经过布局规划、视觉细化、物理优化和场景验证四个阶段,确保生成结果具备物理合理性和空间连贯性。支持用户交互与多样化场景构建,广泛应用于VR/AR、游戏开发、具身智能及虚拟内容创作等领域。

涌墨

涌墨是一款智能文档编写平台,提供全流程文档管理与智能生成服务。平台包含25类符合软件行业国标的文档模板,支持智能解析、内容生成及文档一致性管理。用户可通过项目为中心的工作流进行文档创建、编辑与优化,适用于招投标、规范文档、日常办公及市场调研等多种场景。其可视化功能和高度定制化设计提升了文档管理的效率与准确性。

QLIP

QLIP是一种基于二进制球形量化(BSQ)的视觉标记化方法,具备高质量图像重建和零样本图像理解能力。通过对比学习目标和两阶段训练策略,QLIP可作为视觉编码器或图像标记器,广泛应用于多模态任务,如文本到图像生成、图像到文本生成及多模态理解。其技术设计提升了模型的语义表达与训练效率,为统一多模态模型的开发提供了新思路。

The Matrix

The Matrix是一款基于AI的世界模拟器,能够生成高保真度、无限时长的视频流,支持实时交互控制。它融合了3A游戏数据与真实世界视频,具备零样本泛化能力。核心技术包括交互模块、移窗去噪过程模型和流一致性模型,适用于游戏开发、影视制作、虚拟现实、教育模拟及城市规划等多个领域。

InternVideo2.5

InternVideo2.5是一款由上海人工智能实验室联合多机构开发的视频多模态大模型,具备超长视频处理能力和细粒度时空感知。它支持目标跟踪、分割、视频问答等专业视觉任务,适用于视频检索、编辑、监控及自动驾驶等多个领域。模型通过多阶段训练和高效分布式系统实现高性能与低成本。

BnbIcons

BnbIcons是一款AI驱动的图标生成工具,能够创建类似Airbnb风格的等轴测图标。用户可通过文字描述或上传参考图片生成图标,提供464+个预设图标,支持批量生成和图标动画功能,适用于界面设计、原型设计、社交媒体内容等多种场景。

Klic Studio

Klic Studio是一款基于大型语言模型的视频翻译与配音工具,支持56种语言翻译,适用于多平台内容制作。具备高精度字幕识别、智能分割对齐、语音克隆及一键视频合成等功能,简化视频创作流程,提升多语言内容传播效率。

Udio

由前 Google Deepmind 研究人员开发的AI音乐生成器。用户可以通过文字描述轻松生成带有歌词的音乐。

Mercor

Mercor 是一个基于 AI 技术的全球招聘平台,为求职者提供智能面试与全球职位匹配服务,同时为企业提供高效、合规的招聘解决方案。平台支持一键招聘、简历分析、合规支付等功能,适用于远程工作者、应届生、技术人才及跨国企业,简化招聘流程,提升匹配效率。

ProcessOn思维导图流程图

ProcessOn是北京大麦地信息技术有限公司旗下的一款专业在线作图工具和分享社区,支持流程图、思维导图、原型图、网络拓扑图和UML等多种类型的绘制。它不仅为用户提供思维视觉化的...