数据

GR00T

GR00T-Teleop是NVIDIA Isaac GR00T系统的一部分,用于远程操作数据的采集与处理。它基于NVIDIA CloudXR技术连接高保真头显设备,实现手部跟踪数据与机器人环境视图的实时双向传输,支持用户对机器人进行直观控制。该工具为机器人训练、复杂任务执行及危险环境操作提供高质量数据支持,具备低延迟、高精度和强交互性等特点。

AICC

AICC是一家致力于推动企业AI数字化转型的SaaS品牌,AICC专注于为中国企业提供全方位AI解决方案。

Awesome Chinese LLM

整理了开源的中文大语言模型(LLM),主要关注规模较小、可私有化部署且训练成本较低的模型,目前已收录了100多个相关资源。

亮数据BrightData

一家专注于为企业提供网络数据收集和代理服务的公司,亮数据BrightData提供全面的网络数据解决方案,包括高级代理网络、AI驱动的网络抓取工具、动态更新的数据集等功能。

Rox

Rox 是一款专注于销售领域的AI平台,通过智能代理技术提升客户关系管理与销售流程效率。它能够自动收集和整合客户数据,生成个性化内容,自动化处理任务,并提供深度数据分析,助力销售团队制定精准策略。Rox 支持实时更新和系统集成,适用于客户拓展、会议支持、信息管理和营销互动等多个场景。

Publer

Publer是一款结合AI技术的社交媒体管理工具,提供从内容创作到数据分析的一站式解决方案。它支持多平台帖子的创建、编辑与发布,具备智能排程、团队协作、资料链接优化等功能,帮助企业提升内容质量和运营效率,广泛应用于品牌营销、内容创作及团队协作场景。

TIP

TIP-I2V是一个包含大量真实文本和图像提示的数据集,专为图像到视频生成领域设计。它涵盖了超过170万个独特的提示,并结合多种顶级图像到视频生成模型生成的视频内容。该数据集支持用户偏好分析、模型性能评估以及解决错误信息传播等问题,有助于推动图像到视频生成技术的安全发展。

Docmatix

Docmatix 是一个专为文档视觉问答任务设计的大规模数据集,包含240万张图像和950万个问题-答案对,源自130万个PDF文档。数据集覆盖广泛,包括扫描图片、PDF文件和数字文档,且具有高质量的问答对。Docmatix 支持模型训练和微调,可用于训练视觉语言模型,提高其在理解和回答与文档内容相关问题方面的性能。应用场景包括自动化客户服务、智能文档分析、教育和学术研究以及业务流程自动化等。

Magma

Magma是微软研究院开发的多模态AI基础模型,具备理解与执行多模态任务的能力,覆盖数字与物理环境。它融合语言、空间与时间智能,支持从UI导航到机器人操作的复杂任务。基于大规模视觉-语言和动作数据预训练,Magma在零样本和微调设置下表现优异,适用于网页操作、机器人控制、视频理解及智能助手等多个领域。

Jina Reader

Jina Reader是一款由Jina AI开发的开源工具,专注于将互联网上的HTML网页内容转换为适合大型语言模型处理的纯文本格式。它支持多种内容格式,具备流模式、JSON模式和Alt生成模式等功能,能够高效提取网页核心内容,去除冗余信息,并通过自然语言处理和动态内容处理技术提升文本质量和理解能力。Jina Reader适用于内容聚合、SEO优化、学术研究及个性化推荐等多个领域。