数据

OmniAlign

OmniAlign-V是由多所高校联合开发的多模态大语言模型对齐数据集,包含约20万个多模态样本,涵盖自然图像和信息图表。其核心功能包括提供高质量训练数据、提升模型的开放式问答能力、增强推理与创造力,并支持模型持续优化。数据集通过图像筛选、任务设计及后处理优化确保数据质量,适用于多模态对话系统、图像辅助问答、创意生成等多个应用场景。

Marco

Marco是一款由阿里国际研发的大规模商用翻译大模型,支持15种主流语种,具备基于语境的精准翻译能力。其核心功能包括多语种翻译支持、跨境电商优化、多样化风格翻译以及高并发处理能力。Marco采用深度学习技术,结合多语言数据筛选和参数扩展方法,确保翻译质量和效率。它广泛应用于商品信息本地化、多语言客户服务、跨境电商平台及个人文档翻译等领域,助力全球化沟通。

Infinity

Infinity-MM是智源研究院发布的千万级多模态指令数据集,包含4300万条样本,涵盖视觉问答、文字识别、文档分析及数学推理等多领域任务。它通过严格的筛选和去重保证数据质量,并采用合成数据生成技术扩展数据集规模。基于此数据集,智源研究院训练出了20亿参数的Aquila-VL-2B模型,在多项基准测试中表现出色,推动了多模态AI领域的研究与发展。

Trickle AI

一款基于AI的零代码开发工具,用户可以通过自然语言描述需求,快速生成网页、表单和应用,支持一键部署访问,Trickle适合小商家、创业者、设计师和普通开发者。

灰豚数据

淘宝抖音直播领域专业可视化数据分析监测云平台,为商家、播主及机构提供精准、可靠、高效的直播数据分析服务

薯图宝

一款高效的图文批量生成工具,一款通用的图文批量生成工具,可以通过个性化的自定义模板和多种文案数据组合,快速批量生成图片,帮助用户快速生成用于小红书及其他平台的图文内容。

Dify Marketplace

Dify Marketplace是一个集插件分发、API集成、用户管理于一体的工具平台,涵盖生产力提升、数据分析、内容创作等多个领域。平台提供严格的审核机制以确保插件质量,支持在线安装与本地部署,并鼓励开发者参与生态建设。适用于内容创作、市场分析、技术开发、教育及个人效率提升等多种场景。

BrightHire

BrightHire是一款基于AI技术的招聘平台,提供结构化面试计划设计、自动记录与转录面试、AI驱动的面试笔记及即时反馈等功能。它可与多种现有系统无缝集成,并通过减少招聘偏见、加速决策速度来提升招聘质量和效率,同时优化候选人体验。

LongCite

LongCite是清华大学研发的一项旨在提升大型语言模型在长文本问答中可信度和可验证性的项目。它通过生成细粒度的句子级引用,帮助用户验证模型回答的准确性。LongCite包含LongBench-Cite评估基准、CoF自动化数据构建流程、LongCite-45k数据集,以及基于该数据集训练的模型。这些模型能够处理长文本内容,提供准确的问答服务,并附带可追溯的引用,增强信息的透明度和可靠性。

ManusAI

全球首款通用型AI智能体,ManusAI通过自主任务执行、动态任务拆解、多模态交互和跨平台执行等能力,帮助用户高效完成复杂任务。