多语言

讯飞译制

讯飞译制是一款基于语音识别与机器翻译技术的智能字幕制作与翻译平台,支持多语言转换与自动字幕生成,提供高精度识别、智能时间码匹配、多格式导出及配音功能,适用于短视频出海、教学视频、广告宣传等多种场景,提升内容传播效率与国际化水平。

WebLI

WebLI-100B是由Google DeepMind推出的超大规模视觉语言数据集,包含1000亿个图像与文本配对数据,是目前最大的视觉语言数据集之一。其设计旨在提升模型对长尾概念、文化多样性和多语言内容的理解能力。数据集通过网络爬取构建,保留了丰富的语言和文化多样性,支持多模态任务如图像分类、图像描述生成和视觉问答,广泛应用于人工智能研究、工程开发及教育领域。

AstrBot

AstrBot是一款多功能聊天机器人及开发框架,支持多种大语言模型和消息平台,具备多轮对话、语音转文字、网页搜索等功能。它采用模块化设计,支持插件开发和多平台部署,适用于企业客服、个人助手、教育辅导等多个场景,提供高效的智能交互体验。

PPT.AI

PPT.AI 是一款 AI 演示文稿制作工具,能够将用户输入的主题或上传的文档内容快速转换为专业的 PPT。具备智能内容生成、自动设计与排版、丰富模板选择、多语言支持等功能,支持 15 种主要语言,提供 50 多个专业模板。用户只需输入主题或上传文件,选择模板即可生成演示文稿,并支持进一步自定义编辑。PPT.AI 注重数据安全,提供银行级加密和安全云存储。

Ztalk ai

一个AI驱动的会议实时语音翻译平台,可以与 Zoom、Google Meet 等视频会议平台集成。提供超30种语言的即时语音到语音翻译,延迟小于 100 毫秒,具备高级音频处理和企业安全功能。

混元DiT

混元DiT(Hunyuan-DiT)是腾讯混元团队开源的高性能文本到图像的扩散Transformer模型,具备细粒度的中英文理解能力,能够生成多分辨率的高质量图像。该模型结合了双语CLIP和多语言T5编码器,通过精心设计的数据管道进行训练和优化。混元DiT的主要功能包括双语文本到图像生成、细粒度中文元素理解、长文本处理能力、多尺寸图像生成、多轮对话和上下文理解、高一致性和艺术性。此外,混元DiT在

speakSync

AI语音翻译器,无缝语音和文本转换,一款基于ChatGPT的AI语音翻译应用,支持70多种语言。它可以实现面对面语音通话。

HourOne Ai

一款AI数字人视频生成器,可以在几分钟内通过文本生成专业视频,它提供定制的视频模板、不同口音和语言的AI数字人等功能。

SiteGPT.ai

一个专为网站设计的人工智能聊天机器人,旨在通过个性化的对话方式提供更好的用户体验,即时回答访问者的问题。它通过对网站内容进行训练,能够回答与网站内容相关的任何问题,从而帮助用户创建和训练自己的AI聊天机器人。