R

LogoMakr

LogoMakr是一款免费、简单易用的LOGO在线制作工具。无论您是何种行业,仅需几分钟都可以自助为公司、网站、品牌等在线生成专业的、精美的LOGO

Aero

Aero-1-Audio 是一款基于 Qwen-2.5-1.5B 的轻量级音频模型,拥有 1.5 亿参数,专注于长音频处理,支持连续 15 分钟音频输入并保持上下文连贯性。在语音识别、复杂音频分析及指令驱动任务中表现出色,具备高效的训练方法和多任务处理能力,适用于语音助手、实时转写、归档理解等场景。

QueryPal

QueryPal是一款嵌入Slack和Microsoft Teams的AI聊天助手,可从多个企业数据源(如Google Drive、Notion、Jira等)中提取信息,即时回答员工问题,从而提升工作效率。它支持多种应用场景,包括新员工培训、DevOps支持及客户服务,并能自动管理知识库,减少对静态文档的依赖。

AutoPod

AutoPod是一款基于人工智能技术的视频剪辑工具,专为Adobe Premiere Pro用户打造。它支持多机位编辑、社交媒体优化以及跳跃剪辑等功能,能够大幅提升视频编辑效率。该工具兼容多种摄像机配置,提供灵活的自定义选项和预设功能,广泛应用于播客制作、在线教育、企业宣传及社交媒体内容创作等领域。

TTSMaker马克配音

免费的AI配音平台,可以将文本转换成语音,支持50多种语言和300多种语音风格

GameFactory

GameFactory 是由香港大学与快手科技联合研发的AI框架,专注于解决游戏视频生成中的场景泛化问题。它基于预训练视频扩散模型,结合开放域数据与高质量游戏数据,通过多阶段训练实现动作可控的多样化场景生成。具备高精度动作控制、交互式视频生成及丰富场景支持,适用于游戏开发、自动驾驶模拟及具身智能研究等领域。

PassMore

专业的论文重复率检测、论文降重、论文在线修改、学术不端检测等一站式服务

Zerox

Zerox是一款基于GPT-4o-mini模型的开源OCR工具,支持多种文件格式,具备零样本识别能力,可高效处理扫描文档和复杂布局内容。其输出为Markdown格式,便于编辑与使用,同时提供API接口,适用于企业文档管理、学术研究、法律金融等多个场景,显著提升文档处理效率和准确性。

PDF to Podcast

PDF to Podcast 是一款由 NVIDIA 开发的 AI 工具,能够将 PDF 文档自动转换为高质量的音频内容,如播客。该工具结合了大型语言模型、文本到语音技术以及 NVIDIA NIM 微服务架构,支持从 PDF 提取信息并生成结构化文本,再通过语音合成输出自然流畅的音频。用户可自定义生成内容的重点,并支持多种部署方式,适用于企业培训、技术简报、客户服务、医疗教育等多个领域。