R

MidJourney提示词工具

Midjourney提示词助手为Midjourney用户提供了一个便捷的学习和实验平台,帮助他们更好地掌握提示词的创作技巧,提升AI绘画的质量和效果。

Agent Squad

Agent Squad 是一个轻量级、开源的多 Agents 框架,用于协调多个 AI Agents 处理复杂对话。它支持 Python 和 TypeScript 两种语言,具备智能意图分类、灵活的 Agent 响应(流式与非流式)、上下文管理等功能,并提供模块化安装和可扩展架构。适用于智能客服、旅行规划、企业助手等场景,帮助开发者快速构建高效的多 Agents 系统。

HivisionIDPhotos

HivisionIDPhotos 是一款基于人工智能技术的证件照制作工具,支持智能抠图、多尺寸证件照生成等功能。该工具还计划在未来版本中增加智能换正装和美颜功能。它支持 Docker 部署,并提供 API 接口以便开发者集成和自动化证件照生成流程。适用于个人、企业人力资源、教育机构、在线服务提供商及摄影工作室等多种应用场景。

Objaverse-3D物体数据集

Objaverse 是一个为3D领域提供巨大资源的数据库,它不仅支持 AI 模型的训练和3D内容的生成,还与流行的3D编辑软件 Blender 兼容。

Presentory

一款基于AI 的演示PPT生成制作工具,作为创新且用户友好的视频演示软件,提供各种 AI 功能。它允许用户创建、直播和录制令人惊叹的虚拟演示视频,每次都能吸引观众的注意力。

Westlake

Westlake-Omni是西湖心辰推出的一款开源中文情感端到端语音交互大模型,融合了语音识别、自然语言处理、情感理解和对话管理等功能,具备实时性和端到端交互特性。它通过深度学习技术和离散表示法,实现从语音输入到语音输出的全流程自动化,生成自然流畅的语音回应,并广泛应用于智能助手、客户服务、教育辅助、健康医疗等领域。

Trados

Trados塔多思是一款专业AI翻译工具,业界首屈一指的翻译平台,广受世界各地翻译机构和独立翻译工作者的喜爱。

Recraft.AI

Recraft.AI是一款 AI 在线图像生成工具,Recraft可生成 SVG 向量图、 ICON、 3D 图标等,即使印刷时也不用担心图片分辨率不足等问题。

VoiceCraft

VoiceCraft是一款开源的神经编解码器语言模型,专攻零样本语音编辑和文本到语音(TTS)任务。它采用Transformer架构,通过token重排过程结合因果掩蔽和延迟叠加技术,实现在现有音频序列内高效生成自然的语音。VoiceCraft在多种口音、风格和噪声条件下表现出色,适用于有声读物制作、视频内容创作、播客音频编辑及多语言内容生产等场景。

Emu3

Emu3是一款由北京智源人工智能研究院开发的原生多模态世界模型,结合了多模态自回归技术和单一Transformer架构,能够在图像、视频和文本之间实现无缝转换。它不仅能够根据文本生成高质量图像,还能预测视频发展并理解图文内容,广泛应用于内容创作、广告营销、教育、娱乐等多个领域。