CapsWriter CapsWriter-Offline是一款基于PC端的离线语音输入与字幕转录工具,支持实时语音转文字功能,具备高准确率和无限时长录音能力。其核心技术依托于深度学习模型,可处理中英文混合语音,并提供热词自定义功能以提升特定术语的识别效果。此工具适用于会议记录、学术讲座、视频字幕生成等多种场景,同时确保用户数据的安全与隐私。 --- AI项目与工具 2025年06月12日 38 点赞 0 评论 481 浏览
XHS 小红书链接提取/作品采集工具:提取账号发布、收藏、点赞作品链接;提取搜索结果作品链接、用户链接;采集小红书作品信息;提取小红书作品下载地址;下载小红书无水印作品文件! Ai开源项目 2025年06月05日 77 点赞 0 评论 481 浏览
Picsart Picsart是全球最大的数字创作平台。它的人工智能工具允许各级创作者设计、编辑、绘制和分享照片和视频内容。Picsart已经积累了世界上最大的开源内容集合之一,包括照片、贴纸、背... 创作工具 1970年01月01日 0 点赞 0 评论 481 浏览
Taipy Taipy是一款面向数据科学家和机器学习工程师的工具,专注于将数据和AI算法快速转化为生产级别的Web应用。其核心功能包括用户界面生成、场景与数据管理、大规模数据处理、高性能优化以及与主流数据平台的无缝集成。Taipy支持多种数据源,并提供实时数据可视化功能,广泛适用于数据可视化、机器学习模型部署、财务分析、销售预测及供应链优化等领域。 AI项目与工具 2025年06月12日 75 点赞 0 评论 481 浏览
SDXL SDXL-Lightning是一种基于扩散模型的文本到图像生成技术,由字节跳动的研究团队开发。该模型通过结合渐进式和对抗式蒸馏方法,能够在一至少数步骤内快速生成1024像素分辨率的高质量图像。该模型提供开源模型和权重,支持与现有的LoRA模块和控制插件兼容,可以轻松集成到现有的图片生成系统中。核心技术包括扩散模型、渐进式蒸馏、对抗式蒸馏和鉴别器设计,以确保生成图像的质量和多样性。 AI项目与工具 2024年01月01日 91 点赞 0 评论 482 浏览
Emergent Drums 使用Emergent Drums人工智能生成独特的鼓样本,使用Audialab插件生成无限的鼓样本,全部免版税。 创作工具 1970年01月01日 0 点赞 0 评论 483 浏览
Amodal3R Amodal3R 是一种基于条件的 3D 生成模型,能够从部分遮挡的 2D 图像中重建完整的 3D 模型。通过引入掩码加权多头交叉注意力机制和遮挡感知注意力层,提升了遮挡场景下的重建精度。该模型仅使用合成数据训练,却能在真实场景中表现出色,具有较强的泛化能力。广泛应用于 AR/VR、机器人视觉、自动驾驶及 3D 资产创建等领域。 AI项目与工具 2025年06月12日 39 点赞 0 评论 483 浏览