AI Transcribe Transcribe 是一个基于 OpenAl 训练并开源的录音转文字工具,支持英语、中文等多种语言,最大的优点就是无需下载大型的模型文件。 Ai语音工具 2025年06月05日 76 点赞 0 评论 631 浏览
LatentLM LatentLM是一款由微软与清华大学合作开发的多模态生成模型,能够统一处理文本、图像、音频等多种数据类型。它基于变分自编码器(VAE)和因果Transformer架构,支持自回归生成与跨模态信息共享,特别擅长图像生成、多模态语言模型及文本到语音合成等任务,其提出的σ-VAE进一步提升了模型的鲁棒性。 AI项目与工具 2025年06月12日 67 点赞 0 评论 631 浏览
BlurOn BlurOn是一款使用NTT Data的AI技术的插件,用于视频编辑的AI自动马赛克软件,检测精度达99.7%,在电视节目和汽车行业等使用中,工作时间最多可减少90%。 视频剪辑 2025年06月05日 89 点赞 0 评论 631 浏览
boardmix博思白板-优惠券 boardmix博思白板是一款基于云端的在线思维导图软件,内置AI助手功能,能根据输入的主题自动生成思维导图内容。它支持团队协作,无文件和节点限制,并且免费使用。 Ai办公效率 1970年01月01日 0 点赞 0 评论 631 浏览
FunASR FunASR是一个由阿里巴巴达摩院开源的多功能语音识别工具包,涵盖语音识别(ASR)、语音活动检测(VAD)、标点恢复、说话人验证及分离等功能。它支持工业级模型的训练与微调,并提供预训练模型和易用接口,便于快速部署。新增的Whisper-large-v3-turbo模型进一步提升了其性能,广泛应用于智能助手、会议记录、客服系统和语音搜索等领域。 AI项目与工具 2025年06月12日 99 点赞 0 评论 632 浏览
Amazon Bedrock Amazon Bedrock是一款由AWS推出的完全托管型AI服务平台,集成了多家顶级AI公司的基础模型,支持企业通过单一API访问高性能模型。它提供了从基础模型接入、微调到代理构建的一系列功能,包括检索增强生成(RAG)、自动推理检查及多Agent协作等特性。此外,其模型蒸馏技术能够有效提升效率并降低运行成本,广泛适用于文本生成、虚拟助手、图像生成等多种应用场景。 AI项目与工具 2025年06月12日 88 点赞 0 评论 633 浏览
MoviiGen 1.1 MoviiGen 1.1是由ZulutionAI推出的专注于生成电影级画质视频的AI模型,基于Wan2.1微调而成。它在氛围营造、镜头运动和物体细节保留方面表现优异,支持720P和1080P分辨率,适用于高保真场景和专业电影应用。模型具备提示扩展功能,可优化生成效果,并采用序列并行与环形注意力等技术提升性能。其应用场景包括电影制作、广告、游戏开发、VR/AR及教育等领域。 AI项目与工具 2025年06月11日 53 点赞 0 评论 633 浏览
Dialogue.moe 一个用于动漫台词对白搜索的在线搜索引擎,Dialogue收录了大量的动画和漫画的经典台词,可以通过搜索引擎来查找自己喜欢的作品,也可以通过浏览分类来查找相应的作品。 剧本文案 2025年06月05日 68 点赞 0 评论 633 浏览