iMyFone VoxBox iMyFone VoxBox是一款集多种声音制作功能于一体的AI声音生成器,适合各种使用场景,从视频配音到有声书叙述,再到播客和游戏角色配音等。 Ai语音工具 1970年01月01日 0 点赞 0 评论 446 浏览
Magma Magma是微软研究院开发的多模态AI基础模型,具备理解与执行多模态任务的能力,覆盖数字与物理环境。它融合语言、空间与时间智能,支持从UI导航到机器人操作的复杂任务。基于大规模视觉-语言和动作数据预训练,Magma在零样本和微调设置下表现优异,适用于网页操作、机器人控制、视频理解及智能助手等多个领域。 AI项目与工具 2025年06月12日 100 点赞 0 评论 446 浏览
Pixelcut AI Pixelcut 是一家提供各种基于 AI 技术的图片编辑工具服务商,支持 iOS、Android、Web,可以去背景、橡皮擦、无损放大等 Ai图片处理 2025年06月05日 69 点赞 0 评论 446 浏览
PromptLoop Promptloop 是一个帮助您编写更好文本的网站。它使用人工智能来生成改进您的写作风格、语法、词汇和内容的建议。 Ai办公效率 2025年06月05日 37 点赞 0 评论 446 浏览
媒小三 媒小三 ,实用的新媒体工具大全,提供各种实用新媒体工具,如:AI配音,视频解析,短视频下载,文案提取,文章改写,标题生成等功能,帮助新媒体人一站式快捷操作。 Ai办公效率 2025年06月05日 46 点赞 0 评论 446 浏览
VALL VALL-E一种用于文本到语音合成 (TTS) 的语言建模方法。具体来说,我们使用从现成的神经音频编解码器模型派生的离散代码来训练神经编解码器语言模型(称为 VALL-E),并将 TTS 视为... Ai平台模型 1970年01月01日 0 点赞 0 评论 446 浏览
Multimodal Live API Multimodal Live API是谷歌推出的一种支持文本、音频和视频交互的AI接口,具备低延迟、实时双向通信和自然语言处理能力。它允许用户通过多种输入方式与AI互动,并支持会话记忆和外部功能调用,广泛应用于客户服务、在线教育、远程医疗、视频会议和娱乐等领域。 AI项目与工具 2025年06月12日 51 点赞 0 评论 446 浏览