VoxInstruct VoxInstruct是清华大学开源的语音合成技术,能够根据人类语言指令生成高质量的语音。该系统采用统一的多语言编解码器语言建模框架,将传统的文本到语音任务扩展到了更广泛的人类指令到语音任务。VoxInstruct通过引入语音语义标记和多种无分类器指导策略,提升了语音合成的自然度和表现力。它支持多语言和跨语言合成,适用于智能语音助手、有声读物、教育培训等多个领域。 AI项目与工具 2025年06月12日 79 点赞 0 评论 866 浏览
AgentCPM AgentCPM-GUI是由清华大学与面壁智能团队联合开发的开源端侧GUI代理系统,专为中文应用场景优化。基于MiniCPM-V模型,支持通过截图输入并自主执行用户指令,具备高精度GUI元素识别与OCR能力。采用强化微调和紧凑动作空间设计,提升任务执行效率与移动端适配性。适用于智能助手、自动化测试、老年人辅助及企业应用等领域。 AI项目与工具 2025年06月11日 18 点赞 0 评论 866 浏览
Chatgot.io 一个独特的应用程序,将多个AI聊天助手整合到一个平台中。想象一下,你参与的聊天群组里不是与人交流,而是与各种AI个性互动。 AI写作对话 2025年06月05日 65 点赞 0 评论 866 浏览
JourneyPlan JourneyPlan,你的 AI 旅行规划师! 通过AI 技术在你的时间范围和预算内,根据您自己的喜好、兴趣、预算和时间创建个性化的行程。 生活创意 2025年06月05日 37 点赞 0 评论 866 浏览
YT Navigator YT Navigator 是一款基于 AI 的 YouTube 内容检索工具,支持自然语言查询、语义搜索和视频内容交互。用户可快速定位视频片段并获取时间戳,提升信息获取效率。适用于研究、学习、创作和分析等场景,具备频道管理、安全会话等功能。采用向量嵌入与 BM25 算法结合的搜索机制,提高搜索准确率,项目已开源。 AI项目与工具 2025年06月12日 57 点赞 0 评论 866 浏览
Hatch Hatch是一款AI数字创意画布工具,提供无限的创作空间,能够根据用户的思考过程进行适应和调整。用户可以从一个提示、图像或问题开始,将想法以视觉化的方式进行组织和连接。它支持自由布局、无限扩展、智能生成、图像编辑、AI助手和实时协作等功能,帮助用户将创意转化为现实。适用于创意构思、项目规划和内容创作等场景。 AI项目与工具 2025年06月11日 83 点赞 0 评论 864 浏览
Mind GPT Mind GPT-3o是一款由理想汽车推出的大规模多模态端到端人工智能模型,集成了语音、视觉与语言理解技术,具备记忆、规划、工具集成及表达能力。它不仅能理解复杂信息,还能提供个性化服务,如智能驾驶辅助、家居设备控制、日程管理和健康咨询等。通过强化逻辑推理与上下文理解,该模型实现了从感知到表达的智能化跨越,为用户提供全面的支持。 AI项目与工具 2025年06月12日 65 点赞 0 评论 861 浏览
妙问 妙问是腾讯广告推出的AI营销辅助工具,支持7×24小时在线服务,覆盖广告主从筹备到复盘的全流程需求。其核心功能包括快问快答、深度分析、移动办公等,能提供实时数据支持、爆款素材建议、广告审核答疑及多账户管理。适用于广告咨询、投放优化、效果分析及移动管理等场景,提升营销效率与决策质量。</p> AI项目与工具 2025年06月11日 22 点赞 0 评论 860 浏览
京言AI助手 京东京言AI助手,一款AI智能导购助手,可以为用户提供专业品类咨询、个性化送礼助手、产品对比助手和购物经验知识的功能。 电商运营 2025年06月05日 76 点赞 0 评论 860 浏览