FunAudioLLM FunAudioLLM是由阿里巴巴通义实验室开发的开源语音大模型项目,包含SenseVoice和CosyVoice两个子模型。SenseVoice擅长多语言语音识别和情感辨识,支持超过50种语言;CosyVoice则专注于自然语音生成,支持多种语言、音色和情感控制。该项目适用于多语言翻译、情感语音对话等场景,其相关模型和代码已公开发布。 AI项目与工具 2025年06月12日 66 点赞 0 评论 528 浏览
ASSEMBO.AI ASSEMBO.AI 是一款 AI 驱动的多功能平台,支持电商商家快速生成高质量的营销图片和视频。用户可上传产品图片,选择背景或风格,轻松创建适合多平台展示的内容。平台提供多样化的模板和个性化调整选项,适用于电商、社交媒体营销、广告制作等多个场景,有效提升产品吸引力和品牌曝光率。 AI项目与工具 2025年06月12日 17 点赞 0 评论 527 浏览
AI Manga Translator AI漫画翻译器是一个用户友好的网站,可让您轻松快速地将您喜爱的漫画或扫描件翻译成多种语言。 Ai图片处理 2025年06月05日 77 点赞 0 评论 527 浏览
百度搜索MCP广场 百度搜索MCP广场是百度搜索AI开放平台提供的MCP Servers集成平台,为开发者提供海量服务资源,涵盖搜索、地图、文件系统等多个领域。平台具备智能搜索与推荐功能,支持快速筛选和集成所需服务,提升开发效率。同时支持本地与云端部署,适用于AI应用开发、多模态生成、企业级解决方案及内容创作等多种场景。 AI项目与工具 2025年06月11日 86 点赞 0 评论 527 浏览
LCVD LCVD是一种由四川大学开发的高保真肖像动画生成框架,支持光照可控的动态视频生成。它通过分离肖像的内在与外在特征,并结合多条件分类器自由引导机制,实现对光照和姿态的精细控制。LCVD在图像质量、视频一致性和光照真实感方面表现突出,适用于虚拟现实、视频会议、影视制作及内容创作等多个领域。 AI项目与工具 2025年06月12日 93 点赞 0 评论 527 浏览
LanPaint LanPaint 是一款基于 Stable Diffusion 的高质量图像修复工具,无需额外训练即可实现精准修复。通过多轮迭代推理优化修复效果,支持多种参数调整,适用于图像修复、内容替换及艺术创作等多种场景,操作简便且效果自然。 AI项目与工具 2025年06月12日 61 点赞 0 评论 526 浏览
FlashMLA FlashMLA 是 DeepSeek 开发的开源 MLA 解码内核,针对 NVIDIA Hopper 架构 GPU 优化,提升可变长度序列处理效率。支持 BF16 精度、页式 KV 缓存及分块调度,内存带宽达 3000 GB/s,算力达 580 TFLOPS。适用于大语言模型推理和 NLP 任务,具备高性能与低延迟特性,支持快速部署与性能验证。 AI项目与工具 2025年06月12日 12 点赞 0 评论 526 浏览
Chat2SVG Chat2SVG 是一种基于大语言模型和图像扩散模型的文本到 SVG 生成工具,能够自动创建高质量矢量图形。通过多阶段处理流程,包括模板生成、细节增强和形状优化,确保图形在视觉质量和语义对齐方面达到较高标准。支持自然语言指令编辑,适用于设计原型、图标创作、教育演示及艺术创作等多种场景。 AI项目与工具 2025年06月12日 74 点赞 0 评论 526 浏览
ima App ima App是一款由腾讯推出的AI知识管理工具,结合腾讯混元大模型和DeepSeek-R1模型,提供智能问答、知识库管理、笔记整理及智能写作等功能。支持多端同步与云存储,适用于团队协作和个人知识管理,帮助用户高效获取、整理和应用信息。 AI项目与工具 2025年06月12日 45 点赞 0 评论 526 浏览