Mogao Mogao是由字节跳动开发的多模态生成基础模型,结合双视觉编码器和先进位置嵌入技术,实现高质量的图像与文本生成。支持零样本图像编辑、多模态理解与生成、高分辨率图像输出以及优化的中文文本渲染。适用于内容创作、智能交互、医疗影像分析等多个领域,具备强大的跨模态处理能力和生成稳定性。 AI项目与工具 2025年06月11日 97 点赞 0 评论 615 浏览
KeySync KeySync是一种高分辨率口型同步工具,由帝国理工学院和弗罗茨瓦夫大学联合开发。其采用两阶段生成框架,结合掩码策略和视频分割模型,实现音频与唇部动作的精准对齐。支持高清视频生成,具备遮挡处理、减少表情泄露等功能,在视觉质量、时间连贯性和同步精度上优于现有方法,适用于自动配音、虚拟形象、视频会议等多场景应用。 AI项目与工具 2025年06月11日 32 点赞 0 评论 616 浏览
腾讯混元游戏 腾讯发布的混元游戏视觉生成平台,这是依托混元大模型打造的首个工业级AIGC游戏内容生产引擎,可以优化游戏资产生成与游戏制作流程。 3D&游戏 2025年06月05日 38 点赞 0 评论 616 浏览
Tutor AI Tutor AI 是一款基于人工智能技术的个性化学习平台,通过智能算法为用户提供定制化学习路径、实时反馈及互动式教学,覆盖多学科领域,旨在提升用户的学习效果和自主学习能力,适用于学术、职业、语言学习及兴趣探索等多种场景。 --- AI项目与工具 2025年06月12日 46 点赞 0 评论 616 浏览
voice.ai voice.ai的使命是通过普及人工智能技术,增强协作创造力,并允许社区重新定义音频表达方式。公司相信人工智能应该是易于接近、对所有人开放且富有趣味的。 创作工具 1970年01月01日 0 点赞 0 评论 616 浏览
PHOTOG PHOTOG 是一款专业的AI图像生成工具,能够将真实物品无缝嵌入任意场景,提供高精度的真实感和细节表现。其功能涵盖自由模式、精确模式、局部重绘、参数调整、描述语生成及商品库上传等,适用于家居装饰、电子商务、室内设计、房地产及产品营销等多个领域,助力用户高效完成创意设计和预决策。 AI项目与工具 2025年06月12日 33 点赞 0 评论 616 浏览