DreamVideo DreamVideo-2是一款由复旦大学和阿里巴巴集团等机构共同开发的零样本视频生成框架,能够利用单一图像及界定框序列生成包含特定主题且具备精确运动轨迹的视频内容。其核心特性包括参考注意力机制、混合掩码参考注意力、重加权扩散损失以及基于二值掩码的运动控制模块,这些技术共同提升了主题表现力和运动控制精度。DreamVideo-2已在多个领域如娱乐、影视制作、广告营销、教育及新闻报道中展现出广泛应用前 AI项目与工具 2025年06月12日 65 点赞 0 评论 472 浏览
FLUX Tools FLUX Tools是一套由黑森林实验室开发的增强型文本到图像模型工具,包含FLUX.1 Fill、FLUX.1 Depth、FLUX.1 Canny和FLUX.1 Redux四个模块,能够通过文本描述和掩码对图像进行精确编辑和扩展,支持图像修复、扩展、结构化引导、混合与再创作等功能。工具基于深度学习和神经网络技术,结合结构引导和文本到图像转换功能,适用于多种应用场景,包括数字艺术创作、游戏开发、 AI项目与工具 2025年06月12日 20 点赞 0 评论 471 浏览
Fronty AI Fronty AI,将设计图转换为HTML CSS,世界上第一个设计图到 HTML转换器,人工智能驱动的工具,可在几分钟内创建一个网站。 Ai编程建站 2025年06月05日 18 点赞 0 评论 471 浏览
PhysGen3D PhysGen3D 是一款能够将单张图像转换为交互式 3D 场景并生成物理真实视频的工具。它结合图像分析与物理模拟技术,支持精确控制物体属性、动态效果整合及高质量渲染。适用于影视、VR/AR、教育、游戏和广告等多个领域,提供高效且逼真的视觉内容生成能力。 AI项目与工具 2025年06月12日 51 点赞 0 评论 471 浏览
MoonCast MoonCast 是一个零样本播客生成系统,能够从纯文本源合成自然的播客风格语音。它采用长上下文语言模型和大规模语音数据训练,支持中文和英文,生成几分钟长的高质量播客音频。MoonCast 通过特定的LLM提示生成播客脚本,并利用语音合成模块转换为最终音频,具备长音频生成、增强自然性、多语言支持和零样本语音合成等功能。其技术原理包括多阶段训练、短段级别自回归音频重建和自发性增强,适用于内容创作、教 AI项目与工具 2025年06月11日 63 点赞 0 评论 471 浏览
塔猫AI对话PPT 塔猫AI对话PPT是一款利用深度学习与自然语言处理技术的智能PPT分析工具,可解析文本、图表等内容,支持智能问答、摘要生成及逻辑优化建议等功能。它适用于信息检索、演讲准备、教育培训等多个场景,助力用户高效获取所需信息。 AI项目与工具 2025年06月12日 98 点赞 0 评论 471 浏览
Looooooong Kimi Looooooong Kimi 是一款专注于超长文本处理的智能工具,支持高达200万汉字的文本分析,具备文档上传与解析、多文件处理、网址阅读、实时搜索、语言翻译以及多模态信息识别等功能。该工具广泛应用于学术研究、法律分析、市场调研、教育辅导和技术支持等多个领域,能够高效提取和整理信息,满足用户对复杂文本处理的需求。 AI项目与工具 2025年06月12日 61 点赞 0 评论 470 浏览
CNKI AI学术研究助手 CNKI AI学术研究助手是一款由华知大模型驱动的AI辅助研究工具,专注于科研全流程的支持。其主要功能涵盖问答式增强检索、AI辅助研读、AI辅助创作及苹果树智能体服务,能够提供学术问答、文献综述生成、语言翻译、深度解读等多种能力,适用于文献检索、学术写作及研究趋势分析等多个场景,助力科学研究与创新。 AI项目与工具 2025年06月12日 76 点赞 0 评论 470 浏览
Math24o Math24o 是 SuperCLUE 开源的高中奥林匹克数学竞赛级别数学推理测评基准,基于 2024 年全国高中数学竞赛预赛试题,包含 21 道高难度解答题。评测通过程序自动判断答案一致性,客观评估模型正确率。支持自动化评估流程,适用于教育、学术研究和模型优化等领域,为数学推理能力的提升提供重要工具。 AI项目与工具 2025年06月12日 22 点赞 0 评论 470 浏览
星辰大模型 星辰大模型是中国电信研发的AI工具集,涵盖语义、视觉、语音等多模态领域,支持长文本处理、多语种语音识别和多任务视觉处理。平台提供多种模型选择,包括星辰语义模型、星辰语音大模型及星辰多模态大模型,适用于智能客服、内容审核、智能写作、语音识别与合成、图像识别与分析等多种应用场景。 AI项目与工具 2025年06月12日 86 点赞 0 评论 469 浏览