Video Diffusion Models Video Diffusion Models项目展示了扩散模型在视频生成领域的潜力,通过创新的梯度条件方法和自回归扩展技术,生成了具有高度时间连贯性和质量的视频样本。 Ai绘画生成 1970年01月01日 0 点赞 0 评论 403 浏览
LayerSkip LayerSkip 是一种针对大型语言模型推理优化的技术,通过层 dropout 和早期退出损失机制,实现从早期层的精准退出,降低计算成本并提高解码效率。该方法结合自我推测解码技术,支持模型在早期层生成预测并通过后续层验证修正,广泛适用于文档摘要、编程任务、语义解析等自然语言处理任务,同时确保高精度与低延迟。 AI项目与工具 2025年06月12日 72 点赞 0 评论 403 浏览
DeepFloyd DeepFloyd IF是一个强大的文本到图像生成模型,能够生成高分辨率和逼真度的图像。它结合了先进的语言理解和图像生成技术,提供了多种功能,如超分辨率、风格迁移和零样本学习。 Ai绘画生成 1970年01月01日 0 点赞 0 评论 403 浏览
天工AI搜索 天工AI搜索,搭载天工大模型的AI技术,提供智能、高效、快速的搜索体验。天工AI搜索不仅能够找资料、查信息、搜答案、搜文件,还会对海量搜索结果做AI智能聚合,更系统地解答你的问题,提升你的信息理解效率,做你学习、工作、生活的最佳AI搭档。 AI搜索问答 2025年06月05日 67 点赞 0 评论 403 浏览
口语精灵 口语精灵是一款基于人工智能的英语口语学习工具,提供1V1智能对话练习,涵盖生活、工作、考试等多场景,支持多种英语口音。其具备发音评估、语法纠错、语句优化等功能,帮助用户提升口语表达的准确性和自然度。同时,该工具提供个性化学习方案和考试备考支持,适用于不同学习阶段的用户。 AI项目与工具 2025年06月12日 61 点赞 0 评论 402 浏览
卡内基梅隆大学 卡内基梅隆大学(Carnegie Mellon University),简称CMU,是坐落于美国宾夕法尼亚州的匹兹堡的私立大学,“新常春藤”,全球大学校长论坛成员。拥有14,800名在校学生和1,483名教职... 教育学习 1970年01月01日 0 点赞 0 评论 402 浏览
DeepSeek R1 DeepSeek R1-Zero 是一款基于纯强化学习训练的推理模型,无需监督微调即可实现高效推理。在 AIME 2024 竞赛中 Pass@1 分数达到 71.0%,展现强大逻辑与数学推理能力。支持长上下文处理,具备自我进化、多任务泛化等特性,并通过开源和蒸馏技术推动模型应用与优化。 AI项目与工具 2025年06月12日 34 点赞 0 评论 402 浏览
Caricaturer.io 一个在线漫画生成器,使用 AI 和深度学习将你的肖像照片转换为漫画图片。生成有趣的、夸张的自画像,并给肖像照片添加艺术和夸张效果。 Ai图片处理 2025年06月05日 45 点赞 0 评论 401 浏览
WorldSense WorldSense是由小红书与上海交通大学联合开发的多模态基准测试工具,用于评估大型语言模型在现实场景中对视频、音频和文本的综合理解能力。该平台包含1662个同步视频、3172个问答对,覆盖8大领域及26类认知任务,强调音频与视频信息的紧密耦合。所有数据经专家标注并多重验证,确保准确性。适用于自动驾驶、智能教育、监控、客服及内容创作等多个领域,推动AI模型在多模态场景下的性能提升。 AI项目与工具 2025年06月12日 61 点赞 0 评论 401 浏览