学习

CogVideo

目前最大的通用领域文本生成视频预训练模型,含94亿参数。CogVideo将预训练文本到图像生成模型(CogView2)有效地利用到文本到视频生成模型,并使用了多帧率分层训练策略。

MakeMyTale

一个可让您使用人工智能为儿童创作短篇小说的Ai故事生成器。您可以选择年龄组、流派、主要角色和他们的名字,AI 将在几分钟内为您生成一个独特的故事。

DIAMOND

DIAMOND是一款基于扩散模型的强化学习代理,专注于模拟复杂环境以支持代理的学习与决策。它在Atari游戏和3D环境中表现出色,能够捕捉丰富的视觉信息。通过连续潜在变量和优化的去噪步骤,DIAMOND提升了模型的稳定性和效率。其应用场景涵盖游戏AI开发、机器人技术、虚拟现实、教育培训及科学研究等领域。

EMAGE

EMAGE是一款基于音频输入生成全身手势的AI框架,可同步生成面部表情、肢体动作及整体运动。通过掩蔽音频手势变换器和多模块VQ-VAE建模,实现高质量、多样化的手势生成。适用于虚拟现实、动画制作、数字人交互等领域,提升虚拟角色表现力与交互自然度。

MegaTTS 3

MegaTTS 3是由字节跳动与浙江大学合作开发的零样本文本到语音合成系统,采用轻量级扩散模型,支持中英文及混合语音合成,具备语音克隆、音色控制、韵律调节等功能。系统通过分解语音属性实现精准建模,可快速生成高质量语音,适用于教育、内容制作、语音交互等多个领域。

AI新手村

AI新手村是一个由小红书与Kimi智能助手联合打造的AI技术普及平台,致力于帮助用户轻松理解并应用AI技术。该平台提供了一系列工具和指南,涵盖工作提效、技能学习、驯化AI及生活娱乐等方面,帮助用户在职场、学习和个人生活中更好地利用AI技术。无论是提高工作效率还是激发创意,AI新手村都能为用户提供实用的支持。

MNN

MNN是一个由阿里巴巴开源的轻量级深度学习推理框架,支持多种模型格式和网络结构,具备高性能、低内存占用及跨平台特性。它通过模型量化、计算图优化和异构计算等技术,在移动设备和嵌入式系统中实现高效推理。主要功能涵盖模型转换、硬件加速、内存优化及多模型支持,广泛应用于图像识别、语音处理、智能家居及工业检测等领域。

Desearch

Desearch是一款面向深度研究与智能分析的平台,提供普通、深度和专家三种研究模式,满足不同场景下的信息获取与分析需求。其核心功能包括智能框架生成、图表可视化、海量案例库及深度内容生成,适用于金融、科技、社会、文化等多个领域。平台能够提升研究效率,支持复杂课题的系统性分析与成果展示。

TurboLearn

TurboLearn是一款基于AI技术的学习工具,能将录音和PDF文件转换为结构化笔记、闪卡、测验和播客。支持多种格式编辑,提供智能聊天功能,便于提取关键信息和生成总结。笔记可在多平台同步,适用于学生、教师及专业人士,提升学习效率和知识管理能力。

程序员盒子CoderUtil

一个程序员的高效工具网址导航网站,程序员盒子网提供自定义快捷网址导航,涵盖技术社区、学习平台、资源推荐等多种功能,目前拥有超过200万的程序员用户群体。