学习

Etna

是由七火山科技开发的一个平...

东南大学人工智能学院

人工智能学院在人工智能领域的科研和人才培养方面有较好的基础,拥有一支年轻的高水平研究队伍,主要研究方向包括机器学习、知识表示与推理、计算机视觉、自然语言处理、多智能体...

Hi3DGen

Hi3DGen是由多所高校与企业联合开发的高保真3D几何生成框架,可从2D图像生成具有丰富细节的3D模型。其核心技术包括图像到法线估计、法线到几何学习及3D数据合成,采用两阶段生成流程并结合3D高斯散射与SDF重建技术,提升模型精度与细节表现。适用于游戏开发、影视制作、3D可视化等多个领域。

Trancy

Trancy是一款专为语言学习设计的浏览器插件,提供YouTube/Netflix双语字幕、网页AI划词翻译和全文翻译等功能,用于提升语言学习效率。

CogVideo

目前最大的通用领域文本生成视频预训练模型,含94亿参数。CogVideo将预训练文本到图像生成模型(CogView2)有效地利用到文本到视频生成模型,并使用了多帧率分层训练策略。

Freestyler

Freestyler是一款由多机构合作开发的AI工具,专注于说唱音乐的自动化生成。它通过结合语言模型、条件流匹配技术和神经声码器,实现了从歌词和伴奏到高质量说唱音频的全流程转化。Freestyler还推出了RapBank数据集,并支持零样本音色控制,广泛应用于音乐创作、现场表演、游戏音效及教育等领域。

CheggMate AI

一款一体化家庭作业人工智能代理,旨在帮助从初中到高等教育的各个级别的学生。CheggMate AI支持所有科目和年级,提供个性化的问题指导和专属作业编辑工具。

Text to Bark

Text to Bark 是由 ElevenLabs 推出的全球首个 AI 狗语文本转语音模型,能将文字转化为高度逼真的狗吠声,支持多种犬种选择和语气调整。技术基于深度学习和犬类语言学研究,适用于宠物训练、科研、娱乐及家庭互动等多种场景,具备良好的可扩展性和实用性。

ChatDOC

ChatDOC是一款基于ChatGPT技术的智能文件阅读助手,它可以快速解析、定位和总结上传的PDF文件内容。用户可以通过与AI助手的对话式学习,深入挖掘文本结构和内容。

WhatTheFont

一个简单易用的字体查找器,WhatTheFont可以帮助您识别字体。只需上传您需要识别的字体的图像,该工具就会为您想要识别的字体。