学习

CopyTranslator

一款免费开源的复制即翻译的外文辅助阅读翻译工具,支持复制即翻译,能够解决多余断句和换行带来的乱码问题,翻译结果更符合阅读习惯。

My Drama

My Drama是一款创新的短剧应用,结合了AI聊天机器人技术,提供超过30部肥皂剧和短剧。用户不仅能观看这些剧集,还可以与剧中的AI角色进行互动对话,从而增强沉浸感。My Drama通过AI技术降低制作成本并提高内容生产效率,提供个性化的互动体验,并探索互动叙事的新领域。该应用可在Web、iOS和Android设备上使用,部分剧集免费,高级内容需付费解锁。

清图

清图 - 模糊图片秒变清晰,一个基于深度学习技术的在线图像处理平台

AnyCharV

AnyCharV是一款由多所高校联合研发的角色可控视频生成框架,能够将任意角色图像与目标场景结合,生成高质量视频。它采用两阶段训练策略,确保角色细节的高保真保留,并支持复杂的人-物交互和背景融合。该工具兼容多种文本生成模型,具备良好的泛化能力,适用于影视制作、艺术创作、虚拟现实等多个领域。

Eagle 2.5

Eagle 2.5 是一款由英伟达开发的视觉语言模型,专注于长上下文多模态学习,具备处理高分辨率图像和长视频序列的能力。其参数规模为 8B,但性能接近更大模型。采用信息优先采样和渐进式后训练策略,提升模型稳定性与适应性。支持多样任务,适用于视频分析、图像处理、内容创作及教育等多个领域。

GoEnhance AI

一个基于AI专门用于视频转动漫风格的AI视频增强工具,以实现更高的细节和质量的工具。它利用先进的人工智能技术来分析图像和视频,识别特征和模式,并生成具有更多细节的更高分辨率版本。

OMNE Multiagent

OMNE Multiagent是一个基于长期记忆技术的大模型多智能体框架,由天桥脑科学研究院开发。它支持多个智能体协同工作,每个智能体能独立学习和理解环境,具备深度慢思考和实时适应能力。OMNE框架通过优化搜索空间和逻辑推理机制,提升了复杂问题的决策效率,并在金融、交通、制造、医疗等领域展现出广泛应用潜力。

CogVideoX

CogVideoX是由智谱AI开发的开源AI视频生成模型,支持英文提示词生成6秒长、每秒8帧、分辨率为720x480的视频。它具备低显存需求、视频参数定制、3D Causal VAE技术和推理与微调功能。该模型采用基于Transformer的架构和3D Causal Variational Autoencoder技术,支持多阶段训练和自动及人工评估,适用于创意视频制作、教育材料、广告、游戏、电影编

TextDiffuser-2

一个功能强大的图像生成工具,它通过扩散模型技术,根据文本描述生成高质量的图像。这个工具为用户提供了一种创新的方式来探索和实现他们的创意视觉概念。

V-JEPA

创新的自监督学习模型,它通过预测视频帧的特征表示来学习视频的视觉表示。这种方法不仅能够处理视频内容,还能在图像任务上表现出色,具有广泛的应用潜力。