生成

MinT

MinT是一款基于时间基位置编码技术的多事件视频生成框架,允许用户通过文本提示生成包含多个事件的连贯视频,并支持对事件顺序及持续时间的精确控制。其核心技术ReRoPE使得模型能够有效关联文本提示与视频帧,同时结合预训练的视频扩散变换器(DiT)和大型语言模型(LLM)的提示增强功能,进一步提升了视频生成的质量与丰富度。MinT适用于娱乐、广告、教育等多个领域,为视频创作带来了创新性的解决方案。

Kacha

一款专注于图像处理的AI写真应用程序,Kacha通过简化复杂的照片编辑操作,让用户轻松生成媲美专业摄影的视觉效果照片,无论是婚纱照、卡通头像,还是旅行写真,Kacha 都能为您提供多样化的写真风格体验。

Buzz

Buzz是一款基于OpenAI Whisper模型的离线语音转文字工具,支持实时语音转文字和音频视频文件转录。它具备多语言识别和翻译功能,支持多种格式导出,并能在本地离线操作以保护用户隐私。主要应用于视频字幕制作、采访记录整理、语言学习辅助、会议记录和学术研究等场景。

Caricaturer.io

一个在线漫画生成器,使用 AI 和深度学习将你的肖像照片转换为漫画图片。生成有趣的、夸张的自画像,并给肖像照片添加艺术和夸张效果。

CodeDPO

CodeDPO是一款由北京大学与字节跳动合作开发的代码生成优化框架,主要功能包括提升代码准确性、优化代码效率、集成偏好学习、自动生成与验证代码及测试用例、构建优化数据集以及减少对外部资源的依赖。它采用自生成与验证机制、PageRank启发式算法及Direct Preference Optimization等技术,广泛应用于自动化软件开发、代码辅助编写、编程教育、代码质量保障及优化重构等领域。

Mendeley

一款由Elsevier公司提供的免费文献管理软件,Mendeley可以帮助您存储、组织、记录、共享和引用参考和科研数据,特别适合科研人员、学者和学生使用。

BrickCenter

一个利用AI根据文字描述生成定制积木套装,以及根据图像生成独特的积木人像的平台。无论您是想创建特定的汽车模型、独特的艺术品还是其他任何设计,我们的人工智能积木生成器都能让它变得轻松有趣。

LLM Engineer Toolkit

一个精心整理的LLM工具库,它将120多个与LLM相关的库按照功能和用途进行了细致分类,涵盖了从训练微调、应用开发、推理服务到安全评估等 LLM 开发全流程所需的工具。

TikTok Emoji Generator

一款免费的通过基于文本提示生成AI驱动的表情符号设计的在线工具,帮助用户创建自定义的TikTok表情符号。

吱意

吱意是一款可以适用于图片翻译、文档翻译,视频翻译等场景的在线工具。同时,吱意还提供多模态翻译和智能配音,AI写作,AI成画等AIGC人工智能创作等服务。