R

MindLLM

MindLLM是由多所高校联合开发的AI模型,可将功能性磁共振成像(fMRI)信号解码为自然语言文本。其采用主体无关的fMRI编码器与大型语言模型结合,并引入脑指令调优技术,实现跨个体的高精度解码。该模型在多项任务中表现优异,具备广泛的应用潜力,包括医疗康复、脑机接口、神经科学研究及人机交互等领域。

MakeAnything

MakeAnything是由新加坡国立大学Show Lab团队开发的多领域程序性序列生成框架,能够根据文本或图像生成高质量的分步教程。它采用扩散变换器和ReCraft模型,支持从文本到过程和从图像到过程的双向生成。覆盖21个领域,包含超24,000个标注序列,具备良好的逻辑连贯性和视觉一致性,适用于教育、艺术、工艺传承及内容创作等多种场景。

6Pen Art

支持多种模型和中文描述,不保留版权,不保留数据。6Pen为用户提供了一个强大且易于使用的AI绘画平台,适合需要进行创意绘画和视觉设计的个人或专业人士。

Brave Search

一款注重隐私的搜索引擎,由Brave Software开发。是世界上最完整、最独立、最私密的搜索引擎。 Brave Search以独立索引为基础,提供无痕搜索体验,不会跟踪用户的查询或点击行为。

AutoPod

AutoPod是一款基于人工智能技术的视频剪辑工具,专为Adobe Premiere Pro用户打造。它支持多机位编辑、社交媒体优化以及跳跃剪辑等功能,能够大幅提升视频编辑效率。该工具兼容多种摄像机配置,提供灵活的自定义选项和预设功能,广泛应用于播客制作、在线教育、企业宣传及社交媒体内容创作等领域。

OCRmyPDF

OCRmyPDF 是一款开源的命令行工具,用于将扫描 PDF 转换为可搜索、可编辑的文档。基于 Tesseract OCR 引擎,支持 100 多种语言,具备图像优化、纠偏、清洁等功能,提升识别准确率。支持多核处理与批量操作,适合高效处理大量文件,且完全离线运行,保障数据安全。

xAR

xAR是由字节跳动与约翰·霍普金斯大学联合研发的自回归视觉生成框架,采用“下一个X预测”和“噪声上下文学习”技术,提升视觉生成的准确性和效率。其支持多种预测单元,具备高性能生成能力,在ImageNet数据集上表现优异,适用于艺术创作、虚拟场景生成、老照片修复、视频内容生成及数据增强等多种应用场景。

Ovis2

Ovis2是阿里巴巴国际团队开发的多模态大语言模型,采用结构化嵌入对齐技术提升视觉与文本的融合效果。支持视频、图像和多语言处理,强化了思维链推理和复杂场景下的OCR能力。提供多个参数规模的版本,适用于研究、开发及各类应用场景,展现卓越性能。

MotionGo | 口袋动画

MotionGo (口袋动画)插件是由必优科技开发的PPT动画插件,是一款非常出色的ppt插件,它可以帮助设计师快速制作出精彩纷呈的动画设计,让你的演示更加生动有趣,精彩绝伦!