R

Simular AI

一款专为Mac用户设计的本地AI智能助手,它能通过自然语言处理执行多种任务,如搜索新闻、预订住宿、查找歌词等,还具备自动化重复任务、整合 Mac 应用等功能。

Pollinations AI

Pollinations 是一个通过AI生成媒体内容的平台。平台可能提供多种类型的模板和工具,支持文本、图像、音频、视频等多媒体格式的创作。

Emu3

Emu3是一款由北京智源人工智能研究院开发的原生多模态世界模型,结合了多模态自回归技术和单一Transformer架构,能够在图像、视频和文本之间实现无缝转换。它不仅能够根据文本生成高质量图像,还能预测视频发展并理解图文内容,广泛应用于内容创作、广告营销、教育、娱乐等多个领域。

AIPRM

ChatGPT浏览器扩展的AIPRM为用户提供了一个简单有效的方法来优化他们的网站,并提高其在搜索引擎上的排名。它为SEO, SaaS,营销,艺术,编程等提供了一系列精心策划的提示模板,只...

ConsisID

ConsisID是一款由北京大学和鹏城实验室开发的文本到视频生成工具,其核心技术在于通过频率分解保持视频中人物身份的一致性。该模型具备高质量视频生成能力、无需微调的特点以及强大的可编辑性,同时拥有优秀的泛化性能。其主要功能包括身份保持、高质量视频生成、文本驱动编辑以及跨领域人物处理,广泛应用于个性化娱乐、虚拟主播、影视制作、游戏开发及教育模拟等领域。

PinTree

一个可以帮助用户将浏览器书签快速转换为美观的导航网站的开源项目。

OmniTalker

OmniTalker 是一款由阿里巴巴开发的实时多模态交互技术,支持文本、图像、音频和视频的同步处理,并能生成自然流畅的语音响应。其核心技术包括 Thinker-Talker 架构和 TMRoPE 时间对齐技术,实现音视频精准同步与高效流式处理。适用于智能语音助手、内容创作、教育、客服及工业质检等场景,具有高实时性与稳定性。

加利福尼亚大学伯克利分校

加利福尼亚大学伯克利分校(University of California, Berkeley),简称伯克利,坐落美国旧金山湾区伯克利市,是公立研究型大学,被誉为“公立常春藤”,是美国大学协会成员,全球...

ImageRAG

ImageRAG 是一种基于检索增强生成(RAG)技术的图像生成工具,通过动态检索相关图像提升文本到图像模型的生成能力。它能够增强对罕见概念的理解与生成,提升图像的真实度和相关性,支持多模态生成与个性化定制。无需额外训练即可适配多种 T2I 模型,广泛应用于创意设计、品牌推广、教育及影视等领域。