R

UVR5

UVR5,终极人声去除器,使用先进的 AI技术,从音视频提取伴奏,简单易用、无需注册即可使用来获取高质量的伴奏和其他音轨文件。

Kagi Search

一款优质、无广告的搜索引擎,Kagi 不显示广告或赞助搜索结果,完全专注于向用户提供相关内容,不受干扰。

Vanna AI

一个基于RAG技术的开源Python框架,用于将自然语言问题转换为SQL查询,并支持多种数据库和语言模型。

Spirit Me

SpiritMe允许用户使用数字化身制作视频,这些化身可以用自己的声音和情感表达说出他们输入的任何文本。它提供订阅、预付费计划和免费试用。它可以作为一种工具来进行交流,生成个...

AliExpress Image Search

全球速卖通图片搜索允许您使用产品图片在AliExpress Image Search上搜索产品。直接从全球速卖通发现和购买产品,减少中间商加价。

Operator

Operator是由OpenAI开发的AI工具,基于Computer-Using Agent(CUA)模型,能够模拟人类操作网页浏览器,完成如预订、购物、表单填写等任务。它结合了GPT-4o的视觉识别能力和强化学习的推理能力,支持多任务处理和个性化设置。具备自我纠错、安全防护及隐私保护机制,在涉及敏感信息时会请求用户接管。适用于自动化购物、数据分析、日程安排等多种场景。

Google Bard

Google 推出的一款对话式AI工具,Bard 可以帮助您完成各种任务,例如编写、编码、调试和解释代码。您还可以与 Bard 进行有趣的对话,探索它的创造力和幽默感。

Lumina

Lumina-Image 2.0 是一款开源图像生成模型,基于扩散模型与 Transformer 架构,具有 26 亿参数。它能根据文本描述生成高质量、多风格的图像,支持中英文提示词,并具备强大的复杂提示理解能力。模型支持多种推理求解器,适用于艺术创作、摄影风格图像生成及逻辑推理场景,兼具高效性和灵活性。

WebSSL

WebSSL是由Meta和纽约大学等机构开发的视觉自监督学习模型,基于大规模网络图像数据训练,无需语言监督即可学习有效视觉表示。其包含多个变体,参数规模从3亿到70亿不等,在多模态任务如视觉问答、OCR和图表理解中表现出色。通过筛选含文本图像数据,显著提升特定任务性能。模型具备良好的扩展性,适用于智能客服、文档处理、医疗影像分析等多个领域。

MAS

MAS-Zero是Salesforce推出的多智能体系统(MAS)设计框架,能够在无需人类监督的情况下自动设计和优化MAS。它通过元迭代过程动态生成、评估和改进MAS配置,基于自验证机制选择最优解。该工具在数学推理、问答和代码基准测试中表现优异,具备自进化能力,无需外部监督,适用于复杂问题求解、自然语言处理、软件工程等多个领域。