学习

Gatekeep Ai

一个新型的文本转视频AI,专注教学,Gatekeep Ai通过AI生成的视频,将复杂的数学问题和概念用更简单、更直观的方式呈现给学习者。

CatchMe

一款为识别图片、视频和音频内容是否由人工智能生成而设计的AI内容检测器

PP

PP-DocBee是百度飞桨推出的多模态文档理解模型,基于ViT+MLP+LLM架构,支持文字、表格、图表等多类型文档内容的精准识别与解析。具备高效的推理性能和高质量输出,适用于文档问答、信息提取等场景,支持灵活部署,为文档处理提供智能化解决方案。

Caricaturer.io

一个在线漫画生成器,使用 AI 和深度学习将你的肖像照片转换为漫画图片。生成有趣的、夸张的自画像,并给肖像照片添加艺术和夸张效果。

哄哄模拟器

哄哄模拟器是一款利用AI技术提升用户情商和沟通技巧的应用。该应用基于Moonshot的Kimi智能助手大模型,融合了自然语言处理和人际交往的知识,通过模拟日常生活和恋爱中的沟通场景,帮助用户改善情感智慧和沟通能力。它支持网页版和iOS版本,具备模拟争执场景、文字交流实训、情感状态模拟、沉浸式音效、恋爱交往文本分析以及场景角色定制等功能。

VisionFM

VisionFM是一款专为眼科设计的多模态多任务视觉基础模型,通过大规模预训练支持多种眼科成像模态处理,涵盖疾病筛查、诊断、预后预测、表型细分及全身性生物标志物分析等功能。其在疾病诊断上的表现超越了大部分眼科医生,并具备强大的泛化能力和少样本学习能力。

企鹅读伴

企鹅读伴是一款专为中小学生设计的AI阅读辅助工具,依托腾讯混元大模型与元器平台,提供个性化书目推荐、多模式阅读、互动提问、角色扮演及游戏化激励等功能。通过“阅读-思考-创造”闭环设计,提升学生的阅读兴趣与语文核心素养,适用于日常学习、家庭共读、教学辅助及教育资源补充等场景。

Gemini 2.0

Gemini 2.0 是谷歌推出的原生多模态AI模型,具备快速处理文本、音频和图像的能力,支持多语言输出和实时音视频流输入。通过Agent技术和工具调用,Gemini 2.0 能够自主理解任务并提供解决方案,已在编程、数据分析、游戏等领域展示应用潜力。目前提供免费试用,计划逐步开放更多功能。

PhotoPrism

PhotoPrism是一款开源的AI照片管理工具,采用Go语言开发,支持用户在本地服务器上运行,确保数据隐私与安全性。它通过AI技术实现照片的智能分类与搜索,涵盖人物、物体和场景识别,还支持RAW、JPG等多种文件格式,提供面部识别、地理标签及WebDAV同步等功能,适用于个人、家庭、企业和教育机构等多样化需求。