Recall AI:电脑的照片记忆功能 微软在Windows 11中推出的一项新特性,旨在通过人工智能技术记录和搜索用户在计算机上的所有操作。 Ai办公效率 2025年06月05日 10 点赞 0 评论 433 浏览
Indic Parler Indic Parler-TTS 是一款由 Hugging Face 与 AI4Bharat 联合开发的多语言文本到语音模型,支持 20 种印度语言和英语,提供 69 种独特语音。该模型基于深度学习架构,通过描述性文本输入实现对音调、语速、情感等参数的灵活控制,适用于多种语音合成场景。在低资源语言上表现优异,具备高自然度和清晰度的语音输出能力。 AI项目与工具 2025年06月12日 55 点赞 0 评论 432 浏览
CodeDPO CodeDPO是一款由北京大学与字节跳动合作开发的代码生成优化框架,主要功能包括提升代码准确性、优化代码效率、集成偏好学习、自动生成与验证代码及测试用例、构建优化数据集以及减少对外部资源的依赖。它采用自生成与验证机制、PageRank启发式算法及Direct Preference Optimization等技术,广泛应用于自动化软件开发、代码辅助编写、编程教育、代码质量保障及优化重构等领域。 AI项目与工具 2025年06月12日 79 点赞 0 评论 432 浏览
Florence Florence-2是微软Azure AI团队研发的多功能视觉模型,支持图像描述、目标检测、视觉定位和图像分割等功能。该模型基于Transformer架构,采用序列到序列学习方法,利用自注意力机制实现多模态信息融合。通过训练大规模数据集,Florence-2在多个应用场景中表现出色,包括图像和视频分析、内容审核、辅助驾驶、医疗影像分析以及零售和库存管理。 AI项目与工具 2025年06月12日 67 点赞 0 评论 432 浏览
GeeLark 一款专为移动端设计的多账号管理工具,GeeLark提供了一种创新的解决方案,用于在云端运行多个手机应用程序,从而实现对多个账户的安全、独立管理。 数据分析 2025年06月05日 10 点赞 0 评论 431 浏览
Stirling 一个基于Web强大的开源PDF操作工具。它使您能够对 PDF 文件执行各种操作,包括拆分、合并、转换、重组、添加图像、旋转、压缩等。 Ai开源项目 2025年06月05日 22 点赞 0 评论 431 浏览
LongLLaVA LongLLaVA是由香港中文大学(深圳)研究团队开发的多模态大型语言模型,结合Mamba和Transformer模块,利用2D池化技术压缩图像token,大幅提升处理大规模图像数据的效率。该模型在视频理解、高分辨率图像分析及多模态代理任务中表现优异,特别擅长检索、计数和排序任务。其技术亮点包括渐进式训练策略和混合架构优化,支持多种多模态输入处理,广泛应用于视频分析、医学影像诊断、环境监测等领域。 AI项目与工具 2025年06月12日 67 点赞 0 评论 431 浏览
V-JEPA 创新的自监督学习模型,它通过预测视频帧的特征表示来学习视频的视觉表示。这种方法不仅能够处理视频内容,还能在图像任务上表现出色,具有广泛的应用潜力。 Ai平台模型 1970年01月01日 0 点赞 0 评论 430 浏览
UniDream UniDream,输入文字或者上传图片即可快速生成由你创造的专属AI绘画作品,多种绘画风格包含动漫、3D、真人摄影等多领域大模型随你挑选。 Ai绘画生成 2025年06月05日 47 点赞 0 评论 430 浏览