工具

Pixel Reasoner

Pixel Reasoner是由多所高校联合开发的视觉语言模型,通过像素空间推理增强对视觉信息的理解和分析能力。它支持直接对图像和视频进行操作,如放大区域或选择帧,以捕捉细节。采用两阶段训练方法,结合指令调优和好奇心驱动的强化学习,提升视觉推理性能。在多个基准测试中表现优异,适用于视觉问答、视频理解等任务,广泛应用于科研、教育、工业质检和内容创作等领域。

灵办Ai

一款能解决翻译、对话、写作、阅读、信息获取、笔记、画图等需求的工具。

VITRON

VITRON是一款由多家顶尖机构联合研发的像素级视觉大型语言模型,具备强大的图像与视频处理能力,涵盖理解、生成、分割及编辑等功能。它融合了编码器-LLM-解码器架构、视觉-语言编码和视觉专家系统,支持多种视觉任务,广泛应用于图像编辑、视频创作、教育辅助、电商营销和新闻报道等领域。

酷特喵

一个专注于发现和分享最新、最酷、最有趣的互联网产品工具的网站。用户可以在酷特喵进行投稿和发现新产品。

PPT.AI

PPT.AI 是一款 AI 演示文稿制作工具,能够将用户输入的主题或上传的文档内容快速转换为专业的 PPT。具备智能内容生成、自动设计与排版、丰富模板选择、多语言支持等功能,支持 15 种主要语言,提供 50 多个专业模板。用户只需输入主题或上传文件,选择模板即可生成演示文稿,并支持进一步自定义编辑。PPT.AI 注重数据安全,提供银行级加密和安全云存储。

PDFtoPDF

PDFtoPDF是一款基于AI和OCR技术的PDF转换工具,支持高精度文字识别(准确率达99.5%),并能保留原始文档排版。具备多语言支持、文件压缩、跨平台使用及翻译功能,适用于学术、办公、教育和个人文档管理等多种场景,显著提升文档处理效率与便捷性。

Amie

Amie是一款AI会议记录工具,能够自动录音并生成会议总结,帮助用户高效管理会议内容和后续工作。它支持多种视频会议平台,如Zoom、Google Meet、Slack Huddle和Microsoft Teams,可自动生成笔记,并允许用户添加私人笔记、自定义标题和关键数字。Amie还提供快速会议总结、AI聊天、多平台集成和智能日程安排等功能,适用于日常任务安排、学习、会议记录与分享以及项目管理等

Mellum

Mellum 是 JetBrains 推出的一款专为开发者设计的大型语言模型(LLM),通过深度集成 JetBrains IDE,提供低延迟、高精度的代码补全服务,支持多种编程语言,显著提升开发效率。其训练数据仅限于公开可用且许可宽松的代码,保障用户隐私。

AstrBot

AstrBot是一款多功能聊天机器人及开发框架,支持多种大语言模型和消息平台,具备多轮对话、语音转文字、网页搜索等功能。它采用模块化设计,支持插件开发和多平台部署,适用于企业客服、个人助手、教育辅导等多个场景,提供高效的智能交互体验。