BAGEL BAGEL是字节跳动开源的多模态基础模型,拥有140亿参数,采用混合变换器专家架构(MoT),通过两个独立编码器捕捉图像的像素级和语义级特征。它能够进行图像与文本融合理解、视频内容理解、文本到图像生成、图像编辑与修改、视频帧预测、三维场景理解与操作、世界导航以及跨模态检索等任务。BAGEL在多模态理解基准测试中表现优异,生成质量接近SD3,并适用于内容创作、三维场景生成、可视化学习和创意广告生成等 AI项目与工具 2025年06月11日 92 点赞 0 评论 495 浏览
Nooka Nooka是一款基于AI技术的听书应用,提供全球非虚构类书籍的20分钟音频摘要,适合碎片化时间学习。用户可随时提问并获得AI即时回答,实现深度互动。应用支持多语言字幕、音频剪辑分享及社区交流,适用于通勤、运动、家务等多种场景,提升学习效率与趣味性。 AI项目与工具 2025年06月11日 16 点赞 0 评论 495 浏览
CHANGER CHANGER是一款工业级AI换头技术,基于色键技术和H2增强模块,能够实现演员头部与目标身体的无缝融合。其核心技术包括前景预测注意力变换器(FPAT)模块,用于精确预测和聚焦关键区域。CHANGER适用于视觉特效、数字人类创建、虚拟主播等多个领域,提供高保真的头部融合效果。 AI项目与工具 2025年06月12日 40 点赞 0 评论 495 浏览
Mistral Small 3.1 Mistral Small 3.1 是一款由 Mistral AI 开发的开源多模态 AI 模型,拥有 240 亿参数,支持文本与图像处理,具备长达 128k tokens 的上下文窗口和每秒 150 token 的推理速度。采用 Transformer 架构与 MoE 技术,提升计算效率,支持多语言和本地部署。适用于文档处理、图像分析、质量检测、虚拟助手等多种场景。 AI项目与工具 2025年06月12日 58 点赞 0 评论 495 浏览
Hertz Hertz-Dev是一款由Standard Intelligence开发的开源音频模型,专注于低延迟实时对话AI。它具备强大的音频生成与处理能力,能够处理和生成高质量的音频信号,并支持多任务微调,适用于语音识别、语音合成等多种应用场景。此外,Hertz-Dev还提供了音频自动编码、流式生成等功能,广泛应用于智能助手、客户服务、语音识别及合成等领域。 AI项目与工具 2025年06月12日 48 点赞 0 评论 496 浏览
Get笔记 Get笔记是一款基于AI的实时语音转文字工具,能够将语音高效转化为文本,并提供文本润色服务以优化笔记内容。其主要功能包括实时语音转写、文本智能润色、自动标题生成和录音与文本保存。这款工具界面简洁、操作简便,适用于多种场景,如会议记录、学习笔记、采访记录、灵感捕捉和语言学习等,显著提升了记录效率。 AI项目与工具 2025年06月12日 52 点赞 0 评论 496 浏览
TRINKA TRINKA是一款专注于学术和技术写作的AI语法检查工具,提供全面的语法检查、风格优化、抄袭检测及LaTeX文档校对功能。其核心优势在于支持多种文档格式、保障用户隐私以及优化文本的准确性和一致性,广泛应用于学术、技术、正式写作及商业沟通等领域。 AI项目与工具 2025年06月12日 28 点赞 0 评论 496 浏览
鱼鳞智慧脑图 鱼鳞智慧脑图是一款AI驱动的思维导图工具,可将文本、网页链接、PDF和Word文件自动转换为结构化导图,提升信息整理效率。支持主题扩展、在线协作与多格式导出,适用于学习、研究、项目管理等场景,操作简便,适合各类用户使用。 AI项目与工具 2025年06月11日 82 点赞 0 评论 496 浏览
Pointa Pointa是一款专业的在线视频创作工具,专注于制作流畅自然的Zoom缩放动画效果。它支持多种文件类型的导入与录屏功能,提供多样化的背景选择,并允许添加音频、背景音乐、文本及生成字幕。Pointa具备局部模糊和水印功能,支持多格式导出,适合各类视频应用场景。 AI项目与工具 2025年06月12日 12 点赞 0 评论 496 浏览
AIOpsLab AIOpsLab是一个由多机构联合开发的AIOps原型框架,支持云服务运营管理的自动化测试与优化。它采用模块化设计,集成负载和故障生成器,模拟真实生产环境,并通过代理-云接口(ACI)提供标准化API。具备全面的可观测性,支持从故障检测到缓解的完整生命周期管理,适用于云服务提供商、企业IT运维及研究领域,提升系统自主性和稳定性。 AI项目与工具 2025年06月12日 56 点赞 0 评论 497 浏览