AI项目与工具

大学搜题酱

大学搜题酱是一款专为大学生设计的AI学习工具,具备拍照搜题、文字搜索、AI问答、扫码搜书等功能,覆盖大量高校试题与考试资料,帮助用户快速获取答案和解析,提升学习效率。同时提供丰富的学习资源和实用功能,适用于网课学习、考试备考及日常问题解答。

FireRedASR

FireRedASR是小红书推出的工业级自动语音识别(ASR)模型系列,支持普通话、中文方言和英语,具备高精度和高效推理能力。其包含FireRedASR-LLM和FireRedASR-AED两个版本,分别聚焦于极致精度和计算效率。模型在多个场景如智能助手、视频字幕生成、歌词识别和语音输入中表现出色,且已开源,推动语音识别技术的发展。

Project Turntable

Project Turntable是一款由Adobe发布的AI工具,支持用户在三维空间中旋转二维矢量图像,并利用生成式AI和深度学习技术即时生成图像的隐藏部分。它显著提升了设计师的工作效率,减少了重复性劳动,适用于平面设计、插画创作、动画制作及游戏开发等领域,同时保持了图像的二维特性和平滑过渡效果。

Hiwaifu

Hiwaifu是一款利用AI技术打造的互动平台,支持用户与AI进行深度对话,并允许用户根据个人偏好定制AI伴侣的外貌、性格及兴趣。平台注重隐私保护,提供安全的交流环境,适用于情感陪伴、名人模拟对话、个性化定制以及社交技能提升等场景。

OmniSQL

OmniSQL 是一款开源的文本到 SQL 转换工具,能将自然语言问题精准转化为 SQL 查询语句。它基于大规模数据集 SynSQL-2.5M 进行训练,涵盖 250 万条样本,覆盖 16,000 余个跨领域数据库。支持多种复杂查询类型,提供思维链推理过程,并提供 7B、14B 和 32B 三种模型版本。适用于企业数据分析、教育及跨领域应用,提升数据访问效率与学习体验。

Freestyler

Freestyler是一款由多机构合作开发的AI工具,专注于说唱音乐的自动化生成。它通过结合语言模型、条件流匹配技术和神经声码器,实现了从歌词和伴奏到高质量说唱音频的全流程转化。Freestyler还推出了RapBank数据集,并支持零样本音色控制,广泛应用于音乐创作、现场表演、游戏音效及教育等领域。

ezpic

ezpic是一款基于AI技术的在线图片背景移除工具,支持PNG和JPG格式,能快速准确地去除背景并提供背景颜色选择功能。用户可通过简单操作实现图片美化,提升设计效率。适用于电商、设计、社交媒体、办公及教育等多个场景,完全免费,适合各类用户使用。

Paradot

Paradot是一款基于先进自然语言处理技术的AI伴侣应用,支持用户定制化AI伴侣的性格、声音和外观。它具备记忆功能,能记住用户的兴趣和过往对话,提供连贯且个性化的互动体验。除了情感支持和社交陪伴,Paradot还兼具信息查询、创意激发以及语言学习等功能,适用于情感陪伴、社交练习、语言学习等多个场景,致力于提升用户的数字生活质量。

Wav2Lip

Wav2Lip是一款开源的唇形同步工具,能够将音频文件转换为与口型同步的视频。它支持多种语言,适用于视频编辑、游戏开发和虚拟现实等多个领域。Wav2Lip具备音频驱动口型生成、面部表情同步和多语言支持等功能,采用先进的技术原理,如数据预处理、音频特征提取、口型编码器、音频到口型映射及生成对抗网络(GAN)。该工具提升了电影和视频的后期制作质量,增强了虚拟现实中的交互体验,还用于游戏开发、语言学习和

Omni Reference

Omni Reference 是 Midjourney V7 提供的一项图像生成辅助功能,允许用户将特定人物、物体或场景嵌入生成图像中。通过 `--oref` 和 `--ow` 参数,用户可灵活控制参考图像的权重与风格融合程度,提升创作精度与多样性。支持 Web 和 Discord 两种平台操作,适用于角色嵌入、产品展示、场景构建等多种应用场景。