AI工具

Gemma 3n

Gemma 3n 是谷歌 I/O 开发者大会推出的端侧多模态 AI 模型,基于 Gemini Nano 架构,采用逐层嵌入技术,将内存占用压缩至 2-4B 参数模型水平。支持文本、图像、短视频和音频输入,可生成结构化文本输出,并具备音频转录、情感分析等功能。可在本地设备运行,响应时间低至 50 毫秒,适用于语音助手、内容生成和学术任务定制。

SlideSpeak

SlideSpeak是一款基于AI技术的多功能工具,支持用户上传多种文档格式并生成演示文稿或摘要。其主要功能包括AI生成的演示文稿、文档总结、交互式聊天机器人、视觉内容分析及语音旁白生成。此外,SlideSpeak强调数据安全性,适用于学术研究、商业演示、教育培训等多个领域。

Maverick

Maverick 是一种基于AI 根据每位客户的购买历史、偏好和行为为其生成个性化视频并将其发送给客户的AI工具。

Open Deep Research

Open Deep Research 是一个开源 AI 智能体,支持多语言模型和 Firecrawl 数据提取,用于执行复杂的研究任务。它提供统一 API 和 Next.js 框架,具备实时数据处理、结构化信息提取及多维度分析能力,适用于文献综述、行业分析、投资研究等场景。

CAT4D

CAT4D是一种由Google DeepMind、哥伦比亚大学及加州大学圣地亚哥分校共同开发的工具,它利用多视图视频扩散模型,从单目视频中生成动态3D(4D)场景表示。该工具可以合成新视图、重建动态3D模型,并支持独立控制相机视点和场景动态,适用于电影制作、游戏开发、虚拟现实等多种领域。

Styldod

良好的房源图片是房屋销售过程的基石。Styldod 帮助您快速、轻松、低成本地编辑和增强照片、消除杂乱背景。

FunAudioLLM

FunAudioLLM是由阿里巴巴通义实验室开发的开源语音大模型项目,包含SenseVoice和CosyVoice两个子模型。SenseVoice擅长多语言语音识别和情感辨识,支持超过50种语言;CosyVoice则专注于自然语音生成,支持多种语言、音色和情感控制。该项目适用于多语言翻译、情感语音对话等场景,其相关模型和代码已公开发布。

Decode Investing

Decode Investing是一款基于人工智能技术的股票市场研究与分析平台,主要功能包括AI股票分析、SEC文件搜索、收益电话记录查看、股票筛选器、投资排行榜、行业能力圈分析、智能聊天助手及股市分析工具等。它为投资者提供详尽的数据支持和专业建议,帮助用户高效地进行投资决策和股票研究。

合同嗖嗖

合同嗖嗖,必优科技推出的一款AI生成合同工具。Chat生成AI智能合同,所问即合同内容文书起草

misgif

misgif是一款基于AI的创意工具,通过面部替换技术将用户照片融入热门GIF、影视片段中,生成个性化表情包和视频。它支持多平台操作,拥有丰富的媒体库和强大的编辑功能,适合个人娱乐、社交媒体内容创作及品牌营销推广,同时提升群聊互动趣味性。