Stable Artisan Stable Artisan是一款基于Discord平台的图像和视频生成机器人服务,利用Stability AI的AI技术和模型,如Stable Diffusion 3和Stable Video Diffusion,使用户能够通过自然语言提示生成高质量的图像和视频。此外,它还提供了一系列图像编辑工具,包括搜索替换、背景去除、高清放大、扩展外延、控制素描和结构等功能,适用于创意人士、设计师、内容创作 AI项目与工具 2024年01月01日 46 点赞 0 评论 482 浏览
心响 心响是一款基于人工智能的任务处理应用,通过自然语言交互帮助用户拆解复杂任务并提供可视化结果。其核心功能包括任务调度、旅游攻略生成、智慧图表制作、定时任务管理和模拟对话练习。适用于学习、办公、金融及旅游等多个场景,提升用户的工作效率与决策能力。 AI项目与工具 2025年06月11日 66 点赞 0 评论 482 浏览
EvolveDirector EvolveDirector是一个由阿里巴巴与南洋理工大学合作开发的文本到图像生成框架,通过与高级模型API交互获取数据对,结合预训练的视觉语言模型(VLMs)动态优化训练集,大幅降低数据量和训练成本。该框架支持多模型学习、动态数据集管理及在线训练,显著提升了生成图像的质量和多样性,广泛应用于内容创作、媒体娱乐、广告营销、教育科研等多个领域。 AI项目与工具 2025年06月12日 17 点赞 0 评论 482 浏览
VideoGrain VideoGrain是由悉尼科技大学与浙江大学联合研发的零样本多粒度视频编辑框架,支持类别级、实例级和部件级的精细化视频修改。它通过调节时空交叉注意力和自注意力机制,提升文本提示对目标区域的控制能力,确保时间一致性与特征分离,显著优于现有T2I和T2V方法。该工具无需额外参数调整,具备高效计算性能,适用于影视制作、广告营销、内容创作等多个领域。 AI项目与工具 2025年06月12日 99 点赞 0 评论 482 浏览
A2A A2A是谷歌推出的首个智能体交互协议,旨在实现不同框架和供应商构建的AI智能体之间的高效协作。它支持多模态交互、长期任务管理和实时反馈,基于HTTP、JSON-RPC等标准设计,便于与现有系统集成。A2A具备安全性、可扩展性和用户体验协商能力,适用于企业流程自动化、跨平台客服、招聘优化、供应链协同和智能办公等多个场景。 AI项目与工具 2025年06月12日 59 点赞 0 评论 481 浏览
汉语新解 汉语新解是一款利用AI技术重新诠释汉语词汇的工具,提供深度解读、创意文本生成、SVG卡片设计等功能,支持风格定制与多场景应用,旨在推动语言创新与文化传承。 AI项目与工具 2025年06月12日 22 点赞 0 评论 481 浏览
Omakase AI Omakase AI 是一款基于AI技术的智能购物助手,支持多平台整合与多语言界面,可根据用户输入的网址和偏好提供个性化商品推荐。具备智能筛选、实时更新、用户反馈优化等功能,适用于个人购物、电商运营及数据分析场景,提升购物体验与决策效率。 AI项目与工具 2025年06月12日 18 点赞 0 评论 481 浏览
麦橘超然 麦橘超然(MajicFlus)是一款基于Flux.1架构的AI图像生成模型,专注于高质量人像创作,尤其擅长表现亚洲女性的细腻特征。它支持快速生成与专业控制,具备优秀的光影处理能力和局部重绘功能,适用于人像、非人生物及场景生成。该工具广泛应用于娱乐、商业、影视、教育及科研等多个领域,为创作者提供高效、灵活的图像生成解决方案。 AI项目与工具 2025年06月12日 27 点赞 0 评论 481 浏览
SlidesGPT SlidesGPT是一款利用AI技术快速生成高质量演示文稿的工具,支持从文本到幻灯片的自动化转换,具备智能内容生成、图片匹配、专业排版设计等功能。其应用场景广泛,涵盖教育、商务、培训等多个领域,帮助用户节省时间并提升工作效率。 AI项目与工具 2025年06月12日 100 点赞 0 评论 481 浏览
MMSearch MMSearch 是一款用于评估大型多模态模型(LMMs)搜索能力的基准测试工具,包含 MMSearch-Engine 框架和 MMSearch 测试集。其核心功能包括问题重构、网页排序和答案总结,通过多模态搜索能力评估提升 LMMs 的性能。实验结果显示 GPT-4o 在该测试中表现优异,且增加计算量比扩大模型规模更具优势。 AI项目与工具 2025年06月12日 44 点赞 0 评论 481 浏览