工具

VideoGrain

VideoGrain是由悉尼科技大学与浙江大学联合研发的零样本多粒度视频编辑框架,支持类别级、实例级和部件级的精细化视频修改。它通过调节时空交叉注意力和自注意力机制,提升文本提示对目标区域的控制能力,确保时间一致性与特征分离,显著优于现有T2I和T2V方法。该工具无需额外参数调整,具备高效计算性能,适用于影视制作、广告营销、内容创作等多个领域。

olmOCR

olmOCR 是一款开源 PDF 文档处理工具,结合文档锚定技术和 Qwen2-VL-7B-Instruct 模型,可高效提取结构化文本并保留原始布局。支持多种文档类型,具备大规模批量处理能力和低成本优势,适用于学术研究、法律文件处理、企业文档管理及数字图书馆建设等多个场景。其开源特性与可扩展性也增强了用户的使用灵活性。

Artguru Ai

一个免费在线的AI艺术生成器,用户只需输入一些词语或上传一张照片,就可以利用人工智能的魔力释放创造力,生成美丽的艺术作品。

汉语新解

汉语新解是一款利用AI技术重新诠释汉语词汇的工具,提供深度解读、创意文本生成、SVG卡片设计等功能,支持风格定制与多场景应用,旨在推动语言创新与文化传承。

摹小仙

通过上传真人模特的照片,可以一键生成各种风格的虚拟模特

Krea Video

Krea Video为视频创作者提供简单高效的创作工具。

StyleDrop

StyleDrop 是一个强大的文本到图像生成工具,它通过少量参数的微调和迭代训练,能够以极高的灵活性和准确性捕捉并再现各种风格。

MMSearch

MMSearch 是一款用于评估大型多模态模型(LMMs)搜索能力的基准测试工具,包含 MMSearch-Engine 框架和 MMSearch 测试集。其核心功能包括问题重构、网页排序和答案总结,通过多模态搜索能力评估提升 LMMs 的性能。实验结果显示 GPT-4o 在该测试中表现优异,且增加计算量比扩大模型规模更具优势。

Firra流程图

一款由厦门无限飞科技有限公司独立自主研发的简洁、高效的在线流程图和思维导图设计工具,Firra能够帮助您快速实现各类创作需求。

AI问客

AI问客是一个多功能的AI助手,它能够覆盖广泛的使用场景,为用户提供智能问答和内容创作服务。