BuboGPT | 字节大模型 BuboGPT是由字节跳动开发的大型语言模型,能够处理多模态输入,包括文本、图像和音频,并具有将其响应与视觉对象相对应的独特能力。 Ai平台模型 2025年06月05日 99 点赞 0 评论 156 浏览
LMEval LMEval是谷歌推出的开源框架,用于简化大型语言模型(LLMs)的跨提供商评估。它支持多模态(文本、图像、代码)和多指标评估,兼容Google、OpenAI、Anthropic等主流模型提供商。LMEval基于增量评估引擎,节省时间和计算资源,并通过自加密的SQLite数据库安全存储评估结果。LMEvalboard提供交互式可视化界面,帮助用户分析模型性能并直观比较不同模型的优缺点。 AI项目与工具 2025年06月11日 27 点赞 0 评论 157 浏览
欣智TaxGPTs大模型 欣智TaxGPTs大模型是由方欣科技推出的一款专注于财税领域的大模型,它通过大量的财税数据预训练和自我学习,具备丰富的财税服务能力。 创作工具 1970年01月01日 0 点赞 0 评论 158 浏览
Diffusion Self Diffusion Self-Distillation (DSD) 是一种基于预训练文本到图像扩散模型的零样本定制图像生成技术,通过自动生成数据集并微调模型,支持文本条件下的图像到图像转换任务。其核心在于利用生成图像网格与视觉语言模型筛选高质量配对数据集,实现无需人工干预的身份保持定制化图像生成。该技术广泛应用于艺术创作、游戏开发、影视制作、广告营销及个性化商品等领域。 AI项目与工具 2025年06月12日 68 点赞 0 评论 158 浏览
GenMAC GenMAC是一款基于多代理协作的迭代框架,旨在解决文本到视频生成中的复杂场景生成问题。它通过任务分解为设计、生成和重新设计三阶段,结合验证、建议、修正和输出结构化子任务,利用自适应自路由机制优化视频生成效果。该工具可应用于电影制作、游戏开发、广告设计、教育培训和新闻报道等多个领域,显著提升视频生成的效率和质量。 AI项目与工具 2025年06月12日 42 点赞 0 评论 158 浏览
STIV STIV是一款由苹果公司开发的视频生成大模型,具有8.7亿参数,擅长文本到视频(T2V)及文本图像到视频(TI2V)任务。它通过联合图像-文本分类器自由引导(JIT-CFG)技术提升生成质量,并结合时空注意力机制、旋转位置编码(RoPE)及流匹配训练目标优化性能。STIV支持多种应用场景,包括视频预测、帧插值、长视频生成等,适用于娱乐、教育、广告及自动驾驶等多个领域。 AI项目与工具 2025年06月12日 57 点赞 0 评论 159 浏览
StoryPlay AI 一个致力于为短剧内容创作提供可视化流程,实现剧本策划、剧本创作、剧本分镜创作等围绕短剧创作全工作流的AI赋能,实现创作者5-10倍的降本增效的AI短剧剧本创作工具 AI写作对话 2025年06月05日 55 点赞 0 评论 159 浏览
小爱同学 AI 助手 小爱同学 AI 助手是一款功能全面、智能化程度高的多模态AI助手。它不仅能够提供丰富的信息查询和知识问答服务,还能通过智能分析和建议,帮助用户更高效地规划生活和工作。 创作工具 1970年01月01日 0 点赞 0 评论 161 浏览