工具

MMaDA

MMaDA(Multimodal Large Diffusion Language Models)是由普林斯顿大学、清华大学、北京大学和字节跳动联合开发的多模态扩散模型,支持跨文本推理、多模态理解和文本到图像生成等多种功能。其采用统一的扩散架构和模态不可知设计,结合混合长链推理微调策略与UniGRPO强化学习算法,提升跨模态任务性能。MMaDA在多项任务中表现优异,适用于内容创作、教育辅助、智能客

SUAPP AI

SUAPP AI是一款面向建筑设计行业的AI工具,支持图生图、文生图、图生视频、图片建模及AI对话等功能,提升设计效率与表现力。结合SketchUp平台,提供插件扩展与沉浸式体验,适用于建筑、室内及景观设计场景,助力设计师快速生成高质量成果并优化设计方案。

Audio Enhancer

一个在线音频增强工具,Audio Enhancer使用人工智能算法来帮助用户轻松地减少音频文件中的背景噪音,用于改善音频录音的清晰度和整体质量。

Text to Bark

Text to Bark 是由 ElevenLabs 推出的全球首个 AI 狗语文本转语音模型,能将文字转化为高度逼真的狗吠声,支持多种犬种选择和语气调整。技术基于深度学习和犬类语言学研究,适用于宠物训练、科研、娱乐及家庭互动等多种场景,具备良好的可扩展性和实用性。

3DFY.ai

3DFY.ai是一款利用生成式人工智能从文本中创建高质量3D模型的工具。它旨在满足未来的需求,允许用户在不影响质量的情况下大规模生成3D内容。该工具提供了多种服务,包括文本到3D w...

Semantic Scholar

Semantic Scholar 是一款基于人工智能的科学文献搜索引擎,通过自然语言处理技术理解论文语义,提供精准搜索结果。它具备论文检索、引用网络展示、相关文献推荐及摘要提取等功能,并拥有语义阅读器以优化阅读体验。Semantic Scholar 还为开发者提供API支持,广泛应用于学术研究、教育、跨学科探索和文献综述等领域,助力科研人员提升工作效率。

FullStack Bench

FullStack Bench是一款由字节跳动与M-A-P社区联合推出的专业代码评估工具,主要针对全栈编程和多语言编程能力进行评估。它包含11种真实编程场景、3374个问题以及16种编程语言,具备全面评估、多语言支持、实际场景模拟、代码质量控制等特点,适用于代码智能评估、教育与培训、研究开发、软件测试及多语言编程能力评估等多个场景。

PlaiDay

PlaiDay和Orchestra平台展现了AI技术在个性化内容生成和其他领域的潜力,为用户提供了一个易于使用且功能强大的视频创作环境。

Amazon Nova Act

Amazon Nova Act 是亚马逊 AGI Labs 推出的 AI 代理工具,支持开发者通过 SDK 构建自动化应用。其核心功能包括任务分解、多语言 NLP 处理、网页自动化及 API 集成,适用于办公、电商、个人管理及企业流程等多个场景。Nova Act 可提高任务执行效率与准确性,具备良好的扩展性与智能化能力。