AI项目与工具

Gemini 2.0

Gemini 2.0 是谷歌推出的原生多模态AI模型,具备快速处理文本、音频和图像的能力,支持多语言输出和实时音视频流输入。通过Agent技术和工具调用,Gemini 2.0 能够自主理解任务并提供解决方案,已在编程、数据分析、游戏等领域展示应用潜力。目前提供免费试用,计划逐步开放更多功能。

Continue

Continue是一款开源的AI代码助手,集成于VS Code和JetBrains系列IDE中,通过聊天功能和代码补全功能帮助开发者快速理解代码并完成编写。支持实时代码编辑、动作快捷方式以及自定义模型连接,旨在提高开发效率和代码质量。

字体家

字体家是一款集字体下载、转换与AI生成于一体的综合性平台,主要功能包括基于深度学习技术的个性化字体生成、多种字体生成方式及字型修改服务。其核心优势在于通过AI技术将少量样本字扩展为完整的中文字体库,同时提供便捷的字体管理和版权保障,广泛适用于平面设计、品牌标识、出版物排版等多个领域。

Perplexideez

Perplexideez 是一款基于 AI 技术的本地化助手,支持用户在网络和自托管应用中高效搜索信息。它具备多用户支持、单点登录、网络搜索优化、结论来源追踪、个性化学习建议等功能,适用于个人知识管理、企业内部搜索、学术研究、教育和开发等领域。其核心技术包括 LLM 自然语言处理、Postgres 数据库支持及容器化部署。

Hunyuan3D

Hunyuan3D-1.0 是腾讯推出的一款3D生成模型,支持文本和图像输入生成高质量3D资产。该模型采用两阶段方法,包含轻量版和标准版,具有快速生成和高质量重建的特点,广泛应用于3D创作、工业设计、建筑设计等领域。

ChatLearn

ChatLearn是一款由阿里云开发的高效对齐训练框架,支持多种对齐训练方法,包括RLHF、DPO、OnlineDPO和GRPO。它提供灵活的编程接口、资源调度机制和分布式计算支持,适用于自动化对话系统训练及复杂多模型训练场景。用户可以自定义模型执行流程,实现个性化训练策略。

LongAlign

LongAlign是一种针对文本到图像生成任务的改进方法,通过分段级编码技术和分解偏好优化,有效解决了长文本输入的对齐问题。它能够显著提升生成图像与输入文本的一致性,广泛应用于艺术创作、游戏开发、影视制作及教育等领域,具备高精度和强泛化能力。

befunky

Befunky是一款集照片编辑、图形设计于一体的在线平台,具备裁剪、调色、滤镜应用等基础功能,以及智能背景移除、人像修饰等高级特性。其丰富的模板与素材库助力用户高效完成创意项目,广泛应用于社交媒体内容创作、个人照片优化、营销材料设计等领域。

锐智AI

锐智AI是一款基于人工智能技术的学术辅助工具,支持论文大纲生成、内容撰写、文献引用、查重修改等功能,适用于课程论文、期刊论文、研究报告等多种场景。平台能根据用户输入的主题自动生成结构化内容,并提供语法修正、图表生成、素材库支持等增值服务,提升写作效率与质量。其智能化、多样化的功能满足不同用户的个性化需求,是学术写作的理想助手。

播记

播记是一款基于AI技术的播客节目笔记生成工具,能够自动提取音频内容中的关键信息,生成包含主题、嘉宾介绍、观点及时间戳的详细笔记。支持多种格式导出,便于内容管理和二次创作。适用于社交媒体、邮件简报、博客文章等多种场景,具备智能分类、多语言支持及内容优化功能,提升播客内容的传播效率与质量。