数据
Awesome Chinese LLM
整理了开源的中文大语言模型(LLM),主要关注规模较小、可私有化部署且训练成本较低的模型,目前已收录了100多个相关资源。
亮数据BrightData
一家专注于为企业提供网络数据收集和代理服务的公司,亮数据BrightData提供全面的网络数据解决方案,包括高级代理网络、AI驱动的网络抓取工具、动态更新的数据集等功能。
Jina Reader
Jina Reader是一款由Jina AI开发的开源工具,专注于将互联网上的HTML网页内容转换为适合大型语言模型处理的纯文本格式。它支持多种内容格式,具备流模式、JSON模式和Alt生成模式等功能,能够高效提取网页核心内容,去除冗余信息,并通过自然语言处理和动态内容处理技术提升文本质量和理解能力。Jina Reader适用于内容聚合、SEO优化、学术研究及个性化推荐等多个领域。
