Scrapling v0.2.97版本发布：内存优化与核心功能增强

2025-06-11 03:45:35作者：伍希望

🕷️ An adaptive Web Scraping framework that handles everything from a single request to a full-scale crawl!

项目地址：https://gitcode.com/GitHub_Trending/sc/Scrapling

Scrapling是一个功能强大的Python网络爬虫框架，它提供了简洁高效的API来处理网页抓取、数据提取等任务。本次发布的v0.2.97版本是一个重要的性能优化更新，主要针对内存使用和核心功能进行了改进。

内存优化与性能提升

本次更新最显著的改进是全面降低了所有Fetcher（抓取器）的内存使用量，同时带来了小幅度的速度提升。开发团队对缓存大小实施了新的限制策略，在进行大量请求/操作时，内存消耗将显著低于之前的版本。

技术实现上，团队重构了Fetchers的大部分代码，不仅提高了可维护性，还通过优化内部处理流程获得了性能提升。这种底层架构的改进使得Scrapling在处理大规模数据抓取任务时更加稳定可靠。

关键Bug修复

TextHandler字符串处理修复：修复了当单独导入TextHandler并传递非字符串值时会被转换为空字符串的问题。现在任何传递给TextHandler的值都会自动转换为字符串，然后再转换为TextHandler对象。这一强制转换确保了TextHandler始终如其名称所示——专门用于处理字符串数据。
异步重试机制修复：修复了AsyncFetcher中多个方法的retries参数未被考虑的问题。现在异步抓取的重试机制将按照预期工作，提高了异步操作的可靠性。

类型提示改进

为了提升开发体验，本次更新全面优化了所有Fetcher中大多数参数的类型提示。新的类型提示更加清晰准确，能够帮助开发者更好地理解API的使用方式，并在开发过程中获得更好的IDE支持。

技术意义与升级建议

v0.2.97版本虽然是一个小版本更新，但其内存优化对于大规模爬取任务至关重要。对于经常处理大量数据的开发者来说，升级到此版本可以显著降低服务器资源消耗，提高爬虫的稳定性。

类型提示的改进虽然看似微小，但对于团队协作和长期项目维护有着重要意义。更准确的类型提示可以减少开发时的猜测，提高代码质量。

建议所有Scrapling用户尽快升级到此版本，特别是那些：

运行内存受限的环境
处理大规模数据抓取任务
使用异步抓取功能
依赖类型提示进行开发的团队

这次更新体现了Scrapling项目对性能优化和开发者体验的持续关注，为未来的功能扩展奠定了更坚实的基础。

🕷️ An adaptive Web Scraping framework that handles everything from a single request to a full-scale crawl!

项目地址：https://gitcode.com/GitHub_Trending/sc/Scrapling

登录后查看全文

项目优选

收起

Claude Code 的开源替代方案。连接任意大模型，编辑代码，运行命令，自动验证 — 全自动执行。用 Rust 构建，极致性能。｜ An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed. Get Started

本项目是CANN提供的数学类基础计算算子库，实现网络在NPU上加速计算。

deepin linux kernel

🎉 (RuoYi)官方仓库基于SpringBoot，Spring Security，JWT，Vue3 & Vite、Element Plus 的前后端分离权限管理系统

Ascend Extension for PyTorch

🍒 Cherry Studio 是一款支持多个 LLM 提供商的桌面客户端

openEuler内核是openEuler操作系统的核心，既是系统性能与稳定性的基石，也是连接处理器、设备与服务的桥梁。

flutter_flutter

Nop Platform 2.0是基于可逆计算理论实现的采用面向语言编程范式的新一代低代码开发平台，包含基于全新原理从零开始研发的GraphQL引擎、ORM引擎、工作流引擎、报表引擎、规则引擎、批处理引引擎等完整设计。nop-entropy是它的后端部分，采用java语言实现，可选择集成Spring框架或者Quarkus框架。中小企业可以免费商用