Python代码爬取3000+ 上市公司的信息！能上市的都有这样一个特点！

Python学习交流 · 公众号 · Python · 2019-01-24 14:14

正文

有了上面的信心后，我开始继续完善代码，因为 5 行代码太单薄，功能也太简单，大致从以下几个方面进行了完善：

增加异常处理

由于爬取上百页的网页，中途很可能由于各种问题导致爬取失败，所以增加了 try except 、if 等语句，来处理可能出现的异常，让代码更健壮。

增加代码灵活性

初版代码由于固定了 URL 参数，所以只能爬取固定的内容，但是人的想法是多变的，一会儿想爬这个一会儿可能又需要那个，所以可以通过修改 URL 请求参数，来增加代码灵活性，从而爬取更灵活的数据。

修改存储方式

初版代码我选择了存储到 Excel 这种最为熟悉简单的方式，人是一种惰性动物，很难离开自己的舒适区。但是为了学习新知识，所以我选择将数据存储到 MySQL 中，以便练习 MySQL 的使用。

加快爬取速度

初版代码使用了最简单的单进程爬取方式，爬取速度比较慢，考虑到网页数量比较大，所以修改为了多进程的爬取方式。

推荐文章

Python爱好者社区 · 64k！确实可以封神了！

3 天前

Python爱好者社区 · 公司Rust团队全员被裁，只因把服务写得「太稳定」：“项目0故障、0报警，那养着3个Rust工程师没用啊”

昨天

Python爱好者社区 · 华为目标院校白名单（2025最新版）

4 天前

Python爱好者社区 · 强的离谱！CNN，yyds

2 天前

Python爱好者社区 · 《MCP原理与实践》—— 国内首本MCP图书火热上市

4 天前

易观方舟AnalysysData · 易观大数据应用沙龙：汽车行业大咖带你解锁行业发展新趋势！

8 年前

养生堂 · 养生堂，你家VC的针叶樱桃是车厘子吗？

8 年前

大爱猫咪控 · 汪惹猫咪生气了，猫咪想起来打汪，结果...

8 年前

考研研学姐 · 【研途小憩】学计算机的同学都有哪些无力吐槽的时候？

8 年前

长安街知事 · 两位省委常委充实全总班子

8 年前