Python – So crawlen Sie Daten von umgeleiteten Websites

Question

Ich lerne derzeit einige Kenntnisse über Crawler und verwende Selenium zum Crawlen einiger komplexer Websites. Ich bin auf ein Problem gestoßen. Die Arbeitsauftrags-Website, die ich crawlen muss (ich kenne das Passwort nicht), muss mich zuerst bei einem Authentifizierungssystem anmelden und dann auf der Seite des Authentifizierungssystems auf die Arbeitsauftragssystem-Verbindung klicken Sie müssen sich automatisch nicht mehr anmelden...

漂亮男人 · Answer

用firefox的扩展selenium ide录制一遍操作。
然后导出为python文件。
改改运行就可以了。

建议你去读读虫师写的书。

曾经蜡笔没有小新 · Answer

例如使用requests库作为爬虫的话，先创建session()，A登录，B是跳转的页面即可。

T=requests.session()
A=T.post(url=url,data=data)
B=T.get(url=url)

创建的T就代表存储的cookie，会一直保留

PHP8, ich komme auch

Lernen Sie das Website-Layout in 30 Minuten

Shangguan Oracle Video-Tutorial für Anfänger bis Fortgeschrittene

Ihre erste Zeile UNI-APP-Code

Flattern Sie von Grund auf bis zum App-Start

Brother Lian Neues Linux-Video-Tutorial

AXURE 9 Video-Tutorial (geeignet für die interaktive Produktdesign-Benutzeroberfläche von Product Manager)

Zero Basic Proficiency PS-Video-Tutorial

16-tägiges UI-Video-Tutorial für den Einstieg

PS-Techniken und Slicing-Techniken-Video-Tutorial

Video-Tutorial zum Bau und zur Projekteinführung der Alibaba Cloud-Umgebung

Überblick über Computernetzwerke – Grundkenntnisse, die Programmierer beherrschen müssen

Grundlegendes Tutorial für Programmierer – Erklärung des HTTP-Protokolls

Websocket-Video-Tutorial