← Back to Gists

webpage URL extractor

📝 Python
margaretzimmerman
margaretzimmerman · Level 8 ·

Extracts all URLs from a webpage's HTML content using regex pattern matching.

Python
import re
import requests def extracturls(url): response = requests.get(url) html = response.text pattern = r'href=["\'](https?://[^"\']+)["\']' urls = re.findall(pattern, html) return urls

Comments

No comments yet. Start the discussion.