如何使用 Python 在 2025 年构建价格追踪器
本页为中文译文;如需对照原始表述,请阅读英文原文。

想象一下,在您心仪的商品降价到“超值”的那一刻精准获知,或者在竞争对手意识到定价策略存在缺陷之前就将其洞察。价格追踪不再仅仅是“羊毛党”的专属。电商卖家、代发货商和数据分析师都依赖实时价格数据来保持竞争力。但问题在于:像 Amazon 和 Walmart 这样的网站使用高级反爬虫系统,会拦截可疑活动。
有趣的事实:WebScraper Insights 在 2024 年的一项研究发现,82% 的 DIY 爬虫在没有采取适当预防措施的情况下,会在 48 小时内被封禁。这就是 Python 的简洁性与 Proxy302 的 6500 万+ 全球住宅 IP 发挥作用的地方。让我们构建一个在 2025 年真正有效的价格追踪器。
为什么 Python + 代理 = 无懈可击的价格追踪

Python 是网络爬虫界的瑞士军刀。借助 Requests 和 BeautifulSoup 等库,提取数据只需几分钟。但问题在于:不使用代理进行爬取就像每 5 秒钟敲一次 Amazon 的门——他们肯定会发现。
Proxy302 通过以下方式解决了这个问题:
- 6500 万+ 住宅 IP:模拟 195+ 个国家的真实用户。
- 城市级定位:爬取本地化价格(例如,“Amazon.com 对比 Amazon.co.jp”)。
- 按量付费定价:无订阅费用——流量仅需 $0.15/IP 或 $1.5/GB。
- 99.9% 正常运行时间:避免在关键降价期间出现停机。
代码片段:安装必要库
pip install requests beautifulsoup4 pandas schedule
第 1 步:爬取 Amazon 价格而不被封禁
让我们追踪 PlayStation 5 的价格。
基础爬虫(剧透:这会让你被封禁)
import requests
from bs4 import BeautifulSoup
url = "https://www.amazon.com/PlayStation-5/dp/B0BCNKKZ91"
headers = {"User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64)"}
response = requests.get(url, headers=headers)
soup = BeautifulSoup(response.content, "html.parser")
price = soup.find("span", class_="a-price-whole").text
print(f"当前价格: ${price}")
问题:运行此脚本 10 次,你就会撞上验证码墙。这是肯定的。
集成 Proxy302 代理以隐蔽运行
Proxy302 的轮换 IP 让你的爬虫隐形。
import requests
# 替换为你的 Proxy302 凭据
proxy = {
"http": "http://USERNAME:[email protected]:8000",
"https": "http://USERNAME:[email protected]:8000"
}
# 添加城市定位(例如,从纽约爬取 Amazon 美国站)
params = {"country": "us", "city": "new_york"}
response = requests.get(url, headers=headers, proxies=proxy, params=params)
为什么有效:每个请求都使用来自 Proxy302 资源池的新鲜 IP。想要爬取 Amazon 日本站?只需将 country=jp 和 city=tokyo 即可。
第 2 步:定时爬取并自动保存数据
无需动手,全天候 24/7 追踪价格。
保存数据到 CSV 并设置提醒
import pandas as pd
import schedule
import time
def track_price():
# 在此处插入爬取 + 代理代码
data = {"date": pd.Timestamp.now(), "price": price}
df = pd.DataFrame([data])
df.to_csv("ps5_prices.csv", mode="a", header=False)
print(f"价格于 {data['date']}: ${data['price']}")
# 每 6 小时运行一次
schedule.every(6).hours.do(track_price)
while True:
schedule.run_pending()
time.sleep(1)
专家提示:使用 Twilio 等 API 添加 Telegram/短信提醒,实现即时通知。
避免检测的高级战术
像专业人士一样轮换 User-Agent
Amazon 会封禁重复的浏览器特征。使用 fake_useragent 来随机化请求头:
from fake_useragent import UserAgent
ua = UserAgent()
headers = {"User-Agent": ua.random}
延迟请求以模拟人类行为
高频请求 = 立即封禁。添加延迟:
import random
time.sleep(random.randint(1, 5)) # 在请求之间等待 1-5 秒
为已登录账户使用 Proxy302 的静态 IP
需要保持登录状态?Proxy302 的专用静态 IP($0.5/天)可保持会话一致性。
真实成功案例
案例研究:一位 Shopify 卖家使用此方案配合 Proxy302 的住宅代理追踪了 200 多种竞争对手产品。结果?封禁减少了 90%,每月在手动价格监控上节省了 $8,000。
为什么 Proxy302 优于其他代理服务
- 无订阅费用:按需付费。爬取 10 个 URL?仅需 $0.15。
- 24/7 支持:如果脚本在凌晨 2 点崩溃,可通过在线聊天获得帮助。
- 合规爬取:住宅 IP 符合 GDPR 等数据隐私法律。
SERP 洞察:Proxy302 评测(2025 年 1 月)称其为“需要灵活、可靠代理的专业人士的首选”。
🚀 “仅需 $1 即可获得 6500 万个 IP——立即构建您的价格追踪器!” 🚀
无月费。无封禁。只有为您省钱的数据。
复制粘贴上述代码片段,部署您的价格追踪器,看着省下的钱滚滚而来。

常见问题解答
问:我可以爬取 Amazon 以外的网站吗?
答:当然可以!Proxy302 适用于 Walmart、Best Buy、eBay——任何网站。
问:网络爬虫合法吗?
答:是的,只要你遵守 robots.txt 并避免抓取敏感数据。Proxy302 的住宅 IP 可确保你的合规性。
问:如果遇到问题怎么办?
答:Proxy302 的 24/7 支持团队会在 10 分钟内响应。