⚙️ 爬虫配置
📌 基本设置
只爬取该日期之后发布的微博,格式 yyyy-mm-dd
留空则不限制截止日期
建议 10–50,越大效率越高但易被限制
🔍 爬取范围
爬取全部(原创+转发)
移除 HTML 标签
💾 输出设置
按住 Ctrl 多选
以 ID 命名文件夹(否则用昵称)
🖼️ 媒体下载设置
下载原创微博图片
下载转发微博图片
下载原创视频
下载转发视频
📱 下载原创 Live Photo
📱 下载转发 Live Photo
下载评论
每篇微博最多下载的评论数
🍪 Cookie(可选,建议添加以获取全部数据)
🛡️ 反封禁策略
👥 微博用户管理
添加要爬取的微博用户 ID,支持批量管理。鼠标悬停在行上可编辑。
| User ID | 昵称(可选) | 起始日期(可选) | 关键词(可选) | 操作 |
|---|
🔍 快速查找 User ID
1. 打开 https://weibo.cn 搜索用户
2. 进入 TA 的主页 → 点击「资料」
3. 地址栏中的数字即为 User ID(如 1669879400)
📊 运行状态
容器状态:
检查中...
容器名:
weibo-crawler
📋 运行日志
加载中...
📁 输出文件
爬取结果文件列表
- 加载中...
📄 文件预览
点击上方文件名查看内容
ℹ️ 关于
Weibo Crawler Web UI
基于 weibo-crawler 项目,
使用 weibo.cn(老版手机站)作为数据源,兼容 VPS/云服务器环境。
功能:
• 可视化配置爬虫参数
• 管理爬取用户列表
• 查看运行日志
• 浏览和下载爬取结果
• 一键重启容器生效配置
数据存储路径:/app/weibo/(Docker 挂载卷)
配置文件:/app/config.json
用户列表:/app/user_id_list.txt