Web Tidy
博客

Instagram Follower Scraper vs Exporter:按任务与风险选择

按输入、会话、输出、上限、partial、自动化、保留、成本和恢复,对比文件 exporter、托管 downloader 与 programmable scraper。

2026年8月31日Instagram
本文目录

按结果选,不要按名称选。需要从一个当前会话可访问的 Instagram 主页,由人启动一次 Followers 或 Following 任务,得到有明确上限、confirmed rows 和终态的 CSV/XLSX,选文件 exporter。需要多个输入、JSON/API、dataset、调度或代码下游,选 programmable scraper,并准备承担凭据、分页、成本、保留、恢复和 schema 验证。

Scraper 不自动代表更多、更完整或更安全;exporter 内部也可能分页采集。应先定义输入、交付物、停止条件和验证责任,再选运行模型。

披露: Web Tidy 发布本指南,并开发 INS Follower Exporter。SKU32 事实来自当前本地 1.0.5 runtime/writer。三个外部比较原页已于 2026 年 8 月 31 日打开并读完;其中价格、风险、规模、可靠性和完整性仍是发布方主张。

证据分级限制矩阵

L 表示 SKU32 本地 runtime/writer 已验证,V 表示打开的厂商原页声明,U 表示该模型没有统一答案。V 不是独立测试。

决策维度用户面向文件 exporter(SKU32)托管 downloaderProgrammable scraper/dataset
输入一个 username/profile URL;选 Followers 或 Following(L)常见为公开 username/URL;Following 支持需核验(V/U)一个或多个目标、relation、result limit;schema 各异(V/U)
会话/凭据当前 Instagram 浏览器会话;仅可访问目标(L)“不需 Instagram 登录”只是厂商声明;产品账号与远程凭据另查(V/U)token、cookie、代理或平台账号取决于实现(U)
运行位置Chrome 扩展与本地任务控制器(L)服务商基础设施;区域可能未知(U)自管代码或云任务平台(V/U)
原生输出CSV 或原生 XLSX,固定 14 列(L)CSV/Excel/JSON 各异;先核对样例和扩展名(V/U)dataset 与 JSON/API 常见;CSV/XLSX 可能只是 dataset 视图(V/U)
上限/规模只能选 100、200、500、1,000 confirmed rows;不是全量承诺(L)当前套餐与任务上限需重新核验(U)result/cost limit 各异;可配置上限不等于 confirmed coverage(U)
Partialpartial/completed 且 confirmed > 0 可下载(L)中间文件、计费和续跑规则逐产品核验(U)dataset items、错误项与 checkpoint 逐 job 核验(U)
自动化人工启动有界任务;无 scheduler、API、webhook 或后台监控(L)可能只支持重复人工提交(U)只有官方 API/job contract 支持时才适合代码触发(V/U)
保留/删除当前 run + newest 20 个本地 History 终态记录(L)保留期、删除、备份和区域需核验(U)dataset TTL、删除 API、日志和下游副本需核验(U)
成本本页不声称 Store 价格;本任务未读回确认 Store availability(U)按当天 pricing 与预计行数核算(U)同时限制 job、result、compute/API 和重试成本(U)
恢复login/challenge/rate limit/private/unavailable 需停止或人工处理;不无限重试(L)续跑、重开、退款和 partial 文件规则各异(U)checkpoint、cursor、幂等、重试与错误预算各异(U)
转化边界当前会话、单目标、有界 CSV/XLSX job(L)能接受远程处理的一次文件 job(U)有维护责任的可编程管道(U)

Unknown 单元格保持 unknown,尤其不能把厂商的低风险、无限、完整、价格或成功率主张改写成中立事实。

同一个匿名输入的文件与 dataset 合同

假设任务是目标 @sample_creator、方向 followers、两条匿名记录。以下是 contract-shaped illustration,不是一次真实 Instagram 采集。

SKU32 文件 exporter

task
target=@sample_creator
audience=followers
selected_ceiling=100
confirmed=2
phase=completed
format=csv
 
固定 14 列表头
id,pk,username,profileUrl,fullName,profilePicUrl,isVerified,
followedByViewer,requestedByViewer,audience,sourceProfile,
sourceProfileUrl,collectedAt,rowIndex
 
匿名记录
acct_01,,user_alpha,https://www.instagram.com/user_alpha/,User Alpha,,Yes,,,followers,@sample_creator,https://www.instagram.com/sample_creator/,2026-08-31T08:00:00.000Z,1
acct_02,,user_beta,https://www.instagram.com/user_beta/,,,No,,,followers,@sample_creator,https://www.instagram.com/sample_creator/,2026-08-31T08:00:01.000Z,2

应一起验收 target、Followers/Following、selected ceiling、confirmed rows、completed/partial、14 列顺序和空值语义。collectedAt 是本地归一化时间,不是准确 follow time;rowIndex 是本地输出顺序,不是 Instagram rank。

Generic programmable scraper 验收合同

required job contract — 不是任何厂商 runtime 主张
input: targets[], relation, result_limit, cost_limit
record: stable_id, username, source_target, relation, collected_at
page/job: cursor_or_checkpoint, confirmed_items, error_items, final_state
operations: create_job, inspect_status, read_items, delete_dataset
unknown until verified: credentials, retention, retries, price, completeness

管道需要的不只是一份“也能下载 CSV”的文件,而是可复核的 job 与 dataset:confirmed items、source identity、cursor/checkpoint、错误项、幂等、保留、删除和下游副本责任。没有文档时,自动化只是候选,不是已验收管道。

托管 downloader 验收合同

托管文件路径可减少扩展安装摩擦,却增加远程处理问题:处理位置、产品账号、下载前的准确字段、partial 文件、保留、删除和套餐计费都要确认。公开 username 输入不能证明本地处理或完整覆盖。

按三个真实 job 选择

真实 job首选必须先确认不匹配时停止
现在人工审核一个可访问目标的 100–1,000 行表格SKU32 文件 exporterFollowers/Following、100/200/500/1,000、CSV/XLSX、confirmed、终态需要 JSON/API、超过 1,000 行或调度
不装扩展,处理一个符合条件的公开目标文件托管 downloader产品账号、远程处理、字段、配额、partial、保留/删除不能接受远程处理,或字段/删除合同不清楚
多目标进入代码或重复管道Programmable scraper/datasetAPI、schema、checkpoint、幂等、cost/result limit、删除只需一次人工可审计文件,或团队不维护管道

SKU32 runtime 实际证明什么

Instagram Follower Exporter 支持 Followers 与 Following。可选 ceiling 为 100、200、500、1,000 confirmed rows,默认 200。CSV 与 XLSX 使用相同 14 列:

id, pk, username, profileUrl, fullName, profilePicUrl, isVerified,
followedByViewer, requestedByViewer, audience, sourceProfile,
sourceProfileUrl, collectedAt, rowIndex

默认按 id 去重;仅 partialcompleted 且有 confirmed rows 时可下载。启动新 run 会将上一条终态 run 加入 newest-20 本地 History。

可见阶段包括 validatingrunningpausedattentionstoppingpartialcompletedfailed。用户停止或 source error 时,已有 confirmed rows 才形成可导出 partial;否则 failed。login、challenge、rate limit、private、unavailable 需要停止或人工处理,不得绕过。

SKU32 不提供 JSON/API、scheduler、无限行、后台监控、CRM 同步、丰富化或自动关注/取关。

六步验收

  1. 用一句话写清 job:一次文件、托管下载或可编程 dataset。
  2. 固定输入:单/多目标、Followers/Following、session 与 credentials。
  3. 固定交付:CSV/XLSX、JSON/API、job state、错误项、source identity。
  4. 固定 result、confirmed、cost、retry、retention 上限,拒绝“unlimited”占位。
  5. 用一个允许的小目标验证 schema、blank、dedupe、partial 与删除。
  6. 运行模型吻合时才进入产品;不要把 API/监控 job 强转为文件 CTA。

共同限制与停止线

  • Followers 与 Following 是两个方向。
  • 100/200/500/1,000 ceiling 不是全量证明。
  • 主页显示人数、requested limit 与 confirmed rows 是不同指标。
  • private、unavailable、login、challenge、rate limit 或 source change 可阻止或中断任务。
  • collectedAt 不提供 follow/unfollow 历史。
  • 文件或 dataset 不证明真实性、兴趣、购买意向、营销许可或法律结论。
  • 本页不承诺 Store availability、零风险、无限行、后台监控、准确 follow time 或完整覆盖。

常见问题

Scraper 一定比 exporter 返回更多行吗?

不一定。比较 confirmed items、errors、dedupe 和 final state,不要比较可配置上限或主页显示人数。

Exporter 是否“不采集”?

不是。它可能分页获取数据;区别在产品合同以文件、confirmed rows 与终态为中心。

SKU32 能导出 JSON 或提供 API 吗?

不能。当前原生输出只有 CSV 和 XLSX。

1,000 行 ceiling 是否保证 1,000 行?

不保证。它是选定最大值,访问、去重、中断和列表变化都可能减少 confirmed rows。

Scraper 能告诉我准确 follow time 吗?

不能从名称推断。SKU32 的 collectedAt 是归一化时间,不是 follow time。

哪种模式账号风险最低?

没有跨产品通用答案。会话、凭据、请求、平台规则和用途都会改变风险;厂商评级只能作为厂商主张。

什么时候选择 SKU32?

只在当前会话、单目标、有界、人工启动的 CSV/XLSX job 符合需求时选择;JSON/API、多目标调度和后台监控应选其它模型。